Baseten บน Hugging Face: เสริมพลัง AI ด้วย Inference Providers ที่หลากหลาย 🔥
ข่าวดีสำหรับนักพัฒนาและผู้ที่สนใจในโลกของปัญญาประดิษฐ์! Hugging Face Hub ได้ประกาศว่า Baseten ซึ่งเป็นแพลตฟอร์มโครงสร้างพื้นฐาน AI ได้เข้าร่วมเป็น Inference Provider ที่รองรับบน Hub แล้ว การผสานรวมครั้งนี้จะช่วยเพิ่มขีดความสามารถในการประมวลผลแบบ Serverless Inference โดยตรงบนหน้าโมเดลของ Hugging Face ให้แข็งแกร่งยิ่งขึ้น
Baseten คืออะไร และทำไมถึงน่าสนใจ? 🤔
Baseten คือแพลตฟอร์ม AI ที่ครอบคลุมการทำงานที่หลากหลาย ตั้งแต่ Serverless AI ไปจนถึงการเทรนโมเดล ด้วยคลังโมเดลล้ำสมัยจำนวนมาก Baseten ช่วยให้นักพัฒนาสามารถนำความสามารถของ AI ไปผนว
มเข้ากับแอปพลิเคชันของตนเองได้อย่างง่ายดาย โดยใช้เวลาตั้งค่าน้อยที่สุด
Baseten รองรับโมเดล AI หลากหลายประเภท ไม่ว่าจะเป็น Large Language Models (LLMs) ไปจนถึง Text-to-Speech และอื่นๆ อีกมากมาย ในการผสานรวมเบื้องต้นนี้ Baseten ได้เปิดให้เข้าถึงงานด้านการสนทนา (Conversational) และการสร้างข้อความ (Text-generation) บน Hugging Face ทำให้ผู้ใช้สามารถเข้าถึง LLMs แบบ Open-weight ยอดนิยม เช่น Kimi K3, DeepSeek V4 Flash ล่าสุด, GLM-5.2 และอีกมากมาย โดยคาดว่าจะมีการรองรับงานอื่นๆ เพิ่มเติมในอนาคตอันใกล้
การใช้งาน Baseten ผ่าน Hugging Face Hub 🛠️
การผสานรวม Inference Providers เข้ากับ Hugging Face Hub ทำให้การใช้งานโมเดลต่างๆ สะดวกสบายยิ่งขึ้น โดยเฉพาะอย่างยิ่งเมื่อใช้งานผ่าน Client SDKs ทั้ง JavaScript และ Python
1. การตั้งค่า API Keys 🔑
ในส่วนการตั้งค่าบัญชีผู้ใช้บน Hugging Face คุณสามารถ:
- ตั้งค่า API Keys ของตนเอง สำหรับ Inference Providers ที่คุณสมัครใช้บริการ หากไม่ได้ตั้งค่าคีย์ที่กำหนดเอง คำขอของคุณจะถูกส่งผ่าน Hugging Face โดยอัตโนมัติ
- จัดลำดับความสำคัญของผู้ให้บริการ การตั้งค่านี้จะมีผลกับ Widget และ Code Snippets บนหน้าโมเดล
2. โหมดการเรียกใช้งาน Inference Providers 💡
มีสองโหมดหลักในการเรียกใช้ Inference Providers:
- Custom Key: การเรียกใช้งานจะส่งตรงไปยัง Inference Provider โดยใช้ API Key ของคุณเอง ซึ่งหมายความว่าคุณจะถูกเรียกเก็บค่าบริการโดยผู้ให้บริการนั้นๆ โดยตรง (เช่น หากใช้ Baseten API Key คุณจะถูกเรียกเก็บเงินในบัญชี Baseten ของคุณ)
- Routed by HF: ในโหมดนี้ คุณไม่จำเป็นต้องใช้ Token จากผู้ให้บริการ และค่าใช้จ่ายจะถูกนำไปคิดกับบัญชี Hugging Face ของคุณโดยตรง โดย Hugging Face จะส่งผ่านต้นทุนของผู้ให้บริการโดยไม่มีการบวกเพิ่ม (ในอนาคต อาจมีการตกลงแบ่งปันรายได้กับพาร์ทเนอร์ผู้ให้บริการ)
3. การเข้าถึงผ่าน SDKs 💻
Baseten พร้อมใช้งานแล้วผ่าน Hugging Face SDKs:
- huggingface_hub (>= 1.26.1) สำหรับ Python
- @huggingface/inference สำหรับ JavaScript
ตัวอย่างเช่น การใช้งาน DeepSeek V4 Flash ผ่าน Baseten สามารถทำได้ง่ายๆ เพียงใช้ Hugging Face Token เพื่อยืนยันตัวตน คำขอจะถูกส่งไปยัง Baseten โดยอัตโนมัติ
4. การทำงานร่วมกับ Agent Harnesses 🤝
Inference Providers ของ Hugging Face ได้รับการผสานรวมเข้ากับ Agent Harnesses ส่วนใหญ่ เช่น Pi, OpenCode, Hermes Agents, OpenClaw และอื่นๆ อีกมากมาย ซึ่งหมายความว่าคุณสามารถนำโมเดลที่โฮสต์โดย Baseten ไปใช้กับเครื่องมือโปรดของคุณได้ทันที โดยไม่ต้องเขียนโค้ดเพิ่มเติม
Hugging Face PRO: สิทธิประโยชน์เพิ่มเติม 🔥
สำหรับผู้ใช้งาน Hugging Face PRO จะได้รับเครดิต Inference มูลค่า $2 ต่อเดือน ซึ่งสามารถใช้ได้กับผู้ให้บริการทุกราย นอกจากนี้ การสมัครสมาชิก Hugging Face PRO ยังมอบสิทธิประโยชน์อื่นๆ อีกมากมาย เช่น ZeroGPU, Spaces Dev Mode, ขีดจำกัดที่สูงขึ้นถึง 20 เท่า และอื่นๆ อีกมากมาย
สำหรับผู้ใช้ฟรีที่ลงชื่อเข้าใช้ Hugging Face ก็มี Inference ฟรีให้ใช้งานในโควต้าเล็กน้อย แต่หากต้องการใช้งานอย่างเต็มที่ การอัปเกรดเป็น PRO คือทางเลือกที่คุ้มค่า
ข้อเสนอแนะและขั้นตอนต่อไป 🚀
Hugging Face และ Baseten เปิดรับข้อเสนอแนะจากผู้ใช้งานทุกท่าน คุณสามารถแบ่งปันความคิดเห็นหรือข้อเสนอแนะได้ที่: ขอบคุณ แหล่งข้อมูล
https://huggingface.co/spaces/huggingface/HuggingDiscussions/discussions/49
การผสานรวม Baseten เข้ากับ Hugging Face Hub ครั้งนี้ ถือเป็นก้าวสำคัญในการทำให้การเข้าถึงและใช้งาน AI มีประสิทธิภาพและเข้าถึงได้ง่ายยิ่งขึ้นสำหรับทุกคน
#Baseten #HuggingFace #InferenceProviders #AI #LLMs
ขอบคุณ แหล่งข้อมูล
https://huggingface.co/blog/baseten