2026年8月6日 09:00
Baseten、Hugging Faceに推論基盤追加
Baseten on Hugging Face Inference Providers 🔥
3行まとめ
- •BasetenがHFの推論プロバイダー入り
- •モデルページから直接推論を実行可能に
- •サーバーレスGPUで高速推論を提供
詳細
背景
Hugging Faceは「Inference Providers」という仕組みを通じて、Together AIやFireworks AIなど複数の推論プロバイダーをHubのモデルページに統合してきた。今回新たにBasetenが加わり、対応モデルの選択肢がさらに広がった。Basetenはサーバーレスのモデル推論インフラを専門に手がける企業で、独自の推論エンジンと自動スケーリング機能を強みとしている。
内容
この統合により、Hugging Face Hub上の対応モデルページで「Baseten」を推論プロバイダーとして選択し、モデルの重みを自前でダウンロードすることなくブラウザやAPIから直接推論を実行できるようになる。利用料金はHugging Faceのアカウントに一本化して請求され、Python・JavaScriptのクライアントライブラリやOpenAI互換APIからも呼び出し可能になっている。
今後の影響
開発者はモデルごとに用途に応じて最適な推論基盤を使い分けられるようになり、自前でインフラを構築する手間なくオープンモデルを本番環境に導入しやすくなる。Hugging Face側もプロバイダーの選択肢を増やすことで、推論エコシステムにおける中立的なハブとしての地位を強化する狙いがある。
なぜ重要か
オープンモデルの推論先の選択肢が増え、開発者はインフラを自前で構築せずに本番環境へ導入しやすくなる。
元記事を読む — Hugging Face Blog