Together AI

Together AI

開発者ツール
Together AI
有料API

概要

AIネイティブクラウド。DeepSeek、Llama、Qwenなど200以上のオープンモデルのサーバーレス推論に対応し、ファインチューニングやGPUクラスタも提供。トークン課金でバッチ推論は半額

このツールを共有
Twitter LinkedIn Facebook

編集部評価

おすすめ

オープンソースモデルを本番運用するためのデフォルトの入口

Together AIは、とてもよくある問いへの答えに静かになった。インフラチームを雇わずにオープンソースモデルをどう使うか?カタログは膨大で気持ちよいほど新しい——DeepSeek、Qwen、Llamaの新リリースは数日で並ぶ。APIは流暢なOpenAI方言を話すので移行は1行の変更で済む。価格のはしごも誠実だ。無料モデルでプロトタイプし、安価なサーバーレストークンでローンチし、レイテンシが重要なら専用エンドポイント、それでも足りなければ$1.49/時のGPUクラスター。FlashAttentionを生んだ研究の系譜は、マーケティングではなく実際の速度として現れる。トレードオフは構造的なものだ。ここに独自のフロンティアモデルはなく、最高性能が要る仕事は他所に頼ることになる。モデル間の価格差は、請求をきちんと見るチームに報いる。FireworksやGroqは速度やニッチモデルの個別勝負で勝つこともある。しかし「欲しいオープンモデルが最も揃っていて、価格が公正で、APIは既に知っている」という一社を選ぶなら、Togetherがこのカテゴリで最も安全な第一候補だ。

最適なユーザー

  • コストやコントロールのためにクローズドAPIからオープンモデルへ移行するチーム
  • LLM・ビジョン・画像モデルを一つのAPIでカバーしたい開発者
  • GPUを所有せずにカスタムモデルをファインチューニングして提供するスタートアップ

代替を検討すべき場合

  • 何よりフロンティアモデルの能力が必要(→ OpenAI / Anthropic / Gemini API)
  • ワークロードがLLMではなく生成メディア(→ Fal.ai / Replicate)

対応プラットフォーム

WebアプリAPI

利用可能なプラットフォーム:Webアプリ、API。

主な機能

200以上のオープンソースモデルのサーバーレス推論:Llama、DeepSeek、Qwen、Kimiなど
OpenAI互換API——ベースURLを変えるだけでプロバイダーを切り替え可能
LoRAとフルパラメータに対応するファインチューニングサービス
安定したワークロード向けに分単位のGPU課金による専用エンドポイント
トレーニング用GPUクラスター(H100/H200/B200)を$1.49/時から利用可能
バッチ推論は50%割引、プロトタイプ用の無料モデル枠もあり

料金

free
厳選モデルの無料枠(Llama系エンドポイントを含む)でクレジットカードなしで開発・テスト可能。新規アカウントにはスタータークレジットも付与。
paid
従量課金のトークン単価はモデルサイズにより約$0.03〜$4.50/100万トークン。バッチ推論は50%オフ。専用エンドポイントはGPU時間を分単位で課金。GPUクラスターは1GPUあたり$1.49/時から、リザーブ割引あり。(公式価格ページと照合、2026-07-28。)

活用シーン

GPUを自前管理せずにオープンソースLLMを本番運用
GPT級の呼び出しをオープンモデルに置き換えて推論コストを削減
独自データでLlama/Qwen級モデルをファインチューニング
長期契約なしでH100/H200クラスターを借りてトレーニング

メリット

最も幅広いオープンモデルカタログの一つで、リリースから数日で追加
本格的な研究の系譜(FlashAttentionの流れ)が推論速度に表れている
無料枠からサーバーレス、専用GPU、クラスターまでの完全なはしご
クローズドモデルAPIをしばしば下回る透明なトークン単価

デメリット

独自のフロンティアモデルはない——最高性能をコストとコントロールと引き換えにする
モデルごとの価格差が大きく、モデルを切り替える際は請求を監視する必要がある
専用エンドポイントとクラスターはインフラの意思決定を迫る
激しい競争(Fireworks、Groq、DeepInfra)で機能面の優位は常に変動する

最新情報

2026年:Together AIはモデルリリースへの追随を続けている——DeepSeek、Qwen、Kimi、Llamaの各バリアントが数日以内にプラットフォームに登場——同時にコンピュートのはしごを拡充:バッチ推論半額、ファインチューニングの強化、サーバーレスAPIと並ぶ$1.49/時からのB200/H200 GPUクラスター。

AIニュースを購読

最新のAIツール推薦、業界動向、深層分析をお届けします。

プライバシーを尊重します。いつでも購読解除できます。