CoreWeave、Vera Rubinを本番提供
詳細を読む
CoreWeaveは9月30日、サンフランシスコで開いた「CoreWeave Fully Connected」で、NVIDIAの次世代AI基盤Vera Rubin NVL72のクラウド提供を始めたと発表しました。AIソフトウェア企業Cognitionが初の本番顧客となり、開発用エージェントの推論試験で従来基盤比最大4.8倍の総トークン処理量を確認したとしています。
CognitionはCoreWeave上でAIエンジニア「Devin」の学習、強化学習、本番推論を運用しています。実際のソフトウェア開発課題を使った初期試験では、Vera Rubin NVL72をGB200 NVL72と比較し、リアルタイムのコード生成と多段階推論の応答改善につながる結果を得ました。
CoreWeaveは、AIエージェント向けに設計されたNVIDIA Vera CPUも提供します。1ラックに128基、計1万1264コアを搭載して1万1000超の隔離環境を同時実行でき、同社試験ではエージェント用環境の起動速度が3倍超、Terminal-Benchの合格課題で性能が1.7倍になりました。
新サービスCoreWeave Forgeは、Weights & Biases、OpenPipeの追加学習技術、オープンソースのmarimoを一つの環境にまとめます。本番で得た動作情報を評価や次の学習へ戻し、モデルやエージェントを継続的に改善する工程を、異なるモデル、枠組み、クラウドにまたがってつなぎます。
Forgeでは、実験支援のARIA、障害分析のAgent Lens、隔離実行環境のSandboxesも提供します。Canva、Capital One、MasterClassが初期利用企業に名を連ね、在宅医療のEnnoble Careも臨床文書作成や意思決定支援などのAI推論にCoreWeaveを採用しました。