ページを読み込み中…
ページを読み込み中…
5件の記事
フランスのスタートアップ Kog は、企業が既に保有する AMD MI300X や Nvidia H200 などの標準的なデータセンター向け GPU から、より多くの推論能力を引き出す技術を開発中であると発表した。
TLDR AI は、H100 の先物取引が価格上昇リスクには対抗できても、同一マシン内での複数 GPU 確保という供給不足のリスク(ベースリス)をヘッジできないと指摘した。
Together AI は、推論サービスで 99.9% の稼働率が何を意味するかを解説している。
TLDR AI は、GPU 仕様やモデルのアクティブパラメータ数などを用いて、ユーザーあたりのドル単価を紙上で計算する手法を紹介し、推論エンジン最適化が SaaS の収益性にどう寄与するかを示した。
CoreWeave の共同創業者ブラニン・マビーは、計算リソースがコモディティのように代替可能ではないと主張している。この見解は同社の価値の根幹をなすものだが、市場が存在しないと言っているのではなく、価格差が残る場所を示唆している。