AMD、AIモデルをシリコンに直接埋め込むTaalasを買収
本文の状態
日本語全文を表示中
詳細モードで約1分の本文を読めます。
AMD は Canadian のスタートアップである Taalas を買収し、推論チップにモデル重みを直接ハードコードする技術を採用した。
Continue in AI NEW LAB
このニュースを、実務の判断につなげる
AI NEW LABで、試したことや先に確認したい条件を共有できます。まずはログインなしで読めます。
AI NEW LABで論点を見るAI深層分析を開く2026年8月8日 03:46
AI深層分析
キーポイント
Taalas の技術的特徴
Taalas は AI モデルの重みを推論チップに直接ハードコード(hard-codes)し、特定のモデルに最適化された高速な動作を実現する。
性能とトレードオフ
同社のデモチップは Llama 3.1-8B を実行してユーザーあたり秒間 16,000 トークンを超える速度を記録したが、各チップが単一のモデルにロックされるという制約がある。
競合他社の動向
Google は Gemini のために同様のアプローチの開発を進めていると報じられている。
重要な引用
AMD is buying Canadian startup Taalas, which hard-codes model weights directly into inference chips.
A demo chip hit over 16,000 tokens per second per user running Llama 3.1-8B.
編集コメントを表示
編集コメント
モデル重みをハードウェアに直接埋め込む手法は、推論速度の劇的な向上をもたらす一方で、柔軟性を犠牲にするという明確なトレードオフを提示している。AMD と Google がこの方向性で競合することは、AI インフラストラクチャが特定のワークロード最適化へシフトする兆候を示唆している。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。

AMD がカナダのスタートアップ、Taalas を買収した。同社は AI モデルの重み(weights)を推論用チップに直接焼き付ける技術を開発している。この手法により処理速度は劇的に向上するが、その代わり各チップは単一のモデル専用となる。
デモ版チップでは、Llama 3.1-8B を実行した際、ユーザーあたり秒間 16,000 トークンを超える推論速度を記録している。また Google も Gemini のために同様のアプローチの開発を進めているとの噂がある。
AMD が AI モデルをシリコンに直接焼き込むスタートアップ Taalas を買収したという記事は、The Decoder に最初に掲載された。
原文を表示

AMD is buying Canadian startup Taalas, which hard-codes model weights directly into inference chips. That makes them extremely fast but locks each chip to a single model. A demo chip hit over 16,000 tokens per second per user running Llama 3.1-8B. Google is reportedly working on a similar approach for Gemini.
The article AMD acquires Taalas, a startup that bakes AI models directly into silicon appeared first on The Decoder.
同じ出来事を2媒体で確認
同じ出来事を扱う別媒体の記事です。見出しと公開時刻を比較できます。
関連記事
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み