Qwen2.5-1M:最大100万トークンのコンテキスト長で独自のQwenをデプロイ
Qwenチームは最大100万トークン対応のオープンソースモデルQwen2.5-7B-Instruct-1Mと14B-Instruct-1Mをリリースし、推論フレームワークも提供した。
Tech Report HuggingFace ModelScope Qwen Chat HuggingFace Demo ModelScope Demo DISCORD
Introduction 2 ヶ月後に、Qwen2.5-Turbo のコンテキスト長を最大 100 万トークンに拡張するアップデートが行われてから、私たちはオープンソースの Qwen2.5-1M モデルと、それに対応する推論フレームワークのサポートを提供するために再び登場しました。今回のリリースで期待できることは以下の通りです:
オープンソースモデル:Qwen2.5-7B-Instruct-1M と Qwen2.5-14B-Instruct-1M の 2 つの新しいチェックポイントを公開します。これは、オープンソースの Qwen モデルを 100 万トークンコンテキストに対応させるためにアップグレードした初めての事例となります。
原文を表示
Tech Report HuggingFace ModelScope Qwen Chat HuggingFace Demo ModelScope Demo DISCORD
Introduction Two months after upgrading Qwen2.5-Turbo to support context length up to one million tokens, we are back with the open-source Qwen2.5-1M models and the corresponding inference framework support. Here’s what you can expect from this release:
Opensource Models: We’re releasing two new checkpoints, Qwen2.5-7B-Instruct-1M and Qwen2.5-14B-Instruct-1M, marking the first time we’ve upgraded our opensource Qwen models to handle 1M-token contexts.
関連記事
News to Guide
ニュースの次に確認する
発表内容を、現在の料金や仕様と照らし合わせられる関連ガイドです。
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み