DeepSeek、V4ファミリー最新モデル「Flash-0731」を公開
本文の状態
日本語全文を表示中
詳細モードで約1分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
Simon Willison Blog
DeepSeek が推論能力を大幅に強化した V4 フレッシュシリーズの最新モデル「DeepSeek-V4-Flash-0731」を発表し、高い知能指数と低コストで業界最高の価値を提供する可能性を示している。
AI深層分析を開く2026年8月1日 09:35
AI深層分析
キーポイント
高性能かつ低価格な新モデルの登場
DeepSeek は推論機能を強化した「DeepSeek-V4-Flash-0731」をリリースし、304B パラメータを持ちながらコスト効率が極めて高い。
業界最高クラスの価値評価
Artificial Analysis のランキングでは MiniMax M3 を上回り、知能指数対コストの観点で現在最も魅力的なモデルと評価されている。
推論設定による出力品質の変化
デフォルトの設定では描画に不具合が見られたが、推論レベルを「high」に上げることで品質が劇的に向上することが確認された。
重要な引用
"with substantially enhanced agentic capabilities"
"best value-per-intelligence model out there"
"sitting alone at the far left edge of the green quadrant"
編集コメントを表示
編集コメント
DeepSeek は推論能力の強化により、コスト対性能比において業界トップクラスの地位を確立した。利用者は単にモデルを選定するだけでなく、推論レベルの設定を適切に行うことでその真価を引き出す必要がある。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
deepseek-ai/DeepSeek-V4-Flash-0731
DeepSeek の V4 ファミリー最新作で、エージェント機能に大幅な強化が加えられています。パラメータ数は 3,040 億ですが、Hugging Face 上のサイズは 167GB です。しかし、その性能は数字以上に驚くべきものです。
Artificial Analysis では、このモデルを 4,280 億パラメータの MiniMax M3 よりも上位にランク付けしています。入力 100 万トークンあたり 0.14 ドル、出力 100 万トークンあたり 0.27 ドルという価格設定は、現時点で「知能あたりのコスト」において最高の価値を持つモデルである可能性を示唆しています。

OpenRouter を経由してデフォルトの推論レベルで試したところ、アホウドリに関する回答は期待外れでした。

しかし、推論レベルを「高」に上げると、はるかに優れた結果が得られました。
llm -m openrouter/deepseek/deepseek-v4-flash-0731 -t pelican -o reasoning_effort high

Hacker News での議論も参照ください。
タグ:AI、生成 AI、LLM、ペリカンが自転車に乗る、DeepSeek
「llm-release」「openrouter」「ai-in-china」「artificial-analysis」の各タグが関連する記事です。
原文を表示
deepseek-ai/DeepSeek-V4-Flash-0731
The latest release in DeepSeek's V4 family, "with substantially enhanced agentic capabilities". It's 304 billion parameters - 167GB on Hugging Face - but it appears to punch *well* above its weight.
Artificial Analysis rank it ahead of MiniMax M3 - a 428B model. It's $0.14/million input and $0.27/million output pricing means this may currently be the best value-per-intelligence model out there. It's looking very good on the Intelligence Index vs. Cost per Intelligence Index Task chart:

I got a disappointing pelican from it using the default reasoning level via OpenRouter:

But when I bumped reasoning level up to high I got something much better:
llm -m openrouter/deepseek/deepseek-v4-flash-0731 -t pelican -o reasoning_effort high

Via Hacker News
Tags: ai, generative-ai, llms, pelican-riding-a-bicycle, deepseek, llm-release, openrouter, ai-in-china, artificial-analysis
AI算出
主要ニュースainew評価高い
AI モデルの新規発表であり、ベンチマーク結果や価格設定など具体的な数値情報が含まれているため novelty は高く評価される。ただし、日本固有の導入事例や規制情報は含まれていないため japan_relevance は低めとなる。
6つの評価軸を見る
- AI関連度
- 100
- 情報源の信頼性
- 75
- 新規性
- 75
- 調べる価値
- 75
- 重複の少なさ
- 100
- 日本での有用性
- 25
関連記事
News to Guide
ニュースの次に確認する
発表内容を、現在の料金や仕様と照らし合わせられる関連ガイドです。
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み