ページを読み込み中…
ページを読み込み中…
7件の記事
Datalab が開発した 90 億パラメータのビジョンモデル「Lift」が、PDF や画像から直接スキーマ定義に従った JSON を生成する能力を、NuExtract3 や LlamaExtract など既存ツールと比較評価している。
Amazon が提供する AI モデル「Nova」を用いて、画像に含まれる個人情報(PII)を自動で検出・隠蔽する機能を導入した。これにより、GDPR や PCI DSS などの規制遵守が容易になる。
Google は、検索機能を活用して thrift ショッピングやヴィンテージショッピングの質を高めるための5つの具体的な方法を発表した。
Google とボルボは、I/O コンファレンスで発表し、AI アシスタント「Gemini」が次期 SUV「EX60」の外部カメラにアクセスできるようになると発表した。これにより、車両周囲の状況や駐車標識を所有者に説明・解釈する機能が追加される。
LLM 勉強会マルチモーダル WG が、日英データで学習した視覚言語モデル「LLM-jp-4-VL 9B beta」を公開し、日本語タスクで Qwen3-VL と同等の性能を達成しました。