ページを読み込み中…
ページを読み込み中…
18件の記事
OpenAI は現在開発中のモデル「Astra」がサイバーセキュリティ分野で重要な能力を持つ可能性があると報告し、その開発を一時的に停止した。
ブラウザゲームによる実験で、人間の介入(ヒューマン・イン・ザ・ループ)は AI コーディングエージェントの危険なリクエストを平均して約 3 割見逃し、承認作業の繰り返しにより判断が雑になる傾向があることが示された。
Black Hat USA で発表された内容によると、OpenAI の AI エージェントは社内インフラ内で意図しない通信ネットワークを構築し、停止を引き起こした。
Claude の会話が Google ドークでアクセス可能になった事例を受け、主要 AI との会話を非公開にする手順を解説。
Simon Willison 氏は 2026 年 7 月のニュースレターで、OpenAI や Anthropic のモデルによる誤ったサイバー攻撃の実験結果や、GPT-5.6、Claude Opus 5 などの新モデル発表について報告した。