ページを読み込み中…
ページを読み込み中…
4件の記事
Cursor は、クラウドエージェントがコード変更をテストできるよう環境を整備する際、開発環境自体を製品として扱い、モノレポの可読性向上やローカル環境との整合性確保に注力したと報告した。
Cursor Research は今年初めに複数エージェントが協調して目標達成を試みる実験を行い、ウェブブラウザの構築に成功したが完成品には至らなかったとし、新たなタスク規模や複雑さの可能性を示した。
xAI は Grok 4.5 の公式モデルカードを公開し、同モデルの能力ベンチマークと安全性評価の詳細を文書化した。
Cursor は SpaceXAI と共同で、ソフトウェアエンジニアリング以外の分野でも複雑な長期タスクを処理できる最賢モデル「Grok 4.5」を発表した。