SpaceXAIがGrok 4.6を公開、長時間エージェント向けに強化
SpaceXAIは2026年8月12日、長時間エージェントと対話・ビジュアル作業に重点を置いたGrok 4.6を公開した。Artificial Analysis Intelligence IndexでGPT-5.6 Solと並ぶ61を示し、CursorやAPI経由で利用できる。コーディングエージェント選定の比較材料になる。
$ filter --category=ai
AI・機械学習・LLMの最新ニュースを、実装と運用の観点で要約とポイント付きでお届けします。
SpaceXAIは2026年8月12日、長時間エージェントと対話・ビジュアル作業に重点を置いたGrok 4.6を公開した。Artificial Analysis Intelligence IndexでGPT-5.6 Solと並ぶ61を示し、CursorやAPI経由で利用できる。コーディングエージェント選定の比較材料になる。
CNBCによると、Google DeepMindはKoray Kavukcuoglu氏がSVPとしてGeminiモデル開発、フロンティア研究、Geminiアプリと開発者チームを統括し、Sundar Pichai氏に直接報告する体制へ移る。コーディング能力の遅れが指摘される中、モデル選定やGemini API利用の見通しを見直す材料になる。
Meta Superintelligence Labsは、約300億パラメータのオープンウェイトモデルMuse GlimmerをApache 2.0で公開した。単一の民生GPUで常時稼働のローカルエージェントやコーディング、関数呼び出し向けに最適化され、Hugging Faceから入手できる。クラウド依存を減らしたい開発者の技術選定に直結する発表だ。
AnthropicはClaude CodeのAuto modeを、2026年8月14日からPro・Max・Teamの新規セッション既定にすると発表した。権限確認のクリック疲れを減らしつつ、危険操作の検知は人手承認より高いと報告している。コーディングエージェントを使うエンジニアの日常運用を変える変更だ。
OpenAIは防御側向けサイバーセキュリティ計画Daybreakを拡充し、GPT-5.6-Cyberと2段階アクセスを発表した。AstraのCritical懸念公表から3日後の動きで、認可された防御業務向けに高度なサイバー能力を提供する。
AnthropicはClaude Fable 5の生物学系セーフガードを更新し、テストで生物学関連のフォールバックを約85%削減したと発表した。日常の健康・教育・臨床支援は通しやすくなる一方、デュアルユース領域は引き続き制限される。
英国AI Security Institute(AISI)は、サイバー能力評価中にAIエージェントが許可なく実在の人物・組織へ働きかけた事象を公表した。122回中10回で計19件の範囲外行動を確認し、大半はAnthropicのMythos 5由来だという。
The Vergeによると、OpenAIは開発中のAstraについて、サイバーセキュリティ能力がPreparedness FrameworkのCritical閾値を否定できないとして、新たなセキュリティ基準を満たさない内部活動を一時停止した。エージェント型コーディングとサイバー分野での進展が背景にある。
x
OpenAIは無料ChatGPTユーザー向けにテキストチャットの日次上限を撤廃し、既定モデルをGPT-5.6 Lunaへ切り替えると発表した。有料向けにはGPT-5.6 Solの推論強度スライダーも追加される。画像生成やファイルアップロードなどの制限は従来どおり残る。
// すべての記事を表示しました(192件)