2026年09月22日 朝のAIニュースまとめ

(ほぼ)毎日AIニュースが届きます。ぜひご登録ください。

(ほぼ)毎日AIニュースが届きます
ぜひご登録ください

OpenAIのAIエージェント開発と各社の最新モデル動向

OpenAIが新たなAIエージェントを開発中との報道や、Anthropicとの安全性に関する協定交渉が注目を集めています。次期モデル「GPT-6」のリークも話題です。

また、xAIによる「Grok 4.7」のリリースや、MetaのMuseとShopifyの提携など、各社から重要な発表が相次いでいます。

本日の主要なニュースの詳細を順番に確認していきましょう。

目次

  1. xAIがGrok 4.7をリリース【続報】
  2. Meta MuseがShopify提携、Amazonはブロック【続報】
  3. OpenAIが数学の独立諮問委員会を設立【続報】
  4. XiaomiがMiMo-V2.6-Proを公開【続報】
  5. JevのLangSmith等への統合と代替モデルSemIf登場【続報】
  6. OpenAIとAnthropicが相互ストレステスト協定を交渉
  7. GPT-6 SolとLuna同時発表の噂、Codexリークも【続報】
  8. OpenAIがMuse等対抗のAI Agent開発中

xAIがGrok 4.7をリリース【続報】

  • xAIのGrokシリーズに関する続報です
  • 新モデル「Grok 4.7」がリリースされ、価格を据え置いたまま性能が向上しました
  • CursorBenchやValsなどのベンチマークで評価が分かれていますが、コーディングや法的タスクでの向上が報告されています
  • すでにCursorやv0、OpenRouterなどのプラットフォームで利用可能となっています
Evan: (翻訳) SpaceX所有のGrokが新しいAIモデルをリリースしました。「Grok 4.7が登場」

Haider.: (翻訳) これは本当に驚きです。CursorBench 4.0で、Grok 4.7 xhighが46.3%($6.01/タスク)、Fable 5.1 mediumが46.8%($7.05/タスク)、GPT-5.6 Sol Maxが41.7%($8.23/タスク)でした。Grok 4.6 xhighの41.4%から、ほぼ同じコストで46.3%へと飛躍しています。

🚨 AI News | TestingCatalog: (翻訳) SpaceXAI 🔥: Grok 4.7がGrok Build、Cursor、APIでリリースされました。Grok 4.6の価格で、特定のタスクにおいてOpus 5に近いパフォーマンスを提供します。テストの時間です 👀

Meta MuseがShopify提携、Amazonはブロック【続報】

  • MetaのAIエージェント「Muse」に関する続報です
  • ダウンロード数やDAUが、ChatGPTの初期を上回る勢いで成長していることが報告されました
  • Shopifyと提携し、Muse内でのエージェントチェックアウト(Shop Pay)が可能になることが発表されました
  • 一方で、Amazonからは小売サイトでの利用をブロックされたことが明らかになっています
Rihard Jarc: (翻訳) 以前言ったように、MetaのMuseのユーザーからの反響はChatGPTよりもさらに高いです。最初の12日間で、Museのダウンロード数は180万(ChatGPTは130万)、DAUは64.2万(ChatGPTは23.1万)でした。エージェントこそがAIの真のユースケースであり、チャットボットはGoogle検索の別バージョンに過ぎませんでした。

Alexandr Wang: (翻訳) MuseがShopifyと深く提携し、すべてのShopifyストアでShop Payを使用したエージェントによるチェックアウトを可能にすることを嬉しく思います!Museユーザーに幅広いストアへのアクセスを提供し、絶対に完璧な製品を見つけてもらいたいと考えています ♥️

Bloomberg: (翻訳) Amazonが、Meta Platformsの新しいAIエージェント「Muse」の小売サイトへのアクセスをブロックしました - Bloomberg報道

OpenAIが数学の独立諮問委員会を設立【続報】

  • OpenAIのAIによる数学の未解決問題解決に関する続報です
  • 内部モデルがナビエ・ストークス方程式などを解決したとの噂が広まり、数学界に衝撃を与えています
  • これを受け、OpenAIは数学の進歩を責任を持って共有するため、独立した数学者の諮問委員会を設立したと発表しました
  • 委員会は、新たな数学的成果の評価や伝達方法、学術的基準の維持について助言を行う予定です
Haider.: (翻訳) なんてことだ。OpenAIの新たにトレーニングされた内部モデルが、ミレニアム懸賞問題のナビエ・ストークス方程式や、数学のほとんどの分野にわたる100以上の長年の未解決問題を解決しました。その進歩のペースは、OpenAI内部の数学者たちをも驚かせています。

OpenAI: (翻訳) 私たちは、OpenAIがAIと数学の進歩を責任を持って共有できるよう、独立した数学者の諮問グループと協力しています。このグループは、新しい数学的成果の評価と伝達方法、学術的および専門的基準の維持、そしてツールの構築について助言を行います。

Rohan Paul: (翻訳) OpenAIのAIが100以上の未解決問題を解決し、数学者の間で懸念が高まったことを受け、OpenAIは独立した数学諮問グループを設立しました。「このグループはOpenAIから独立して運営されます。私たちが求めていない助言を提供したり、OpenAIについてコメントしたりする自由を持ちます」

XiaomiがMiMo-V2.6-Proを公開【続報】

  • Xiaomiのオープンソースモデル「MiMo」シリーズの続報です
  • 新たなオープンウェイトモデル「MiMo-V2.6-Pro」と「Flash」がリリースされました
  • Artificial AnalysisのIntelligence Indexでトップのオープンモデルとなり、Opus 5やGPT-5.6 Solに匹敵する性能を示しています
  • 強化学習のダッシュボードやフレームワークも公開され、コミュニティから高く評価されています
Artificial Analysis: (翻訳) MiMo-V2.6-Proが、Artificial Analysis Intelligence Index(46)でトップのオープンウェイトモデルとしてデビューしました。Intelligence Indexタスクあたり0.13ドルで、インテリジェンス対タスクコストのパレートフロンティアに位置しています。Xiaomiは、主要なオープンウェイトモデルであるMiMo-V2.6-Proをリリー...

🚨 AI News | TestingCatalog: (翻訳) XIAOMI 🔥: MiMo-V2.6-ProとFlashのオープンソースモデルがリリースされました!MiMo-V2.6-ProはArtificial Analysis Intelligence Indexで6位にランクインし、利用可能なトップのオープンウェイトモデルとなりました。Claude Opus 5やGPT-5.6 Solと同等のパフォーマンスを発揮します!

Nathan Lambert: (翻訳) 真のオープンモデルオタクは、XiaomiがMiMoで何か企んでいることを知っていました!トップスコアのオープンモデルのためのオープンな強化学習ダッシュボードは素晴らしいです。

JevのLangSmith等への統合と代替モデルSemIf登場【続報】

  • 意思決定モデル「Jev」に関する続報です
  • LangSmithやClaude Codeに統合され、エージェントのルーティングや評価での活用が進んでいます
  • また、類似のオープンソース代替モデル「SemIf」も登場し、LangSmith Gatewayで無料提供されるなど注目を集めています
  • 開発者の間では、Jevのような高速で安価な「システム1」モデルの重要性が再認識されています
Alvaro Cintas: (翻訳) Claude Codeの中で直接Jevを使用できるようになりました 🤯 これはjev-model-routerと呼ばれ、Claude Codeの新しい関数フック上に構築された早期アクセスMODです。毎ターンの前にJevに確認し、タスクがどれくらい機械的か、どれくらいの推論が必要か、リスクがあるかどうかを尋ねます。

Harrison Chase: (翻訳) Jevは「意思決定モデル」という新しいタイプのモデルです。いくつかのオープンソースの代替案があり、その1つがSemIf(qwen3.5ベース)です。私たちはSemIfをホストし、来週までLangSmith Gatewayを通じて無料で提供します!

LangChain: (翻訳) Jevが従来のLLMと比べてどのように機能するかを考える簡単な方法です。

OpenAIとAnthropicが相互ストレステスト協定を交渉

  • OpenAIとAnthropicが、互いのAIモデルの脆弱性や危険性をストレステストするための法的拘束力のある協定を結ぶ交渉を行っていたことが判明しました
  • この交渉は、OpenAI内部でAI関連のセキュリティインシデントに対する懸念が高まる中で行われたとのことです
  • ライバル企業同士がAIの安全性に関してより深い協力を模索していることを示しています
The Information: (翻訳) 独占記事:OpenAIとAnthropicは、互いのAIモデルの脆弱性や隠れた危険性をストレステストするための法的拘束力のある協定に近づいていました。この交渉は、一連のAI関連のセキュリティインシデントがOpenAI内部の懸念を強める前に行われました。

Stephanie Palazzolo: (翻訳) OpenAIが安全性の懸念に対応しようとする中、1つの解決策が最近の過去にあるかもしれません。今年初め、OpenAIとAnthropicは互いのモデルをストレステストするための法的拘束力のある契約を交渉していました。

The Information: (翻訳) 独占記事:OpenAIとAnthropicは、互いの商用AIモデルをテストする契約をまとめようとしていました。これには、どちらの企業も相手のデータを保持できないようにするセーフガードが含まれていました。この交渉は、ライバル同士がAIの安全性についてより深い協力を模索していたことを示しています。

GPT-6 SolとLuna同時発表の噂、Codexリークも【続報】

  • OpenAIの次期モデルに関する続報です
  • Codexのバックエンドコードから「gpt-5.6-luna」のリクエストが「gpt-6-luna」として処理されるリークが新たに発見されました
  • 以前から噂されている「GPT-6 Sol」に加え、GPT-6シリーズの複数モデルが同時に発表されるのではないかと期待が高まっています
ML_Bear: 【最近の噂まとめ】 ・GPT-6 Solが火曜にもリリースされる。Astraより安く賢い可能性あり、6.2相当か。 ・GPT-6 SolのリリースはOpenAIがAGIと認識する未公開のモデル "Bel" がサポートしたという噂がある。 ・Opus 5.5も近日公開との噂。GPT-6 Solに先立って公開される可能性がある

Haider.: (翻訳) Codexのコードに興味深いGPT-6 Lunaのリークがあります。バックエンドは時々gpt-5.6-lunaのリクエストにgpt-6-lunaとして応答するようで、コードにはすでにその価格設定のサポートが含まれています。OpenAIはGPT-6 Solと一緒にローンチする計画だったようです。

まつにぃ: GPT-6 Lunaね。 このが5.6 Terra〜Solのどの辺まで今の価格帯で攻めるのかが見ものですな。 これ次第でオープンソースモデルにもガンガンプレッシャーが出て良い雰囲気になる。

OpenAIがMuse等対抗のAI Agent開発中

  • OpenAIが、SpaceXのGrok BotやMetaのMuseに対抗する新たなパーソナルAIアシスタント機能を開発中と報じられました
  • バックグラウンドで数時間から数日間にわたって稼働し、ビジネスソフトウェアを横断してタスクをこなす機能が検討されています
  • 既存のエージェント技術を再パッケージ化し、消費者向けAIアシスタント市場での競争力を強化する狙いがあると見られます
The Information: (翻訳) OpenAIは、ユーザーがビジネスソフトウェア全体で機能する常時稼働のAIエージェントを作成できるSpaceXのGrok Botとより直接的に競争するための機能を開発しています。また、MetaのMuseに対抗するアシスタントについても議論しています。

The Information: (翻訳) OpenAIはAIエージェントの普及に貢献しましたが、SpaceXとMetaは現在、バックグラウンドで数時間から数日間機能できるパーソナルアシスタントへとさらに押し進めています。OpenAIは、これに対応するために既存のエージェント技術を再パッケージ化する方法を検討しています。

Subscribe to ML_Bear Times

(ほぼ)毎日AIニュースが届きます。ぜひご登録ください。
(ほぼ)毎日AIニュースが届きます
ぜひご登録ください