2026年08月13日 朝のAIニュースまとめ
(ほぼ)毎日AIニュースが届きます。ぜひご登録ください。
(ほぼ)毎日AIニュースが届きます
ぜひご登録ください
強力なAIモデルの連続リリースとエージェント機能の進化
Grok 4.6やDeepSeek V4 Proなど強力なモデルが立て続けにリリースされ、低価格化による競争が激化しています。
また、Gemini Sparkのブラウザ自律操作機能やClaudeのセッション同期など、AIエージェントの実用性を高めるアップデートも相次ぎました。
本日の主要な動向を順番に確認していきましょう。
目次
- Grok 4.6正式リリース、利用枠2倍キャンペーンも【続報】
- DeepSeek V4 Pro GA版がリリース【続報】
- Qwen3.8-Maxのオープンウェイトが公開【続報】
- Grok 4.7がSpaceXデータ学習中、数週間後登場【続報】
- Gemini SparkにAuto Browse機能搭載【続報】
- ClaudeのChrome拡張がセッション同期に対応
- ChatGPTで動画生成可能なHiggsfield Plugin登場
- AnthropicがAIエージェント間のマインドウイルスを研究
- AIエージェントへの指示ファイル「CLAUDE.md」の肥大化問題
- AIエージェントへの指示は文末を「?」にするTipsが話題
Grok 4.6正式リリース、利用枠2倍キャンペーンも【続報】
- xAIの最新モデル「Grok 4.6」に関する続報です
- 正式にリリースされ、APIやCursor、Grok Build経由で利用可能になりました
- ベンチマークでGPT-5.6 SolやClaude Fable 5に匹敵する性能を示しつつ、入力$2/M、出力$6/Mという低価格で提供されています
- 最初の1週間はCursorとGrok Buildでの利用枠が2倍になるキャンペーンも実施されています
まつにぃ: きたぞGrok4.6!! そしてなんと比較対象はSol MAXとFable MAX。 これは検証のしがいがあるな!
まつにぃ: そしてGrok4.6は ・1M/入力トークンあたり2ドル ・1M/出力トークンあたり6ドル おおよそSolの1/5、Fableの1/10のコスト。 これで日本語うまかったら、「それGrokでよくね??」って言える。 こんな日が来ようとは。
🚨 AI News | TestingCatalog: (翻訳) 速報🔥: SPACEXAIがGROK 4.6をリリースし、多くのベンチマークでFABLE 5やGPT 5.6 SOLに匹敵する性能を示しました! > Frontend Arenaでも1553ポイントで13位にランクインしました。 > Grok 4.6は本日よりCursorとGrok Buildで利用可能で、最初の1週間は利用枠が2倍になります。
DeepSeek V4 Pro GA版がリリース【続報】
- DeepSeek V4 ProのGA(一般提供)版がリリースされ、OpenRouterなどで利用可能になりました
- 入力$0.435/M、出力$0.87/Mという圧倒的な低価格設定でありながら、高い性能を発揮しています
- Grok 4.6などと合わせて、フロンティアモデルの価格競争がさらに激化していると話題になっています
leo 🐾: (翻訳) DeepSeek V4 Pro GAのロールアウト開始から数分後、xAI APIでGrok 4.6がローンチされました。行くぞ
Chubby♨️: (翻訳) DeepSeek 4 Pro GAは非常に優れたモデルです。しかし、価格設定がめちゃくちゃ素晴らしい! 1Mトークンコンテキストで入力$0.435/M、出力$0.87/M。これは狂ったような価格設定です!!
OpenRouter: (翻訳) DeepSeek V4 Pro 0813がOpenRouterで利用可能になりました。@deepseek_ai はV4 Pro Previewからのエージェント性能の大幅な向上を報告しています:DeepSWE 62.7 (+49.9)、CyberGym 83.3 (+30.6)、NL2Repo 61.5 (+23.0)、Terminal Bench 2.1 87.9 (+15.8)。他...
Qwen3.8-Maxのオープンウェイトが公開【続報】
- 以前から予告されていたAlibabaの「Qwen3.8-Max」のオープンウェイトがHugging Faceで公開されました
- 2.4Tパラメータ(アクティブ95B)を持つ強力なMoEモデルです
- 1日の間にGrok 4.6、DeepSeek-V4-Pro、Qwen3.8-Maxと3つの強力なモデルが立て続けにリリースされ、オープンソースAIの進化と競争の激しさにコミュニティが沸き立っています
Lisan al Gaib: (翻訳) Qwen3.8 2.4Tがオープンウェイトになりました
Yuchen Jin: (翻訳) Qwen3.8-MaxのウェイトがHugging Faceで公開されました!総パラメータ数2.4T、アクティブ95Bです。OSS AIにとって良い一日です。
Yuchen Jin: (翻訳) 1日で3つのフロンティアモデルが登場! - Grok 4.6: Fable 5レベルだが85%安い。 - Qwen3.8-Max: 2.4Tパラメータ、95Bアクティブ。ウェイト公開。 - DeepSeek-V4-Pro-0813: いつウェイトが公開されてもおかしくない。ベンチマーク特化ではなく実際に良いと聞いている。競争は消費者や企業にとって素晴らしいことです。
Grok 4.7がSpaceXデータ学習中、数週間後登場【続報】
- xAIのGrok 4.7に関する続報です
- Elon Musk氏が、同モデルが3〜4週間後にリリースされる予定であることを明らかにしました
- 初期トレーニングは完了しており、現在はSpaceXの膨大な社内データを追加学習しているとのことです
- 実世界のエンジニアリングタスクにおいて、現在のすべてのモデルを凌駕すると自信を見せています
Pliny the Liberator 🐉󠅫󠄼󠄿󠅆󠄵󠄐󠅀󠄼󠄹󠄾󠅉󠅭: (翻訳) 本当ならすごい👀
Tech Dev Notes: (翻訳) Grok 4.7が3〜4週間後に登場します
Chubby♨️: (翻訳) 私はこれを真剣に受け止めています。Grok 4.6は私が望んでいた飛躍でした。もし10Tモデルがまだ控えているなら、Elonの言葉は真剣に受け止めることができます:それは本当に(一般的に)最高のモデルになる可能性があります。もちろん、AnthropicはすでにFable 5.5を準備して待機していますが。
Gemini SparkにAuto Browse機能搭載【続報】
- ChromeのAIエージェント機能「Auto Browse」に関する続報です
- Gemini Sparkに同機能が搭載され、ユーザーのブラウザを直接操作してタスクを完結させることが可能になりました
- 1文で目標を記述するだけで、ログイン状態などを活用し、訪れたことのないページでも自律的に操作を行います
CyrilXBT: (翻訳) Gemini Sparkは、実際のChromeブラウザを使用し、ログイン済みのアカウントや保存されたパスワードを含めて、ウェブ上のタスクを自律的に完了できるようになりました。Auto Browseは、1文で説明した目標に基づいて、訪れたことのないページにアクセスし、人間のように操作します。
ClaudeのChrome拡張がセッション同期に対応
- Claude in ChromeのセッションがClaude Coworkと同じソリューションで稼働するようになりました。
- デスクトップ、ウェブ、モバイルアプリ間でセッションが同期され、デバイスをまたいだ作業が可能になります。
- SkillsやConnectorsもサポートされており、MaxおよびTeamプランのユーザー向けに提供が開始されています。
🚨 AI News | TestingCatalog: (翻訳) Claude in Chromeのセッションは、Claude Coworkと同じソリューションで稼働するようになり、異なるクライアント間で同期されるようになりました。SkillsとConnectorsもサポートされています👀 > 本日よりMaxとTeamで利用可能で、数週間以内にProにも展開されます。
ChatGPTで動画生成可能なHiggsfield Plugin登場
- ChatGPTアプリ内で直接動画生成ができるHiggsfield Pluginがリリースされました
- Seedance 2.5やKling 3.0などのトップモデルを使用し、チャット画面から離れることなくプロンプトの構築から動画生成まで完結できます
- 複数のツールを行き来する必要がなくなり、動画生成のワークフローが大幅に簡略化されると期待されています
elvis: (翻訳) Higgsfield PluginがChatGPTアプリで利用可能になりました。私がショットを説明すると、ChatGPTがプロンプトを構築し、完成したフレームがチャット内に直接表示されました。生成は既存のHiggsfieldクレジットを使用してトップモデルで実行され、APIキーは不要です。編集も同じように機能します。
Charly Wargnier: (翻訳) Higgsfield Plugin以前の生活:ChatGPTでプロンプトを書き、どれが一番うまくいくか確認するために3つの異なるツールにエクスポートする。以後の生活:@Higgsfield プラグインがChatGPTストアに登場しました🔥 今ではChatGPTで「木製のテーブルの上にある1つの赤い陶器のマグカップ」とプロンプトを入力するだけです。
AnthropicがAIエージェント間のマインドウイルスを研究
- Anthropicが、マルチエージェントシステム内で伝播するマインドウイルス(アイデア)の進化に関する新しい研究を発表しました
- エージェントが他のホストにアイデアを伝えることでどのように拡散するかを測定し、そのメカニズムを解明しようとしています
- AIエージェントが自律的に相互作用する環境における、情報の伝播とリスク管理の観点から注目されています
elvis: (翻訳) Anthropicからの非常に興味深い新しい研究です。(ブックマーク推奨)彼らは、各ホストに伝達させることでマルチエージェントシステムを通じて広がるアイデアである「マインドウイルス」を進化させ、何がその拡散を支配しているかを測定しています。仕組み:共有コーディングプロジェクトに取り組むエージェントの小さなチームと...
AIエージェントへの指示ファイル「CLAUDE.md」の肥大化問題
- AIエージェントへの指示を記述する「CLAUDE.md」や「AGENTS.md」が際限なく肥大化する理由を分析した研究が話題になっています。
- 指示を追加するのは簡単ですが、その理由がなくなった後に削除するのは指数関数的にコストがかかることが指摘されています。
- AIエージェントを活用した開発プロジェクトにおける、プロンプト管理の難しさを浮き彫りにしています。
elvis: (翻訳) なぜCLAUDE.MDは肥大化し続けるのか?CLAUDE.mdやAGENTS.mdを管理しているなら、これは読む価値があります。(ブックマーク推奨)この研究は、なぜこれらのファイルが際限なく大きくなるのかを追跡しています。指示を追加するのは無料です。しかし、その理由がなくなった後に削除するのは指数関数的なコストがかかります。
AIエージェントへの指示は文末を「?」にするTipsが話題
- AIエージェントに指示を出す際、断言するのではなく文末を「?」にして微妙に自信がない感じを残すというTipsが共有されました。
- 断言してしまうとAIが人間の意見に合わせすぎてしまうため、AIに良い感じに判断させるための工夫として紹介されています。
- AIエージェントの自律性を引き出すための、実践的なコミュニケーション手法として多くの賛同を集めています。
Kenn Ejima: AIエージェントと仕事をするときのtips 文末を常に「?」で終わらせる 「それでやって」ではなく 「それでやるのがいいね?」みたいに 微妙に自信がない感じを残すと いい感じに判断してくれる 断言するとこちらに合わせすぎるので