ai-powered-markdown-translatorfr から ja に翻訳された記事、gpt-5.4-mini を使用。
8月22日、Anthropicは、遠隔マシン上で動作中のClaude Codeセッションを電話から操作できるRemote Controlの提供を開始しました。一方、Googleは同様の機能をAntigravityに追加し、エージェントを遠隔操作できるようにしています。モデル面では、Together AIによる2つの比較で、オープンモデルGLM-5.3がDeepSWEベンチマークにおいてGPT-5.6 SolとClaude Fable 5に匹敵、あるいは上回ることが示され、そのコストはごく一部にすぎません。さらにPerplexityは、Gitでバージョン管理されるエージェントメモリBrainのアーキテクチャを詳述し、NotebookLMはGoogle SearchのAIモードに統合されたうえで全ユーザーが利用可能になりました。ほかにも、Replitはエージェントモードを見直し、Runwayはモデルライセンス提供を開始、OpenAIはAPIコスト管理とCodexのセキュリティスイートを強化し、Grok Botはアクセス対象を拡大しています。
Claude Code Remote Control:信頼性向上と電話からのセッション開始
8月22日 — AnthropicはX上で、電話からClaude Codeセッションを操作できる機能Remote Controlについて、いくつかの信頼性修正を詳述したスレッドを公開しました。電話とマシン間の状態同期により、Claude Code終了後に幽霊セッションが残って表示されることがなくなり、ネットワーク切断(Wi‑Fiの切り替え、蓋を閉じるなど)時には自動再接続が行われ、iOSでは大きなセッションの読み込みも大幅に高速化されています。3つのスラッシュコマンドには、モバイル向けの専用動作が追加されました(/clear, /compact, /diff)。製品面の新機能として、電話から直接セッションを開始できるようになり、claude remote-control を実行している任意のマシンが Code タブ内でデバイスカードとして表示され、選択するとリモートでセッションを開始できます。
Your phone now stays in sync with what’s running on your machine. Resuming a session on your laptop keeps the phone on the live session instead of archiving it. When Claude Code exits, your phone shows it offline within seconds instead of leaving a stale session hanging around.
🇯🇵 今では、あなたの電話はマシン上で動いている内容と同期されたままです。ノートパソコンでセッションを再開すると、電話側はそのアクティブなセッションをアーカイブせずに維持します。Claude Code が終了すると、電話は古いセッションを表示し続けるのではなく、数秒でオフラインとして表示します。 — @ClaudeDevs on X
🔗 Xの完全なスレッド 🔗 Remote Controlドキュメント
Replit:Conversations、Agentモード改称(Power/Max)、RoutinesとMemoriesがベータに
8月22日 — Replitは週間まとめの This Week in Replit を公開し、3つの新機能を発表しました。Conversations により、アプリのアイデアを構築に入る前に会話ベースのリサーチとアイデア出しの段階から始められるようになり、この段階を別のAIアシスタントで行った際に失われがちだったコンテキストを保持できます。Agentのモード名も変更され、旧 Economy モードは Power に、旧 Power モードは Max になりましたが、どちらも価格は同じです。さらに、Routines と Memories がベータで登場しました。Routines は会話からタスク実行を予約し、永続メモリシステムを基盤に結果を自動で返します。これらの発表は、ReplitのFriday Showcaseでライブ紹介されました。
🔗 発表スレッド
Together AIがGLM-5.3をGPT-5.6 SolとClaude Fable 5とDeepSWEで比較
8月21日 — Together AIは同日に、Zhipu/Z.aiの最新オープンモデルGLM-5.3を、ソフトウェア工学ベンチマークDeepSWE(113タスク、構成ごとに4試行、最大努力、合計904回の実行)で2つのクローズドモデルと比較する独立評価を2本公開しました。GPT-5.6 Solとの比較では、GLM-5.3は初回試行では劣るものの2回目で追いつき、4回目で上回り、しかもコストは大幅に低く抑えられています。Claude Fable 5との比較では、初期差はほぼなく、複数試行を重ねることでGLM-5.3に明確に有利な差が開きました。Claude Fable 5は比較対象の中で最も高価な構成でした。失敗時のみSolへエスカレートするGLM-5.3→Solのカスケードは、1タスクあたり6.61ドルで85.9%の成功率を達成し、完全なオラクルルーターよりも良い結果(83.8%)でした。
| テストした比較 | 1回目試行のスコア | 4回試行後のスコア | 実行あたりのコスト |
|---|---|---|---|
| GLM-5.3 vs GPT-5.6 Sol | 69,0 % vs 72,7 % | 87,6 % vs 85,8 % | 3,99 $ vs 8,37 $(2,1倍安い) |
| GLM-5.3 vs Claude Fable 5 | 69,0 % vs 69,7 % | 87,6 % vs 84,1 % | 3,99 $ vs 21,63 $(5,4倍安い) |
Don’t pick one. Run GLM-5.3 first, escalate to GPT-5.6 Sol when the tests fail. That cascade solves 85.9% of DeepSWE tasks at $6.61 each. Sol alone solves 72.7% at $8.37. Thirteen points better, 21% cheaper.
🇯🇵 1つのモデルだけを選ばないでください。まずGLM-5.3を実行し、テストが失敗したときにGPT-5.6 Solへエスカレーションしてください。このカスケードで、DeepSWEのタスクの85.9%を1件6.61ドルで解決できます。Sol単独では72.7%を1件8.37ドルで解決します。13ポイント改善し、21%安くなります。 — Together AI、公式ブログ
🔗 GLM-5.3 vs Claude Fable 5の比較
NotebookLMが全ユーザーに利用可能に、Google SearchのAIモードに統合
8月21日 — NotebookLMのXアカウント(Gemini Notebookに改称)は、再設計された「Notebook」体験が段階的展開を経て、Web上の全ユーザーに利用可能になったと発表しました(モバイル版も今後提供予定)。もう1つの大きな変更は、ノートブックがGoogle SearchのAIモードから直接アクセス可能になったことです。これにより、文書要約ツールがGoogleの主要検索エンジンにさらに近づきました。発表にはChat側の修正も2点含まれており、数式の表示とコピー&ペーストの改善、そして右から左へ書く言語(アラビア語、ヘブライ語)で数字が逆に表示されるバグの修正です。今後数週間で、さらに新機能が予定されています。
🔗 Xでの発表
OpenAI、Usage and SpendダッシュボードにAPIキー別の支出追跡を追加
8月21日 — OpenAIは、開発者向けプラットフォームのUsage and SpendダッシュボードにAPIキー単位の粒度を追加しました。これまでは組織またはプロジェクト単位で集計されていた支出追跡が、各APIキーの寄与を個別に切り分けられるようになり、どのアプリケーションやワークフローが請求額の大部分を占めているのかを正確に特定できます。この機能には、組織またはプロジェクト単位で設定できる支出上限も付属し、上限到達時に自動でトラフィックを遮断する厳格な制限も設定可能です。これらの制御はAPI PlatformのインターフェースとAdmin APIから利用でき、プログラム的なワークフローに組み込めます。OpenAIはこの更新を、同日に発表したGPT-5.6 Solの価格引き下げを補完するものと位置づけています。
🔗 Xでの発表
Codex Security:サイバー防御向け実践ガイドとオープンソースCLI(Daybreak)
8月21日 — OpenAIは、AI支援サイバー防御プラットフォームDaybreakのエコシステムを、ChatGPTでの初期トリアージから検証済み修正の作成まで含めて解説するガイドを公開しました。開発者にとって最も実用的なのは、npmパッケージとして公開されたオープンソースツール Codex Security CLI(@openai/codex-security)で、ローカルリポジトリのスキャン(npx @openai/codex-security scan .)に使え、SARIF形式での出力を伴ってCI/CD(GitHub Actions、GitLab CI/CD)に統合できます。注目すべき新機能は bulk-scan で、CSVインベントリからリポジトリ全体のポートフォリオを監査でき、中断からの再開と設定可能な同時実行パラメータに対応しています。OpenAIはまた、2つのアクセスレベルも区別しています。承認済みの防御担当者向けの Daybreak Blue(脆弱性トリアージ、修正検証)と、より限定された許可済み用途向けの Daybreak Red(高度な脆弱性研究、レッドチーミング)です。Codex Security cloudはすでに、3万以上のコードベースに対して3,000万件超のコミットを解析しています。
🔗 完全ガイド
Grok Botがより多くのプランに対応し、試用は無料に
8月21日 — ベータ開始から10日後、Grok Botは対応プランを拡大し、SuperGrok Plus、SuperGrok Heavy、さらにCursorの各プラン(Pro+、Ultra、すべてのTeamsプラン)でも利用できるようになりました。これらのプラン以外のユーザーには、利用制限付きの無料試用が提供されます。これらの自律型AIエージェントは、ブラウザとターミナルにアクセスできる独自のクラウド環境を備えており、営業開拓、完全なWebサイトの作成(ドメイン購入とデプロイ込み)、受信箱の整理、カスタマーサポート、会議メモの作成といったタスクに使えます。複数のBotを同じグループ内で並列実行でき、いわゆる「routine」モードでは、ユーザーが一度実行する様子を見せることで、Botがタスクを学習できます。大規模展開向けに企業待機リストも開設されています。
🔗 Xでの発表
Runwayが企業戦略とモデルライセンス提供を詳述
8月21日 — Runwayの新営業責任者Sean Holcombeは、同社の企業向け戦略をブログで詳しく説明しました。年間売上は2倍超、純継続率は300%超、そして海外展開も顕著で、欧州は企業基盤の20%超、日本はアジア最大市場になったといいます。最も重要な発表は モデルライセンス 提供の開始です。API経由で使用量課金のアクセスを提供するのではなく、特定の企業顧客には、閉じたモデルの重みと、独自環境内で直接ホスト・微調整できる専用の学習/推論フレームワークが提供されます。Runwayは、独自の創作IPを持つ企業、すでに計算資源を保有するプラットフォーム、厳しい規制の下にある組織、そして超大規模利用者の4つを主要対象としています。
🔗 全文記事
PerplexityがComputerのエージェントメモリシステムBrainを詳説
8月19日 — Perplexityは、自社のローカルエージェントComputerにおける永続メモリシステムBrainの仕組みを詳しく説明しました。一般的なベクトルDBではなく、BrainはGitでバージョン管理された知識Wikiとしてメモリを整理し、サンドボックスのファイルシステム内で3層に分かれています。knowledge/(Wiki本体)、notes/(要約した抜粋)、sessions/(生の書き起こし)です。専用の「Memory Agent」は、起動のたびにツリー全体を複製するのではなく、必要なファイルだけをオンデマンドで読み込みます。一方、「Dream」と呼ばれるバックグラウンドエージェントは、公開前の検証を伴う4段階の工程でオフラインのままWikiを維持します。
| 評価指標 | Brainなし | Brainあり |
|---|---|---|
| 正確性(社内ベンチマーク、640問) | 0,600 | 0,661 |
| 証拠再現率(社内ベンチマーク) | 0,573 | 0,625 |
| 本番での正確性(直近30日) | 基準 | +9,3ポイント |
🔗 技術記事
短報
- Devin(Cognition)— GPT-5.6 Solに追加で20%割引 — OpenAIは、8月18日から既に適用されている70%割引に加え、GPT-5.6 Solの価格を3か月間さらに20%下げます。これにより、Devin DesktopとCLIでの累積割引は2026年10月3日まで76%に達します。🔗 発表
- Google Antigravity 2.9.1 — エージェントを遠隔操作するRemote Control — どのブラウザからでもローカルなエージェントセッションを開始・監視できる新機能で、性能向上とエラー後の復旧改善を含みます。🔗 変更履歴
- Copilot Max向けAuto model selectionが30%オフ — Copilot Max加入者向けに、モデルの自動選択(Claude、GPT、またはMicrosoft AI)を2026年9月30日まで割引提供。🔗 発表 · 🔗 終了日
- GitHub Universe 2026 — チケット販売を再開 — GitHub Universe 2026カンファレンスのマーケティング再始動を短い動画で実施。製品発表はありません。🔗 動画
- Midjourney — サイトalpha版の大型変更履歴 — alpha.midjourney.comでの2週間にわたるUX修正:プロジェクトフォルダ、Upscale/Zoom/Varyの復活、設定の永続化、性能修正。🔗 変更履歴
- MiniMaxがSambaNova上でのM3モデル公開を示唆 — SambaNovaの謎めいた発表への返答として、MiniMaxはM3モデルの近日登場を示唆したものの、仕様や公開日は明かしていません。🔗 投稿
- Grok 4.6がGoogle Enterprise Agent Platformで利用可能に — モデルがModel Garden(旧Vertex AI)に加わり、50万トークンのコンテキストウィンドウと、入出力それぞれ100万トークンあたり2 $ / 6 $ の価格設定が適用されます。🔗 発表
- Cohereがsuperwhisper経由の音声入力にローカルモードを追加 — 「Go Local」モードは、Cohere TranscribeとsuperwhisperのオープンモデルS1-mini(6億パラメータ)を組み合わせ、完全にデバイス上で文字起こしを行います。🔗 発表
それが意味すること
今日、互いに無関係な2つの発表が、同じ方向性へ収束している。つまり、AIエージェントの制御を、実際に動いているマシンから切り離すという動きだ。Anthropicでは、Claude Code Remote Control により、いまやスマートフォンから直接セッションを開始でき、デバイス間の自動再接続と状態同期が可能になった。Googleでは、Antigravity が独自の「Remote Control」機能を導入し、任意のブラウザからローカルなエージェントセッションを操作・監視できるようにした。どちらの場合も、計算と実行はワークステーション上にとどまり続ける――モバイル化するのは制御ウィンドウのほうだ。この分離は、いまや一般的になった使い方に応えるものでもある。開発マシンで長時間タスクを実行し、その後は別のデバイスから進捗を確認し、必要なら制御を再開する。実行中の処理を止めることなく、だ。
今日見えている2つ目の流れは、モデルの経済性に関わるものだ。Together AI の2つの比較では、Zhipu/Z.ai のオープンモデルである GLM-5.3 が、同一のソフトウェア工学ベンチマークで GPT-5.6 Sol や Claude Fable 5 と同等、あるいはそれを上回る結果を示し、そのコストは2〜5分の1だった。これは孤立した事例ではない。同じ週に、xAI は Grok 4.6 のためのクラウド統合を次々と拡大し(GitHub Copilot と Amazon Bedrock に続いて Google Enterprise Agent Platform でも利用可能に)、OpenAI は Devin のユーザーに対して GPT-5.6 Sol の累計76%割引を提供し、Replit も独自のエージェントモードを拡張した。競争の主戦場は、もはやモデルの生の能力だけではない。費用対効果とマルチプラットフォームでの利用可能性であり、そこでオープンモデルとモデル間カスケード戦略の組み合わせが、クローズドモデルに対する本格的な商業的武器になりつつある。
今日、もうひとつの、より目立たない流れもある。持続的メモリが、AIエージェント向けのインフラストラクチャの1要素として完全に定着しつつあるのだ。Perplexity は、Brain のアーキテクチャを詳述した。これは、従来のベクトルデータベースに積み上げるのではなく、Gitでバージョン管理された知識Wikiとして Computer エージェントのメモリを構造化するもので、事実の正確性と証拠の再現率で測定された改善をもたらしている。同じタイミングで、Google は NotebookLM の再設計された Notebook 体験へのアクセスを拡大し、それを Google Search の AIモードに直接統合したことで、文書要約ツールを主たる検索エンジンへとさらに近づけた。いずれの場合も、付加価値はもはや基盤モデルだけから生まれるのではなく、蓄積された履歴と知識をどう整理し、見つけ出し、セッション間で再利用するかにかかっている。
最後の論点は、企業の技術チームやセキュリティチーム向けツールの成熟度に関するものだ。OpenAI は、APIキーごとの支出追跡と厳格な設定可能上限をダッシュボードに追加した。同時に、ポートフォリオ全体のリポジトリを監査できるオープンソースCLIを備えた Codex Security の詳細ガイドも公開している。これら2つの発表は、同じチームが同じ日に公開したものであり、AIエージェントを大規模に展開する組織が共有する懸念、すなわち、これらのツールが約束する速度を手放すことなく、コストとセキュリティ面の攻撃対象領域を細かく管理する必要性に対する、一貫した回答を示している。
ソース
- Claude Code Remote Control — 全スレッド
- Claude Code Remote Control — 同期引用
- Remote Control ドキュメント
- Replit — 今週の Replit
- Together AI — DeepSWE における GLM-5.3 対 GPT-5.6 Sol
- Together AI — DeepSWE における GLM-5.3 対 Claude Fable 5
- NotebookLM — Xでの発表
- OpenAI — APIキーごとの使用量と支出
- OpenAI — Codex Security と Daybreak
- Grok Bot — Xでの発表
- Grok Bot — x.ai の詳細
- Runway — 企業戦略とモデルライセンス
- Perplexity — Brain、Computer のエージェントメモリ
- Devin — GPT-5.6 Sol の追加割引
- Google Antigravity — 変更履歴 2.9.1
- GitHub — 自動モデル選択で -30 %
- GitHub — 自動モデル選択、終了日
- GitHub Universe 2026 — チケット販売再開
- Midjourney — alpha の変更履歴
- MiniMax — M3 モデルの発表
- Grok 4.6 — Google Enterprise Agent Platform
- Cohere — superwhisper のローカルモード