検索

DeepSeek-V4-Proがオープンウェイトを公開、Gemini 3.7 Flashが登場、GPT-5.6 SolがUltrafastで加速

人工知能によって生成された記事
DeepSeek-V4-Proがオープンウェイトを公開、Gemini 3.7 Flashが登場、GPT-5.6 SolがUltrafastで加速

ai-powered-markdown-translator

gpt-5.4-miniを使用してfrからjaに翻訳された記事。

GitHub でプロジェクトを見る ↗

2026年8月13日、DeepSeekは主力モデルDeepSeek-V4-Proを公開し、発表当日にMITライセンスのオープンウェイトとしてリリースしました。一方、GoogleGemini 3.7 Flashを発表し、コードとエージェント向けの新しい日常的な主力モデル(workhorse)として位置づけました。こちらも本日からGitHub Copilotで利用可能です。OpenAIはその一方で、Ultrafastをプレビュー公開しました。これはCerebrasのハードウェアにより、GPT-5.6 Solを標準処理より最大14倍速く実行できるサービス層です。ほかにも、AnthropicはClaudeのセッション同期をデバイス間で実現し、CursorはBuildsでクラウドエージェントを高速化、Grok 4.6はPerplexity、Warp、Gensparkで展開を継続し、Hugging Faceはモデルと公開研究の発表を次々と行っています。


DeepSeek-V4-Pro:主力モデルを発表、Hugging Faceでオープンウェイト公開

8月13日 — DeepSeekは主力モデルDeepSeek-V4-Proを発表し、アプリ、ウェブ(「Expert Mode」経由)、APIですぐに利用可能になりました。ドキュメント内のモデル名は変更されていません。発表ではエージェント向けの大幅な改善が強調されており、V4-Proと軽量版V4-Flashの両方で、推論の強さを調整できるようになっています。

努力度推奨用途
単純なタスク
日常的なエージェント作業フロー
最大複雑なタスク

もう一つの技術的な新機能は、OpenAI Responses APIのネイティブサポートです。Codex向けにワンクリック設定で最適化されており、DeepSeekが独自の孤立したAPIを提供するのではなく、OpenAI形式を中心に構築されたエージェント型コードツールのエコシステムを直接狙っていることを示しています。

Hugging Faceの研究者Elie Bakouchは、V4-ProがHugging FaceでもMITライセンスのオープンウェイトとして公開されていることを確認しました。ただし彼は「V4」という名称には慎重で、前回の版はあくまでプレビューだったのに対し、今回ははるかに多くの学習が行われたと指摘しています。彼によれば、「V4.5に近い」とのことです。この発表はDeepSeekにとって忙しい一日の一部でもあり、同日にAPI料金体系の刷新と、初のオープンソースのエージェントハーネスであるDeepSeek Harness(下記参照)も公開しました。こうした一連の動きは、同社を単なるモデル提供者ではなく、エージェント・エコシステム全体を担う総合的なプレイヤーとして再位置づけるものです。

We’re launching DeepSeek-V4-Pro today! Major Agent upgrades with strong production gains! Flexible reasoning effort for V4-Pro & V4-Flash: low for simple tasks, high for daily Agent workflows, max for complex tasks. Native OpenAI Responses API support, optimized for Codex with one-click setup.

🇯🇵 本日、DeepSeek-V4-Proを発表します! エージェント側で大幅な改善があり、本番環境で強い成果を出しています! V4-ProとV4-Flashの柔軟な推論設定:単純なタスクには低、日常的なエージェント作業フローには高、複雑なタスクには最大。OpenAI Responses APIのネイティブサポートを備え、Codex向けにワンクリック設定で最適化されています。@deepseek_ai sur X

🔗 オープンウェイトとMITライセンスの確認


Gemini 3.7 Flash:コードとエージェント向けの新しい日常的な主力モデル(workhorse

8月13日 — GoogleはGemini 3.7 Flashを発表しました。これは、Gemini 3.6 Flashからわずか3週間で登場した、コードとエージェント向けにこれまでで最も賢い日常的な主力モデル(workhorse)だとされています。このモデルは、ソフトウェア工学、ウェブ開発、複雑な知識作業(文書分析、業務ワークフロー)の3つの主要用途を対象としています。

ベンチマーク評価分野3.6 Flash3.7 Flash
FrontierCode 1.1 Mainコード品質34,4 %43,6 %
DeepSWE v1.1ソフトウェア工学(デバッグ)49,0 %65,3 %
WebDev Arenaウェブ開発(Eloスコア)15381588
GDP.pdf文書理解22,0 %34,0 %
AutomationBench自動化された業務ワークフロー17,0 %30,4 %

料金面では、Gemini 3.7 Flashは2026年12月31日まで導入価格が適用され、3.6 Flashの半額です。入力は100万トークンあたり$0,75、出力は100万トークンあたり$3,75となっており、2027年1月以降の標準料金はそれぞれ$1,50と$7,50です。このモデルは本日から、Google Antigravity、Google AI StudioとAndroid StudioのGemini API、Gemini Enterprise Agent、そしてGemini Sparkで利用できます。Gemini Sparkは、160か国以上でGoogle AI ProとUltraの加入者に提供される、先回りして提案する個人向けアシスタントです。Googleはまた、化学、生物、放射線、核の各分野における悪意ある利用や、サイバーセキュリティにおける攻撃的能力に対するモデルの安全対策も強化したと説明しています。

同日、Gemini 3.7 FlashはGitHub Copilotにも展開されます。GitHubによると、初期テストでは前のバージョンと比べてウェブ開発、アプリ開発、エージェント的コーディングの各面で改善が見られました。展開対象はCopilot Pro、Pro+、Max、Business、Enterpriseで、VS Code、Visual Studio、Copilot CLI、Copilot cloud agent、Copilotアプリ、JetBrains、Xcode、Eclipseのモデルセレクタからアクセスできます。EnterpriseとBusinessプランでは、組織のメンバーがアクセスできるようになる前に、管理者が「Gemini 3.7 Flash Preview」ポリシーを有効化する必要があります。課金は従量課金の枠内で、各プロバイダーの料金に従います。

Today we’re introducing Gemini 3.7 Flash, our most intelligent workhorse model yet for coding and agents. This model brings substantial gains across software engineering, web development, and complex knowledge work.

🇯🇵 本日、コードとエージェント向けにこれまでで最も賢い日常的な主力モデル(workhorse)であるGemini 3.7 Flashを発表します。このモデルは、ソフトウェア工学、ウェブ開発、複雑な知識作業において大きな向上をもたらします。@Google sur X

🔗 Google公式発表 · GitHub Copilotの更新履歴


Ultrafast:Cerebras搭載でGPT-5.6 Solが最大14倍高速化

8月13日 — OpenAIはUltrafastを発表しました。これはAPI向けの新しいサービス層で、GPT-5.6 Solを標準処理より最大14倍速く動作させます。Cerebrasのハードウェアによって実現され、このモードでは1秒あたり最大750トークンを生成できます。これまでリアルタイム速度を得るには、知能を犠牲にしてより小さいモデルや特化型モデルを選ぶ必要がありました。Ultrafastはこの関係を変え、OpenAIで最も先進的なモデルの能力を犠牲にせず、1秒あたりより多くの有用な作業を行うことを目指しています。

特徴詳細
モデルGPT-5.6 Sol
速度標準処理の最大14倍
スループット1秒あたり最大750出力トークン
ハードウェアパートナーCerebras
利用可能状況プレビュー、OpenAI API、申請制アクセス

OpenAIは、この速度によって新たな用途が開けるいくつかのシナリオを挙げています。たとえば、インシデント対応(インシデント進行中にログ、最近のコード変更、エンジニアの報告を分析する)、金融調査(市場シグナルや取引をリアルタイムで分析する)、音声カスタマーサポート(会話を途切れさせずに複雑な問題を解決する)、コマース(カート放棄前に製品に関する質問へ答える)、実験的研究(一晩かかっていた計算を対話的なセッションに変える)です。最初の顧客グループはすでに、コード、コマース、金融調査、サポートの各ユースケースで、実運用環境下のUltrafastモードのGPT-5.6 Solを試しています。OpenAIは、特にインシデント対応で社内利用していることも明らかにしています。

現時点でアクセスは、API経由で限られた一部の顧客に限定されており、利用枠が増えるにつれてより多くの企業に通知されるよう申請フォームが用意されています。

Previewing Ultrafast mode: GPT-5.6 Sol at up to 14x the speed. Launching first in the OpenAI API to a select group of customers with expanded access to more businesses as capacity grows.

🇯🇵 Ultrafastモードのプレビュー:GPT-5.6 Solが最大14倍の速度。まずは少数の顧客向けにOpenAI APIで提供を開始し、容量が増えるにつれてより多くの企業へアクセスを広げていきます。@OpenAI sur X

🔗 Ultrafastのプレビュー — 公式発表


Claudeがデバイス間の継続性を拡張

Anthropicは同じ日に、同じ方向性を示す2つの発表を行いました。Claudeのセッションが、もはやデバイスではなくユーザーに追随するようになります。

Claude in Chrome — desktop、web、mobile間でセッションを同期

8月12日 — Anthropicのブラウザ拡張機能であるClaude in Chromeのセッションは、もはや開いたデバイスに閉じたものではありません。会話は保存され、desktop、web、mobileの間で自動的に引き継がれるようになり、ユーザーのskillsやconnectorもブラウザ内でそのまま利用できます。この機能は本日からMaxおよびTeamプランで利用可能で、Pro加入者への展開は今後数週間以内に予定されています。

🔗 Xでの発表

Claude Cowork — サイドパネルがdesktop、web、mobileとセッションを共有

8月12日 — Claude Coworkのサイドパネル(side panel)は、desktop、web、mobileアプリと同じセッションを実行するようになりました。セッションは単一のデバイスではなくユーザーアカウントに紐づくため、ブラウザのタブで作業を始めて、あとから別の端末で同じ作業を再開しても、コンテキストが失われません。

🔗 Xでの発表


エージェント型開発ツール:Cursor、Devin、DeepSeekが前進

AI支援の開発ツールが、8月13日に並行していくつも進展しました。エージェント基盤、戦略的採用、ライブデータへの直接アクセスがその中心です。

CursorがBuildsを導入 — クラウドエージェントが最初のトークンまで最大3倍高速化

8月13日 — Cursorはbuildsを導入しました。これは、開発環境の事前準備済みコピー(クローン済みリポジトリ、インストール済み依存関係、実行済みのインストールスクリプト)で、クラウドエージェントが即座に起動できるものです。Cursorによると、社内では環境起動が10倍高速になり、最初のトークンまでの時間が3倍高速になっています。システムは堅牢で、buildが失敗しても、失敗がバックグラウンドで修正される間、エージェントは最後に正常だったbuildを使い続けます。この機能はCloud Agentsに追加費用なしで含まれています。

🔗 Cursorの更新履歴

CursorがFiretigerチームを迎え入れる

8月13日 — Cursorは、Firetigerチームの加入を発表しました。目的は、コードを本番まで追跡し、うまく動作しない箇所を修正できるエージェントを構築することです。これは、同日のBuilds発表の自然な延長線上にあります。Cursorは、開発から本番監視まで、ライフサイクル全体をカバーしようとしています。金銭的な詳細は公表されていません。

🔗 Xでの発表

Devin(Cognition)がMongoDB Atlasのライブデータ上で直接作業

8月13日 — CognitionはDevinにMongoDB Atlas統合を追加しました。これによりエージェントは、ライブデータベースを問い合わせて管理できるようになり、タスク実行中に新しいクラスターをプロビジョニングすることも可能です。固定スキーマや手動でコピーされたコンテキストは不要です。狙いは、コードエージェントにありがちな摩擦、つまり人間がテスト用データベースを設定するのを待つ時間をなくすことです。

🔗 Xでの発表

DeepSeek Harness v0.1:DeepSeek初のオープンソース・エージェントハーネス

8月13日 — DeepSeekはDeepSeek Harness v0.1をDeveloper Previewとして公開しました。これはエージェントハーネス(agent harness)であり、コードをMITライセンスの下でオープンソース化することで、世界中の開発者に開放しています。アーキテクチャは社内メタフレームワーク「Cordis」と、すべてがプラグインであるという中心的な考え方に基づいています。モデル、ツール、skills、セッション、サンドボックス、ファイルシステム、実行ループ、オーケストレーション、ユーザーインターフェースのすべてがプラグインです。これは、DeepSeekがエージェント向けツール層に सार्वजनिकに踏み込んだ初の試みであり、これまでClaude CodeやCodex CLIのようなハーネスが占めてきた領域です。

🔗 Xでの発表


オープンモデルと研究:Hugging Faceが次々と新展開

複数の研究機関が相次いでオープンモデルと研究を公開し、Hugging Faceが複数の発表の中心に立っています。

MiniMax-Music3:オープンウェイトの音楽生成モデル

8月13日 — MiniMaxはMiniMax-Music3を公開しました。これは音楽生成モデルの新世代で、今回はオープンウェイトとして提供され、本番運用に対応しているとされています。Hugging Faceによると、このアーキテクチャは80億パラメータのLLMと27億パラメータのDiT(Diffusion Transformer)を組み合わせ、プロンプトと歌詞から完全な楽曲を生成します。一般向けの控えめなGPUでも動くように設計されており、diffusersとComfyUIをサポートしています。MiniMaxは、公開初日にHugging Faceが統合してくれたことに感謝しています。重み、音声デモ、コードはHugging Face、GitHub、ModelScopeで利用できます。

🔗 MiniMaxの発表 · Hugging Faceの確認 · 音声デモ

Sakana Chat:Fugu、Namazu、コード実行を含む大幅アップデート

8月12〜13日 — Sakana AIは、無料でログイン不要の一般向け製品Sakana Chatの大幅アップデートを展開しました。現在はFuguというオーケストレーター・モデルによって駆動され、新世代の自社製日本語LLMであるNamazuが組み合わされています。最大の新機能は完全なコード実行です。ユーザーは、日本語を含め、ブラウザ内でインタラクティブなウェブアプリ、ゲーム、ツールを直接「vibe-coding」できます。Sakanaは2つのユースケースを強調しています。ひとつは復習用の教育ゲーム(数学、漢字)、もうひとつは単一のExcelファイルから始める業務分析です。

🔗 Xでの発表 · ブログ記事

Hugging Face:Strands Agents、LeRobot、ロボットデータループ向けStorage Buckets

8月13日 — Amazon(AWS Strandsチーム)とHugging Faceは共同ブログを公開し、Strands Agents(AWSのApache 2.0 SDK)、LeRobot(Hugging Faceのロボットフレームワークで、データ形式は90,000以上のデータセットとモデルで利用されている)、そしてXetのStorage Bucketsを組み合わせたロボット向けワークフローを説明しています。記事では具体的な数値も示されています。500MBのファイルのバイトを1%変更するだけなら再アップロードは5.5MBで済み、いわゆる「ホット」バケットではローカルコピーなしで約1,086MB/sのストリーミングスループットが出ます。

🔗 Hugging Faceのブログ記事

2,226本のICML 2026論文再現ハッカソンの総括

8月13日 — Hugging Faceは、コミュニティ・ハッカソン(7月15日〜8月2日)の総括を公開した。このイベントでは、1,221人の参加者が、AIエージェントを使ってICML 2026で採択された2,226本の論文の再現に挑戦した。結果は明暗が分かれ、約**51%**の論文で少なくとも1つの主張が独立に検証された一方、**23%**には少なくとも1つの無効化または争点となった主張が含まれていた。強調された結論は、AIエージェントは人間の監督下で最もよく機能し、成功した再現では、人間がエージェントを誘導し、数値指標だけでは捉えられない知覚的な判断を下していたというものだ。

🔗 Hugging Faceの投稿

FineBooks:歴史文書におけるオープンOCRモデルを評価するためのリーダーボード

8月10日 — Hugging FaceとEleutherAIは、FineBooksを公開した。これは、Biodiversity Heritage Library由来の専門家による転写済み2,165ページを用いて、14のオープンOCRモデルを評価するリーダーボードである。目的は、ベンダーのマーケティング発表ではなく、参照用データセットを使って、オープンOCRモデルがデジタル化された歴史資料を実用化できるほど十分に優れているかどうかに答えることだ。

🔗 Xでの発表


GitHub、dependency graphのライセンスデータ品質を改善

8月13日 — GitHubはライセンス情報の主要な取得元を変更した。従来はClearlyDefinedサービスに優先的に依存していたが、これからは依存関係グラフが各パッケージレジストリそのものを直接参照する。対象は npmjs.org、PyPI、crates.io、RubyGems、nuget.org、pkg.go.dev、Maven、pub.dev、さらにPHP向けのPackagistだ。ClearlyDefinedは引き続きフォールバックとして使われる。この変更により、カバレッジは大きく改善し、1億7,000万件のパッケージを対象とした集計で、ライセンスデータがないパッケージの割合は**45%から24%**へ低下した。システムは今後、個々のバージョンごとのエントリを要求するのではなく、バージョン範囲を追跡するため、まだ公開されていない将来のバージョンも自動的にカバーする。関連機能には、依存関係情報、SBOM(ソフトウェア部品表)、GitHub Advanced Securityでのライセンス準拠、依存関係レビューのアクションが含まれる。

🔗 GitHubのChangelog


生成系メディア:統合と規制対応

生成系メディア分野のいくつかの発表が、8月13日に、製品統合と規制対応の両面で交差した。

HeyGen、LiveAvatarにCartesiaをネイティブ統合

8月13日 — HeyGenとCartesiaはネイティブ統合を発表した。Cartesiaのリアルタイム音声エンジンが、HeyGenのリアルタイムアバター製品であるLiveAvatar内で直接動作するようになった。目的は、すでに構築済みの音声エージェントにアニメーションした顔を与えることであり、技術的な再設計なしに、WebアプリまたはAPI経由で利用できる。

🔗 Xでの発表

LumaとDumbstruck、広告向けにCreative Intelligenceを開始

8月13日 — Lumaは、感情分析プラットフォームであるDumbstruckと提携し、「Creative Intelligence」を立ち上げる。Dumbstruckは、視聴者パネルに対する感情分析を通じて、動画広告の中で視聴者の注意が離れる正確な瞬間を特定し、その後Lumaが、既存のラッシュ素材からそれらのシーケンスだけを再生成する。新たな撮影は不要だ。

🔗 Xでの発表

Synthesia、AI Act第50条への準拠を詳説

8月13日 — Synthesiaは、EUのAI Actにおける第50条の行動規範(Code of Practice)に署名した最初期のAI企業の1つとして、透明性の取り組みを詳しく説明した。対象動画には、デフォルトでC2PA(Content Credentials)の来歴シグナルが埋め込まれ、将来的には署名付きダウンロードによって、こうした情報が動画ファイルとともに移動するようになる。さらに、知覚できない透かし(watermarking)の検討や、EUの参照デザインに基づくカスタマイズ可能なAIラベルも進めている。

🔗 全文

Suno Studio 2.0が正式リリース

8月13日 — 8月11日のティーザーの後、Sunoはブラウザ内の音楽制作ワークステーション(DAW)であるStudio 2.0を一般提供として公開した。これはワンクリック生成だけでなく、各トラックを細かく制御できる。Studioではすでに、通常の制限を受けない個別トラック(stems)のダウンロードが可能だ。

🔗 Xでの発表

GeForce NOW:Linuxネイティブアプリがベータ終了、クラウド最適化も実施

8月13日 — NVIDIAは、GeForce NOWのLinuxネイティブアプリをベータ版から正式版へ移行した。Ubuntu 24.04+のサポートと、新しいFlatpakリポジトリが含まれる。性能面では、NVIDIAはサーバー側でDLSS Frame Generationのストリーミング画像生成を最適化し、1440pおよび4Kでの遅延を削減した。また、Chromebook Fast Passプログラムを通じて、Chromebookから2,000以上のPCゲームにアクセスできるようにした。

🔗 NVIDIAの記事


GPT-5.6 のビルダー向けガイド

8月13日 — OpenAIは、GPT-5.6ファミリーにおけるモデル選択について、開発者向けガイドを公開した。BrowseCompベンチマーク(Web上の見つけにくい事実を探すタスク)では、コスト面の改善が明確だ。

評価モデルBrowseCompスコアコスト
GPT-5.5 Extra High(3か月前)84,36 %33,27 $
GPT-5.6 Luna Extra High(公開時)84,04 %1,33 $

言い換えれば、ほぼ同等の性能を25分の1のコストで実現している。OpenAIは、より軽量なモデル(Terra、Luna)は大量処理かつ低遅延が重要なワークフローに使い、最上位モデルSolは最も要求の厳しいタスクに充てることを推奨している。このガイドでは、Responses APIの3つの新機能も詳述されている。すなわち、呼び出し間での推論の永続化とネイティブな圧縮の組み合わせ、ネイティブなマルチエージェント・オーケストレーション、そして、決定的な処理をモデルではなくコード側へ移すためのプログラム的なツール呼び出しだ。

🔗 The builder’s guide to GPT-5.6


Grok 4.6の展開継続:Perplexity、Warp、Genspark

xAIのモデルGrok 4.6は、8月12日に発表されたばかりだが、8月13日にはサードパーティのツールへと引き続き広がった。1日で3件の独立した統合が行われたことになる。

8月13日Perplexityは、Perplexity本体および自社のエージェント層であるPerplexity Computerで利用可能なモデルとしてGrok 4.6を追加した。社内ベンチマークWANDRでは、PerplexityはGrok 4.6が性能と効率のパレート境界上にあり、Fable 5と同等の結果を60%以上低いコストで達成していると主張している。

Grok 4.6 is now available in Perplexity and Perplexity Computer. On WANDR, it sits on the Pareto frontier of performance and efficiency, matching Fable 5 results at over 60% lower cost.

🇯🇵 Grok 4.6は、現在PerplexityとPerplexity Computerで利用可能です。WANDRでは、性能と効率のパレート境界上に位置し、Fable 5と同等の結果を60%以上低いコストで実現しています。@perplexity_ai on X

Warpは、既存の /connect-grok コマンドを通じてGrok 4.6のサポートを追加し、X PremiumまたはSuperGrokのサブスクリプションで接続できるようにした。🔗 Warpの発表

Gensparkは、AI Chat、Code Agent、Genspark ClawでGrok 4.6を利用可能にした。モデルセレクタから直接アクセスできる。🔗 Gensparkの発表


Perplexity Computer:より速く、より信頼性の高いSearch as Code

8月13日 — Perplexityは、6月に発表した大規模かつ深掘り型の検索機能であるSearch as Code (SaC) の最適化を詳述した。これにより、結果品質を維持したまま、タスクあたりのコストを約**10%削減した。Search SDKの2回にわたる更新で、アクション実行の信頼性は81.9%から92.6%へ向上し、その結果、ユーザー満足度は高まり、Perplexity Computerでのタスクあたりコストは8%**削減された。

🔗 全文スレッド


速報

  • Amp — 小規模な改善(GLM-5.2の高速モード、メディアキャッシュ、音声入力、テーマ) — AmpのLowモード(GLM-5.2)に、約200 tokens/秒の高速モードが追加され、エージェントが生成したメディアは即時読み込みのためにキャッシュされ、新しい音声入力とテーマのオプションも登場した。🔗 Tweet
  • DeepSeek、API料金をピーク/オフピーク制に更新 — オフピーク料金はピーク料金より50%安くなり、2026年8月16日 16:00 UTCに有効になる。🔗 Tweet
  • TRL、非同期GRPOトレーナーを追加し、2〜4倍高速化 — Hugging Faceのライブラリは、進行中のGRPO学習をこの新しい非同期トレーナーへ移行することを推奨している。🔗 Tweet
  • Gradio 6.24、アプリの実行を自動保存して再生 — 実行履歴はブラウザ内に保持され、サーバーのキューを再び通さずに再生できる。🔗 Tweet
  • Hugging Face Science、選定モデルにデモ用Spacesを追加 — 注目のモデル、データセット、論文を、そのページだけでなく直接試せるようになった。🔗 Tweet
  • Gemini Omni:3人のDeepMindの専門家がモデルの舞台裏を語る — 生成と動画編集の創造的な例を通じて、Gemini Omni Flashの汎用性を示す「舞台裏」形式の紹介。🔗 Googleの投稿
  • GitHubガイド:Copilotアプリで最初のプロンプトを書く — 初めての指示の書き方、コンテキストとモデルの選び方、別のデバイスからセッションを再開する方法に関する実践ガイド。🔗 GitHubガイド
  • Grok Imagine Image 2.0がRunwayで利用可能に — xAIの画像モデルが、同プラットフォームにすでに統合されている画像・動画モデルのカタログに加わった。🔗 Tweet
  • NVIDIA、300以上のスキルをCursorに公開 — Cursorのエージェントは、NVIDIAの30以上の製品をカバーする300以上のスキルにアクセスできるようになった。🔗 Tweet
  • MiniMax H3、Video Edit Arenaで首位を主張 — 手法の詳細は公開されていないが、総合ランキングでの1位だとしている。🔗 Tweet
  • Runway、9月30日のSF Summit登壇者を発表 — Physical Intelligence、NVIDIA、Anyscale、Google DeepMind、CoreWeaveの関係者が、発表済みの登壇者リストに加わる。🔗 Tweet
  • OpenAI、Dali RajicをChief Revenue Officerに任命 — WizとZscalerの元社長兼COOが、グローバル収益組織のトップとしてDenise Dresserの後任となる。🔗 OpenAIの発表
  • RingCentral、AIネイティブ開発のためにChatGPT WorkとCodexを展開 — 「AI-Native Challenge」により、非技術職を含む全従業員にChatGPT WorkとCodexを配布し、完全なプロジェクトを納品させた。🔗 OpenAIの事例

これが意味すること

推論の速度とコストをめぐる競争が、この日のニュースのかなりの部分を形作っている。OpenAIのUltrafastは、専用のCerebrasハードウェアによって最先端モデルに標準比最大14倍の速度を約束する一方、GoogleはGemini 3.7 Flashのエントリー価格を半分にして本番導入を加速し、DeepSeekは商用公開当日にV4-ProをMITライセンスのオープンウェイトとして公開した。これら3つの異なる戦略——特殊なハードウェア加速、強気の価格設定、完全な重み公開——はいずれも、大規模運用において最先端推論をより安く、より速くするという同じ目標に収束しているが、それぞれがモデルの大きさ競争だけではない別々のレバーに賭けている。

AI支援の開発ツールは、より深く、より相互接続されたインフラ層へと収束している。CursorはBuildsでエージェント環境を事前構築し、Firetigerのチームを迎えてコードを本番環境まで追跡し、DevinはMongoDB Atlasを通じてライブデータベースに直接アクセスできるようになり、DeepSeekは交換可能なプラグインを中心に構築された独自のオープンソース・エージェント・ハーネスを公開した。Anthropicは一方で、Claudeのセッションを端末から切り離し、ユーザーアカウントにひも付けている。共通点は明らかだ。これらのツールは、もはや単なる孤立したアシスタントではなく、実行環境、セッション間の継続性、データへのアクセスがコード生成そのものと同じくらい重要なインフラ層になりつつある。

オープンな研究エコシステムは、広がりと同時に深さも増している。Hugging Faceは8月13日に、構造化された取り組みを次々と打ち出した。Strands AgentsとLeRobotを組み合わせたロボティクスのワークフローと、定量化されたスループット向上、ICMLの2,226本の論文再現ハッカソンの率直な総括——調査対象の23%の論文に無効化された主張が含まれており、純粋な自動監督の限界を思い出させる——、そしてアーカイブ用途の実用性を狙ったOCRリーダーボード(FineBooks)だ。これに加えて、音楽向けのMiniMax-Music3のような高度に特化したオープンモデルや、日本語でのvibe-coding向けに更新されたSakana Chatもある。オープン性はもはや一般的な言語モデルに限らず、個別のニッチ分野全体へ広がっている。

最後に、業界はルールをただ受け入れるのではなく、ますます自ら交渉するようになっている。SynthesiaはC2PAの来歴シグナルをデフォルトで備えた形でAI Act第50条への準拠を詳細に示し、GitHubはパッケージレジストリを直接参照することでライセンスデータの信頼性を高め、Grok 4.6は3つの異なる統合先(Perplexity、Warp、Genspark)に同日に広がったが、どの企業もそれを独占にしようとはしていない。この急速な標準化——数日でほぼどこでも使えるモデル、受け身ではなく先回りする規制——は、配布とガバナンスの実務を、その技術能力の進化と同じ速度で成熟させつつある業界の姿を描いている。


ソース