Zoeken

DeepSeek-V4-Pro publiceert zijn open weights, Gemini 3.7 Flash komt eraan, GPT-5.6 Sol versnelt met Ultrafast

Artikel gegenereerd door kunstmatige intelligentie
DeepSeek-V4-Pro publiceert zijn open weights, Gemini 3.7 Flash komt eraan, GPT-5.6 Sol versnelt met Ultrafast

ai-powered-markdown-translator

Artikel vertaald van het fr naar het nl met gpt-5.4-mini.

Bekijk project op GitHub ↗

Op 13 augustus 2026 lanceert DeepSeek zijn vlaggenschipmodel DeepSeek-V4-Pro, dat op dezelfde dag als de aankondiging als open weights onder MIT-licentie wordt uitgebracht, terwijl Google Gemini 3.7 Flash onthult, zijn nieuwe dagelijkse werkpaard (workhorse) voor code en agents — vandaag ook beschikbaar in GitHub Copilot. OpenAI toont op zijn beurt Ultrafast, een servicelaag die GPT-5.6 Sol tot 14 keer sneller laat draaien dankzij hardware van Cerebras. Ook op het menu: Anthropic synchroniseert Claude-sessies tussen apparaten, Cursor versnelt zijn cloudagents met Builds, Grok 4.6 zet zijn uitrol voort bij Perplexity, Warp en Genspark, en Hugging Face vermenigvuldigt zijn publicaties van modellen en open onderzoeken.


DeepSeek-V4-Pro: lancering van het vlaggenschipmodel, open weights op Hugging Face

13 augustus — DeepSeek lanceert zijn vlaggenschipmodel DeepSeek-V4-Pro, onmiddellijk beschikbaar in de app, op het web (via de « Expertmodus ») en via de API, waarbij de modelnamen in de documentatie ongewijzigd blijven. De aankondiging benadrukt grote verbeteringen aan de agentkant, met een nu instelbare redeneerinspanning voor V4-Pro en voor de lichtere versie V4-Flash.

InspanningsniveauAanbevolen gebruik
LaagEenvoudige taken
HoogDagelijkse agentische workflows
MaximaalComplexe taken

Nog een technische nieuwigheid: native ondersteuning voor de OpenAI Responses API, geoptimaliseerd voor Codex met éénklikconfiguratie — een signaal dat DeepSeek direct mikt op het ecosysteem van agentische code-tools rond het OpenAI-formaat in plaats van een eigen geïsoleerde API aan te bieden.

Hugging Face-onderzoeker Elie Bakouch bevestigt dat V4-Pro ook als open weights op Hugging Face is uitgebracht, onder MIT-licentie. Hij nuanceert echter de benaming « V4 »: de vorige versie was slechts een preview, terwijl deze veel meer training heeft gekregen — volgens hem lijkt het « meer op een V4.5 ». Deze lancering past in een drukke dag voor DeepSeek, dat op dezelfde dag een herziening van zijn API-prijsstelling en zijn eerste open-source agent-harnas, DeepSeek Harness, publiceert (zie hieronder) — een samenhangend geheel dat het bedrijf opnieuw positioneert als een volwaardige speler in het agentische ecosysteem, niet alleen als modellenleverancier.

We’re launching DeepSeek-V4-Pro today! Major Agent upgrades with strong production gains! Flexible reasoning effort for V4-Pro & V4-Flash: low for simple tasks, high for daily Agent workflows, max for complex tasks. Native OpenAI Responses API support, optimized for Codex with one-click setup.

🇳🇱 We lanceren DeepSeek-V4-Pro vandaag! Grote verbeteringen aan de agentkant, met sterke productiviteitswinsten! Flexibele redeneerinspanning voor V4-Pro en V4-Flash: laag voor eenvoudige taken, hoog voor dagelijkse agentische workflows, maximaal voor complexe taken. Native ondersteuning voor de OpenAI Responses API, geoptimaliseerd voor Codex met éénklikconfiguratie.@deepseek_ai op X

🔗 Bevestiging van open weights en MIT-licentie


Gemini 3.7 Flash: nieuw dagelijkse-werkpaardmodel (workhorse) voor code en agents

13 augustus — Google lanceert Gemini 3.7 Flash, gepresenteerd als zijn slimste dagelijkse werkpaardmodel (workhorse) tot nu toe voor code en agents, slechts drie weken na Gemini 3.6 Flash. Het model richt zich op drie hoofdtoepassingen: software-engineering, webontwikkeling en complex kenniswerk (documentanalyse, bedrijfsworkflows).

BenchmarkBeoordeeld domein3.6 Flash3.7 Flash
FrontierCode 1.1 MainKwaliteit van geproduceerde code34,4 %43,6 %
DeepSWE v1.1Software-engineering (debugging)49,0 %65,3 %
WebDev ArenaWebontwikkeling (Elo-score)15381588
GDP.pdfDocumentbegrip22,0 %34,0 %
AutomationBenchGeautomatiseerde bedrijfsworkflows17,0 %30,4 %

Op het vlak van prijsstelling profiteert Gemini 3.7 Flash van een introductietarief tot en met 31 december 2026, voor de helft van de prijs van 3.6 Flash: $0,75 per miljoen tokens in input en $3,75 per miljoen in output (tegenover $1,50 en $7,50 in standaardtarief vanaf januari 2027). Het model is vanaf vandaag beschikbaar in Google Antigravity, via de Gemini API in Google AI Studio en Android Studio, in Gemini Enterprise Agent, en in Gemini Spark — de proactieve persoonlijke assistent voor Google AI Pro- en Ultra-abonnees in meer dan 160 landen. Google vermeldt ook dat het de veiligheidsrails van het model heeft versterkt tegen kwaadwillig gebruik op chemisch, biologisch, radiologisch en nucleair gebied, evenals tegen offensieve cyberbeveiligingscapaciteiten.

Op dezelfde dag wordt Gemini 3.7 Flash ook uitgerold in GitHub Copilot: volgens GitHub tonen de eerste tests vooruitgang in web- en applicatieontwikkeling en in agentische codering ten opzichte van de vorige versie. De uitrol geldt voor de abonnementen Copilot Pro, Pro+, Max, Business en Enterprise, toegankelijk via de modelkiezer in VS Code, Visual Studio, Copilot CLI, de Copilot cloudagent, de Copilot-app, JetBrains, Xcode en Eclipse. Voor de Enterprise- en Business-abonnementen moeten beheerders het beleid « Gemini 3.7 Flash Preview » inschakelen voordat leden van de organisatie toegang krijgen; de facturatie volgt de tarieven van de leverancier binnen het pay-as-you-go-gebruik.

Today we’re introducing Gemini 3.7 Flash, our most intelligent workhorse model yet for coding and agents. This model brings substantial gains across software engineering, web development, and complex knowledge work.

🇳🇱 Vandaag presenteren we Gemini 3.7 Flash, ons slimste dagelijkse werkpaardmodel (workhorse) tot nu toe voor code en agents. Dit model levert aanzienlijke verbeteringen op het gebied van software-engineering, webontwikkeling en complex kenniswerk.@Google op X

🔗 Officiële Google-aankondiging · GitHub Copilot-changelog


Ultrafast: GPT-5.6 Sol tot 14x sneller, aangedreven door Cerebras

13 augustus — OpenAI onthult Ultrafast, een nieuwe servicelaag voor de API die GPT-5.6 Sol tot 14 keer sneller laat draaien dan standaardverwerking. Aangedreven door Cerebras-hardware haalt deze modus tot 750 gegenereerde tokens per seconde. Tot nu toe vereiste realtime-snelheid de keuze voor een kleiner of gespecialiseerd model ten koste van intelligentie; Ultrafast verandert die vergelijking door meer nuttig werk per seconde na te streven zonder de capaciteiten van OpenAI’s meest geavanceerde model op te offeren.

KenmerkDetail
ModelGPT-5.6 Sol
SnelheidTot 14 keer de standaardverwerking
DoorvoerTot 750 outputtokens per seconde
HardwarepartnerCerebras
BeschikbaarheidPreview, OpenAI API, toegang op uitnodiging

OpenAI noemt verschillende scenario’s waarin deze snelheid nieuwe toepassingen mogelijk maakt: incident response (logs, recente codewijzigingen en rapporten van ingenieurs analyseren terwijl een incident nog bezig is), financieel onderzoek (marktsignalen en transacties in realtime analyseren), spraakgestuurde klantenondersteuning (complexe problemen oplossen zonder het gesprek te onderbreken), commerce (vragen over producten beantwoorden vóór het winkelmandje wordt verlaten) en experimenteel onderzoek (een berekening die voorheen een nacht duurde omzetten in een interactieve sessie). Een eerste groep klanten test GPT-5.6 Sol al in Ultrafast-modus op code-, commerce-, financieel onderzoeks- en supportuse-cases, in echte productieomstandigheden. OpenAI geeft aan Ultrafast intern te gebruiken, onder meer voor incident response.

De toegang blijft voorlopig beperkt tot een kleine groep klanten via de API, met een inschrijfformulier om op de hoogte te worden gebracht naarmate de capaciteit zich uitbreidt naar meer bedrijven.

Previewing Ultrafast mode: GPT-5.6 Sol at up to 14x the speed. Launching first in the OpenAI API to a select group of customers with expanded access to more businesses as capacity grows.

🇳🇱 Voorvertoning van de Ultrafast-modus: GPT-5.6 Sol tot 14 keer de snelheid. Eerst gelanceerd in de OpenAI API bij een beperkte groep klanten, met bredere toegang voor meer bedrijven naarmate de capaciteit toeneemt.@OpenAI op X

🔗 Previewing Ultrafast — officiële aankondiging


Claude breidt continuïteit tussen apparaten uit

Anthropic zet op dezelfde dag twee aankondigingen neer die dezelfde richting uitgaan: een Claude-sessie die nu de gebruiker volgt in plaats van het apparaat.

Claude in Chrome — gesynchroniseerde sessies op desktop, web en mobiel

12 augustus — De sessies van Claude in Chrome, de browserextensie van Anthropic, zijn niet langer beperkt tot het apparaat waarop ze zijn geopend. Gesprekken worden nu opgeslagen en verschijnen automatisch op desktop, web en mobiel, met de skills en connectors van de gebruiker die rechtstreeks beschikbaar blijven in de browser. De functie is vanaf vandaag beschikbaar voor de abonnementen Max en Team, met een uitrol naar Pro-abonnees gepland voor de komende weken.

🔗 Aankondiging op X

Claude Cowork — het zijpaneel deelt de sessie met desktop, web en mobiel

12 augustus — Het zijpaneel (side panel) van Claude Cowork voert nu dezelfde sessie uit als de desktop-, web- en mobiele apps. Sessies zijn gekoppeld aan het gebruikersaccount in plaats van aan één enkel apparaat, waardoor een taak in een browsertabblad kan worden gestart en later vanaf een ander apparaat kan worden hervat, zonder contextverlies.

🔗 Aankondiging op X


Agentische ontwikkeltools: Cursor, Devin en DeepSeek gaan vooruit

Verschillende door AI ondersteunde ontwikkelingstools boeken op 13 augustus parallel vooruitgang, tussen agentinfrastructuur, strategische werving en directe toegang tot live data.

Cursor lanceert Builds — cloudagents tot 3 keer sneller bij de eerste token

13 augustus — Cursor introduceert de builds: vooraf voorbereide kopieën van de ontwikkelomgeving (gekloneerde repository, geïnstalleerde afhankelijkheden, installatiescript al uitgevoerd) die cloudagents direct opstarten. Cursor meldt intern een 10 keer snellere omgevingsstart, met een 3 keer snellere tijd tot de eerste token. Het systeem blijft veerkrachtig: als een build mislukt, blijven agents werken met de laatst functionerende build terwijl de fout op de achtergrond wordt opgelost. De functie is inbegrepen in Cloud Agents zonder extra kosten.

🔗 Cursor-changelog

Cursor verwelkomt het Firetiger-team

13 augustus — Cursor kondigt de komst van het Firetiger-team aan, met als doel agents te bouwen die hun code tot in productie kunnen volgen en kunnen repareren wat niet werkt — een logische voortzetting van de aankondiging van vandaag over Builds: Cursor wil de volledige levenscyclus afdekken, van ontwikkeling tot monitoring in productie. Er worden geen financiële details bekendgemaakt.

🔗 Aankondiging op X

Devin (Cognition) werkt rechtstreeks op de live data van MongoDB Atlas

13 augustus — Cognition voegt een MongoDB Atlas-integratie toe aan Devin: de agent kan nu een live database bevragen en beheren, en tijdens een taak een nieuwe cluster provisioneren, zonder vast schema of handmatig gekopieerde context. Het doel is een veelvoorkomende frictie bij code-agents weg te nemen — het wachten tot een mens een testdatabase configureert.

🔗 Aankondiging op X

DeepSeek Harness v0.1: eerste open-source agent-harnas van DeepSeek

13 augustus — DeepSeek publiceert DeepSeek Harness v0.1 in Developer Preview, een agent-harnas (agent harness) dat het wereldwijd openstelt voor ontwikkelaars door de code open source te maken onder MIT-licentie. De architectuur is gebaseerd op het interne meta-framework « Cordis » en op één centraal idee: alles is een plugin — modellen, tools, skills, sessies, sandboxes, bestandssystemen, uitvoeringslussen, orkestratie en gebruikersinterface. Dit is DeepSeek’s eerste publieke stap in de toolinglaag voor agents, een terrein dat tot nu toe werd bezet door harnassen zoals Claude Code of Codex CLI.

🔗 Aankondiging op X


Open modellen en onderzoek: Hugging Face stapelt de initiatieven op

Verschillende laboratoria publiceren kort na elkaar open modellen en studies, met Hugging Face centraal bij meerdere aankondigingen.

MiniMax-Music3: model voor muziekgeneratie met open weights

13 augustus — MiniMax publiceert MiniMax-Music3, de nieuwe generatie van zijn muziekgeneratiemodel, dit keer met open weights en gepresenteerd als productie-klaar. Volgens Hugging Face combineert de architectuur een LLM met 8 miljard parameters en een DiT (Diffusion Transformer) met 2,7 miljard parameters om een prompt en songtekst om te zetten in een compleet nummer, gedimensioneerd om te draaien op bescheiden consument-GPU’s, met ondersteuning voor de bibliotheken diffusers en ComfyUI. MiniMax bedankt het Hugging Face-team voor de integratie op de dag van de release; de weights, een audio-demo en de code zijn beschikbaar op Hugging Face, GitHub en ModelScope.

🔗 MiniMax-aankondiging · Bevestiging van Hugging Face · Audio-demo

Sakana Chat: grote update met Fugu, Namazu en code-uitvoering

12-13 augustus — Sakana AI voert een grote update uit voor Sakana Chat, zijn gratis consumentenproduct zonder inlogvereiste, nu aangedreven door Fugu, zijn orkestratiemodel, gecombineerd met een nieuwe generatie Namazu, zijn eigen Japanse LLM. De grote nieuwigheid is volledige code-uitvoering: gebruikers kunnen interactieve webapps, games en tools direct in de browser « vibe-coden », ook in het Japans. Sakana benadrukt twee use-cases: educatieve herhalingsgames (wiskunde, kanji) en bedrijfsanalyse op basis van slechts één Excel-bestand.

🔗 Aankondiging op X · Blogpost

Hugging Face: Strands Agents, LeRobot en Storage Buckets voor de robotica-datalus

13 augustus — Amazon (AWS Strands-team) en Hugging Face publiceren een gezamenlijk artikel waarin een robotica-workflow wordt beschreven die Strands Agents (AWS SDK onder Apache 2.0), LeRobot (robotic framework van Hugging Face, waarvan het dataformaat wordt gebruikt door meer dan 90.000 datasets en modellen) en Storage Buckets van Xet combineert. Het artikel geeft concrete cijfers: het wijzigen van 1 % van de bytes in een bestand van 500 MB vereist slechts 5,5 MB opnieuw uploaden, en een « warme » bucket haalt ongeveer 1 086 Mo/s streamingdoorvoer zonder lokale kopie.

🔗 Hugging Face-artikel

Terugblik op de reproductie-hackathon van 2.226 ICML 2026-papers

13 augustus — Hugging Face publiceert het verslag van zijn community-hackathon (15 juli – 2 augustus), waarin 1.221 deelnemers probeerden 2.226 papers te reproduceren die op ICML 2026 waren geaccepteerd, met behulp van AI-agenten. Het resultaat was gemengd: ongeveer 51 % van de papers had minstens één onafhankelijk geverifieerde bewering, maar 23 % bevatte minstens één ontkrachte of betwiste bewering. De nadruk ligt op de conclusie dat AI-agenten het best presteren onder menselijke supervisie, waarbij geslaagde reproducties menselijke betrokkenheid vereisten om de agenten te sturen en perceptuele oordelen te vellen die met alleen metrics niet konden worden vastgelegd.

🔗 Hugging Face-blogbericht

FineBooks: leaderboard om open OCR-modellen op historische documenten te evalueren

10 augustus — Hugging Face en EleutherAI publiceren FineBooks, een leaderboard dat 14 open OCR-modellen evalueert op 2.165 pagina’s die door experts zijn getranscribeerd en afkomstig zijn uit de Biodiversity Heritage Library. Het doel: beantwoorden of open OCR-modellen goed genoeg zijn om gedigitaliseerde historische archieven bruikbaar te maken, met een referentiedataset in plaats van marketingaankondigingen van leveranciers.

🔗 Aankondiging op X


GitHub verbetert de kwaliteit van de licentiegegevens van de dependency graph

13 augustus — GitHub verandert zijn primaire bron voor licentie-informatie: in plaats van in de eerste plaats te vertrouwen op de ClearlyDefined-dienst, raadpleegt de dependency graph voortaan rechtstreeks de pakketregisters zelf — npmjs.org, PyPI, crates.io, RubyGems, nuget.org, pkg.go.dev, Maven en pub.dev, evenals Packagist voor PHP. ClearlyDefined blijft als fallback in gebruik. Deze wijziging verbetert de dekking aanzienlijk: het aandeel pakketten zonder licentiegegevens daalt van 45 % naar 24 % op een set van 170 miljoen pakketten. Het systeem volgt nu versiebereiken in plaats van te eisen dat er voor elke individuele versie een vermelding bestaat, waardoor toekomstige, nog niet gepubliceerde versies automatisch worden gedekt. De betrokken functies omvatten afhankelijkheidsinformatie, software bill of materials (SBOM), licentiecompliance in GitHub Advanced Security en code review-acties voor afhankelijkheden.

🔗 GitHub-changelog


Media-generatie: integraties en naleving van regelgeving

Meerdere aankondigingen uit de generatieve mediasector komen op deze 13 augustus samen, tussen productintegraties en naleving van regelgeving.

HeyGen integreert Cartesia native in LiveAvatar

13 augustus — HeyGen en Cartesia kondigen een native integratie aan: de realtime stemengine van Cartesia draait nu rechtstreeks in LiveAvatar, HeyGens realtime avatarproduct. Het doel is om een bestaande spraakagent een geanimeerd gezicht te geven, zonder technische herbouw, toegankelijk via de webapp of de API.

🔗 Aankondiging op X

Luma en Dumbstruck lanceren Creative Intelligence voor reclame

13 augustus — Luma werkt samen met Dumbstruck, een platform voor emotionele analyse, om “Creative Intelligence” te creëren: Dumbstruck identificeert via emotieanalyse op panels van kijkers de precieze momenten in een videoreclame waarop de aandacht van het publiek verslapt, waarna Luma alleen die sequenties regenereert op basis van de bestaande opnames, zonder nieuwe opnames.

🔗 Aankondiging op X

Synthesia licht zijn naleving van Artikel 50 van de AI Act toe

13 augustus — Synthesia, een van de eerste AI-bedrijven die het Code of Practice van Artikel 50 van de Europese AI Act heeft ondertekend, licht zijn transparantiemaatregelen toe: C2PA-herkomstsignalen (Content Credentials) die standaard zijn ingebouwd in in aanmerking komende video’s, binnenkort ondertekende downloads zodat deze informatie met het videobestand meereist, verkenning van een onzichtbare watermerkoplossing (watermarking), en aanpasbare AI-labels gebaseerd op het referentieontwerp van de EU.

🔗 Volledig bericht

Suno Studio 2.0 is officieel gelanceerd

13 augustus — Na een teaser op 11 augustus lanceert Suno in algemene beschikbaarheid Studio 2.0, zijn muziekproductiewerkstation (DAW) in de browser, dat fijne controle over elke track biedt in plaats van alleen generatie met één klik. Studio biedt al downloads van afzonderlijke sporen (stems) aan die vrijgesteld zijn van de gebruikelijke beperkingen.

🔗 Aankondiging op X

GeForce NOW: native Linux-app uit bèta en cloudoptimalisaties

13 augustus — NVIDIA brengt de native Linux-app van GeForce NOW uit de bèta, met ondersteuning voor Ubuntu 24.04+ en een nieuwe Flatpak-repository. Qua prestaties optimaliseert NVIDIA aan serverzijde de generatie van DLSS Frame Generation-beelden tijdens streaming om de latentie in 1440p en 4K te verlagen, en geeft het toegang tot meer dan 2.000 pc-games vanaf Chromebooks via het Chromebook Fast Pass-programma.

🔗 NVIDIA-artikel


De buildersgids voor GPT-5.6

13 augustus — OpenAI publiceert een gids voor ontwikkelaars over modelkeuze binnen de GPT-5.6-familie. Op de BrowseComp-benchmark (zoeken naar obscure feiten op het web) is de kostenwinst duidelijk:

Geëvalueerd modelBrowseComp-scoreKosten
GPT-5.5 Extra High (3 maanden geleden)84,36 %33,27 $
GPT-5.6 Luna Extra High (bij lancering)84,04 %1,33 $

Met andere woorden: een bijna identieke prestatie voor een 25 keer lagere kostprijs. OpenAI adviseert de lichtere modellen (Terra, Luna) te reserveren voor workflows met groot volume en latentiegevoeligheid, en het vlaggenschipmodel Sol voor de meest veeleisende taken. De gids beschrijft ook drie nieuwigheden in de Responses API: het behouden van redenering tussen aanroepen in combinatie met native compacting, native multi-agent-orchestratie, en programmatische tool-aanroepen om deterministisch werk naar code te verplaatsen in plaats van naar het model.

🔗 De buildersgids voor GPT-5.6


Grok 4.6 zet zijn uitrol voort: Perplexity, Warp en Genspark

Het Grok 4.6-model van xAI, gelanceerd op 12 augustus, blijft zich op 13 augustus verspreiden in tools van derden — drie afzonderlijke integraties in één enkele dag.

13 augustusPerplexity voegt Grok 4.6 toe als beschikbaar model in Perplexity en in Perplexity Computer, zijn agentlaag. Op zijn interne benchmark WANDR stelt Perplexity dat Grok 4.6 zich op de Pareto-frontier tussen prestaties en efficiëntie bevindt, met resultaten die gelijkwaardig zijn aan Fable 5 voor een kostprijs die meer dan 60 % lager ligt.

Grok 4.6 is now available in Perplexity and Perplexity Computer. On WANDR, it sits on the Pareto frontier of performance and efficiency, matching Fable 5 results at over 60% lower cost.

🇳🇱 Grok 4.6 is nu beschikbaar in Perplexity en Perplexity Computer. Op WANDR bevindt het zich op de Pareto-frontier tussen prestaties en efficiëntie, met resultaten die gelijkwaardig zijn aan Fable 5 voor een kostprijs die meer dan 60 % lager ligt.@perplexity_ai op X

Warp voegt ondersteuning voor Grok 4.6 toe via de bestaande opdracht /connect-grok, met verbinding via een X Premium- of SuperGrok-abonnement. 🔗 Aankondiging Warp

Genspark maakt Grok 4.6 beschikbaar in AI Chat, Code Agent en Genspark Claw, rechtstreeks toegankelijk via de modelkiezer. 🔗 Aankondiging Genspark


Perplexity Computer: Search as Code sneller en betrouwbaarder

13 augustus — Perplexity licht optimalisaties toe voor Search as Code (SaC), zijn brede en diepgaande zoekfunctionaliteit die in juni werd gelanceerd, en verlaagt de kost per taak met bijna 10 % terwijl de kwaliteit van de resultaten behouden blijft. Twee rondes updates voor de Search SDK verhogen de betrouwbaarheid van actieverwerking van 81,9 % naar 92,6 %, met als resultaat een hogere gebruikerstevredenheid en een daling van de kost per taak met 8 % in Perplexity Computer.

🔗 Volledige thread


Kort nieuws

  • Amp — kleine verbeteringen (snelle modus GLM-5.2, mediacache, dicteren, thema’s) — de Low-modus van Amp (GLM-5.2) krijgt een snelle modus van ongeveer 200 tokens/seconde, door de agent gegenereerde media worden gecachet voor direct laden, en er verschijnen nieuwe dicteer- en thema-opties. 🔗 Tweet
  • DeepSeek werkt zijn API-prijzen bij met piek-/daluren-tarieven — daluren-tarieven zullen 50 % lager liggen dan piekuren-tarieven, van kracht op 16 augustus 2026 om 16:00 UTC. 🔗 Tweet
  • TRL voegt een asynchrone GRPO-trainer toe, 2 tot 4x sneller — de Hugging Face-bibliotheek raadt aan om lopende GRPO-trainingen te migreren naar deze nieuwe asynchrone trainer. 🔗 Tweet
  • Gradio 6.24 slaat app-uitvoeringen automatisch op en speelt ze opnieuw af — de uitvoeringsgeschiedenis wordt in de browser bewaard, met de mogelijkheid om ze opnieuw af te spelen zonder opnieuw door de serverwachtrij te gaan. 🔗 Tweet
  • Hugging Face Science voegt demo-Spaces toe aan geselecteerde modellen — uitgelichte modellen, datasets en papers worden rechtstreeks testbaar, zonder alleen via hun pagina te hoeven gaan. 🔗 Tweet
  • Gemini Omni: drie DeepMind-experts vertellen over de achtergrond van het model — een “achter de schermen”-format dat de veelzijdigheid van Gemini Omni Flash illustreert aan de hand van creatieve voorbeelden van video-generatie en -bewerking. 🔗 Google-bericht
  • GitHub-gids: je eerste prompt schrijven in de Copilot-app — een praktische gids over het schrijven van een eerste prompt, het kiezen van context en model, en het hervatten van een sessie vanaf een ander apparaat. 🔗 GitHub-gids
  • Grok Imagine Image 2.0 beschikbaar op Runway — het beeldmodel van xAI voegt zich bij de catalogus van reeds geïntegreerde beeld- en videomodellen op het platform. 🔗 Tweet
  • NVIDIA opent meer dan 300 skills voor Cursor — Cursor-agenten kunnen nu toegang krijgen tot meer dan 300 skills die meer dan 30 NVIDIA-producten bestrijken. 🔗 Tweet
  • MiniMax H3 claimt de eerste plaats in Video Edit Arena — een algehele ranking, zonder gedeelde methodologische details. 🔗 Tweet
  • Runway onthult de sprekers voor zijn SF Summit op 30 september — vertegenwoordigers van Physical Intelligence, NVIDIA, Anyscale, Google DeepMind en CoreWeave sluiten zich aan bij de lijst van aangekondigde sprekers. 🔗 Tweet
  • OpenAI benoemt Dali Rajic tot Chief Revenue Officer — de voormalige president en COO van Wiz en Zscaler volgt Denise Dresser op aan het hoofd van de wereldwijde revenue-organisatie. 🔗 OpenAI-aankondiging
  • RingCentral rolt ChatGPT Work en Codex uit voor AI-native ontwikkeling — een “AI-Native Challenge” gaf ChatGPT Work en Codex aan alle werknemers, inclusief niet-technische, om een volledig project op te leveren. 🔗 OpenAI-studie

Wat dit betekent

De race om inferentiesnelheid en -kosten structureert een groot deel van deze dag. OpenAI’s Ultrafast belooft tot 14 keer de standaardsnelheid voor zijn meest geavanceerde model dankzij speciale Cerebras-hardware, terwijl Google de instapprijs van Gemini 3.7 Flash halveert om de productieadoptie te versnellen, en DeepSeek V4-Pro in open gewichten publiceert onder een MIT-licentie op dezelfde dag van zijn commerciële lancering. Drie verschillende strategieën — gespecialiseerde hardwareversnelling, agressieve prijsstelling, volledige openheid van de gewichten — convergeren naar hetzelfde doel: toonaangevende inferentie goedkoper en sneller maken op schaal, elk vertrouwend op een andere hefboom in plaats van alleen op de wedloop naar modelgrootte.

AI-ondersteunde ontwikkeltools bewegen zich richting diepere en meer onderling verbonden infrastructuurlagen. Cursor bereidt agentomgevingen vooraf voor met de Builds en werft het Firetiger-team in om code tot in productie te volgen, Devin krijgt directe toegang tot live databases via MongoDB Atlas, en DeepSeek publiceert zijn eigen open-source agent-harnas dat volledig is opgebouwd rond verwisselbare plugins. Anthropic koppelt op zijn beurt Claude-sessies los van het apparaat en koppelt ze aan het gebruikersaccount. De gemene deler: deze tools houden op louter losse assistenten te zijn en worden infrastructuurlagen waar de runtime-omgeving, sessiecontinuïteit en gegevenstoegang net zo belangrijk zijn als het genereren van code zelf.

Het ecosysteem van open onderzoek wordt zowel dieper als breder. Hugging Face zet op 13 augustus meerdere structurele initiatieven neer: een robotische workflow die Strands Agents en LeRobot combineert met gekwantificeerde doorvoergroei, een eerlijke terugblik op de reproductie-hackathon van 2.226 ICML-papers — waarbij 23 % van de onderzochte papers een ontkrachte bewering bevatte, wat de grenzen van louter geautomatiseerde supervisie onderstreept — en een OCR-leaderboard (FineBooks) dat is ontworpen voor concrete archiveringsgebruiksscenario’s in plaats van marketing. Daarbij komen sterk gespecialiseerde open modellen zoals MiniMax-Music3 voor muziek of de update van Sakana Chat voor vibe-coding in het Japans: openheid beperkt zich niet langer tot algemene taalmodellen, maar strekt zich uit tot volledige niches.

Tot slot onderhandelt de industrie steeds vaker over haar spelregels in plaats van ze te ondergaan. Synthesia licht zijn naleving van Artikel 50 van de AI Act diepgaand toe met standaard C2PA-herkomstsignalen, GitHub verbetert de betrouwbaarheid van zijn licentiegegevens door rechtstreeks pakketregisters te raadplegen, en Grok 4.6 verspreidt zich op dezelfde dag bij drie verschillende integratoren (Perplexity, Warp, Genspark) zonder dat een van hen exclusiviteit nastreeft. Deze snelle normalisering — een model dat binnen enkele dagen bijna overal beschikbaar is, regelgeving die wordt voorzien in plaats van ondergaan — schetst een sector die zijn distributie- en governancepraktijken in hetzelfde tempo volwassen maakt als zijn technische capaciteiten.


Bronnen