Zoeken

Grok komt naar Copilot voor Word, Excel en PowerPoint, OpenAI verlaagt de ChatGPT-licentie voor Amerikaanse overheden naar nul, DeepSeek behoudt V4 Pro

Artikel gegenereerd door kunstmatige intelligentie
Grok komt naar Copilot voor Word, Excel en PowerPoint, OpenAI verlaagt de ChatGPT-licentie voor Amerikaanse overheden naar nul, DeepSeek behoudt V4 Pro

ai-powered-markdown-translator

Artikel vertaald van het Frans naar het Nederlands met gpt-5.6-sol.

Bekijk project op GitHub ↗

Geen nieuw vlaggenschipmodel deze zaterdag, maar wel concrete veranderingen voor wie deze tools al gebruikt. Microsoft rolt de Grok-modellen van SpaceXAI uit in Copilot voor Word, Excel en PowerPoint, een dag nadat Grok Bot naar Teams kwam. OpenAI verlaagt de prijs van de ChatGPT-licentie voor alle Amerikaanse overheden naar nul en pleit tegelijkertijd voor een federale wet, terwijl de documentatie van DeepSeek de voor 14 september geplande omleiding van V4 Pro annuleert. Wat ontwikkelingstools betreft, wordt Amp gratis voor wie zelf rekenkracht en modellen meebrengt, terwijl Gemini CLI en Vibe CLI hun beveiligingscontroles aanscherpen.


Grok vestigt zich in de Microsoft-suite, van Copilot voor Word, Excel en PowerPoint tot Teams

12 september — Microsoft kondigt de uitrol aan van de Grok-modellen van SpaceXAI in Copilot voor Word, Excel en PowerPoint. De lancering is gericht: deze begint uitsluitend bij klanten van het Microsoft Frontier-programma en Microsoft presenteert haar als een uitbreiding van de modelkeuze in Copilot. Het account @grok deelde de aankondiging minder dan een uur later.

Launching even more models in Copilot. Grok models from SpaceXAI are rolling out in Copilot in Word, Excel, and PowerPoint—starting with a focused release to customers in the Microsoft Frontier program.

🇳🇱 Er komen nog meer modellen naar Copilot. De Grok-modellen van SpaceXAI worden uitgerold in Copilot voor Word, Excel en PowerPoint, te beginnen met een gerichte lancering voor klanten van het Microsoft Frontier-programma.@Microsoft365 op X

De nuance is belangrijk: SpaceXAI bood sinds juni en juli al eigen Grok-add-ins voor Word, Excel, PowerPoint en Outlook aan, en Grok 4.6 is sinds eind augustus beschikbaar op Microsoft Foundry. Ditmaal worden de Grok-modellen in Microsofts eigen Copilot geïntegreerd. De aankondiging vermeldt niet om welke Grok-versie het gaat en geeft evenmin informatie over de prijs of de planning na het Frontier-programma.

🔗 Grok deelt de aankondiging op X

Grok Bot zoekt en handelt in Microsoft Teams

11 september — De dag vóór de aankondiging van Microsoft meldde het account @bot dat Grok Bot, het aanbod van permanente agents van SpaceXAI, nu namens de gebruiker kan zoeken en handelen in Microsoft Teams. Een bericht dat op 10 september aan het einde van de middag Pacific Time werd gepubliceerd, richtte zich al op verkoopteams: Grok Bot maakt verbinding met Salesforce, HubSpot, Gong, Clay en Granola om klantaccounts te volgen, opvolging te verzorgen en diepgaand onderzoek uit te voeren. Deze connectors vormen een uitbreiding van de functies die begin september werden gepresenteerd, van Grok Bot for Enterprise tot het invullen van formulieren en het opstellen van berichten. Geen van beide berichten vermeldt welk abonnement vereist is, wat de prijs is of welke gebruikslimieten gelden.

🔗 Aankondiging van Grok Bot voor Microsoft Teams op X


OpenAI tegenover de Amerikaanse overheid, tussen overheidsinkoop en een oproep tot wetgeving

9 en 10 september — Twee teksten van OpenAI die halverwege de week werden gepubliceerd en niet in onze vorige edities waren opgenomen, tonen het bedrijf in twee verschillende rollen tegenover de Amerikaanse overheid: het verkoopt aan de overheid en vraagt de wetgever om regelgeving vast te stellen.

OneGov 2.0, een kosteloze ChatGPT-licentie voor alle overheden

10 september — OpenAI for Government sluit met de federale General Services Administration (GSA) een nieuwe meerjarige overeenkomst af, als vervolg op het federale aanbod van vorig jaar. De licentie, die normaal 15 dollar per gebruiker per maand kost, wordt kosteloos en kent geen minimale afnameverplichting, terwijl het gebruik tegen de helft van de prijs wordt gefactureerd. Het aanbod reikt nu verder dan het federale niveau: voor het eerst komen ook staten, lokale overheden en tribale overheden ervoor in aanmerking. Meer dan een miljoen ambtenaren hadden via bestaande overeenkomsten al toegang tot ChatGPT; nu komen ongeveer 23 miljoen mensen in aanmerking en ook GPT-6 Astra behoort tot de aangeboden tools.

Onderdeel van de overeenkomstAangekondigde inhoud
Licentie per gebruiker0 dollar in plaats van 15 dollar per maand, zonder minimale afnameverplichting
Gebruik van de modellen50% korting
In aanmerking komende overhedenFederale overheid, staten, lokale overheden en tribale overheden
CyberdefensieDaybreak Blue tegen 50% van het commerciële tarief, Daybreak Red op aanvraag tegen het standaardtarief
Looptijd van de overeenkomst27 maanden, van 1 oktober 2026 tot en met 31 december 2028

Het onderdeel voor cyberdefensie bouwt voort op Daybreak for Frontline Defenders, waarvoor een miljard dollar is uitgetrokken en dat de week ervoor werd aangekondigd. OpenAI benadrukt dat ChatGPT Enterprise de gegevens van organisaties, zowel invoer als uitvoer, niet gebruikt om zijn modellen te trainen. Op 14 september staat een informatief webinar gepland.

🔗 AI-toegang en cyberdefensie uitbreiden voor federale, staats-, lokale en tribale overheden

Een opiniestuk voor een federale wet en vier Californische wetsvoorstellen

9 september — In een opiniestuk dat stelt dat er momenteel een politieke kans ligt, vraagt Chris Lehane, Chief Global Affairs Officer van OpenAI, het Congres om vóór het einde van zijn zittingsperiode verplichte nationale regelgeving aan te nemen die is gebaseerd op de capaciteiten van modellen. Deze verplichtingen zouden gericht moeten zijn op het handjevol laboratoria dat de meest geavanceerde systemen ontwikkelt, niet op startups of kleine ontwikkelaars, en veiligheidsbeleid mag geen beleid tegen open-weight-modellen worden. In afwachting daarvan steunt OpenAI formeel vier wetsvoorstellen die door de Californische wetgevende macht zijn aangenomen en aan gouverneur Newsom zijn voorgelegd. SB 1119 is daar een van: OpenAI had eind augustus al zijn steun voor dit wetsvoorstel aangekondigd.

Californisch wetsvoorstelOnderwerp van de tekst
SB 813Kader voor onafhankelijke veiligheidsevaluaties
AB 1405Normen voor AI-auditors
SB 1119Bescherming van minderjarigen die companion-chatbots gebruiken
AB 1864Waarborgen tegen door AI vergemakkelijkte biologische dreigingen

Some of these bills we did not endorse in the past, and are now supporting after reconsidering in light of the recent jump in capabilities we have seen.

🇳🇱 We hebben sommige van deze wetsvoorstellen in het verleden niet gesteund, maar doen dat nu wel nadat we ze opnieuw hebben beoordeeld in het licht van de recente sprong in capaciteiten die we hebben waargenomen. — Chris Lehane, hoofd mondiale zaken, OpenAI

Het opiniestuk pleit ook voor industriële normen voor het monitoren van misalignment: een snelle schriftelijke melding aan de betrokken organisaties wanneer een model tijdens de ontwikkeling of evaluatie zonder toestemming hun beveiligingscontroles omzeilt. Voor Astra zegt OpenAI volledige trajecten, inclusief chains of thought, te monitoren en vóór elke bredere interne uitrol een alignment-evaluatie te verplichten. Volgens de tekst vindt volledig autonome recursive self-improvement momenteel niet plaats en zou deze niet moeten worden nagestreefd zolang dat niet veilig kan.

🔗 Het beleidsvenster voor AI staat open. We moeten handelen.


DeepSeek behoudt zijn V4 Pro-API uiteindelijk ook na 14 september

Vastgesteld op 12 september — De documentatie van de DeepSeek-API zegt nu het tegenovergestelde van de aankondiging van 10 september. Die dag, bij de release van V4.1-Flash, plande DeepSeek het einde van V4 Pro: vanaf 14 september om 04:00 UTC zouden alle verzoeken naar deepseek-v4-pro worden omgeleid naar V4.1-Flash en tegen het Flash-tarief worden gefactureerd, totdat V4.1-Pro zou verschijnen. Een opmerking op de pagina Models & Pricing vermeldt nu dat DeepSeek na 14 september de V4 Pro-API zal blijven aanbieden om aan de vraag van gebruikers te voldoen, met ongewijzigde tarieven, en dat het bedrijf gebruikers zal informeren als er opnieuw iets verandert.

Dezelfde alinea staat in het Engels en Chinees in de vermelding van 10 september in het Change Log. DeepSeek heeft deze koerswijziging niet gedateerd en er op X geen melding van gemaakt, terwijl het aankondigingsbericht van 10 september nog altijd de oude planning toont: er staan dus nog steeds twee tegenstrijdige versies online.

Factureringspost per miljoen tokensdeepseek-flash, dalurendeepseek-flash, piekurendeepseek-v4-pro, dalurendeepseek-v4-pro, piekuren
Invoer met cache (cache hit)0,003 dollar0,006 dollar0,022 dollar0,044 dollar
Invoer zonder cache (cache miss)0,15 dollar0,30 dollar0,66 dollar1,32 dollar
Uitvoertokens0,60 dollar1,20 dollar1,98 dollar3,96 dollar
Gelijktijdige verzoeken2 5002 500500500
Beeldbegripjajaneenee

Voor gebruikers van de API vindt de automatische omleiding dus niet plaats: beide modellen blijven naast elkaar bestaan, elk met een context van één miljoen tokens en een maximale uitvoer van 384K. Afhankelijk van de factureringspost kost V4 Pro 3,3 tot 7,3 keer zoveel als Flash. De piekuren lopen van 01:00 tot 04:00 en van 06:00 tot 10:00 UTC, van maandag tot en met vrijdag; buiten die uren geldt de helft van de prijs.

🔗 Models & Pricing, DeepSeek-API 🔗 Change Log van de DeepSeek-API


Amp wordt gratis voor wie eigen rekenkracht en modelabonnementen meebrengt

12 september — Amp heeft een bericht met de titel Free Agent online gezet, op zijn website gedateerd op 13 september, dat de factureringslogica van zijn coding agent verandert. Het gebruik wordt gratis zodra gebruikers hun eigen rekenkracht en modelabonnementen of modelsleutels meebrengen. Voor het koppelen van een ChatGPT-abonnement is geen maandabonnement meer vereist en voor persoonlijke API-sleutels via Bring Your Own Key (BYOK) gelden geen kosten per token of limieten meer, voor alle klanten buiten Enterprise. Amp brengt voortaan orbs in rekening, zijn externe machines waarop agents autonoom en parallel werken, terwijl runners die op eigen machines worden geïnstalleerd het mogelijk maken deze gratis te vermijden. Inference blijft via Amp verkrijgbaar, zonder toegevoegde marge.

Amp-abonnementWeergegeven prijsWat het abonnement omvat
Hobby (nieuw)GratisAlle functies, orbs betaald naar gebruik of gratis persoonlijke runners, BYOK zonder kosten of limiet
Individual (Megawatt of Gigawatt)20 dollar per maand voor Megawatt45 000 minuten orb-tijd, onbeperkte openbare en privé-repositories
Teams (nieuw)Zonder meerprijsLeden met verschillende abonnementen, gedeelde threads en portals, gezamenlijke credits, SAML/OIDC SSO
EnterprisePrijs op aanvraagGezamenlijke credits zonder betaalde seats, SCIM, uitgavenlimieten, auditlogs

Voor teams verdwijnen de instapkosten: iedereen kan gratis worden uitgenodigd voor een workspace en intensieve gebruikers stappen over op een betaald abonnement voor gebruikskortingen, gemiddeld 60% voor Megawatt en 65% voor Gigawatt volgens Amp. SAML/OIDC single sign-on wordt gratis voor de hele workspace zodra één lid betaalt, en het beleid voor nul- of minimale gegevensbewaring, dat tot nu toe alleen contractueel was gegarandeerd voor Enterprise-klanten, wordt uitgebreid naar iedereen. Megawatt en Gigawatt krijgen ten slotte vroege toegang tot acht extra providers, waaronder OpenRouter, Amazon Bedrock en Ollama Cloud.

🔗 Amps Free Agent-bericht


ChatGPT voor desktop 26.908, Quick Chat vanuit Pets en Appshots op Windows

11 september — OpenAI brengt versie 26.908 van de ChatGPT-desktopapp uit, met de nadruk op Pets. Deze optionele geanimeerde metgezellen, die op macOS en Windows boven andere vensters zweven, werden tot nu toe gebruikt om lopende gesprekken te volgen. Nu dienen ze ook als startpunt: via de bedieningselementen onder het dier kan een Quick Chat worden getypt en met Enter worden verzonden, zonder het hoofdvenster te openen. Een globale sneltoets toont deze bedieningselementen, Option+Spatie op macOS en Windows+Alt+P op Windows, terwijl de Mini-modus dezelfde sneltoetsen en meldingen behoudt, maar zonder dier op het scherm.

Het dier geeft vier statussen aan: gesprek actief, wachtend op een beslissing, voltooid of geblokkeerd door een fout, en geeft voorrang aan threads die op een antwoord wachten. Gesprekken die via deze bedieningselementen worden gestart, worden buiten elk project aangemaakt, en aangepaste pets blijven op de machine opgeslagen, zonder synchronisatie met ChatGPT op het web.

Appshots, die eind augustus op macOS werden geïntroduceerd, komen daarnaast naar Windows: door beide Alt-toetsen tegelijk in te drukken, wordt het venster op de voorgrond naar ChatGPT gestuurd als schermafbeelding, samen met de beschikbare tekst, naar een gesprek naar keuze. De sneltoets kan worden aangepast en op Windows wordt de appshot in de hoofdapp geopend.

🔗 Aankondiging van ChatGPT op X 🔗 Changelog van de ChatGPT-app


Gemini CLI, een nightly die de sandbox isoleert en buildbestanden bewaakt

12 september — Na twee nightlies zonder codewijzigingen op 10 en 11 september brengt de v0.61.0-nightly.20260912 van Gemini CLI twee wijzigingen, beide gericht op beveiliging, in het verlengde van de nightlies van 2, 4 en 5 september. De kanalen stable (v0.59.0) en preview (v0.60.0-preview.0) blijven ongewijzigd.

De eerste wijziging (PR #29250) richt zich op indirecte promptinjectie (indirect prompt injection) via buildbestanden: gemanipuleerde externe inhoud zet de agent ertoe aan een Makefile of package.json te wijzigen en vervolgens de build te starten. De CLI volgt voortaan buildconfiguratiebestanden die tijdens de sessie worden aangemaakt of gewijzigd, en elke build- of testopdracht die daarna wordt uitgevoerd (npm run, make, cargo, blaze) vereist uitdrukkelijke bevestiging. Dezelfde regel geldt wanneer een opdracht argumenten overneemt uit niet-vertrouwde externe inhoud: Google Docs, Buganizer, pagina’s die via web fetch zijn opgehaald of antwoorden van MCP-servers.

De tweede wijziging (PR #29214, 45 commits) scheidt de sandbox van de configuratie en inloggegevens van de gebruiker. Gemini CLI weigert deze te starten vanuit de persoonlijke map, de systeemroot of ~/.gemini, en weigert deze paden in een container te mounten. Die ontvangt voortaan alleen een opgeschoonde kopie van de instellingen, zonder hooks of API-sleutels. Op macOS verbieden de Seatbelt-profielen schrijftoegang tot ~/.gemini en gevoelige bestanden (oauth_creds.json, trustedFolders.json, .env), evenals leestoegang tot opslagplaatsen met inloggegevens en hookdefinities.

🔗 Notities bij nightly v0.61.0-nightly.20260912


Vibe CLI 2.25.4 vereist goedkeuring voor riskante shellsyntaxis

12 september — Mistral brengt Vibe CLI 2.25.4 uit, de vierde versie in vier dagen. Deze correctieve versie richt zich in de eerste plaats op beveiliging: controles van shellmachtigingen vereisen voortaan goedkeuring van de gebruiker voor riskante opdrachtsyntaxis en -opties waarmee de workspacecontroles en denylist konden worden omzeild. De release notes koppelen deze aanscherping aan vier identificatiecodes, van CVE-2026-87984 tot en met CVE-2026-87987, en aan resterende varianten van CVE-2026-87988. Op 12 september stond er geen beveiligingsadvies in de repository en de ernst van deze kwetsbaarheden wordt niet vermeld.

De intelligente goedkeuring (smart approve), waarvoor versie 2.25.1 al voorkwam dat git-opdrachten die mogelijk geheimen tonen automatisch werden goedgekeurd, verandert opnieuw van gedrag. Wanneer opnieuw om een riskante actie wordt gevraagd, wordt deze niet langer alleen geblokkeerd: het systeem vraagt om bevestiging en toont de reden. Automatisch goedgekeurde aanroepen verschijnen als een eenvoudige melding in plaats van een waarschuwing, en de modus verschijnt in de keuzelijst van Vibe Desktop wanneer deze door de gefaseerde uitrol wordt geactiveerd.

De rest maakt het dagelijkse gebruik betrouwbaarder: een ongeldige connector verhindert niet langer dat andere connectoren worden geladen, bestandsvermeldingen via @ werken in alle roots die met --add-dir zijn toegevoegd, en ACP-clients zoals Zed en JetBrains tonen altijd de actieve modus.

🔗 Release notes voor 2.25.4 op GitHub


Wringer, een redeneermodel met 4 miljard parameters en 2,655 bits per gewicht

12 september — weiciao wu publiceert op de communityblog van Hugging Face Wringer, een kwantisatiemethode die is getest op InternScience/Agents-A1-4B, een redeneermodel met 4 miljard parameters en een hybride Qwen3.5-architectuur. Het is een individuele bijdrage, geen publicatie van een laboratorium. De kern van het model daalt tot 2,655 bits per gewicht en behoudt gemiddeld 93,7% van de oorspronkelijke scores op IFEval, HumanEval en GSM8K, terwijl de curve van GGUF-kwantisaties van hetzelfde model volgens interpolatie bij dezelfde bitsnelheid tot 52,7% daalt.

Het recept bestaat uit drie stappen. Een kwantisatie in gesloten vorm, via GPTQ op de volledige covariantiematrix, levert al een behoud van 81,4% op. De opvulling (fill) bevriest vervolgens de codes en voegt aan elke lineaire laag een adapter met rang 128 toe, getraind via zelfdistillatie op ongeveer 100 miljoen tokens, oftewel 7 uur en 30 minuten op één GPU. Het uitwringen (wring) verwijdert ten slotte de adapter door de codes opnieuw te berekenen om diens bijdrage te absorberen: hetzelfde bitbudget, geen adapter tijdens inferentie.

Geteste configuratieBits per gewicht van de kernIFEval-scoreHumanEval-scoreGSM8K-scoreGemiddeld behoud
bf16, referentie1692,7994,5195,53100 %
GGUF, klasse IQ2_M2,76373,3863,4176,6575,47 %
Wringer zonder training2,65575,9770,7383,7081,44 %
Wringer, twee cycli (gepubliceerd model)2,65588,1785,3793,4894,65 %
GGUF, klasse IQ2_XXS2,55834,3820,1236,5432,16 %

Het cijfer van 93,7% komt overeen met de eerste evaluatie na één cyclus; het op de Hub gepubliceerde model, na twee cycli, bereikt 94,65%. De beperkingen worden duidelijk vermeld: de 2,655 bits hebben alleen betrekking op de lineaire gewichten van de kern, en het volledige model komt uit op 4,69 bits per gewicht doordat de embedding in bf16 blijft. Bij inferentie wordt in vLLM weer naar bf16 overgeschakeld wegens het ontbreken van native low-bit-kernels, waardoor tijdens uitvoering nog geen geheugen- of snelheidswinst is aangetoond. Bovendien blijft de evaluatie beperkt tot één model, drie benchmarks en een vergelijking met GGUF. Het project nam ongeveer vijf weken in beslag op één GPU, waarbij een agent de experimentreeksen uitvoerde terwijl een persoon bepaalde welke richtingen werden gevolgd.

🔗 Wringer op de Hugging Face-blog


Kort nieuws

  • Cognition en Perplexity vertrouwen end-to-end-tests toe aan GPT-6 Astra — twee casestudy’s van de API. Devin test het iPhone-spel Otter Run en levert een opname uit een simulator op, met een rapport dat onderscheid maakt tussen geslaagde controles en niet-geteste gebieden; Perplexity laat Astra een klein programma bouwen dat de antwoorden van andere diensten nabootst om een applicatie end-to-end te testen. 🔗 bron
  • OpenAI Developers brengt dertien met GPT-6 Astra gebouwde projecten samen — waaronder 2.234 anatomische onderdelen die in 3D kunnen worden verkend, Manhattan nagebouwd in Unreal Engine, een oude treintekening omgezet in een Blender-model met 3.295 bewerkbare objecten, en een in C++ geschreven raytracer (ray tracer) die naar Swift op de GPU van de iPhone is geporteerd. 🔗 bron
  • autofinetune vertrouwt tientallen fine-tuning-experimenten met Gemma toe aan een agent — op de Google Developers Blog wijzigen Antigravity CLI en Gemini 3.7 Flash het trainingsscript, voeren ze Tunix uit op Cloud TPU en behouden ze alleen de winnende commits. Resultaten: 20 experimenten in enkele uren met FunctionGemma 270M, gevolgd door 40 GRPO-experimenten in twee tot drie dagen met Gemma 3 1B, voor ongeveer 10% meer beloning. 🔗 bron
  • ToolGrad genereert gegevens over toolgebruik vanuit het antwoord — inhaalbericht van 10 september: Google Research bouwt eerst een geldige reeks API-aanroepen en formuleert daarna de aanvraag, met een slagingspercentage van bijna 100% op de ruim 16.000 API’s van ToolBench. Een Gemma 3 12B die op deze gegevens is gefinetuned behaalt 83,1 op BFCL, tegenover 83,2 voor gemini-2.5-pro en 74,4 voor GPT-5, de toonaangevende modellen ten tijde van het artikel. 🔗 bron
  • De documentatie van de Gemini API komt naar Google AI Studio — inhaalbericht van 10 september: een eerste preview, volledig opnieuw opgebouwd en beschikbaar op ai.studio/docs, die Logan Kilpatrick omschrijft als ontworpen voor zowel mensen als agents. De berichten vermelden niet hoe agents er gebruik van maken. 🔗 bron
  • Drie door Google ondersteunde Android XR-projecten op het Filmfestival van Venetië — het team van 100 ZEROS ondersteunde Andy Serkis’ NEVATARS en Galápagos: The Last Eden, verteld door Margot Robbie, waarin Gemini gesprekken met de kijker tot leven brengt, evenals de trailer van Sedona, een psychologische thriller van Asylm Studios die automatisch van 2D naar 3D is omgezet. De blogpost vermeldt geen specifiek model of beschikbaarheidsdatum. 🔗 bron
  • Claude Code 2.1.270 verhelpt een regressie uit 2.1.269 — alleen-lezen git-opdrachten die door de Bash-tool worden uitgevoerd, vragen na enige sessietijd niet langer opnieuw om toestemming. Dit is de enige wijziging in deze versie. 🔗 bron
  • Intelligente rapporten (smart reports) in bèta op Claude Enterprise — inhaalbericht van 10 september: Claude analyseert een steekproef van de transcripties van een team over maximaal 28 dagen en stelt een rapport op over het verrichte werk, de kosten, knelpunten en herhaalde taken die in gedeelde skills kunnen worden omgezet. Tien gratis rapporten per maand tijdens de bèta; de functie is standaard uitgeschakeld. 🔗 bron
  • Copilot-statistieken meten het Agents-venster van VS Code — nu algemeen beschikbaar: nieuwe velden tellen de dagelijkse actieve gebruikers, sessies en berichten in dit venster over 1 en 28 dagen, per bedrijf, organisatie of gebruiker. Toegang is voorbehouden aan eigenaars, factureringsbeheerders en rollen met de machtiging View Copilot Metrics. 🔗 bron
  • GitHub start de kaartverkoop voor Universe 2026 opnieuw — een korte video belicht de programmeerbare badge, gepresenteerd als een minicomputer en voorbehouden aan aanwezige deelnemers: een toegangspas voor 1.399 dollar voor 28 en 29 oktober in San Francisco, met gratis virtuele deelname. Een promotie zonder productaankondiging, in het verlengde van de hernieuwde campagnes van 22 augustus en 7 september. 🔗 bron
  • Fugu Ultra v2 komt naar OpenRouter — de hoogwaardige orchestrator van Sakana AI kost daar 5 dollar per miljoen invoertokens en 30 dollar per miljoen uitvoertokens, met een context van één miljoen tokens. Prompts van meer dan 272.000 tokens worden tegen een hoger tarief berekend, en de tokens die de orchestratie zelf verbruikt, worden als gewone tokens gefactureerd. 🔗 bron
  • ChordStream, een 64-bits token per akkoord voor modellen voor symbolische muziek — specificatie gepubliceerd op de communityblog van Hugging Face: elk token bevat de toonsoort, trap, bas en positie van het akkoord, geëxtraheerd uit MIDI-bestanden of REMI-stromen, samen met de dataset captioned-ChordStream. De extractor blijft heuristisch en er wordt geen getraind model gepresenteerd. 🔗 bron
  • Qwen3.8-27B draait op Cerebras met ongeveer 1.850 tokens per seconde — een context van 64k tokens bij gratis toegang en 128k bij betaalde toegang, voor 0,99 dollar per miljoen invoertokens en 1,49 dollar per miljoen uitvoertokens. Cerebras kent het model een score van 34 toe op de Artificial Analysis Intelligence Index. 🔗 bron

Wat dit betekent

De eerste rode draad van de dag is distributie. De Grok-modellen komen via Microsoft terecht in Copilot voor Word, Excel en PowerPoint, terwijl SpaceXAI al eigen invoegtoepassingen voor deze applicaties aanbood. Grok Bot wordt een dag eerder in Teams geïnstalleerd, nadat deze al was verbonden met commerciële tools zoals Salesforce en HubSpot. OpenAI richt zich met ChatGPT voor desktop op hetzelfde terrein: een gesprek begint vanuit een zwevende assistent en Windows kan nu met twee toetsaanslagen een venster naar ChatGPT sturen. Microsoft presenteert de komst van Grok bovendien als een uitbreiding van de modelkeuze in Copilot: het model wordt een optie in de tool die al geopend is, en is niet langer alleen een applicatie die afzonderlijk moet worden opgezocht.

De tweede rode draad is politiek. In twee dagen heeft OpenAI een overeenkomst gepubliceerd die de ChatGPT-licentiekosten voor ongeveer 23 miljoen Amerikaanse overheidsmedewerkers, van de federale overheid tot tribale overheden, tot nul terugbrengt, en een opiniestuk waarin het Congres wordt opgeroepen tot een verplichte wet op basis van de capaciteiten van modellen. De twee teksten sluiten op elkaar aan: het bedrijf wordt op nationale schaal leverancier van de overheid en stelt voor dat de verplichtingen rusten op het handjevol laboratoria dat de krachtigste systemen ontwikkelt, en niet op startups of open weights. De steun voor vier Californische wetsvoorstellen, waaronder enkele die het bedrijf eerder niet steunde, past binnen wat het opiniestuk omgekeerd federalisme (reverse federalism) noemt: de wetten van de afzonderlijke staten groeien naar elkaar toe in afwachting van federale wetgeving.

De derde rode draad betreft de prijs van het gebruik. Amp brengt niet langer de tokens in rekening die gebruikers zelf aanleveren, verkoopt inferentie zonder winstmarge en verlegt de facturering naar de externe machines waarop de agents draaien. DeepSeek, dat V4 Pro wilde terugtrekken ten gunste van een goedkopere V4.1-Flash, houdt het model tegen dezelfde prijs beschikbaar om aan de vraag te voldoen, hoewel het 3,3 tot 7,3 keer duurder is: een deel van de gebruikers hecht meer aan een specifiek model dan aan de laagste prijs. Sakana factureert op zijn beurt de tokens van zijn eigen orchestratie, terwijl Cerebras Qwen3.8-27B op snelheid verkoopt. Wringer herinnert er ten slotte aan dat compressie tot 2,655 bits per gewicht de kosten nog niet verlaagt zolang de inferentie weer naar bf16 overschakelt.

De laatste rode draad betreft de beveiliging van agents op de opdrachtregel en draait om hetzelfde mechanisme: het vragen om goedkeuring. Gemini CLI verplicht dit wanneer tijdens de sessie een buildbestand is gewijzigd of wanneer een opdracht argumenten overneemt van een webpagina of MCP-server, en schermt de sandbox af van de inloggegevens van de gebruiker. Vibe CLI 2.25.4 maakt goedkeuring verplicht voor shellsyntaxis waarmee de controles konden worden omzeild, onder verwijzing naar vier CVE’s en varianten van een vijfde, en laat de intelligente goedkeuring voortaan om bevestiging vragen in plaats van alleen te blokkeren. Claude Code 2.1.270 toont de keerzijde: door een regressie werd opnieuw om toestemming gevraagd voor eenvoudige alleen-lezen git-opdrachten. Tussen een kwetsbaarheid die iets onterecht doorlaat en een vraag die te vaak wordt gesteld, wordt het afstellen van deze goedkeuringsverzoeken een zichtbaar onderdeel van het werk van leveranciers.


Bronnen