ai-powered-markdown-translatorÖversatt artikel från fr till sv med gpt-5.4-mini.
Den 24 augusti är en dag lika mycket för hårdvara som för modeller. NVIDIA släpper tre infrastrukturanimationer i samma Hot Chips-våg — de första mätningarna på kisel för Vera Rubin NVL72, Groq 3 LPX går in i produktion, plattformen öppnas för tredjepartschip via NVLink Fusion. Alibaba lanserar Wan 3.0, som genererar 30 sekunder inbyggd video i ett enda pass. Och två icke-amerikanska laboratorier syns samma dag tillsammans med nationella institutioner: Mistral med HUMAIN i Saudiarabien, Sakana AI med Japans försvarsministerium. Därtill kommer den allmänna tillgängligheten för företagsauktorisering för MCP-anslutningar hos Anthropic, ankomsten av GPT-5.6 i Kiro och en serie tillkännagivanden om röstagenter.
Wan 3.0 genererar 30 inbyggda sekunder i ett enda pass
24 augusti — Alibaba lanserar Wan 3.0, den nya generationen av sin videomodell. Den tydligaste förändringen gäller längden: modellen producerar 30 inbyggda sekunder i ett enda pass, utan sammanfogning av efterföljande klipp (stitching). Fram till nu har man behövt generera flera segment och sedan länka ihop dem för att komma förbi ungefär tio sekunder, med de kohensdriftproblem som detta medför för ljus, texturer och ansikten.
Den andra axeln är den multimodala ingången. Wan 3.0 accepterar upp till 20 referensasset och analyserar dokument och webbsidor utöver bilder, ljud och video — det som den officiella sidan kallar omnikreation (Omni-Creation). I praktiken matar man den med en varumärkesmapp snarare än en textbeskrivning.
Modellen genererar dessutom ett inbyggt synkroniserat ljud: röster, effekter och atmosfär produceras samtidigt som bilderna, inte läggs till i efterhand. För stillbilder kan Wan 3.0 slå samman upp till 9 bilder till en enda komposition och generera 12 sekventiella bilder med konsekvent stil och motiv, vilket uttryckligen riktar sig till storyboard och reklamvarianter.
Två mindre spektakulära förmågor är viktiga i professionell användning: lång textåtergivning på 12 språk, som täcker diagram, formler och infografik där videomodeller vanligtvis misslyckas, samt exakt färgkontroll, en förutsättning för att följa en grafisk profil.
Ekosystemet följde med samma dag: Wan 3.0 fanns dag noll hos fal, Leonardo.Ai, Scenario, RunningHub, Venice, TapNow, DeeVid, Pixmax och via Pika API Club.
| Angiven kapacitet | Värde för Wan 3.0 |
|---|---|
| Inbyggd längd | 30 s i ett pass, utan sammanfogning |
| Referensassets | Upp till 20, med analys av dokument och webbsidor |
| Ljud | Synkroniserat, genererat inbyggt med bilderna |
| Textåtergivning | Lång text på 12 språk (diagram, formler, infografik) |
| Bildfusion | Upp till 9 bilder i en komposition |
| Bildserier | Upp till 12 sammanhängande sekventiella bilder |
NVIDIA mäter upp till 30x mer arbete per watt på Vera Rubin NVL72
24 augusti — I samband med konferensen Hot Chips publicerar NVIDIA sina första prestandamätningar på kisel för Vera Rubin NVL72. Siffran som lyfts fram riktar sig direkt mot datacenter-ekonomin: upp till 30x mer genomströmning per megawatt än generationen GB300 NVL72 på modellen DeepSeek V4 Pro, och en kostnad per miljon tokens som är upp till 35x lägre.
Den metodologiska detaljen är minst lika viktig som resultatet. NVIDIA utesluter de klassiska inferensmätningarna, kalibrerade på sekvenser om 1 000 till 8 000 tokens: i en agentisk session byggs kontexten upp och når flera hundratusen tokens i indata. Mätningarna gjordes därför med SemiAnalysis AgentX, en last av verkliga inspelade agentiska kodsessioner, med verktygsanrop och bevarade underagenter. Två reservationer: siffrorna väntar på SemiAnalysis granskning och inkluderar ännu inte bidraget från Vera CPU.
Motiveringen ligger i en OpenRouter-statistik: en agentisk last förbrukar 15x fler tokens än en enkel chattfråga. För en AI-fabrik som är begränsad av energi formuleras insatsen utan omsvep — genomströmning per megawatt avgör intäkterna, kostnaden per miljon tokens avgör marginalen. Tekniken DSX MaxLPS gör det dessutom möjligt att tillhandahålla upp till 40% fler GPU:er vid samma megawattbudget.
Vinsterna kommer från en stapling av inferensoptimeringar: avkopplad tjänst som separerar kontexthantering och svarsgenerering, distribuerad KV-cache med stegvis avlastning, sammanslagna CUDA-kärnor som MegaMoE och NVFP4-kvantisering som komprimerar vikterna i 4 bitar. Den kompletta plattformen omfattar sju chip, inklusive GPU Rubin.
| Mätt jämförelse | Angiven vinst |
|---|---|
| Vera Rubin NVL72 mot GB300 NVL72 (genomströmning per megawatt) | upp till 30x |
| Vera Rubin NVL72 mot GB300 NVL72 (kostnad per miljon tokens) | upp till 35x billigare |
| GB300 NVL72 mot Hopper (genomströmning per megawatt) | upp till 15x |
| DSX MaxLPS | +40% GPU med samma megawattbudget |
🔗 Vera Rubin NVL72 och agentiska laster
Groq 3 LPX går in i full produktion, Nebius och SpaceXAI antar Vera Rubin
24 augusti — Andra delen av samma Hot Chips-våg: NVIDIA:s rackskaliga system Groq 3 LPX går in i full produktion, som en utvidgning av Vera Rubin NVL72.
Referenssiffran kommer från ett Artificial Analysis-benchmark på Gemma 4 31B: 3 400 outputtokens per sekund vid lång kontext på 100 000 tokens, alltså 4x den närmaste alternativa plattformen. Problemet som riktas in sig på har ett exakt namn — avkodningslatens: en agent genererar sitt svar token för token, och varje liten fördröjning multipliceras längs arbetskedjorna.
Rollfördelningen är tydlig: Rubin GPU:er hanterar kontext i stor skala, LPX snabbar upp latenskänslig avkodning. Ett rack kan samla 256 LP30-acceleratorer sammankopplade med direkta chip-till-chip-länkar.
Tre användare nämns. Nebius är den första AI-molntjänsten som integrerar Groq 3 LPX, i sin Token Factory; CoreWeave driftsätter Spectrum-X Multiplane i produktion för att sammankoppla sina Vera Rubin-rack; och SpaceXAI antar NVIDIA Vera CPU:er för orkestrering, verktygsanrop och kodkörning bakom den agentiska AI:n, med avsikten att bygga sin arkitektur kring Vera Rubin, från jordbaserade datacenter till satelliter i omlopp.
På nätverkssidan har det hittills krävts ett tredje lager för att överträffa dagens största kluster, med kostnader i kablage, optik, energi och latens. Spectrum-X Multiplane delar i stället upp anslutningen för varje server i flera oberoende vägar, eller planer, som vardera driver sitt eget tvånivåsnätverk.
| Mätt element | Angivet värde |
|---|---|
| Groq 3 LPX på Gemma 4 31B, 100k kontext | 3 400 tokens/s i output, 4x närmaste plattformen |
| Groq 3 LPX-rack | upp till 256 LP30-acceleratorer, chip-till-chip-länkar |
| Spectrum-X Multiplane | upp till 512 000 GPU:er på två nivåer |
| Förlust av en av åtta planer | cirka 90% bandbredd bevarad |
| Maskinvaruåterhämtning | 11x snabbare än mjukvarubalans, 1,6x produktion |
🔗 Groq 3 LPX, Spectrum-X och NVLink Fusion
NVLink Fusion kopplar anpassade chip till NVIDIA-plattformen
24 augusti — NVIDIA:s tredje artikel för dagen: NVLink Fusion för in anpassade chip (XPU) i ett område med skala upp till 72 acceleratorer över NVLink. Den sjätte generationen av NVLink visar en 3x lägre ände-till-ände-latens än lösningar baserade på standard-Ethernet, med 10x högre paketgenomströmning; färdplanen utlovar domäner på upp till 1 152 acceleratorer och co-packaged optik. NVLink-C2C kopplar XPU:er till Vera CPU:er eller andra CPU:er med upp till 6x energieffektivitet jämfört med ett PCIe-gränssnitt.
Argumentet är frikoppling: planeringen av en AI-fabrik — energi, byggnad, kylning, rack, nätverk — börjar långt innan acceleratorblandningen är fastställd, och ett datacenter som låses till ett enda chip blir en schemarisk. De som antar lösningen återanvänder MGX-rackarkitekturen och dess leveranskedja. Nämnda partner: Intel, MediaTek, GUC, QCT och Annapurna Labs.
Mistral och HUMAIN skriver under för en suverän AI i Saudiarabien
24 augusti — Mistral tillkännager ett strategiskt samarbete med HUMAIN, det saudiska artificiella intelligensföretaget: datorinfrastruktur, utveckling av avancerade modeller och utrullning av lösningar i kungadömet och regionen. Åtagandet uppgår, enligt Mistral, till flera hundra miljoner euro.
De inledande områdena är cybersäkerhet och röst, med frontier-modeller som presterar väl på arabiska. Mistral kommer att undersöka användningen av HUMAIN:s datacenter för sina lokala beräkningsbehov, och de två partnerna kommer gemensamt att rikta in sig på kungadömets reglerade branscher. Tillkännagivandet förlänger en sekvens som inleddes i somras — utökat partnerskap med Microsoft, sedan European Compute Units i början av augusti — och pressmeddelandet klargör att detta är framåtblickande uttalanden, beroende av senare kommersiella avtal.
Control is becoming the defining topic in enterprise AI adoption. Across the world, and especially in regulated industries, organizations want the benefits of AI without giving up control over their sensitive data and systems.
🇸🇪 Kontroll håller på att bli den avgörande frågan för införandet av AI i företag. Över hela världen, och särskilt i reglerade branscher, vill organisationer ha fördelarna med AI utan att ge upp kontrollen över sina data och sina känsliga system. — @MistralAI på X
🔗 @MistralAI:s tillkännagivande · Mistrals inlägg
Sakana AI får ett kontrakt från Japans försvarsministerium
24 augusti — Sakana AI offentliggör ett kontrakt som undertecknades den 29 juli med Japans försvarsministerium (防衛省), som gäller studie och demonstration av de AI-funktioner som behövs för integrerade analysoperationer. Projektet riktar sig till analysofficerare inom underrättelsedirektoratet, längs tre axlar: insamling, analysförmåga och dokumenthantering. Den komponent som används är labbets teknik för AI-agenter.
Detta är inte dess första försvarskontrakt: i mars 2026 hade laboratoriet i Tokyo redan valts för grundtekniken i system för kommando och kontroll. För ett företag vars offentliga identitet bygger på öppna modeller är utvecklingen värd att notera — bloggen har nu en särskild rubrik för försvar och underrättelse, och Sakana AI rekryterar till detta team.
「Sakana AI株式会社は、令和8年7月29日、防衛省と「総合分析業務に必要なAI機能の調査・実証」に関する契約を締結いたしました。」
🇸🇪 Sakana AI ingick den 29 juli 2026 ett kontrakt med försvarsministeriet om studie och demonstration av de AI-funktioner som krävs för integrerade analysoperationer. — Sakana AI, officiellt inlägg
🔗 Sakana AI — integrerad analys för Försvarsmakten
Anthropic öppnar företagsstyrd auktorisering för MCP-anslutningar i allmän tillgänglighet
24 augusti — Företagsstyrd auktorisering (enterprise-managed auth) för MCP-anslutningar går till allmän tillgänglighet på Claude Team och Claude Enterprise, efter en öppen beta i juni. Problemet som löses är konkret: fram till nu krävde det två steg att koppla in en MCP-anslutning — administratören aktiverade den för organisationen, sedan gick varje användare igenom ett OAuth-flöde för varje verktyg. Administratören godkänner nu en gång, via företagets identitetsleverantör, och användarna hittar sina verktyg redan anslutna.
En punkt intresserar säkerhetsteamen: en administratör kan kräva att en anslutning alltid går via identitetsleverantören, vilket förhindrar att ett privat konto kopplas till ett arbetsverktyg. Tio MCP-leverantörer stöds vid lansering — Asana, Atlassian, Canva, Datadog, Figma, Granola, Linear, Notion, Slack och Supabase — med Okta som enda IdP för närvarande. Mekanismen är inte proprietär: detta är den första implementeringen av tillägget Enterprise-Managed Authorization för Model Context Protocol.
🔗 @ClaudeDevs tillkännagivande · Anthropics inlägg
Boris Cherny erkänner cybersäkerhetsavslag som en brist
24 augusti — Dagen efter sina kommentarer om de tre kapacitetsnivåerna svarar ansvarig för Claude Code på två återkommande frågor från säkerhetsutvecklare. Den första är misstanken om en privilegierad intern modell: teamet använder exakt samma Fable som slutanvändarna.
Den andra är mer direkt: avslag som triggas av cybersäkerhetsämnen erkänns som en brist, i ordalag som inte försöker mildra det, och teamet arbetar på att minska dem. Det är användbar information för praktiker inom defensiv säkerhet eller CTF, som regelbundet stöter på avslag på legitima begäranden. Ingen tidsplan anges, men budskapet förlänger augustiuppdateringen om Fable 5:s biologiska skyddsräcken, som redan syftade till att minska falska positiva.
We use the same exact Fable. Cyber security refusals suck, and we are working on reducing them. More to come.
🇸🇪 Vi använder exakt samma Fable. Cybersäkerhetsavslag är jobbiga, och vi arbetar på att minska dem. Mer kommer. — @bcherny på X
Anthropic börjar automatiskt underhålla sina egna appar
23 augusti — När Boris Cherny pressas att precisera vad han menar med att koda gör han en enkel åtskillnad: coding är själva handlingen att skriva kod, engineering är allt det andra ovanpå. Han medger att uppdelningen mellan taktiskt arbete och strategiskt arbete är en annan legitim tolkningsram.
Det är slutet av hans meddelande som innehåller den nya informationen. Han säger sig se delar av det strategiska arbetet börja automatiseras och ger ett konkret exempel: Anthropic börjar automatiskt underhålla sina appar, och ett snabbt växande antal kunder skulle göra detsamma. Nyansen är viktig — det handlar inte längre om att generera kod på begäran, utan om att låta agenter sköta löpande underhåll av appar i produktion: uppdateringar av beroenden, korrigeringar, anpassningar till API-förändringar. Verbet som används beskriver en pågående utrullning och inte ett faktum, och inga siffror, inga namngivna appar och ingen exakt omfattning anges.
🔗 @bchernys tråd om coding och engineering
Ett automatiserat veckovis kommersiellt digest med Claude Code
24 augusti — Anthropic publicerar ett inlägg om en intern användning av Claude Code utanför mjukvaruutveckling: en fältmarknadsförare berättar där hur hon ersatte måndagsmorgonens femton minuter långa standup med ett personanpassat veckodigest, levererat i ett Slack-meddelande till varje säljare.
Arkitekturen är okomplicerad: Claude är kopplad till BigQuery via MCP, där lagret fungerar som sanningskälla för marknadsföringsdata. Metoden är mer lärorik än tekniken: piloten startade med endast ett frivilligt team, och varje korrigering som kom tillbaka från mottagarna omvandlades till en uttrycklig regel i prompten: i slutet av första veckan innehöll den nio innehållsregler, var och en spårbar till en specifik återkoppling. Eftersom varje meddelande sätts samman utifrån mottagarens kontolista är inga två meddelanden någonsin identiska; BDR:erna (business development representatives) bad därefter om sin egen variant.
🔗 Ett personligt veckodigest med Claude Code
GPT-5.6 kommer till Kiro, AWS:s utvecklingsagent
24 augusti — Den kompletta GPT-5.6-familjen — Sol, Terra och Luna — finns tillgänglig i Kiro, AWS:s mjukvaruutvecklingsagent. Argumentet som lyfts fram är inte rå prestanda utan pris/prestanda-förhållandet: i Terminal-Bench 2.1, ett test genomfört gemensamt av OpenAI och AWS, slutför GPT-5.6 Terra de lyckade uppgifterna med omkring 82% lägre kostnad.
Förklaringen som förs fram handlar om Kiros metod, spec-driven development (spec-driven development): verktyget omvandlar en övergripande intention till krav, teknisk design och körbara uppgifter, vilket förankrar modellen i ett exakt sammanhang från början och begränsar villospår. OpenAI beskriver de avsedda användningsfallen: strukturerade implementeringsplaner, flerstegs koduppgifter, repository-kontext, kontrollpunkter innan ändringar tillämpas. För den som följer kodagenternas ekosystem bekräftar tillkännagivandet framför allt att GPT-5.6-serien sprider sig utanför OpenAIs ytor.
Codex får ett utvecklarläge med åtkomst till Chrome DevTools Protocol
24 augusti — ChatGPT- och Codex-changloggen får en rad nyheter centrerade kring agentstyrd webbläsare. Den viktigaste är ett utvecklarläge för Browser use, i Chrome såväl som i Codexs inbyggda webbläsare: det ger kontrollerad åtkomst till Chrome DevTools Protocol, gränssnittet som Chrome-utvecklingsverktygen använder. Agenten kan därmed profilera prestanda och felsöka nätverkstrafik, konsolutdata och sidans tillstånd, i stället för att begränsas till det den läser på skärmen.
Samma protokoll används för hastighet: Browser use blir upp till två gånger snabbare tack vare DOM-snapshots som minskar rundresorna till och från webbläsaren. Schemalagda automatiseringar respekterar nu det valda godkännandeläget, vilket rättar till en irriterande avvikelse för obevakade körningar.
| Nyhet i changeloggen | Angiven omfattning |
|---|---|
| Utvecklarläge för Browser use | Chrome och inbyggd webbläsare i Codex, kontrollerad CDP-åtkomst |
| Snabbare Browser use | Upp till 2x snabbare (CDP-optimeringar och DOM-snapshots) |
Kommando /init | Skriv appen, fungerar på samma sätt som Codex CLI |
| Computer Use | Företag utanför EES, Storbritannien och Schweiz |
| Computer Use-kontroller i Windows | Konfigurerbara per applikation |
🔗 ChatGPT- och Codex-changeloggen
Vinnarna i Gemma 4 Good Challenge
24 augusti — Google publicerar resultaten av sin Gemma 4 Good Challenge, en Kaggle-tävling som bjöd in utvecklare att lösa verkliga problem med sina öppna modeller: mer än 1 600 projekt lämnades in på sex veckor. Svårigheten låg mindre i modellernas kvalitet än i deras driftsättning i begränsad miljö, där deltagarna använde LiteRT, Cactus, Ollama, llama.cpp och Unsloth för att köra på vanlig hårdvara.
Den gemensamma nämnaren för de prisbelönta projekten är offline-funktion och integritet genom design. GEM-4 tar förstaplatsen med en robotassistent för äldre och personer med funktionsnedsättning: en Gemma 4 31B annoterar träningsvideosekvenser, och en finjusterad E2B-styrning översätter observationer och instruktioner till rörelser. Bland specialpriserna finjusterar Gem-Care Gemma 4 E2B för att återskapa icke-normativt tal och sänker felord-frekvensen från 32,7% till 19,0%; PreVillage levererar konversativ routing på romaniserad nepali på en Raspberry Pi 5 med 7,5 tokens per sekund.
🔗 De prisbelönta projekten i Gemma 4 Good Challenge
ADK utvärderar inbyggt röstagenter
24 augusti — Googles Agent Development Kit stöder nu utvärdering av live- och röstagenter, i samma loop som för textagenter. Principen: en usersimulator uttalar sina turer, syntetiserade av Gemini TTS och därefter streamade till agenten, vars talade svar poängsätts automatiskt. Live-läget aktiveras av enbart närvaron av ett live_model_config-block; utan det körs samma testfall i textläge.
Testfallen delas in i två stilar: scenariot, där en persona improviserar sina turer enligt en plan, och den fasta konversationen, skriven ord för ord. Poängsättningen sker genom LLM-domare styrda av rubriker på naturligt språk, skrivna en gång och sedan tillämpade på hela sviten. Körningen görs via adk eval eller via AgentEvaluator, vilket gör det möjligt att infoga röstutvärderingar i en CI/CD-pipeline. ADK Web lägger till en växling mellan standardläge och live-läge, bygger om transkriptionen från ljudströmmen och bifogar ett spelbart ljudklipp till varje tur.
Grok Voice Think Fast 2.0 tar ledningen i Speech-to-Speech-indexet
24 augusti — xAI meddelar att Grok Voice Think Fast 2.0 tar förstaplatsen i Artificial Analysiss Speech-to-Speech-index, som mäter mindre kvaliteten på den återgivna rösten än en röstagents förmåga att resonera kring det den hör, lösa ett verkligt kundproblem och slutföra en uppgift genom att anropa verktyg.
Modellen är ingen nyhet i dag: presentationsinlägget är daterat 29 juli. Det xAI kommunicerar här är rankningen och produktionssiffror. Hos Starlink, samma koncerns dotterbolag, hanterar Grok Voice mer än 15 000 inkommande support- och säljsamtal per dag och slutför mer än 3 000 beställningar per vecka, sammantaget för röst och chatt. Think Fast-familjen kör sitt resonemang parallellt med talsyntesen, vilket undviker att betala för intelligens i latens.
| Benchmark | Think Fast 2.0 | GPT-Realtime-2.1 (High) | Gemini 3.1 Flash (High) |
|---|---|---|---|
| AA Speech-to-Speech Quality Index | 82,9 % | 79,1 % | 69,5 % |
| τ-voice Bench (agentprestanda) | 56,5 % | 45,7 % | 37,7 % |
| Tid till första ljud | 0,70 s | — | 2,98 s |
🔗 @SpaceXAI:s tillkännagivande · x.ai-inlägget
ElevenLabs lägger hela sitt API i terminalen
24 augusti — ElevenLabs publicerar version 1 av sitt CLI, som exponerar hela API:et i terminalen. Tillkännagivandet riktar sig lika mycket till två målgrupper: utvecklare och kodagenter.
Denna dubbla målgrupp syns i de tekniska valen. Kommandona dokumenteras så att de är lätta att upptäcka, agent skills är direkt inbyggda i verktyget, och utdata finns tillgänglig i strukturerad JSON — tre villkor för att en agent på ett tillförlitligt sätt ska kunna styra verktyget i stället för att tolka fri text. Dry run-läget kompletterar helheten: det gör det möjligt att förhandsgranska resultatet av en operation innan den körs, en viktig säkerhetsnivå när det är en autonom agent som utlöser anropet. Utgivningen ligger i linje med den officiella MCP-server som förlaget lanserade den 17 augusti.
MiniMax öppnar 14 dagar med obegränsad åtkomst på GMI Cloud
24 augusti — Från 24 augusti till 6 september öppnar MiniMax obegränsad åtkomst till sina modeller på GMI Cloud: M3 och M2.7 på språksidan, Speech 2.8 och Music 3.0 på ljudsidan.
Det anmärkningsvärda går utöver den kommersiella operationen. Den 21 augusti nöjde sig MiniMax med ett gåtfullt tillkännagivande som antydde att en M3-modell var på väg, utan specifikationer eller datum. Tre dagar senare är M3 uttryckligen tillgänglig i ett daterat erbjudande, tillsammans med två ljudmodeller vars versionsnummer inte hade förekommit i leverantörens tidigare kommunikation. Inga benchmarkresultat eller tekniska specifikationer åtföljer tillkännagivandet: det är en tillgängliggörning, inte ett produktblad.
🔗 14 dagar med obegränsad åtkomst på GMI Cloud
Kortnytt
- Nemotron 3.5 Lightning går in i topp 4 på PinchBench — NVIDIA-modellen placerar sig bland de fyra bästa open-weight-modellerna med 86,4% genomsnittlig träffsäkerhet på standardiserade OpenClaw-agenttester; Nemotron 3 Ultra behåller förstaplatsen. 🔗 Tweet från @NVIDIAAI
- Wan 3.0 finns redan tillgänglig via Pika API Club — Aggregeraren, lanserad den 5 augusti, ger tillgång till mer än hundra modeller genom ett enda API. Tillägget dag ett följer den logik som redan observerats med Seedance 2.5 den 17 augusti. 🔗 Tweet från @pika_labs
- Runway utökar Ruby till alla modeller på sin plattform — Utsignaler från Seedance 2.5, Gen-4.5 eller MiniMax H3 konverteras nu till 16-bitars EXR eller till ProRes och HEVC 10- och 12-bitars, utan en separat kalibreringskedja per generator. 🔗 Tweet från @runwayml
- Runway öppnar en hackathon på plats i San Francisco — Den 30 september, med fokus på att bygga agenter och appar; ansökningar går via hackathon.runway.com. 🔗 Tweet från @runwayml
- Enligt Boris Cherny visade sig prompt injection vara lösbart — Han fortsätter på temat kodgenerering utan buggar och nämner föregångaren: kombinationen av alignment-träning och mekanistisk interpretabilitet lyckades till slut lösa problemet, efter många år. 🔗 @bchernys tråd
- GitHub-webbinarium den 25 augusti om Copilot-appen — Live-demo kl. 18–19 CEST med Pierce Boggan och James Clancey; registreringssidan beskriver Agent Merge, som hanterar rebase, granskningar och checks fram till merge. 🔗 Tweet från @github
- GitHub lyfter fram säsong 2 av sin podcast — Presentationsvideo med programledarna och deras favoritavsnitt från föregående säsong, utan produktannons. 🔗 Tweet från @github
- Grok 4.6 till halva priset i Nous Research-portalen — 50% rabatt under en vecka, användbar med den öppna källkod-agenten Hermes eller via ett befintligt SuperGrok- eller X Premium+-abonnemang. 🔗 Tweet från @SpaceXAI
- Codex Live Build lyfter fram röststyrning — Livesession på X med skaparen Alex Finn, om arbete utan tangentbord i Codex på dator och mobil. Demonstration, utan funktionsmeddelande. 🔗 Tweet från @OpenAIDevs
- HeyGen publicerar en promptguide för fastighetsvideor — Skriva prompts avsedda för avatarvideor med filmisk kvalitet, i linje med dess serie om fastigheter. 🔗 Tweet från @HeyGen
- De amerikanska nationalparkerna fyller 110 år med Maps, Search och Gemini — Google korsar sina söktrender (frågor om vandring för nybörjare ökar med 165% på en månad) med användningen av AI Mode, Ask Maps och Gemini Live i reseförberedelser. Ingen ny funktion. 🔗 blog.google-inlägg
Vad det betyder
Efter flera dagar med fokus på mjukvaruanvändningar är hårdvaran tillbaka i förgrunden — och det den mäter har förändrats. NVIDIA avfärdar uttryckligen inferensmått kalibrerade på sekvenser med 1 000 till 8 000 tokens till förmån för verkliga inspelade agentiska kodningssessioner, med växande kontext, verktygskanrop och underagenter inkluderade. Räkneenheten följer samma förskjutning: det handlar inte längre om rå genomströmning utan om arbete per megawatt, och kostnad per miljon tokens. Begränsningen är inte längre tillgängligt kisel, utan den energi man kan ge det. Fördelningen GPU/LPU säger samma sak ur ett annat perspektiv: kontextbearbetning å ena sidan, latenskänslig avkodning å den andra, eftersom agentisk inferens har slutat vara en homogen belastning.
Dagens andra signal är plattformens öppning. NVLink Fusion kopplar samman chip som utformats av andra, SpaceXAI använder Vera-CPU:er, och Intel, MediaTek och Annapurna Labs finns med på partnerlistan. Det kommersiella argumentet handlar om tidplan: en AI-fabrik planeras — energi, byggnad, kylning, nätverk — långt innan mixen av acceleratorer är fastställd, och att sälja rack, nätverk och verktyg snarare än bara acceleratorn innebär att göra sig oumbärlig även för dem som bygger sitt eget kisel.
Mer oväntat är att suveränitet står i centrum för två tillkännagivanden samma dag. Mistral meddelar ett samarbete med HUMAIN för arabiskspråkiga modeller och användning av saudiska datacenter; Sakana AI skriver under med det japanska försvarsministeriet för underrättelseanalys. Två icke-amerikanska laboratorier, två nationella institutioner, en och samma logik: det som Mistral kallar kontroll och det som den japanska regeringen kallar informationsmakt betecknar förmågan att köra träning och inferens i en vald jurisdiktion. För Sakana, vars offentliga identitet bygger på öppna arbeten, pekar den dedikerade försvarssektionen och de tillhörande rekryteringarna mot en varaktig verksamhetslinje snarare än ett enskilt kontrakt.
Kvar finns en diskret men sammanhängande tråd: verktygen struktureras för att styras av en agent, inte bara av en människa. ElevenLabs släpper ett CLI vars säljargument — upptäckbara kommandon, strukturerad JSON, dry run-läge — uttryckligen riktar sig till kodagenter. Codex får tillgång till Chrome DevTools Protocol, vilket vill säga möjligheten att läsa en sidas verkliga tillstånd snarare än dess rendering. ADK lägger till inbyggd vokal utvärdering så att talande agenter slutar levereras på känsla. Och Grok Voice publicerar produktionsvolymer — 15 000 anrop per dag hos Starlink — i stället för att nöja sig med en rankningspoäng. Varje gång samma skifte: att ta sig ur prototypen kräver maskinläsbara gränssnitt och reproducerbara mätningar.
Källor
- Wan 3.0 — officiell sida
- NVIDIA — Vera Rubin NVL72 och agentiska laster
- NVIDIA — Groq 3 LPX, Spectrum-X och NVLink Fusion
- NVIDIA — NVLink Fusion och XPU:er
- NVIDIA — Nemotron 3.5 Lightning på PinchBench
- Mistral och HUMAIN — officiellt tillkännagivande
- Mistral — tillkännagivandet om samarbetet med HUMAIN på X
- Mistral — kontroll som avgörande ämne
- Sakana AI — integrerad analys för Försvarsmakten
- Sakana AI — tillkännagivande på X
- Anthropic — enterprise-managed auth för MCP-anslutningar
- Anthropic — tillkännagivande om enterprise-managed auth på X
- Boris Cherny — avslag inom cybersäkerhet
- Boris Cherny — kodning, ingenjörsarbete och automatisk underhållning
- Boris Cherny — promptinjektion som ett lösbart problem
- Anthropic — ett personligt veckodigest med Claude Code
- OpenAI — GPT-5.6 i Kiro
- OpenAI — changelog för ChatGPT och Codex
- OpenAI — Codex Live Build med Alex Finn
- Google — de prisbelönta projekten i Gemma 4 Good Challenge
- Google — utvärdera talagenter i ADK
- Google — de amerikanska nationalparkerna 110 år
- xAI — Grok Voice Think Fast 2.0
- xAI — ranking för Speech-to-Speech på X
- xAI — Grok 4.6 i portalen Nous Research
- ElevenLabs — CLI v1
- MiniMax — 14 dagars obegränsad åtkomst på GMI Cloud
- Runway — Ruby utökad till alla modeller
- Runway — hackathon i San Francisco
- Pika — Wan 3.0 i API Club
- HeyGen — promptguide för fastighetsvideor
- GitHub — webbinarium om Copilot-appen
- GitHub — säsong 2 av podden