Sök

Claude Code styrt från telefonen, GLM-5.3 går före GPT-5.6 Sol och Claude Fable 5, Perplexity redogör för sitt Brain-minne

Artikel genererad av artificiell intelligens
Claude Code styrt från telefonen, GLM-5.3 går före GPT-5.6 Sol och Claude Fable 5, Perplexity redogör för sitt Brain-minne

ai-powered-markdown-translator

Artikel översatt från fr till sv med gpt-5.4-mini.

Visa projekt på GitHub ↗

Den 22 augusti öppnar Anthropic Claude Code Remote Control för att starta sessioner från telefonen, medan Google utrustar Antigravity med en motsvarande funktion för att styra sina agenter på distans. På modelsidan visar två jämförelser från Together AI att den öppna modellen GLM-5.3 kan matcha eller överträffa GPT-5.6 Sol och Claude Fable 5 på benchmarken DeepSWE, till en bråkdel av kostnaden. Perplexity redogör dessutom för arkitekturen bakom Brain, dess versionshanterade agentiska minne med Git, och NotebookLM blir tillgängligt för alla användare med en integration i Googles AI-läge i Google Search. På menyn finns också: Replit ser över sina agentlägen, Runway öppnar ett licenserbjudande för modeller, OpenAI stärker sin kontroll över API-kostnader och sin säkerhetssvit Codex, och Grok Bot breddar sin åtkomst.


Claude Code Remote Control: stärkt tillförlitlighet och start av session från telefonen

22 augusti — Anthropic publicerar på X en tråd som beskriver flera tillförlitlighetsfixar för Remote Control, funktionen som gör det möjligt att styra en Claude Code-session från en telefon medan den körs på en fjärrdator. Tillståndssynkroniseringen mellan telefon och maskin lämnar inte längre kvar någon spöksession som visas efter att Claude Code stängts, nätverksavbrott (Wi‑Fi-byte, stängning av locket) utlöser nu automatisk återanslutning, och öppning av stora sessioner går märkbart snabbare på iOS. Tre slash-kommandon får ett särskilt mobilt beteende (/clear, /compact, /diff). Produktnyhet: det blir möjligt att starta en session direkt från telefonen — alla maskiner som kör claude remote-control visas som ett enhetskort i fliken Code, valbart för att starta sessionen på distans.

Your phone now stays in sync with what’s running on your machine. Resuming a session on your laptop keeps the phone on the live session instead of archiving it. When Claude Code exits, your phone shows it offline within seconds instead of leaving a stale session hanging around.

🇸🇪 Din telefon förblir nu synkroniserad med det som körs på din maskin. Att återuppta en session på din bärbara dator gör att telefonen stannar kvar på den aktiva sessionen i stället för att arkivera den. När Claude Code avslutas visar telefonen det som offline inom några sekunder i stället för att lämna kvar en föråldrad session.@ClaudeDevs på X

🔗 Fullständig tråd på X 🔗 Dokumentation för Remote Control


Replit: Conversations, omdöpta Agent-lägen (Power/Max), samt Routines och Memories i beta

22 augusti — Replit publicerar sin veckosammanfattning This Week in Replit, med tre helt nya nyheter. Conversations gör det möjligt att starta en appidé med en fas av research och konversationell idéutveckling innan man går vidare till byggandet, utan att tappa det uppbyggda sammanhanget — ett vanligt problem när den här fasen började i en annan AI-assistent. Agent-lägena döps om: det tidigare Economy-läget blir Power, det tidigare Power-läget blir Max, till samma kostnad för båda. Slutligen kommer Routines och Memories i beta: Routines schemalägger körningen av en uppgift utifrån en konversation och återger resultatet automatiskt, med stöd av ett system för bestående minne. Dessa tillkännagivanden presenterades live under Replits Friday Showcase.

🔗 Tillkännagivandetråd


Together AI jämför GLM-5.3 med GPT-5.6 Sol och Claude Fable 5 på DeepSWE

21 augusti — Together AI publicerar samma dag två oberoende jämförelser som ställer GLM-5.3, Zhipu/Z.ai:s senaste öppna modell, mot två stängda referenser på DeepSWE, deras benchmark för mjukvaruutveckling (113 uppgifter, 4 försök per konfiguration, maximal ansträngning, 904 körningar totalt). Mot GPT-5.6 Sol ger GLM-5.3 efter på första försöket men kommer ikapp redan på det andra och går om på det fjärde, till en klart lägre kostnad. Mot Claude Fable 5 är det initiala gapet nästan obefintligt och växer tydligt till GLM-5.3:s fördel med flera försök — Claude Fable 5 framstår som den dyraste konfigurationen i jämförelsen. En GLM-5.3-till-Sol-kaskad, som endast eskalerar vid testfel, når 85,9 % träffsäkerhet till 6,61 dollar per uppgift, ett bättre resultat än en perfekt oracle-router (83,8 %).

Testad jämförelseResultat vid första försöketResultat efter 4 försökKostnad per körning
GLM-5.3 vs GPT-5.6 Sol69,0 % vs 72,7 %87,6 % vs 85,8 %3,99 $ vs 8,37 $ (2,1× billigare)
GLM-5.3 vs Claude Fable 569,0 % vs 69,7 %87,6 % vs 84,1 %3,99 $ vs 21,63 $ (5,4× billigare)

Don’t pick one. Run GLM-5.3 first, escalate to GPT-5.6 Sol when the tests fail. That cascade solves 85.9% of DeepSWE tasks at $6.61 each. Sol alone solves 72.7% at $8.37. Thirteen points better, 21% cheaper.

🇸🇪 Välj inte bara en enda modell. Kör GLM-5.3 först och eskalera till GPT-5.6 Sol när testerna misslyckas. Denna kaskad löser 85,9 % av DeepSWE-uppgifterna för 6,61 dollar styck. Sol ensam löser 72,7 % för 8,37 dollar. Tretton procentenheter bättre, 21 % billigare.Together AI, officiell blogg

🔗 Jämförelse GLM-5.3 vs Claude Fable 5


21 augusti — NotebookLM:s X-konto, omdöpt till Gemini Notebook, meddelar att den omarbetade upplevelsen av « Notebook » nu är tillgänglig för alla användare på webben (en mobilversion är på väg), efter en gradvis utrullning. En annan strukturell förändring är att notebooks nu är direkt tillgängliga från Googles AI-läge i Google Search, vilket för verktyget för dokumentöversikt närmare Googles huvudsakliga sökmotor. Tillkännagivandet innehåller också två Chat-fixar: bättre rendering och kopiera-klistra av matematiska ekvationer, samt en rättning av ett fel som visade siffrorna upp och ner i språk som skrivs från höger till vänster (arabiska, hebreiska). Fler nyheter utlovas under de kommande veckorna.

🔗 Tillkännagivande på X


OpenAI lägger till utgiftsuppföljning per API-nyckel i instrumentpanelerna Usage and Spend

21 augusti — OpenAI lägger till granularitet per API-nyckel i instrumentpanelerna Usage and Spend på sin utvecklarplattform. Tidigare var uppföljningen av utgifter aggregerad på organisations- eller projekt-nivå, men nu går det att isolera bidraget från varje enskild API-nyckel, för att exakt identifiera vilka appar eller arbetsflöden som väger tyngst på fakturan. Funktionen åtföljs av konfigurerbara utgiftstak på organisations- eller projekt-nivå, med möjlighet att sätta hårda gränser som automatiskt stoppar trafiken när taket nås. Dessa kontroller är tillgängliga från gränssnittet i API Platform och via Admin API, för att kunna integreras i programatiska arbetsflöden. OpenAI beskriver uppdateringen som ett komplement till prissänkningen för GPT-5.6 Sol som annonserades samma dag.

🔗 Tillkännagivande på X


Codex Security: praktisk guide och öppen källkod-CLI för cyberförsvar (Daybreak)

21 augusti — OpenAI publicerar en guide som beskriver Daybreak-ekosystemet, dess AI-assisterade cyberförsvarsplattform, från den initiala triageringen i ChatGPT till produktionen av en verifierad åtgärd. Det mest konkreta för utvecklare är Codex Security CLI, ett verktyg med öppen källkod som publicerats som ett npm-paket (@openai/codex-security), användbart för att skanna ett lokalt repository (npx @openai/codex-security scan .) och integrerbart i CI/CD (GitHub Actions, GitLab CI/CD) med export i SARIF-format. En anmärkningsvärd nyhet är bulk-scan, som granskar en hel portfölj av repositories utifrån ett CSV-inventarium, med återupptagning efter avbrott och konfigurerbara samtidighetsparametrar. OpenAI skiljer också mellan två åtkomstnivåer: Daybreak Blue (triagering av sårbarheter, validering av patchar) för godkända försvarare, och Daybreak Red (avancerad sårbarhetsforskning, red teaming), reserverad för ett mer begränsat antal tillåtna användningsområden. Codex Security cloud har redan analyserat mer än 30 miljoner commits över mer än 30 000 kodbaser.

🔗 Fullständig guide


Grok Bot utökar sin åtkomst till fler abonnemang och blir gratis att prova

21 augusti — Tio dagar efter lanseringen i beta utökar Grok Bot sin åtkomst till ett bredare urval av abonnemang: SuperGrok Plus, SuperGrok Heavy, samt Cursor-erbjudandena (Pro+, Ultra och alla Teams-planer). Användare utanför dessa abonnemang får nu en kostnadsfri provperiod med begränsad användning. Dessa autonoma AI-agenter har sin egen molnmiljö med webbläsar- och terminalåtkomst, för uppgifter som säljsökning, skapande av kompletta webbplatser (inklusive domänköp och driftsättning), sortering av inkorgar, kundsupport eller mötesanteckningar. Flera Bots kan köras parallellt i en och samma grupp, och ett « rutin »-läge gör det möjligt för en Bot att lära sig en uppgift genom att iaktta användaren när den utförs första gången. En väntelista för företag är öppen för större utrullningar.

🔗 Tillkännagivande på X


Runway redogör för sin företagsstrategi och ett erbjudande om modelllicens

21 augusti — Runways nya kommersiella chef, Sean Holcombe, redogör i ett inlägg för företagets företagsstrategi: mer än fördubblad omsättning under året, nettoretention över 300 %, och tydlig internationell expansion (Europa över 20 % av företagsbasen, Japan har blivit den största asiatiska marknaden). Det mest strukturella tillkännagivandet är öppnandet av ett erbjudande om modelllicens: i stället för betalad åtkomst per användning via API kommer vissa företagskunder att kunna få slutna modellvikter och ett proprietärt tränings-/inferensramverk som kan hostas och finjusteras direkt i deras egen miljö. Runway riktar in sig på fyra profiler: företag med egen kreativ immateriell egendom, plattformar som redan har beräkningskapacitet, organisationer som omfattas av hårda regulatoriska krav, och aktörer med mycket stora volymer.

🔗 Fullständigt inlägg


Perplexity redogör för Brain, Computer:s agentiska minnessystem

19 augusti — Perplexity redogör för hur Brain fungerar, det persistenta minnessystemet i Computer, deras lokala agent. I stället för en klassisk vektordatabas organiserar Brain minnet som ett Git-versionerat kunskapswiki, fördelat över tre lager i sandboxens filsystem: knowledge/ (wikin), notes/ (destillerade utdrag) och sessions/ (råa transkriptioner). En särskild « Memory Agent » laddar vid behov relevanta filer i stället för att kopiera hela trädet vid varje uppstart, medan bakgrundsagenter kallade « Dream » håller wikin offline i fyra steg, med kontroller före publicering.

Utvärderad metriskUtan BrainMed Brain
Träffsäkerhet (internt benchmark, 640 frågor)0,6000,661
Bevisåterkallelse (internt benchmark)0,5730,625
Träffsäkerhet i produktion (senaste 30 dagarna)kontroll+9,3 poäng

🔗 Teknisk artikel


Kortnotiser

  • Devin (Cognition) — ytterligare 20 % rabatt på GPT-5.6 Sol — OpenAI lägger till en prissänkning på 20 % för GPT-5.6 Sol i 3 månader, vilket kommer ovanpå den rabatt på 70 % som redan har gällt sedan den 18 augusti: den samlade rabatten på Devin Desktop och CLI uppgår nu till 76 % fram till den 3 oktober 2026. 🔗 Tillkännagivande
  • Google Antigravity 2.9.1 — Remote Control för att styra sina agenter på distans — Ny funktion som gör det möjligt att starta och övervaka en lokal agentsession från vilken webbläsare som helst, med prestandavinster och bättre återhämtning efter fel. 🔗 Changelog
  • Auto model selection till -30 % för Copilot Max — Kampanj på automatisk modellval (Claude, GPT eller Microsoft AI) för Copilot Max-prenumeranter, giltig till och med den 30 september 2026. 🔗 Tillkännagivande · 🔗 Slutdatum
  • GitHub Universe 2026 — återstart av biljettförsäljningen — Marknadsföringsåterstart av konferensen GitHub Universe 2026 via en kort video, utan något tillhörande produktmeddelande. 🔗 Video
  • Midjourney — stort changelog för webbplatsens alpha — Två veckor av UX-fixar på alpha.midjourney.com: projektmappar, återkomst av Upscale/Zoom/Vary, bestående inställningar och prestandafixar. 🔗 Changelog
  • MiniMax antyder lanseringen av modellen M3 på SambaNova — Som svar på ett gåtfullt tillkännagivande från SambaNova antyder MiniMax att en M3-modell snart är på väg, utan att några specifikationer eller något släppdatum kommuniceras. 🔗 Tweet
  • Grok 4.6 tillgänglig på Google Enterprise Agent Platform — Modellen ansluter till Model Garden (tidigare Vertex AI), med ett kontextfönster på 500 000 tokens och prissättning på 2 $ / 6 $ per miljon tokens in/ut. 🔗 Tillkännagivande
  • Cohere aktiverar ett lokalt läge för röstdiktering via superwhisper — Läget « Go Local » kombinerar Cohere Transcribe och den öppna modellen S1-mini (0,6 miljarder parametrar) från superwhisper, med helt lokal transkribering på enheten. 🔗 Tillkännagivande

Vad det betyder

Två oberoende tillkännagivanden, utan koppling till varandra, pekar i dag mot samma rörelse: att frikoppla styrningen av en AI-agent från den maskin där den faktiskt körs. Hos Anthropic gör Claude Code Remote Control det nu möjligt att starta en session direkt från telefonen, med automatisk återanslutning och tillståndssynkronisering mellan enheter. Hos Google introducerar Antigravity sin egen funktion för «Remote Control»: att styra och övervaka en lokal agentsession från vilken webbläsare som helst. I båda fallen förblir beräkning och exekvering förankrade på arbetsstationen — det är kontrollfönstret som blir mobilt. Denna frikoppling svarar mot ett numera vanligt användningsmönster: att starta en lång uppgift på sin utvecklingsmaskin och sedan följa den samt återta kontrollen från en annan enhet, utan att någonsin avbryta den pågående körningen.

Den andra rörelsen som syns i dag rör modellernas ekonomi. De två Together AI-jämförelserna visar GLM-5.3, en öppen modell från Zhipu/Z.ai, som matchar eller överträffar GPT-5.6 Sol och Claude Fable 5 på samma benchmark för mjukvaruteknik, till en kostnad som är 2 till 5 gånger lägre. Det är inte ett isolerat fall: samma vecka multiplicerar xAI molnintegrationerna för Grok 4.6 (Google Enterprise Agent Platform efter GitHub Copilot och Amazon Bedrock), OpenAI ger en kumulativ rabatt på 76 % på GPT-5.6 Sol för Devin-användare, och Replit breddar sina egna agentlägen. Konkurrensen avgörs inte längre bara av modellernas råa kapacitet, utan av kostnads-/nyttoförhållandet och tillgängligheten över flera plattformar — en arena där öppna modeller, kombinerade med strategier för modellkaskader, blir fullt ut kommersiella argument gentemot slutna modeller.

En tredje tråd, mer diskret, går också genom dagen: det beständiga minnet håller på att bli en egen infrastrukturkomponent för AI-agenter. Perplexity beskriver arkitekturen bakom Brain, ett versionshanterat kunskapswiki med Git som strukturerar minnet hos dess Computer-agent i stället för att stapla det i en klassisk vektordatabas, med uppmätta förbättringar i korrekthet och återkallning av bevis. Samtidigt breddar Google tillgången till den omarbetade Notebook-upplevelsen i NotebookLM och integrerar den direkt i Google Searchs AI-läge, vilket för dokumentationssyntesverktyget ännu närmare den huvudsakliga sökmotorn. I båda fallen kommer mervärdet inte längre bara från den underliggande modellen, utan från hur historik och ackumulerad kunskap organiseras, återfinns och återanvänds från en session till en annan.

En sista vinkel gäller mognaden hos verktyg avsedda för tekniska team och säkerhet i företag. OpenAI lägger till utgiftsspårning per API-nyckel och strikta konfigurerbara gränser i sina instrumentpaneler, samtidigt som de publicerar en detaljerad guide om Codex Security, med en open source-CLI som kan granska en hel portfölj av repositories. Dessa två tillkännagivanden, publicerade samma dag av samma team, tecknar ett sammanhängande svar på en gemensam oro bland organisationer som rullar ut AI-agenter i stor skala: att behålla fin kontroll över kostnader och säkerhetsyta, utan att avstå från den hastighet som dessa verktyg utlovar.


Källor