Sök

Muse får en röst och en avatar på Meta Connect 2026, Claude Codes molnsessioner lämnar förhandsversionen, Perplexity lanserar Fast Search

ai-powered-markdown-translator

Artikel översatt från franska till svenska med gpt-6-sol.

Visa projekt på GitHub ↗

På Meta Connect 2026 ger Meta sin personliga agent Muse en realtidsröst och en videoavatar, lovar att ta den till sina glasögon och gör Meta Model API allmänt tillgängligt. Claude Codes molnsessioner lämnar förhandsversionen med en engångskredit för prenumeranter, och Perplexity lanserar Fast Search, som bygger på Photon, en egen sökmotor skriven i Rust. Ett tecken i tiden är att Meta och Google med bara några timmars mellanrum lanserar videoavatarer som talar i realtid.


Meta Connect 2026: Muse får en röst, Meta förnyar sina glasögon

23 september — Meta inledde Meta Connect 2026 med en keynote klockan 16 PT (klockan 01 den 24 september i Paris), med fokus på Muse, den personliga agent som lanserades den 8 september. Muse får ett röstläge i realtid: man kan föra långa samtal med den medan den arbetar i bakgrunden, och utforma dess röst genom att beskriva den (snabbare, långsammare, med en viss accent). Den får också ett animerat ansikte, Muse Realtime Avatar, som beskrivs närmare nedan. På Mac finns nu computer use: med användarens tillåtelse kan Muse styra valfri app och fortsätta arbeta när användaren är borta.

Nyhet för MuseTillgänglighet enligt beskedet
Röstläge i realtid, anpassningsbar röstPresenterades på Connect, inget datum
Computer use i Muse för MacTillgängligt
Muse på AI-glasögonen”Under de kommande månaderna”
Muse Charm, en enhet i fickformatDecember, enligt Mark Zuckerberg
Egen e-postadress för MuseAviserad, inget datum

På glasögonen ska man tilltala Muse med namn för att få hjälp med det man tittar på, till exempel en vara på en hylla eller en affisch. Enligt Zuckerberg får Muse Charm plats på en nyckelring och har en röstmodell i realtid; i Metas officiella sammanfattning utlovas bara mer information före årets slut.

Dagen efter @Muse besked om Shopify, PayPal, Expedia och Instacart ger Meta hela listan över anslutningar: Walmart, Best Buy, American Eagle Outfitters, DICK’S Sporting Goods, Fanatics, Gap, Michael Kors, Sephora, Ulta och Wayfair för shopping, Shop Pay och PayPal för betalningar, Instacart, Expedia fortfarande ”snart”, samt Notion, Granola, GitHub och Box för arbete. GitHub beskrev sin anslutning samma kväll: granska pull requests, följa issues och aviseringar samt kommentera utan att lämna agenten. Någon abonnemangsnivå eller några länder angavs inte. Meta anger varken priser eller länder för nyheterna.

🔗 Metas sammanfattning · Mark Zuckerbergs tråd · Muse-anslutningen för GitHub

Glasögon: Ray-Ban Meta Audio, Gen 3, Meta VR Glasses och Ray-Ban Display i Frankrike

23 september — Meta förnyar också sitt sortiment av glasögon och utlovar över 100 modeller före årets slut. Ray-Ban Meta Audio är en ny kategori utan kamera: 43 g, upp till 12 timmars batteritid och ytterligare 48 timmar med fodralet. Tredje generationens Ray-Ban Meta får en timme längre batteritid (9 timmar), en åtgärdsknapp och sex mikrofoner. Meta Ray-Ban Display, glasögon med skärm, kommer till Frankrike: efter Storbritannien och Kanada öppnar förbeställningarna där stegvis, liksom i Italien och Tyskland, inför lanseringen den 13 oktober.

Aviserad enhetStartprisTillgänglighet enligt beskedet
Ray-Ban Meta Audio349 dollarFörbeställning, leverans den 13 oktober
Ray-Ban Meta (Gen 3)449 dollarTillgänglig den 23 september
Meta Ray-Ban DisplayEj angivetFrankrike, Italien, Tyskland: 13 oktober
Meta VR Glasses (cirka 100 g)1 299,99 dollarVåren 2027

🔗 Metas tillkännagivande


Meta Model API blir allmänt tillgängligt, Muse Spark 1.3 hos Oracle och Google Cloud, Replit för Metas enheter

24 september — Den andra dagen av Meta Connect riktade sig till utvecklare. Huvudnyheten är att Meta Model API, som ger tillgång till Muse-modellerna, blir allmänt tillgängligt världen över, med support och garantier om regelefterlevnad för företag. Muse Spark 1.3 finns nu på Oracle Cloud AI Platform och går in i privat förhandsversion på Google Cloud, enligt Meta två nya prioriterade molnpartner.

Google Clouds produktsida (Gemini Enterprise Agent Platform) anger villkoren: modellen meta/muse-spark-1.3 är i förhandsversion och tillgänglig på begäran, med ett kontextfönster på 1 miljon token, enbart text som indata och utdata, MCP-kompatibla verktygsanrop, funktionsanrop, strukturerade utdata och stöd för resonemang. Batchprediktioner och reserverad kapacitet stöds däremot inte, och endast en global endpoint finns. Priset fanns ännu inte på prissidan när vi kontrollerade.

Nyhet för utvecklareAngiven status
Meta Model APIAllmänt tillgängligt världen över
Muse Spark 1.3 på Oracle CloudTillgängligt
Muse Spark 1.3 på Google CloudPrivat förhandsversion
Muse CodeKommer till Windows
Wearables Device Access Toolkit 1.0Lanserat efter ett års förhandsversion
WebMCP och Meta AI ConnectorsFörhandsversion för utvecklare
Meta Global AI Developer Hackathon1 miljon dollar, datum inte meddelade

Muse Code, Metas kodagent för terminalen, lämnade betaversionen den 31 augusti på macOS och Linux och kommer nu till Windows. Ash Jhaveri (”VP AI & Hardware Ecosystems” enligt sin biografi på X) upprepar att vikterna för Muse Spark 1.2 kommer ”snart”, ett löfte som upprepats sedan den 10 augusti, fortfarande utan datum. För glasögonen låter WebMCP Meta AI anropa endast de funktioner som en webbapp väljer att exponera.

🔗 Meta Connect 2026, sammanfattningen för utvecklare · Muse Spark 1.3 på Google Cloud

Replit bygger för Metas headset och glasögon

24 september — Replit presenterade på Meta Connect ett sätt att bygga för Metas enheter: man beskriver en app med vanligt språk, Replit Agent skriver koden och visar en förhandsgranskning i webbläsaren, och därefter öppnas appen eller webbupplevelsen på ett Meta Quest-headset, Meta Ray-Ban Display eller Meta VR Glasses, utan att något verktyg behöver installeras. Tre vägar beskrivs: Expo (bygga, paketera och driftsätta) eller webbläsaren för Meta Quest och VR Glasses, samt simulering i Replit följd av webbdriftsättning för Ray-Ban Display. Uppgifterna om Muse går isär: Replits sida beskriver en Replit-anslutning i Metas agent som ”på väg”, utan datum, medan ett inlägg från Replit samma dag säger att Muse redan kan skapa appar i Replit. Inga priser nämns.

🔗 Replit × Meta Connect 2026 · Muse i Replit, enligt @Replit


Claude Code: molnsessionerna lämnar förhandsversionen, Projects får stöd för lokala sessioner

23 september — Claude Codes molnsessioner lämnar forskningsförhandsversionen (research preview), meddelar @ClaudeDevs i en tråd publicerad klockan 21.23 UTC. En molnsession körs på Anthropics infrastruktur: arbetet fortsätter även när den bärbara datorn är stängd.

Cloud sessions are officially available and out of research preview! They let you keep Claude Code working, even when your laptop is closed.

🇸🇪 Molnsessioner är nu officiellt tillgängliga och lämnar forskningsförhandsversionen! De låter Claude Code fortsätta arbeta även när din bärbara dator är stängd. — @ClaudeDevs på X

För att låta användarna prova erbjuder Anthropic befintliga prenumeranter en engångskredit som är skild från användningsgränserna:

Villkor för kreditenPublicerade uppgifter
Belopp för Pro100 dollar
Belopp för Max250 dollar
Sista datumHämta ut före den 7 oktober
Så hämtas den utLänken i tillkännagivandet eller CLI-kommandot /claim-credit
FörutsättningarAnslutet GitHub-konto, villkor gäller
OmfattningEn kredit per konto, endast molnsessioner
Åtkomstvägarclaude.ai/code, fliken Code i mobilappen, datorappen, claude --cloud

Efter frågor förtydligade @ClaudeDevs den 24 september klockan 01.57 UTC att molnsessioner räknas mot Pro- eller Max-abonnemanget precis som övrig användning av Claude Code: den valfria krediten förbrukas bara först. Dokumentationen bekräftar upplägget: hastighetsgränser delas med all Claude-användning på kontot, parallella uppgifter förbrukar mer av kapaciteten och den virtuella maskinen faktureras inte separat. Molnsessioner är tillgängliga för Pro, Max och Team samt för Enterprise-användare med premiumplatser eller Chat + Claude Code. Kloning och pull requests går via GitHub; ett GitLab- eller Bitbucket-repo kan skickas som ett lokalt bundle med CCR_FORCE_BUNDLE=1.

🔗 Dokumentation om molnsessioner · @ClaudeDevs förtydligande om abonnemanget

Projects kör sina trådar lokalt

23 september — En och en halv timme senare (22.49 UTC) meddelar @ClaudeDevs stöd för lokala sessioner i Projects i Claude Code, som lanserades den 17 september i beta för Pro och Max: trådarna i ett projekt kan nu köras på användarens dator. Hittills har varje tråd varit en molnsession på en egen gren, och dokumentationen rekommenderade en lokal session utanför projektet för arbete som kräver verktyg som bara datorn kan nå (en lokal databas, en emulator eller ett API bakom ett VPN). Anthropic säger sig också öppna Projects för fler Pro- och Max-prenumeranter på väntelistan; migreringen av användare från de äldre Claude-projekten pågår fortfarande. Tillkännagivandet ligger före dokumentationen: på kvällen den 24 september angav Projects-sidan fortfarande att lokala sessioner inte kan ingå i ett projekt, och inlägget på X säger inte varifrån man startar dessa trådar.

🔗 Tillkännagivandet från @ClaudeDevs · Dokumentation om Projects


Perplexity: Fast Search och Photon

24 september — Perplexity lägger till ett snabbt läge, Fast Search, i sitt Search API. Det aktiveras med parametern search_type: "fast". Företaget presenterar också motorn bakom det: Photon, en tjänst för hämtning och rangordning (retrieval and ranking) skriven i Rust, som ersätter den open source-motor företaget tidigare hade anpassat och nu används för alla sökningar hos Perplexity.

Fast Search runs on Photon, our new Rust-based retrieval and ranking service that we built with a small team of engineers and hundreds of agents.

🇸🇪 Fast Search bygger på Photon, vår nya tjänst för hämtning och rangordning skriven i Rust, som vi byggde med ett litet team av ingenjörer och hundratals agenter. — @perplexity_ai på X

JämförelsepunktStandardsökningFast Search
Search API, 1 000 förfrågningar5 dollar1 dollar
Verktyget web_search i Agent API, 1 000 anrop (exkl. token)2,50 dollar1 dollar
Poäng på 3 554 uppgifter i sex benchmarktester för agenter64,0 %64,3 %
Uppskattad kostnad, modell och sökning, för dessa uppgifter187,60 dollar59,73 dollar
Latens per anrop, median och 95:e percentilen (egna uppgifter)Ej publicerad160 ms och 230 ms

Avvägningen är uttalad: i interna tester med ovanliga sökfrågor sjunker relevansen med 0,24 poäng och sannolikheten att få ett svar med omkring 3 procentenheter. Perplexity rekommenderar Fast Search för vanligt agentarbete och standardsökning för svåra eller tvetydiga frågor. Blogginlägget påpekar att latensjämförelsen med andra API:er bygger på siffror som varje leverantör själv har uppgett, utan kontrollerat test; för Search API kräver Python- och TypeScript-SDK:erna tills vidare att man kringgår deras validering. I produktion har Photon sänkt motorns interna p99-latens från cirka 800 till 65 ms, med omkring 20 % färre maskiner.

🔗 Photon: Building a Retrieval and Ranking Engine From Scratch · Dokumentation om Fast Search


Videoavatarer i realtid: Meta och Google lanserar med några timmars mellanrum

Meta och Google har med bara några timmars mellanrum lanserat samma typ av produkt: en videoavatar som lyssnar, talar och reagerar i realtid, driven av en röstmodell.

Muse Realtime Avatar

23 september — Meta Superintelligence Labs beskriver Muse Realtime Avatar, Muses ansikte. Utifrån en referensbild (ett porträtt, en helkroppsillustration, ett djur eller ett vardagsföremål) animerar modellen en figur live, med ansiktsuttryck, handgester och kroppsrörelser. Ett enda flöde av taltoken, framtaget av röstmodellen Muse Realtime Voice, styr ljud och bild så att röst och läpprörelser hålls synkroniserade. Genom destillering minskar antalet beräkningar från 120 till 2 utvärderingar per segment.

Mått enligt MetaAngivet värde
Porträttvideo448x768, 25 bilder/s
Svarslatens för röst och videoCirka 870 ms
Samtidiga sessioner per GB20012
Föredras framför Runway Characters78 % mot 22 %
Föredras framför HeyGen LiveAvatar88 % mot 12 %

Preferenssiffrorna kommer från en mänsklig utvärdering utförd av Meta, som påpekar att skillnaden i uppträdande jämfört med Runway inte är statistiskt signifikant. Varje video innehåller den osynliga vattenstämpeln Meta Video Seal.

🔗 Bringing Your Muse to Life

Gemini 3.8 Live med Live Avatar

24 september — Nio dagar efter Gemini 3.8 Live ger Google sin modell för röstdialog ett ansikte: avataren lyssnar, ser det användaren visar den (via kamera eller skärmdelning) och svarar med synkroniserad röst och video. Den är allmänt tillgänglig i Gemini Enterprise och tillgänglig för utvecklare via Live API på företagets agentplattform, med slutpunkter i USA och EU. Gemini 3.8 Live Extended Thinking är fortfarande i privat förhandsversion. Avataren talar 97 språk och anropar verktyg utan att avbryta samtalet. En anpassad avatar kräver registrering på en tillåtelselista. Enligt modellspecifikationen är utdata begränsade till 24K tokens och en sammanhängande interaktion kan pågå i några minuter. Avatarvideo kostar 1 dollar per miljon tokens, med 6 192 tokens per sekund tal; lyssnandet räknas inte. Allt förses med vattenmärket SynthID.

🔗 Googles tillkännagivande


Vad Claude kostar: cachen i Opus 5.5 och avslag som åter debiteras

Två publikationer från den 24 september handlar om vad Claude-användaren betalar: var besparingarna med Opus 5.5 uppstår och att vissa avslag åter börjar debiteras.

Längre sessioner och varför Opus 5.5 kostar mindre i dem

24 september — I ett inlägg på claude.com sammanställer Michael Segner användningen av Claude Code från mars till september 2026. Antalet promptar per session har inte förändrats, men Claude arbetar 3,3 gånger längre med var och en, med över 40 % fler modellanrop och 68 % färre avbrott. Kontexten per begäran har ökat 2,6 gånger, och förhållandet mellan indata- och utdatatokens har gått från 189:1 till 324:1. Läsning från cachen står därför för den största delen, vilket gör prissänkningen på 60 % med Opus 5.5 särskilt betydelsefull. Enligt Anthropic kostar en cachad token i Opus 5.5 en femtedel av vad den gör i konkurrerande modeller. I Opus 5.5 och Fable 5.1 återställs cachen inte längre när man ändrar ansträngningsnivån under en session, trots att guiden som publicerades den 22 september sade motsatsen.

🔗 Inlägg på claude.com

Blockerade begäranden debiteras åter i tre kategorier

24 september — Anthropic återupptar debiteringen av begäranden som företagets skyddsmekanismer blockerar innan Claude svarar, meddelar @ClaudeDevs. Enligt inlägget gäller det bara kategorier med låg andel falska positiva: biologi, destillationsattacker och utveckling av LLM vid teknikfronten. Skälet som anges är ”samordnade attacker” mot företagets system under de senaste veckorna. Anthropic uppger att 99,7 % av kontona för Claude Code, Claude.ai och Cowork inte utlöste någon sådan debiterbar blockering i nyligen genomförda tester och siktar på mindre än 0,1 % falska positiva. En obefogad blockering kan rapporteras med /feedback. Enligt dokumentationen debiteras ett avslag enligt modellens pris, både via Claude API och via Bedrock, Google Cloud och Microsoft Foundry. Varje avslagen begäran räknas mot hastighetsgränserna.

Avslagskategori (dokumentation)Debiteras före utdata
bioJa
frontier_llmJa
reasoning_extractionJa
cyberNej
general_harmsNej

🔗 Tillkännagivande från @ClaudeDevs · Så debiteras avslag


AI och hälsa: ebola i Kongo-Kinshasa, OpenEvidence, AlphaFold Database och NV-Reason-CT

Två tillkännagivanden från den 22 september, som vi tar upp här, sätter Claude i folkhälsans tjänst. NVIDIA publicerar också två öppna arbeten, ett inom virologi med Google DeepMind och EMBL-EBI och ett inom radiologi.

Ebola i Kongo-Kinshasa

22 september — I ”The Situation Report”, ett inlägg daterat den 22 september och delat av @AnthropicAI på kvällen den 23 september, beskriver Anthropic hur Claude används mot utbrottet av Bundibugyo-ebola i östra Demokratiska republiken Kongo. Enligt lägesrapporten den 19 september har 7 672 fall bekräftats och 3 699 personer avlidit (en dödlighet på 48,2 %), och inget vaccin är godkänt mot denna variant. Partnerskapet som samordnas av CEPI, tillsammans med WHO:s Afrikakontor och det nationella institutet för biomedicinsk forskning (INRB), arbetar med två team från Anthropic. WHO:s Afrikakontor har skrivit ett skill som hämtar siffror från varje hälsodistrikt, jämför dem med föregående dag och markerar trendförändringar. Det gör att den dagliga lägesrapporten kan tas fram på mindre än en timme i stället för en hel dag. CEPI använder Claude för att jämföra vaccinkandidater, medan experterna fattar de vetenskapliga besluten. INRB kan låta Claude Science sammanställa virusgenom och virusets fylogenetiska träd.

🔗 The Situation Report (Anthropic)

OpenEvidence gratis i omkring 100 länder

22 september — Under FN:s generalförsamling tillkännagav OpenEvidence ett partnerskap med Anthropic för att erbjuda kliniker i omkring 100 låg- och medelinkomstländer en specialiserad version av sin plattform utan kostnad. Bland länderna finns Uganda, Angola, Sudan, Haiti och Mongoliet (listan kommer från OpenEvidence, enligt Reuters). OpenEvidence besvarar kliniska frågor med stöd i sakkunniggranskad medicinsk forskning och behandlingsrekommendationer. Tjänsten är redan gratis i USA och Kanada. Enligt Reuters exklusiva rapport står Anthropics teknik för den bakomliggande driften, medan OpenEvidence anpassar systemet till varje region. De ekonomiska villkoren har inte offentliggjorts. Tillkännagivandet kommer från OpenEvidence och Reuters; Anthropic har inte delat det i sina officiella kanaler.

🔗 OpenEvidences tillkännagivande · Reuters exklusiva rapport

Proteinkomplex från över 2 800 virus i AlphaFold Database

24 september — NVIDIA ansluter sig till en koalition av åtta organisationer, däribland Google DeepMind, EMBL-EBI och CEPI, som publicerar förutsagda 3D-strukturer för proteinkomplex från över 2 800 virus i AlphaFold Database, från förkylningsvirus till nya hot som mpox. Förutsägelserna är märkta med konfidensnivå och har tagits fram med AlphaFold2, optimerat med NVIDIA BioNeMo Inference Runtime. Omkring 30 % av de tillagda interaktionerna finns inte i Protein Data Bank, den främsta databasen över experimentellt bestämda strukturer. NVIDIA öppnar också BioNeMo Structure Prediction Pipeline, som producerade uppgifterna, så att forskare kan använda den för sina egna mål. Publiceringen sammanfaller med ett möte om pandemiförebyggande i New York under FN:s generalförsamling. Databasen innehåller nu över 260 miljoner förutsägelser.

🔗 Hur öppen vetenskap kan hjälpa forskare att förbereda sig för nästa pandemi

NV-Reason-CT

23 september — NVIDIA publicerar NV-Reason-CT, en öppen vision-språkmodell för datortomografi av bröstkorg och buk. I stället för att behandla volymen som en stapel av 2D-snitt delar en 3D ViT-encoder upp den i 13 824 visuella tokens som skickas till språkmodellen Qwen3.5-4B. Modellen skriver strukturerade rapporter, redovisar ett resonemang inspirerat av en radiologs arbete och besvarar följdfrågor. På CT-RATE, det främsta offentliga benchmarktestet för förståelse av 3D-CT, rapporterar NVIDIA ett macro-F1 på 0,614 och ett macro-AUROC på 0,871, bättre än de publicerade modeller som jämförelsen omfattar (VoxelFM: 0,581 respektive 0,870). Modellvikterna finns på Hugging Face. NVIDIA betonar att detta är en forskningsbas som behöver anpassas för ett specifikt användningsområde, inte ett självständigt diagnostiskt verktyg eller en godkänd klinisk produkt.

🔗 Introduktion till NV-Reason-CT


OpenAI förespråkar internationella standarder för avancerad AI

23 september — Sam Altman, vd för OpenAI, talade inför FN:s säkerhetsråd, och OpenAI publicerar talet så som det hölls. Han beskriver två utvecklingar som måste undvikas: att förlora kontrollen över framtiden till AI och att makten koncentreras så att en person, ett företag eller ett land kan påtvinga andra sin världsbild med hjälp av de mest kraftfulla modellerna. När vi närmar oss system som kan förbättra sina egna efterföljare ”kräver det här ögonblicket yttersta försiktighet”, säger han. Enligt Altman har OpenAI redan saktat ned utvecklingen på eget initiativ och kommer att göra det igen.

It doesn’t matter whether people put the risk of catastrophe at 10%, or 1%, or 12%, or .1%. None of these levels are remotely acceptable.

🇸🇪 Det spelar ingen roll om man bedömer risken för en katastrof till 10 %, 1 %, 12 % eller 0,1 %. Ingen av dessa nivåer är ens i närheten av acceptabel. — Sam Altman, tal inför FN:s säkerhetsråd

Han riktar fyra uppmaningar till staterna: en mekanism som förenar nationella och internationella standarder för avancerad AI, gemensamma standarder för att jämföra underlag och kontrollera efterlevnad, protokoll för incidentrapportering samt säkra kommunikationskanaler mellan regeringar, operatörer av kritisk infrastruktur och experter. Han återkommer därmed till ett inlägg som OpenAI publicerade den 21 september och som vi tar upp här. Där hävdar OpenAI att helt autonom rekursiv självförbättring ännu inte finns och att den inte bör eftersträvas förrän den kan genomföras säkert. Företaget uppmanar USA att leda arbetet med globala tekniska standarder tillsammans med nätverket av institut för AI-säkerhet (tio länder, däribland Frankrike), samordnat av amerikanska CAISI (Center for AI Standards and Innovation). Enligt OpenAI skulle standarderna varken innebära licenskrav eller obligatorisk granskning före publicering; varje stat skulle avgöra vilken plats de får i den egna lagstiftningen. En dialog mellan USA och Kina om dessa frågor vore ”ett positivt framsteg”.

🔗 Att bygga standarder för nästa fas av AI


AI inom cyberförsvar: Daybreak för Ukraina och Fuzzing Taskflow

Två tillkännagivanden sätter modellerna i försvararnas tjänst: det ena öppnar ett program för en stat, det andra låter en agent sköta fuzzing.

Daybreak öppnas för Ukraina

23 september — OpenAI öppnar sitt cyberförsvarsprogram Daybreak för Ukrainas regering tillsammans med ministeriet för digital omvandling. Programmet ger verktyg för att hitta sårbarheter i programvara och därefter utveckla och testa korrigeringar snabbare, för att skydda civil infrastruktur. Tillkännagivandet gjordes i anslutning till FN:s generalförsamling av Dmytro Kushneruk, Ukrainas generalkonsul i San Francisco, och Sasha Baker, ansvarig för nationell säkerhetspolitik på OpenAI. OpenAI påminner om att CERT-UA, landets nationella incidenthanteringsgrupp, hanterade nära 6 000 cyberincidenter under 2025, riktade bland annat mot sjukhus, energiförsörjning och telekommunikation. Inlägget nämner två europeiska resultat: ENISA hittade sårbarheter i programvara som används av EU:s institutioner, vilka alla nu har åtgärdats, och CERT Polska bidrog till att upptäcka sex sårbarheter i en tredjeparts routerprogramvara. Varken tidsperiod eller belopp anges.

🔗 OpenAI utökar Ukrainas tillgång till cyberverktyg för civilt försvar

Fuzzing Taskflow från GitHub Security Lab

24 september — GitHub Security Lab publicerar Fuzzing Taskflow, en autonom pipeline för fuzzing av C/C++-projekt, licensierad under MIT och byggd på dess ramverk Taskflow Agent. Man anger ett GitHub-repo: agenten hittar ingångspunkter, skriver testhärvor, kör AFL++, granskar täckningen, klassificerar varje krasch enligt sju utfall och skriver en rapport för varje unikt fel, med ett föreslaget rättningsförslag märkt ”för granskning”. Agenten fattar besluten och MCP-verktyg utför dem. Varje iteration fördubblar tidsbudgeten, från 30 till 960 sekunder (omkring 32 minuter per mål), och slingan avslutas när två iterationer ger mindre än 1 % ytterligare täckning. Standardmodellen är Claude Sonnet 5, som klarade alla teamets interna tester. Security Lab varnar för att pipelinen kör kommandon som valts av LLM utan container och därför bör användas i en miljö som kan kasseras. Inlägget ger inga siffror över antalet hittade fel.

🔗 Inlägg från GitHub Security Lab


Project Suncatcher: TPU i omloppsbana

24 september — Project Suncatcher, Googles projekt för att undersöka AI-beräkning i rymden som presenterades förra året, går vidare till sitt första test i omloppsbana. En prototypsatellit byggd tillsammans med Planet ska skjutas upp med SpaceX-uppdraget Transporter-18, och i inlägget från den 24 september meddelas att Googles första TPU i omloppsbana kommer ”nästa vecka”. Målet är att kontrollera att kretsarna klarar uppskjutningen, strålningen och temperaturskillnaderna. På marken har TPU Trillium som utsatts för en protonstråle vid UC Davis under full AI-belastning klarat en högre stråldos än den som väntas under ett femårigt uppdrag. Kylning med värmerör och radiatorer har prövats i en termisk vakuumkammare. Nästa steg 2027 är två satelliter som ska testa laserförbindelser med mycket hög kapacitet. En satellit i låg omloppsbana fångar upp till åtta gånger mer solenergi än på marken, enligt Google.

🔗 Bakom Project Suncatcher


Generativa bilder och videor: Midjourney, Runway, Google Research och Nunchux

På skaparsidan förbättrar Midjourney sina redigeringsverktyg, Runway redovisar siffror för sin modellrouter, Google Research skapar videor på flera minuter i följd och Nunchux snabbar upp MiniMax-H3 på AMD-GPU:er.

Midjourney: inpainting, —tile och snabba modeller i alfa

24 september — Midjourney släpper en ny version av parametern --tile, som skapar upprepningsbara mönster, för V8.1 och V8.2. Enligt Midjourney försvinner de synliga skarvarna mellan plattorna. Inpainting och outpainting i redigeringsmodellen ändrar nu bara de markerade pixlarna, vilket gör det möjligt att redigera bilden flera gånger utan att försämra resten. På alpha.midjourney.com experimenterar Midjourney med snabba modeller (fast models), som på X beskrivs som en första förhandsvisning av realtidsmodeller. Med alternativet ”Live previews” förhandsvisar fältet Styles den senaste prompten i varje stil, och ett klick startar genereringen. Varken namn eller tidsplan anges. Alfaändringsloggen från den 23 september lägger dessutom till standardinställningar (Settings → Advanced → Your defaults) och gör koreanska tillgängligt för alla på midjourney.com.

🔗 Tillkännagivande från @midjourney · Midjourneys uppdateringar

Runway redovisar siffror för sin Model Router

24 september — Runway publicerar en första kvantitativ utvärdering av Model Router, routern i Runway Dev som väljer genereringsmodell för varje begäran utifrån önskemål om kostnad, kvalitet eller latens. Metoden jämför Seedance 2.5 som referens med tre routerinställningar för 250 promptar för bild-till-video, bedömda dubbelblint.

Testad inställningAnvändbara videorKostnad per klippSkillnad i utgift
Referens (Seedance 2.5)78 %1,80 dollar—
Router för kvalitet77 %1,28 dollar-29 %
Kvalitet med tak på 1 dollar74 %0,61 dollar-66 %
Router för kostnad38 %0,30 dollar-83 %

Enligt Runway behåller inställningen med kostnadstak 95 % av referenskvaliteten. Den presterar bättre på dialog och läppsynkronisering (96 % mot 92 %), men sämre på fysik (52 % mot 60 %). Runway rekommenderar den för produktion och avser kostnadsläget för utforskning. Bland utvecklare som redan använder routern har 64 % ställt in den på kostnad.

🔗 Utvärdering av kostnad och kvalitet med Runway Model Router

AI video co-director från Google Research

24 september — Google Research presenterar AI video co-director, ett orkestreringslager med flera agenter ovanpå Gemini och Veo för att skapa sammanhängande berättande videor på flera minuter. Diffusionsmodeller har svårt att sätta ihop bildsekvenser utan att kostymer och miljöer förändras. Systemet består av fyra forskningsramverk: en banditalgoritm som väljer kreativ strategi, berättarform och estetik innan en multimodal domare bedömer resultatet; CANVAS, som upprätthåller ett visuellt minne av karaktärer, platser och föremål; A²RD, som genererar segment för segment och har skapat en sammanhängande film på tio minuter; samt VQQA, som skriver om prompten utifrån kritik från en vision-language-modell. På GenAD-Bench, ett av de tre benchmarktest som teamet har skapat (400 reklamscenarier), når systemet som högst 81,4 i kvalitetspoäng. Det rör sig om forskning: varken någon produkt eller något tillgänglighetsdatum har meddelats.

🔗 Automatisering av sammanhängande videogenerering i långt format

MiniMax-H3 på AMD MI355X genom Nunchux

24 september — Resultat som Nunchux AI publicerade den 23 september och som MiniMax har spridit vidare visar MiniMax-H3, MiniMax videomodell med öppna vikter, på en server med åtta AMD MI355X-GPU:er: en video på 5 sekunder genereras på 1,33 sekunder och en på 15 sekunder på 5,39 sekunder, i 1344×768. Jämfört med SGLang på samma hårdvara, kört i BF16 med 50 Euler-steg, är hastighetsökningen 21,8 till 26,7 gånger. Tiderna omfattar textkodning, brusreducering samt video- och ljudavkodning, men inte den slutliga MP4-kodningen. Nunchux tillskriver ökningen sin modelloptimerare och inferensmotor, med en egen MXFP6-kärna. Hastigheten gör det möjligt att ändra prompten under uppspelning. Kostnadsfri tillgång utlovas ”mycket snart” via en väntelista; mätningarna kommer från Nunchux.

🔗 Videogenerering på AMD MI355X · Vidareförmedlat av @MiniMax_AI


Kodagenter: Claude Code, Delta, Devin, Qwen Code och Kimi Code

Fem kodagenter släpper nya versioner: Claude Code från Anthropic, Delta från Zed, Devin från Cognition, Qwen Code från Alibaba och Kimi Code från Moonshot AI.

Claude Code 2.1.282

24 september — Claude Code 2.1.282, som släpptes kl. 18.38 UTC, har 86 poster, varav 59 är felrättningar. Inställningen maxProseWidth begränsar bredden på Claudes text i breda terminaler, medan tabeller och kodblock behåller hela bredden. Flera ändringar begränsar vad ett projekt kan påtvinga användaren: projektinställningar och lokala inställningar ignorerar OpenTelemetry-variabler som aktiverar export eller samlar in innehåll (CLAUDE_CODE_ENABLE_TELEMETRY, OTEL_LOG_*), vilket meddelas vid start och via /status och claude doctor. Namnrymderna anthropic-skills och claude-ai är reserverade för skills som synkroniseras från claude.ai, och den hanterade inställningen allowClaudeInChromeWithManagedMcp gör det möjligt att starta claude --chrome bredvid en exklusiv managed-mcp.json. Autoläget använder som standard klassificeraren på serversidan vid direkt anslutning till API:et, även när telemetri är avstängd. Felrättningar förhindrar också att utökat tänkande (extended thinking) går förlorat när sessioner återupptas.

🔗 Versionsinformation för Claude Code 2.1.282

Delta 0.17 från Zed

23 september — Zed släpper version 0.17.0 av Delta, sin miljö för att koda tillsammans med agenter, som har varit i offentlig beta sedan den 16 september: 20 nyheter, 26 förbättringar och 59 felrättningar. Från en tråd går det nu att be agenten starta flera uppgifter, var och en i en egen tråd på högsta nivån med en isolerad arbetsyta, så att de kan utföras parallellt. Agenterna kan också skriva till varandra mellan trådar. Kommandona /approve och /request-changes ger ett granskningsutlåtande i valfri tråd. Versionen innehåller också de två funktioner som aviserades den 22 september: trådfärger som ärvs av undertrådar och underagenter, samt en mätare för framstegen mot automatisk komprimering i kontextpanelen, uppdelad på instruktioner, meddelanden, tänkande och verktyg.

🔗 Versionsinformation för Delta · Meddelande från @zeddotdev

Devin Review: kombinerbara utlösare och Perforce

23 september — Devins versionsinformation från den 23 september, med 26 rubriker, ägnar stort utrymme åt Devin Review, verktyget för granskning av pull requests. Automatisk granskning bygger nu på kombinerbara utlösare: man riktar in sig på ett konto, en organisation, ett repository, ett prefix för repositoryn eller en medlem och filtrerar sedan efter författare, label, grenar, ändrade filer, typ av författare (människa, bot eller Devin) eller diffens storlek. Villkoren kan kombineras; varje utlösare anger när granskningen sker, och undantag har alltid företräde. Devin Review får också stöd för Perforce: en Helix Swarm-granskning kan utlösa det via en testdefinition eller, från och med Swarm 2026.3, via en utgående webhook. Kapacitetsväljaren visar nu modellnamnen (Ultra: Fable 5.1 och GPT-6 Astra), och Devins GitHub-app begär sex nya behörigheter som administratörer behöver godkänna.

🔗 Devins versionsinformation från den 23 september

Qwen Code v0.24.5

24 september — Qwen Code v0.24.5 är en stabil version utan aviserade inkompatibla ändringar. Den har 87 poster, varav 28 funktioner och 38 felrättningar. Qwen Live, agentens röstsamtal i realtid, går nu via Web Shell i webbläsaren på alla plattformar. På macOS blir den inbyggda värdkomponenten valfri (QWEN_SERVE_LIVE_NATIVE_HOST=1). Under ett samtal kan användaren dela sin skärm, som överförs med högst en bild per sekund, utan att skärmdelningen i sig utlöser ett svar. Web Shell får en tidslinje över körningens förlopp i tre spår (huvudsession, verktygsanrop och underagenter), och meddelandekanalerna leder meddelanden till separata sessioner utifrån deras prefix (messageRoutes). På integritetssidan respekterar läget --bare nu användarens val att avstå från användningsstatistik. Qwen Code Desktop v0.24.5 och TypeScript-SDK:t v0.1.15 följde samma dag.

🔗 Versionsinformation för Qwen Code v0.24.5

Kimi Code 2.1.1 upphäver säkerhetsskärpningarna i 2.1.0

24 september — Mindre än 19 timmar efter 2.1.0, som den 23 september presenterades som en säkerhetsskärpning, backar Kimi Code 2.1.1 från ändringarna. Versionsinformationen säger att ”vissa alltför defensiva ändringar” tas bort. Pull request #4013 är tydligare: den upphäver skärpningen av arbetsytans förtroendegräns med motiveringen att innehållet i ett repository är användarens ansvar när användaren väl har godkänt det. De fyra berörda skydden försvinner: filverktygen följer åter symboliska länkar utanför arbetskatalogen, den lokala konfigurationen (local.toml tillämpas utan att invänta godkännande, repositoryts git-konfiguration begränsas inte längre vid bakgrundsåtgärder, och hemkatalogen eller rotkatalogen avvisas inte längre som extra kataloger. Om läsningen av förtroendeinformationen misslyckas räknas platsen fortfarande som ”inte godkänd”. Filbevakarna, som stängdes av i 2.1.0, aktiveras åter som standard.

🔗 Versionsinformation


Skrivbordsagenter: Portable Computer från Perplexity och Kimi Work 3.2.14

Två skrivbordsagenter som arbetar på användarens dator utvecklas den 24 september: Perplexity öppnar Portable Computer för datorer med AMD-processorer, och Moonshot AI släpper Kimi Work 3.2.14.

Portable Computer på AMD Ryzen AI Max

24 september — Portable Computer, den helt lokala versionen av Perplexitys agent Computer, fungerar nu på Windows-datorer med processorer i AMD Ryzen AI Max Series, däribland utvecklingsplattformen Ryzen AI Halo. Tidigare nämnde de publicerade systemkraven bara NVIDIA-hårdvara, från DGX Spark till datorer med RTX-GPU. Det krävs minst 24 Go minne tillgängligt för GPU:n, Windows 10 eller 11 och cirka 20 Go diskutrymme. Två lokala modeller erbjuds på dessa maskiner, PPLX 27B, som Perplexity har eftertränat, och Qwen 27B, medan produktsidan bara erbjuder PPLX 27B på RTX-datorer. En lokal klassificerare identifierar namn, kontonummer och identifierare innan något lämnar datorn, och lokal inferens förbrukar inga Computer-krediter. Erbjudandet är öppet för Pro- och Max-prenumeranter, både privatpersoner och företag.

🔗 Portable Computer kommer till agentdatorer med AMD-processorer

Kimi Work 3.2.14: sidokonversationer och versionshistorik

24 september — Två dagar efter 3.2.12 släpper Moonshot AI Kimi Work 3.2.14, nästa version av sin skrivbordsagent, utan något tillhörande inlägg på X. Den viktigaste nyheten är sidokonversationen (Side Chat): via panelen ”+” öppnar man en fristående konversation inom en session som ärver kontexten från den ursprungliga konversationen. Man kan också citera ett markerat avsnitt ur konversationen. Office-filer får versionshistorik, och i webbläsaren går det att kommentera webbsidor och sedan citera kommentarerna i inmatningsfältet. Fjärrstyrningen (Remote Control) gör det nu möjligt att förhandsgranska filer och skicka bilagor från telefonen, och funktionen för att hålla datorn vaken (Keep Awake) aktiveras numera bara på begäran.

🔗 Versionsinformation för Kimi Work


Öppna modeller och laboratorier: Tev1, LFM2.5-VL-DSpark, LeRobot och Sakana AI

I det öppna ekosystemet: en liten beslutsmodell, en utkastmodell som snabbar upp en vision-language-modell, ett nytt dataformat för robotik och Jürgen Schmidhubers ankomst till Sakana AI.

Tev1-4B-experimental från Together AI

23 september — Together AI släpper Tev1-4B-experimental, en liten beslutsmodell: den får en situation, en fråga och en lista med 2 till 24 alternativ och svarar med bokstaven för det valda alternativet. Det är en finjustering av Qwen3.5-4B inspirerad av Jev, beslutsmodellen som ofta nämns i inlägg från Hugging Face-communityn. Modellbeskrivningen klargör att det inte är en Jev-motor; modellen behåller Qwens vanliga språkhuvud. Together lyfter fram kostnaden: 17 dollar för träning, med datarecept och en handledning. Modellen erbjuds för 0,042 dollar per miljon inkommande tokens och 0 dollar för utgående tokens. På sin huvudsakliga utvecklingsdatamängd fattar den 880 rätt beslut av 1 000, ett resultat som modellbeskrivningen skiljer från ett oberoende benchmarktest. Licensen för de finjusterade vikterna är ”under färdigställande”.

🔗 Meddelande från Together AI · Modellbeskrivning

LFM2.5-VL-DSpark från Liquid AI

24 september — Liquid AI utökar sin teknik DSpark för spekulativ avkodning till vision-language-modellen LFM2.5-VL-3B. Utkastmodellerna för text presenterades den 20 augusti. En utkastmodell med 279,5 miljoner parametrar (+8,9 %) föreslår flera tokens i förväg som målmodellen kontrollerar, utan att ändra det slutliga svaret vid girig avkodning. På Mac M5 Max med MLX går avkodningen 2,30 till 3,13 gånger snabbare, och den totala latensen förbättras med en faktor på 1,56 till 2,62. På H100 går avkodningen upp till 2,66 gånger snabbare. Den faktiska vinsten begränsas fortfarande av bildkodningen, som tekniken inte snabbar upp. Utkastmodellen stöds från första dagen av llama.cpp, MLX-VLM och SGLang.

🔗 Snabbare vision-language-modeller med LFM2.5-VL-DSpark

LeRobot och LanceDB

24 september — LeRobot, Hugging Faces bibliotek för robotinlärning, kan nu läsa datamängder i Lance-format direkt med samma API:er för träning. Därmed går det att träna direkt från Hub eller objektlagring, utan att ladda ned hundratals gigabyte och med blandning av data över hela datamängden. På DROID (27,6 miljoner bildrutor, 369 Go video) tog 10 000 steg med SmolVLA på 8 H100 1 h 27 från fjärrlagring, jämfört med 2 h 00 med standardläsaren på en lokal NVMe-kopia, som dessförinnan krävde en nedladdning på 384 Go. Den slutliga förlusten är identisk: skillnaden beror på tiden som går åt till att vänta på data, 1,7 % jämfört med 37,4 %. På en liten datamängd är de två metoderna likvärdiga.

🔗 Så tränar du din robot: LanceDB-utgåvan

Jürgen Schmidhuber hos Sakana AI

24 september — Sakana AI meddelar att Jürgen Schmidhuber blir vetenskaplig chefsrådgivare (Chief Scientific Advisor), en roll han kommer att kombinera med sina nuvarande uppdrag. Han är känd för sitt arbete med världsmodeller, metainlärning och Gödelmaskinen och ska engagera sig i RSI Lab hos startupbolaget i Tokyo, som arbetar med rekursiv självförbättring. Han kommer också att regelbundet besöka Tokyo. Enligt Sakana har hans forskning, däribland avhandlingen från 1987 om rekursiv självförbättring, direkt inspirerat Darwin Gödel Machine och The AI Scientist. Meddelandet visar också en ny inriktning: Sakana arbetar med sina första ”agentbaserade” världsmodeller, som kan simulera de fysiska följderna av en handling innan den utförs, med japansk tillverkningsindustri i sikte.

🔗 Jürgen Schmidhuber ansluter till Sakana AI


Kortnyheter

  • Claude Tag och personliga anslutningar — I en Slack-kanal kan Claude Tag nu använda de personliga anslutningarna för den person som tilltalar den (kalender, drive, CRM), och endast den personens, med granskning av varje svar eller i autoläge. De används aldrig för schemalagda rutiner. Utrullningen pågår för Team; Enterprise följer. 🔗 källa
  • Sora 2 lämnar API:et — Som meddelades den 24 mars stängdes Sora 2-modellerna och Videos API av den 24 september, utan något likvärdigt ersättnings-API. Fem identifierare tas bort, från sora-2 och sora-2-pro till deras daterade ögonblicksversioner. Nedstängningen bekräftas endast i dokumentationen. 🔗 källa
  • ChatGPT Ads i Sydostasien — ChatGPT:s annonsplattform lanseras i Indonesien, Malaysia, Filippinerna, Singapore, Thailand, Vietnam och Taiwan och omfattar nu över 60 länder, jämfört med över 40 i slutet av augusti. Endast abonnemangen Free och Go visar annonser. 🔗 källa
  • Grab och OpenAI — Programmet GO Forward with AI ska under två år utbilda 30 000 förare, bud och handlare som är partner till Grab, med start i Singapore, genom workshoppar byggda på OpenAI Academy och ChatGPT Work. 🔗 källa
  • Tre fallstudier hos OpenAI — Ringg hanterar över 7 miljoner besvarade samtal i månaden och har sänkt modellkostnaden med omkring 90 % för arbetslaster som flyttats från GPT-4.1 till GPT-5.6 Luna. invideo säger sig ha ungefär tredubblat sin framgång med färgkorrigering med GPT-6 Astra. Harvey delar sina erfarenheter utan att ange några siffror. 🔗 källa
  • ChatGPT för iOS 1.2026.258 — Posten från den 23 september i ändringsloggen för ChatGPT & Codex beskriver en omarbetad startskärm, en delad vy på iPad som visar uppgiftslistan bredvid den öppna uppgiften och en korrigering av misslyckad SSH-parkoppling på Mac och Linux. 🔗 källa
  • Gemini CLI v0.61.0 — Gemini 3.8 Flash och Gemini 3.5 Flash Lite, som redan fanns i nightly, blir tillgängliga i stable genom en cherry-pick som inte nämns i den officiella versionsinformationen. v0.62.0-preview.0 inleder nästa preview-kanal. 🔗 källa
  • Gemini i Chrome — På datorer skapar Gemini in Chrome interaktiva quiz utifrån den öppna fliken, till en början på engelska i USA och Indien. Det kan nu också analysera nästan alla poddar eller videofiler som spelas upp i sin helhet, utöver YouTube. 🔗 källa
  • Google Photos — Den virtuella garderoben, som katalogiserar kläder från foton så att man kan prova olika kombinationer, öppnas för berättigade användare i USA, Indien och Brasilien, tillsammans med retrostilarna Moods och 15 nya Remix-mallar. 🔗 källa
  • API Gateway som MCP-server — I publik förhandsversion omvandlar Google Cloud API Gateway operationerna i ett REST-API till MCP-verktyg utifrån dess annoterade OpenAPI 3.x-specifikation. Autentisering, kvoter och loggar återanvänds, med stöd för upp till 1 000 verktyg per gateway. 🔗 källa
  • PostgreSQL for agents i AlloyDB — I förhandsversion skapar AlloyDB på några sekunder isolerade, skrivskyddade instanser med data som släpar efter med högst någon sekund, för att hantera agenternas anhopningar av förfrågningar. Google uppger över 3 miljoner förfrågningar per sekund. 🔗 källa
  • OLMo 3 7B återskapad på TPU — Google Clouds TPU-team har i MaxText återskapat förträningen av Ai2:s OLMo 3 7B (cirka 5 900 miljarder token). Modellen går inte att skilja från originalet i åtta benchmarks och når 44,5 % FLOPs-utnyttjande på Ironwood, efter att teamet hittat en bugg i dataladdaren. 🔗 källa
  • The Talking Museum — Google Arts & Culture Lab öppnar ett virtuellt studierum med över 190 kulturföremål i 3D. Besökaren kan vrida på dem medan Gemini berättar om deras historia och svarar på frågor. 🔗 källa
  • DeepSeek Harness 0.1.7-rc.2 — Den andra release candidate-versionen på två dagar och den 22:a förhandsversionen utan någon stabil version: uppgifter fortsätter i bakgrunden när Desktop-fönstret stängs, och schemalagda uppgifter överlever en omstart och kan upprepas så ofta som en gång per minut. 🔗 källa
  • En förfrågningsrouter på Jetson — På Hugging Faces blogg ersätter Eric Mey en 9B-modell med en finjusterad ModernBERT-large som väljer svarstyp: 180 rätta routningar av 180, jämfört med 175, på 42 ms jämfört med 771 ms, på olika hårdvaror. Modell, data och kod finns under Apache-2.0. 🔗 källa
  • Utökat genomiskt Carbon-korpus — Parag Ekbote publicerar en pipeline för processorer, utan Carbon-modellen, som lägger till längd, GC-halt, kodningsstatus och taxonomi för 32,4 miljoner poster i HuggingFaceBios förträningskorpus. 🔗 källa
  • ZCode v3.14.3 — Den enda GitHub-versionen av ZCode, Z.ai:s agentramverk, sedan koden öppnades den 21 september: samtidigheten i ett pågående arbetsflöde kan ändras utan att det stoppas, och arbetsflödesskripten förbrukar färre token. 🔗 källa
  • xAI:s Python-SDK 1.20.0 — För grok-imagine-video-1.5 låser last_frame_url klippets sista bildruta och keyframes placerar upp till fyra nyckelbilder i klippet. Dessa alternativ beskrevs redan i API-dokumentationen. 🔗 källa
  • Copilot code review — Sidan med personliga inställningar för kodgranskning öppnas för alla Copilot-abonnemang, inklusive Business och Enterprise. Automatisk granskning utökas till nya pushar och utkast, och företag kan ange en standardnivå för granskningsinsatsen. Som meddelades i slutet av augusti ändrar GitHub standardnivån från Lite till Balanced den 28 september. 🔗 källa
  • Närvarobevis i GitHub Enterprise Cloud — I publik förhandsversion kan åtgärder med stor påverkan (skapande av token, webhooks, säkerhetsinställningar) kräva förnyad autentisering eller MFA hos identitetsleverantören, giltig i två timmar. Funktionen är begränsad till företag med EMU och GHEC-DR som använder Microsoft Entra ID. 🔗 källa
  • Slut för Node 20 i GitHub Actions — Runners kör nu JavaScript-actions med Node 24, alternativet att falla tillbaka tas bort, och självhostade runners på macOS 13.4 eller äldre samt ARM32 stöds inte längre. 🔗 källa
  • Arbetsytorna i Copilot-appen — Burke Holland argumenterar för de små fullstack-apparna som samspelar med agenten i stället för att allt ska ske i chatten, med tokenbesparing som argument. Ingen ny funktion tillkommer; arbetsytorna har funnits sedan juni. 🔗 källa
  • Amp delar sina runners — En runner som startats med --share kan nu användas av hela arbetsytan via ampcode.com. Amp varnar för att andra medlemmar då kör kod under värdens identitet, och administratörer kan stänga av delningen. 🔗 källa
  • Modellväljaren i v0 — Uppföljning från den 22 september: den nya väljaren visar modellerna i AI Gateway och deras pris per token. Den kommer till Enterprise-team, där ägaren måste aktivera Allow custom models. 🔗 källa
  • BioNeMos MoE-recept — NVIDIA beskriver träning av biologiska modeller med en blandning av experter med BioNeMo och Transformer Engine: upp till 2,21 gånger högre genomströmning än referensen från Hugging Face på Mixtral-8x7B och åtta B200. Den sammanslagna kärnan är förbehållen Blackwell. 🔗 källa
  • Draft-läge för Seedance 2.5 i Runway — Snabbare utkast som kostar färre krediter gör det möjligt att utforska idéer innan de bästa skapas i full kvalitet. Runway anger inte kreditkostnaden, och samma läge kom till Pika den 22 september. 🔗 källa
  • Runway MCP i Cursor Marketplace — Runways MCP-server kan installeras från Cursor Marketplace sedan den 23 september, och sedan den 22 september kan agenter läsa Brand Kits utan att ändra dem. 🔗 källa
  • Pika API Club — Pika sätter siffror på medlemmarnas besparingar jämfört med Fal.ai: 12 185,80 dollar mindre för 3 822 Seedance 2.5-genereringar under 30 dagar hos Vuvie, och en månadsräkning som sjunkit från cirka 2 000 till 990 dollar hos AI-Bridge. 🔗 källa
  • HeyGen-studie om avatarer — Bland 1 000 småföretag har 71,6 % redan spelat in en video som aldrig publicerats. Bland användare av avatarer säger 71,1 % att de sparar tid och 55,3 % att de publicerar oftare. 🔗 källa
  • Luma-undersökning — Uppföljning från den 22 september: bland 760 yrkesverksamma kreatörer har 81 % redan publicerat innehåll skapat med AI, men ingen enskild uppgift når över 42 % användning, och 62 % oroar sig för att bli beroende av AI på bekostnad av mänsklig kreativitet. 🔗 källa
  • Perplexitys guide till marknadsundersökningar — En guide i åtta steg med exempelinstruktioner, verifieringssteg och en checklista med fem punkter. Ingen ny funktion tillkommer; guiden hänvisar till Deep Research och Spaces. 🔗 källa

Vad det betyder

Agenten flyttar ut ur chattfönstret. Muse talar med en röst som användaren beskriver, visar sig som en avatar, styr en Mac och ska komma till glasögon och sedan, enligt Mark Zuckerberg, till en enhet i fickformat i december. Google ger också Gemini 3.8 Live ett animerat ansikte för reception och kundservice, Perplexity installerar sin lokala agent på datorer med AMD-processorer, och Claude Code fortsätter arbeta i molnet när den bärbara datorn har stängts. Tidsplanerna skiljer sig åt: datoranvändning på Mac och Live Avatar finns redan, medan Muse på glasögon utlovas ”under de kommande månaderna” och någon tidpunkt för dess e-postadress inte har angetts.

Kostnaden för agentbaserat arbete blir ett argument i siffror. Anthropic erbjuder 100 eller 250 dollar i kredit för molnsessioner och visar med användningsdata att läsning från cache nu står för den största delen i Claude Code, där förhållandet mellan indata och utdata har ökat från 189:1 till 324:1. Perplexity tar 1 dollar för 1 000 förfrågningar med Fast Search i stället för 5 och uppskattar besparingen för agentuppgifter till omkring 68 % vid jämförbara resultat. Runway behåller 74 % användbara videor till 66 % lägre kostnad. Together AI tränar en beslutsmodell för 17 dollar. Var och en mäter sina besparingar med sin egen metod: siffrorna är användbara, men sällan direkt jämförbara.

Tilliten avgörs från fall till fall, ibland i motsatt riktning. Anthropic tar åter betalt för vissa avslag för att motverka ”samordnade attacker”, med målet att hålla falska positiva resultat under 0,1 %. Claude Code 2.1.282 hindrar ett projekt från att påtvinga sin telemetri, medan Kimi Code 2.1.1 mindre än 19 timmar efter införandet tar bort skydden i 2.1.0 med motiveringen att ett godkänt kodförråd är användarens ansvar. GitHub testar närvarobevis före känsliga åtgärder. På försvarssidan öppnar OpenAI Daybreak för Ukraina, och GitHub Security Lab låter en agent sköta fuzzing men varnar för att den gör fel och måste köras i en tillfällig miljö.

Slutligen diskuteras regler och infrastruktur i stor skala. I FN efterlyser Sam Altman internationella standarder för avancerad AI, som OpenAI vill att USA ska leda arbetet med tillsammans med nätverket av institut för AI-säkerhet, utan krav på licens eller granskning före publicering. Google förbereder sina första TPU:er för omloppsbana för att pröva beräkning i rymden, och Perplexity har skrivit om motorn som hanterar alla dess sökningar i Rust, vilket har sänkt p99-latensen från omkring 800 till 65 ms. Standarder som förhandlas mellan stater, kretsar i omloppsbana och en omskriven motor: infrastrukturen som driver agenterna byggs samtidigt som de själva.


Källor