Sök

Claude Dashboards och Claude Motion, Cyber Mission och OSS Scanner, GPT-6.1 Sol i Ultrafast

ai-powered-markdown-translator

Artikel översatt från franska till svenska med gpt-6.1-sol.

Visa projekt på GitHub ↗

Anthropic lägger till två funktioner i Claude, Claude Dashboards för dashboards som hålls uppdaterade och Claude Motion för animationer skrivna i kod, och tar Docs, Slides och Design ur beta för alla abonnemang, inklusive Free. Samma dag lanserar företaget sin Cyber Mission, med ett program för att skydda kritisk infrastruktur och OSS Scanner, som erbjuder open source-projekt gratis skanningar med företagets mest kraftfulla modeller. OpenAI lanserar samtidigt nivån Ultrafast för GPT-6.1 Sol, upp till 8 gånger snabbare än Standard-läget, medan Anthropic och NVIDIA gör åtaganden inom Genesis Mission på 150 miljoner respektive 1 miljard dollar.


Claude Dashboards och Claude Motion i beta, Docs, Slides och Design för alla abonnemang

8 oktober — Anthropic lägger till två funktioner i Claude. Med Claude Dashboards, i beta för betalabonnemang, ansluter man företagets dataplattform (Amazon Redshift, BigQuery, ClickHouse, Databricks eller Snowflake) eller en annan connector, exempelvis för affärsmöjligheter i Salesforce, och ställer sedan en fråga med vanligt språk: Claude skriver frågan, bygger en dashboard och håller den uppdaterad när data ändras. Ett klick på en siffra visar frågan som tar fram den, och varje diagram anger när dess data senast uppdaterades. Anthropic avser funktionen för snabba och utforskande frågor; för att gå vidare kan dashboarden skickas till Amplitude, Grafana, Hex, Mixpanel, Omni, Perplexity, PostHog eller Sigma, medan stöd för Looker, monday.com och Tableau väntas.

Claude Motion, i beta för Team och Enterprise, är avsett för korta animationer: en 30 sekunder lång förklarande video utifrån en kvartalsrapport, ett animerat diagram i en presentation eller en produktdemonstration. Eftersom ingen modell för videogenerering används innehåller animationen varken AI-genererade sekvenser eller personer.

Claude Motion turns reports, charts, or product walkthroughs into short animations. Claude writes each one as code, with no video model involved, so you can change any word, number, or timing, then export an MP4. In beta on Team and Enterprise plans.

🇸🇪 Claude Motion förvandlar rapporter, diagram eller produktdemonstrationer till korta animationer. Claude skriver var och en av dem i kod, utan någon videomodell, så att du kan ändra vilket ord, tal eller vilken tidsinställning som helst och sedan exportera en MP4. I beta för abonnemangen Team och Enterprise. — @claudeai på X

Samma dag lämnar Claude Docs, Slides och Design beta och blir tillgängliga för alla abonnemang, inklusive Free. Enligt Anthropic har över 45 miljoner dokument, presentationer och designer skapats sedan funktionerna infördes i konversationerna den 16 september. När funktionerna lämnar beta tillkommer stöd för CMEK för artefakter, möjlighet för administratörer att välja artefaktmallar, gemensam redigering med Claude, delning utanför organisationen om administratören tillåter det, PowerPoint- och PDF-exporter som återger innehållet i redigeraren troget, direkt överföring till Google Slides och redigering från mobilappen.

Berörd funktionStatus den 8 oktoberBerörda abonnemang
Claude DashboardsBetaBetalabonnemang
Claude MotionBetaTeam och Enterprise
Claude Docs, Slides och DesignHar lämnat betaAlla, inklusive Free
claude.ai/design (fristående webbplats)Öppen till den 14 december—

Praktisk konsekvens: den fristående webbplatsen claude.ai/design, som nu är integrerad i Claude, förblir öppen till 14 december. En organisations designsystem (design systems) kan migreras i ett steg via sidan Artifacts, men den fristående webbplatsens konversationer och kommentarer, liksom dess offentliga länkar, försvinner när den stängs. I Enterprise är Dashboards och Motion avstängda som standard, medan Docs, Slides och Design aktiveras som standard den 15 oktober.

🔗 Claude-inlägg: Dashboards och Motion · Tråd från @claudeai

Runway och Luma, lanseringspartner för Claude Motion

8 oktober — Två aktörer inom generativ video presenterar sig som lanseringspartner för Claude Motion. Till Runway kan varje animation exporteras för att lägga till genererade sekvenser, retuschera klipp genom att beskriva den önskade ändringen och låta Runway Agent sätta ihop en längre video kring animationen; samma 16:9-animation kan också göras om till vertikalt och kvadratiskt format där. Hos Luma öppnas animationerna direkt via Luma-connectorn (MCP) som lagts till i Claude: videomodellerna Ray och Uni ger dem en ny stil med bibehållen rörelse, beskär dem till 9:16, 1:1, 4:3 eller 21:9, och agenten Luma skapar fler versioner av dem. Varken Runway eller Luma anger något pris eller någon kostnad i krediter. Anthropic nämner också Adobe, Descript, HeyGen, Higgsfield och invideo bland verktygen där en animation kan vidareutvecklas, medan Canva och Captions väntas tillkomma snart.

🔗 Inlägg från Runway · Inlägg från Luma


Anthropic Cyber Mission: ett program för kritisk infrastruktur och OSS Scanner för open source

8 oktober — Två dagar efter att ha utökat sitt Cyber Verification Program lanserar Anthropic Anthropic Cyber Mission, som presenteras som ett långsiktigt åtagande för att säkra de system som alla är beroende av. Utgångspunkten kommer från Project Glasswing: det har aldrig varit så enkelt att hitta sårbarheter, men att verifiera, prioritera och åtgärda dem är fortfarande svårt. Satsningen börjar inom två områden, kritisk infrastruktur och open source-programvara; fler områden har aviserats utan något datum.

För kritisk infrastruktur ger Critical Infrastructure Defense Program (CIDP) leverantörer som arbetar åt operatörer av operativ teknik tillgång till de mest avancerade Claude-modellerna, ingenjörer på plats och Anthropics forskning om hot: det gäller programmerbara styrenheter, styrprogram och industriella nätverk inom el, vatten eller transporter, som ofta inte kan stoppas för att installera en patch. Elva grundarpartner deltar: Accenture, Booz Allen, CrowdStrike, Deloitte, Dragos, Hitachi, Insane Cyber, Nozomi Networks, Palo Alto Networks, PwC och Rockwell Automation. Programmet börjar med en liten grupp och ska utökas till fler partner och sektorer under de kommande månaderna.

För open source erbjuder OSS Scanner, inspirerat av Googles OSS-Fuzz, registrerade projekt kostnadsfria återkommande skanningar med Anthropics mest kraftfulla modeller, inklusive Claude Mythos. Varje rapport innehåller kod för att återskapa sårbarheten, en förklaring och, när det finns, ett förslag till patch, men skickas utan mänsklig granskning: Anthropic förväntar sig att över 90 % av fynden är korrekta och varnar för att vissa rapporter kommer att innehålla fel, exempelvis en felbedömd allvarlighetsgrad. Tjänsten tar sig an den flaskhals som Frontier Red Team beskriver: de upptäckta sårbarheterna överstiger vida vad människor kan sortera.

Mått publicerat av AnthropicPublicerat värde
Potentiella sårbarheter hittade på sex månaderFler än 29 000
Sårbarheter granskade och sorterade manuelltCirka 6 000
Verifierade sårbarheter med kritisk eller hög allvarlighetsgrad (48 projekt)97
Som nådde kravnivån för samordnat offentliggörande (CVD)85, det vill säga 88 %
Verkliga men dubblerade, eller ogiltiga11 och 1
Andel sårbarheter som hittats av LLM på testbänken CyberGymMindre än 20 % i början av förra året, över 85 % i år

wolfSSL uppger att av 74 mottagna rapporter var alla utom två giltiga och fem blev CVE:er. Registrering sker genom en pull request i GitHub-arkivet anthropics/oss-scanner och är förbehållen huvudansvariga maintainer för projekt som bedöms vara kritiska, efter individuell prövning. Defender Advantage Fund, som lanserades i augusti, håller tjänsten kostnadsfri. Anthropics prognos är försiktig: inom två år kommer AI att gynna försvaret, men inte nödvändigtvis på kort sikt, eftersom det är billigare att utnyttja sårbarheter medan verifiering, offentliggörande och åtgärder fortfarande går långsamt.

🔗 Anthropic-inlägg: Anthropic Cyber Mission · Inlägg från Frontier Red Team om OSS Scanner · Kodarkivet anthropics/oss-scanner


Ultrafast för GPT-6.1 Sol: upp till 8 gånger snabbare, för 12 och 60 dollar per miljon tokens

8 oktober — Nivån Ultrafast, som den 29 september aviserades som «kommer snart», blir nu tillgänglig för GPT-6.1 Sol. OpenAI Developers uppger att den lanseras samma dag i API:t, i Codex och i ChatGPT Work, med en intelligens som beskrivs som nära GPT-6 Astra. OpenAI avser den för arbete där varje sekund räknas: felsöka ett driftstopp, låta agenter navigera i appar eller erbjuda upplevelser i realtid.

Ultrafast is rolling out today for GPT-6.1 Sol in the API, Codex, and ChatGPT Work. Near-Astra intelligence at up to 8x faster speeds than Sol Standard, so you can build as fast as the ideas come.

🇸🇪 Ultrafast lanseras i dag för GPT-6.1 Sol i API:t, Codex och ChatGPT Work. En intelligens nära Astra, upp till 8 gånger snabbare än Sol i Standard-läget, så att du kan bygga lika snabbt som idéerna kommer. — @OpenAIDevs på X

I API:t räcker det att anropa gpt-6.1-sol med service_tier: "ultrafast" i Responses API. Läget är öppet för alla API-användare, inom gällande anropsgränser, med global bearbetning och dataresidens i USA och Europeiska unionen, medan GPT-6 Astra i Ultrafast fortfarande är begränsat till dataresidens i USA. Priset följer den regel som redan gäller för Astra: sex gånger Standard-priset, alltså 12 dollar per miljon tokens för inmatning och 60 dollar för utmatning, en femtedel av priset för GPT-6 Astra i Ultrafast (60 och 300 dollar).

Bearbetningsläge för gpt-6.1-solInmatningsprisCachad inmatningCacheskrivningUtmatningspris
Standard, kort kontext2,00 dollars0,10 dollar2,50 dollars10,00 dollars
Fast, kort kontext4,00 dollars0,20 dollar5,00 dollars20,00 dollars
Ultrafast, kort kontext12,00 dollars0,60 dollar15,00 dollars60,00 dollars
Ultrafast, lång kontext24,00 dollars1,20 dollar30,00 dollars90,00 dollars

Priser per miljon tokens, API:ts Pricing-sida den 8 oktober.

I Codex och ChatGPT Work är tillgången förbehållen abonnemanget Pro 500, berättigade Enterprise-arbetsytor med användningsbaserad fakturering och kreditbaserade Edu-erbjudanden. I Enterprise är Ultrafast avstängt som standard och arbetsytans ägare måste aktivera det för vissa användare eller för alla. Codex-dokumentationen beskriver kostnaden: abonnemangets inkluderade kvoter förbrukas 8 gånger snabbare än i Standard-läget, och köpta krediter samt Enterprise-användning på begäran debiteras till sex gånger priset. Övriga självbetjäningsabonnemang har inte tillgång vid lanseringen, även om användaren har köpt krediter.

🔗 Changelog för OpenAI:s API · Priser för OpenAI:s API · Ultrafast i Codex (dokumentation)


Vetenskap: 150 miljoner dollar från Anthropic och 1 miljard från NVIDIA till Genesis Mission, en ultraviolett karta över himlen

Två åtaganden inom Genesis Mission, det amerikanska federala programmet som vill påskynda vetenskapliga upptäckter med AI, tillkännagavs den 8 oktober på samma toppmöte, «Science: A New Golden Age», som arrangerades i Washington av Vita husets Office of Science and Technology Policy (OSTP). Samma dag visar Anthropic vad Claude Science kan ta fram för en astrofysiker.

Anthropic: 150 miljoner dollar under tre år och Claude för över 15 federala myndigheter

8 oktober — Anthropic åtar sig att bidra med 150 miljoner dollar under tre år till Genesis Mission. Finansieringen ska göra Claude tillgängligt för över 15 myndigheter som deltar i programmet, däribland NASA, National Institutes of Health och National Science Foundation. Konkret kommer Anthropic att tillhandahålla Claude, Claude Code och API-krediter till flera hundra forskningsprojekt, arbeta med myndigheterna och de nationella laboratorierna kring regeringens prioriteringar, bland annat fusionsenergi och kvantberäkning, samt erbjuda utbildning och teknisk support. Åtagandet bygger vidare på det partnerskap som ingicks i december 2025 med energidepartementet; i juli hade Google DeepMind (40 miljoner dollar) och OpenAI (17 miljoner dollar) tillkännagett sina egna åtaganden inom programmet.

🔗 Anthropic-inlägg: åtagande inom Genesis Mission · Tweet från @AnthropicAI

NVIDIA: 1 miljard dollar under fem år till amerikansk vetenskap

8 oktober — Vid samma evenemang tillkännager NVIDIA åtaganden till ett värde av 1 miljard dollar under fem år för att utveckla USA:s kapacitet inom forskning och utveckling av superintelligens inom områden som kvantberäkning, hälsa och energisäkerhet. Pressmeddelandet nämner tre delar utan att fördela beloppet: stöd till forskningsinstitutioner vid universitet, investeringar för att stärka USA:s ledarskap inom kvantberäkning och stöd till cloudleverantörer som bidrar till regeringens uppdrag. NVIDIA uppger också att företaget medverkar i flera projekt som finansieras under fas 2 av Genesis Mission och som tillkännagavs samma dag, inom kvantberäkning, fusion, konstruktion av acceleratorer och mikroelektronik, och påminner om sitt partnerskap med DOE, som omfattar departementets största vetenskapliga superdator vid Argonne National Laboratory.

🔗 Pressmeddelande från NVIDIA

Den första kompletta kartan över himlen i ultraviolett ljus, framtagen med Claude Science

8 oktober — Bloggen Anthropic Science berättar hur Brice Ménard, astrofysiker vid Johns Hopkins-universitetet och forskare hos Anthropic, med Claude Science har tagit fram vad Anthropic beskriver som den första kompletta kartan över himlen i ultraviolett ljus. Rymdkartläggningen GALEX (NASA, 2003-2013) täckte bara omkring två tredjedelar av himlen, med ungefär 38 000 observationer. Claude samordnade agenter som samlade in offentliga kartläggningar och kalibrerade dem mot varandra, och sedan fyllde i den saknade tredjedelen genom rekonstruktion (inpainting), utifrån sambandet mellan ultraviolett ljus och andra våglängder. I områden som avsiktligt dolts ligger uppskattningarna inom ungefär 10 % från de faktiska mätvärdena.

The work would have taken humans weeks of work, but, with Claude, just took a few days while Ménard worked on other projects.

🇸🇪 Det här arbetet skulle ha tagit människor flera veckor, men med Claude tog det bara några dagar medan Ménard arbetade med andra projekt. — @AnthropicAI på X

🔗 Blogginlägg från Anthropic Science


Förbjudna användningar och missbruk: Anthropics användningspolicy för 2026 och två påverkansoperationer som OpenAI har stoppat

Två publikationer från den 8 oktober visar vad laboratorierna förbjuder och hur de spårar missbruk: Anthropic skriver om sin användningspolicy, och OpenAI redogör för två påverkansoperationer som företaget har blockerat.

Anthropic publicerar 2026 års version av sin användningspolicy, som träder i kraft den 12 november

8 oktober — Anthropic publicerar den årliga uppdateringen av sin användningspolicy (Usage Policy), som träder i kraft den 12 november. Det handlar främst om förtydliganden som bygger på observerat missbruk. Ett nytt avsnitt samlar de tidigare utspridda reglerna om vilseledande kampanjer och artificiell aktivitet och omfattar all vilseledande aktivitet, politisk eller kommersiell, inklusive utveckling av verktyg för påverkansoperationer. Valavsnittet, som döpts om till ”underminera inte demokratiska processer” (Do Not Undermine Democratic Processes), slopar det generella förbudet mot personanpassad kommunikation riktad till väljare, som hindrade användning för medborgerliga ändamål, exempelvis att informera väljare på andra språk. Texten klargör också att vapenförbudet omfattar programvara och komponenter till vapen samt beväpning av drönare, förbjuder spårning av personer utan deras samtycke och förbjuder, endast i extrema fall, ihållande och omotiverat kränkande beteende mot modeller.

🔗 Blogginlägg från Anthropic: uppdatering av användningspolicyn för 2026

OpenAI stoppar Dark Clark och Bogus Bylines, inklusive sin första operation i kategori 5

8 oktober — OpenAI publicerar en rapport om två hemliga påverkansoperationer som företaget har blockerat och som drev falska organisationer (false front) med hjälp av dess modeller. ”Dark Clark”, med ryskt ursprung, riktade sig mot Latinamerika: operatörerna använde främst ChatGPT för att skriva sina interna rapporter och drev ett påstått forskningscentrum, Social Research Center, lett av en fiktiv person, ”Mia Clark”. ”Bogus Bylines”, med iranskt ursprung, placerade nästan 100 artiklar under sju falska västerländska journalistsignaturer i ett dussintal nätmedier, varav ett hade nästan 2 miljoner följare på Facebook. OpenAI uppger att företaget har avslöjat 30 operationer av det här slaget under två och ett halvt år.

Stoppad operationKontonas ursprungHuvudmålKategori på IO Breakout Scale (1 till 6)
Dark ClarkRysslandLatinamerika5, den första enligt OpenAI
Bogus Bylines, artiklarIranInternationella nätmedier4
Bogus Bylines, kommentarerIranSociala medier2

🔗 OpenAI:s rapport om operationer med falska fasader


Claude Haiku 5.5 hos tredje part: GitHub Copilot gör modellen tillgänglig redan med Pro, Devin mäter den till 58,4 %

Claude Haiku 5.5 lanserades den 7 oktober och blev samma dag tillgänglig i två kodverktyg, som båda jämför modellen med Claude Sonnet 5.

GitHub Copilot: Haiku 5.5 i alla betalabonnemang, inklusive Pro

7 oktober — Drygt två timmar efter lanseringen hos Anthropic blir Claude Haiku 5.5 allmänt tillgänglig i GitHub Copilot för abonnemangen Pro, Pro+, Max, Business och Enterprise: även Pro, precis som Claude Sonnet 5.5 och till skillnad från GPT-6.1 Sol i slutet av september. Modellen kan väljas i tio miljöer, från VS Code till Xcode. GitHub avser att den ska användas för underagenter, snabba ändringar och uppgifter i terminalen; enligt företagets första tester nådde den samma nivå som Claude Sonnet 5 på många koduppgifter med betydligt färre tokens och steg, utan att några siffror publicerats. Den debiteras enligt den offentliga prislistan: 0,10 dollar per miljon tokens för indata och 0,50 dollar för utdata upp till 100 000 tokens i indata, därefter 0,50 respektive 2,50 dollar, alltså en tiondel av priset för Claude Haiku 4.5 på den första prisnivån.

🔗 Claude Haiku 5.5 i GitHub Copilot · Modeller och priser för GitHub Copilot

Devin: 58,4 % på FrontierCode 1.1, högre än Claude Sonnet 5

7 oktober — Cognition gör Claude Haiku 5.5 tillgänglig i Devin. På FrontierCode 1.1, företagets egna benchmark som bedömer modeller på verkliga ingenjörsuppgifter utifrån kodens kvalitet och möjligheten att slå samman den, får Haiku 5.5 58,4 %, högre än Claude Sonnet 5, till ungefär en åttondel av dess kostnad per uppgift enligt Cognition, som inte anger något exakt belopp. Modellen blir också en av medhjälparna (sidekicks) i Devin Fusion, som kombinerar en huvudmodell med en kompletterande modell: med Claude Opus 5.5 som huvudmodell och Haiku 5.5 som stöd behåller Fusion en poäng på 66,2 samtidigt som kostnaden och latensen minskar.

Modell utvärderad av CognitionPoäng på FrontierCode 1.1 Extended
Claude Sonnet 556,2
Kimi K358,2
Claude Haiku 5.558,4
GPT-6.1 Sol60,4
Claude Sonnet 5.564,4
Claude Opus 5.565,3

🔗 Claude Haiku 5.5 i Devin


Kodagenter: Claude Code 2.1.295, Codex CLI 0.162.0, Antigravity CLI 1.3.1, VS Code 1.141 och Delta 0.19

Fem verktyg för kodagenter utvecklas: Claude Code skärper sina hooks, Codex CLI hanterar worktrees, Antigravity CLI gör om granskningen av ändringar, VS Code ordnar agentsessioner i rutnät och Delta öppnar för samarbete.

Claude Code 2.1.295: hooks som blockerar när de misslyckas

8 oktober — Claude Code har fått två versioner under dagen. Version 2.1.294 korrigerar hooks prompt och agent formulerade som instruktioner på naturligt språk, som kunde släppa igenom det de skulle blockera. Version 2.1.295 innehåller 143 poster, varav 97 buggfixar. Med det nya alternativet onFailure: "block" för command- och HTTP-hooks blockeras åtgärden om en hook inte startar, når sin timeout eller returnerar en oväntad kod, i stället för att släppas igenom; flera buggfixar går i samma riktning, för skydden i mods och alternativen --tools och --restricted. Claude Code stöder också Program Status Protocol (OSC 7501), som låter kompatibla terminaler visa om agenten arbetar, väntar eller är klar, och beskrivningarna av MCP-verktyg som läses in via verktygssökning utökas från 2 048 till 16 384 tecken.

🔗 Claude Code 2.1.295 · Claude Code 2.1.294

Codex CLI 0.162.0: hanterade worktrees och fästa uppgifter

8 oktober — Codex CLI 0.162.0, den första stabila versionen sedan 0.161.0 dagen innan, listar 225 PR. När worktrees-funktionen är aktiverad har Codex verktyg för att skapa och lista hanterade Git-worktrees från betrodda lokala projekt, och agenternas kommandocentral gör det möjligt att fästa en uppgift med tangenten p, i en delad grupp ”Pinned” när servern stöder det. Terminalen får /copy för att bläddra bland och kopiera block i transkriptionen, Ctrl+Insert för att kopiera en markering och en inställning för rullningshastighet, och URL:er blir klickbara även i godkännanden och MCP-prompter. Anpassade modellleverantörer som är kompatibla med Responses API kan deklarera webbåtkomst i realtid och compaction på distans. Bland buggfixarna bevarar apply_patch CRLF-radslut, säkerheten i Linux-sandboxen förstärks och Windows-versionerna får en signerad PowerShell-installerare.

🔗 Versionsanteckningar för Codex CLI 0.162.0

Antigravity CLI 1.3.1: omgjord granskning i /diff, medelhög verbositet som standard

7 oktober — Antigravitys CLI har släppt fem versioner mellan den 2 och den 7 oktober. Version 1.3.1 förbättrar kodgranskningen i terminalen: i filvyn i /diff öppnar vänster- och högerpilarna den intilliggande filen vid dess första ändring, varje fil minns sin position, n och N går vidare till nästa eller föregående fil, och rubriken visar var man befinner sig. De tio buggfixarna berör bland annat /rewind i mycket långa konversationer, plugins i Windows och sessioner med nyckeln GEMINI_API_KEY, som försöker igen när anslutningen till Gemini API bryts. Version 1.3.0 från den 6 oktober ändrar standardverbositeten från ”high” till ”medium”, som grupperar verktygsanrop och resonemang i korta sammanfattningar; /config gör det möjligt att återgå till den tidigare inställningen. Tidigare överlät version 1.2.16 bildgenereringen till en inbyggd underagent och version 1.2.15 tillförde Android-binärer för Termux.

🔗 Changelog för Antigravity, fliken CLI

VS Code 1.141: agentsessioner i rutnät och rensning av worktrees

7 oktober — VS Code 1.141 fokuserar på Copilots agentsessioner. Fönstret Agents kan ordna flera sessioner i ett rutnät, och kommandot Chat: Open Worktree Cleanup visar hur mycket diskutrymme som upptas av inaktiva sessioners worktrees, så att de kan tas bort på begäran eller automatiskt när pull requesten har slagits samman. Konversationer som startats i Copilot CLI eller i appen GitHub Copilot visas redan vid den första förfrågan, utan att redigeraren laddas om, och en Codex-konversation som öppnats i appen ChatGPT eller i Codex CLI kan fortsättas där med sin historik: genom att välja en Copilot-modell fortsätter man med sitt GitHub Copilot-abonnemang, exempelvis efter att ha nått sin användningsgräns i ChatGPT. För företag kan sandboxen i Copilots harness göras obligatorisk via hanterade inställningar, som förhandsfunktion, och detta harness blir gradvis standardvalet för användare som har experiment aktiverade.

🔗 Versionsanteckningar för VS Code 1.141

Delta 0.19: omnämnanden mellan teammedlemmar och inkorg

7 oktober — Zed Industries släpper Delta 0.19.0, sin miljö för att koda tillsammans med agenter, följt den 8 oktober av buggfixversionen 0.19.1. Nu kan man nämna en teammedlem i ett meddelande eller en kommentar genom att skriva @ följt av användarnamnet, och aviseringen kommer till en ny inkorg (Inbox). Agenten @delta läser och ändrar en stor del av inställningarna direkt i konversationen. Inställningen Agent Thread Creation hindrar agenter från att skapa konversationer på toppnivå utan att stänga av underagenterna, agenten kan slå samman worktrees från flera trådar och CLI-kommandon körs utan att öppna ett fönster. Totalt listar versionsanteckningarna 11 nyheter, 22 förbättringar och 45 buggfixar. Den 8 oktober berättar ett blogginlägg som delats av Zed hur teamet ersatte Google Docs med Delta för sina interna dokument.

🔗 Versionsanteckningar för Delta · Blogginlägg från Delta om att lämna Google Docs


Generativa medier: Nano Banana 2.1, Brand Kit och ElevenReader i Brasilien hos ElevenLabs, SemanTok från Stability AI

Fyra tillkännagivanden om bild, video och röst: en bildmodell till halva priset hos Google, en återanvändbar grafisk profil och en app för ljuduppläsning hos ElevenLabs samt forskning om videogenerering hos Stability AI.

Nano Banana 2.1 allmänt tillgänglig i Gemini API, till halva priset

6 oktober — Google har gjort Nano Banana 2.1 (gemini-nano-banana-2.1) allmänt tillgänglig i Gemini API och Google AI Studio, utan något blogginlägg. Modellen för bildgenerering och bildredigering uppdaterar Nano Banana 2, med bättre visuell kvalitet, bättre textrendering, mer konsekventa karaktärer från en tur till nästa och panoramaformat från 1:4 till 8:1, utan artefakter från tiling i 2K och 4K. Den accepterar upp till 14 referensbilder och stöder sig på Google-sökning. Priset per bild halveras för 1K och 2K, och Google markerar Nano Banana 2 (gemini-3.1-flash-image) som föråldrad, utan något avstängningsdatum.

Pris för utdataNano Banana 2.1Nano Banana 2
Bild 1K0,0336 dollar0,067 dollar
Bild 2K0,0504 dollar0,101 dollar
Bild 4K0,113 dollar0,151 dollar
Miljon bildtokens30 dollars60 dollars

🔗 Versionsanteckningar för Gemini API · Informationssida för Nano Banana 2.1

Brand Kit från ElevenLabs: den grafiska profilen samlad i arbetsytan

8 oktober — ElevenLabs lägger till Brand Kit i ElevenCreative, sin svit för innehållsskapande. Färger, typsnitt, logotyper med användningsregler, referensbilder och varumärkesregler, inklusive sådant som varumärket aldrig gör, bildar ett enda objekt i arbetsytan som man anropar med @ i Image & Video, i Flows eller hos agenten ElevenCreative. Enligt ElevenLabs tråd kan ett kit skapas på några minuter genom att klistra in adressen till en webbplats eller ladda upp organisationens material; hela teamet genererar sedan utifrån samma instruktioner, och en byrå kan skapa ett kit per kund. ElevenLabs vill utöka kiten till varumärkets röst och ljud, utan angivet datum. Brand Kit är tillgängligt nu, utan angivet pris; HeyGen (augusti) och Runway (september) erbjuder redan jämförbara verktyg.

🔗 Blogginlägg från ElevenLabs: Brand Kit · Tråd från @ElevenLabs

SemanTok från Stability AI: en modell på 201M som matchar en 3,4 gånger större modell

7 oktober — Teamet Interactive Research på Stability AI presenterar SemanTok, en videotokenizer för världsmodeller (world models) som genererar video token för token, med ett tillkännagivande på X den 8 oktober. I tokenizers som går ”från grovt till fint” (coarse-to-fine) beskriver de första tokens scenen som helhet och de följande lägger till detaljer; SemanTok gör dessa första tokens mer meningsrika och därmed lättare att förutsäga. För detta tillför den frysta DINO-features i sin encoder och lägger till lätta heads som rekonstruerar dem från varje prefix av tokens. Enligt Stability AI matchar eller överträffar en autoregressiv modell med 201M parametrar byggd på SemanTok en 3,4 gånger större VideoFlexTok-modell, och korta prefix är billigare att förutsäga. Artikeln finns på arXiv; varken kod eller vikter nämns.

🔗 Forskningsinlägg från Stability AI · Artikel på arXiv

ElevenReader kommer till Brasilien med Fábio Porchats röst och 70 000 böcker

8 oktober — ElevenLabs lanserar ElevenReader i Brasilien, sin app som omvandlar böcker, dokument och artiklar till ljud, gratis på iOS och Android, med skådespelaren och komikern Fábio Porchats röst. Katalogen bygger på ett partnerskap med Bookwire Brasil: 70 000 titlar på brasiliansk portugisiska, licensierade från landets största förlag, varav de flesta tidigare saknade en ljudutgåva. ElevenLabs har också producerat Dom Casmurro av Machado de Assis, uppläst av Fábio Porchat med originalmusik och ljuddesign. Enligt Bookwire Brasils vd är det det största utbudet av brasilianska böcker som någonsin erbjudits i ljudformat.

Utbud i BrasilienÅtkomstvillkor
Appen ElevenReader (iOS, Android)Gratis
Dom Casmurro uppläst av Fábio PorchatGratis för alla
70 000 titlar licensierade via BookwireMed ElevenReader Ultra, pris ej angivet

🔗 ElevenLabs inlägg: ElevenReader i Brasilien


Specialiserade modeller: LightOnOCR-3 för dokument, Falcon-ASR för arabiska, Carbon-A för genom

Tre specialiserade modeller, varav två med öppna vikter, för att läsa dokument, transkribera arabiska och annotera genom.

LightOnOCR-3: tre öppna OCR-modeller som också identifierar sidlayouten

8 oktober — LightOn släpper LightOnOCR-3 under Apache 2.0-licens i tre storlekar (0.8B, 1B och 4B). Utöver att transkribera en sida kan modellerna identifiera varje region på den: med en prompt för visuell förankring (grounding) föregås varje block av en märkt bounding box, bilder får en kort beskrivning och diagram omvandlas till HTML-tabeller med data. På en H100 behandlar 4B-modellen 21 % fler sidor per sekund än Chandra-OCR-2, som liksom den bygger på Qwen3.5. LightOn förtydligar att poängen beräknas efter en normalisering av utdata, som publiceras tillsammans med kodarkivet och som väsentligt ändrar poängen för alla ledande modeller.

UtvärderingssvitLightOnOCR-3-4BLightOnOCR-3-0.8BLightOnOCR-3-1BAngiven referens
olmOCR-Bench, totalpoäng86,385,584,5Infinity Parser Pro (35,1B) 87,6 ; Chandra 2 85,8
ParseBench, fem kategorier75,174,671,4Infinity Parser Pro 74,3
fr-bench-pdf2md, franska dokument74,170,569,6Chandra 2 69,0 ; MistralOCR4.1 54,1

🔗 Inlägg om LightOnOCR-3

Falcon-ASR: 1,6 miljarder parametrar för emiratisk arabiska, utan publicerade vikter

7 oktober — Technology Innovation Institute (TII) i Abu Dhabi presenterar Falcon-ASR, en taligenkänningsmodell med 1,6 miljarder parametrar inriktad på arabiska, särskilt den emiratiska dialekten. Samma uppsättning vikter transkriberar också engelska, franska, spanska och portugisiska utan att språket behöver anges, med en tidsstämpel för varje ord. Liksom Falcon-OCR-Arabic och Falcon-Emirati, som presenterades dagen innan, erbjuds den bara som demo: TII aviserar åtkomst via API och native-appar, utan att publicera vikterna.

Utvärdering av ordfelfrekvens (WER)Falcon-ASR:s poängAngiven referens
Genomsnitt för sex arabiska dataset (Open Universal Arabic ASR)20,92 %23,17 %, bästa publicerade resultat per den 30 september
Emiratisk arabiska, TII:s interna utvärdering22,73 %Qwen3-Omni, tvåa, 4,07 poäng högre
Genomsnitt för sju engelska dataset (Open ASR Leaderboard)5,74 %Ingen referens angiven

🔗 Inlägg om Falcon-ASR

Carbon-A: 566 miljoner kandidatgener hos 22 617 arter

8 oktober — Hugging Faces biologiteam (HuggingFaceBio) släpper Carbon-A, en modell med 1,2 miljarder parametrar under MIT-licens som identifierar proteinkodande regioner direkt i ADN, med en enda modell för däggdjur, växter, svampar och protister. På 42 referensgenom uppnår den ett genomsnittligt F1 på nukleotidnivå på 0,944 och överträffar enligt författarna de sju jämförda verktygen, däribland AUGUSTUS, Helixer och Tiberius. Teamet har kört den på de eukaryota genomen i GenBank för att bygga Carbon Annotation Database: 48 167 sammansättningar från 22 617 taxon och 566 miljoner förutsagda kodande loci, alltså 11 gånger fler taxon än i träningskorpusen. En laboratorievalidering med ActiveSite och UCSD genom fullständig ARN-sekvensering bekräftar en del av generna; författarna förtydligar att detta visar att transkription sker, men ännu inte att proteinerna produceras. En ny omgång planeras om tre veckor.

🔗 Inlägg om Carbon-A


Träning med förstärkningsinlärning: TermGrades 1 004 miljöer och TRL v1.15.0

Två publiceringar för förstärkningsinlärning: poängsatta terminalmiljöer och ett bibliotek som gör det möjligt att träna på längre sekvenser.

TermGrade: 1 004 terminalmiljöer poängsatta av sex modeller

8 oktober — Företaget ai& släpper TermGrade, 1 004 terminalmiljöer för att träna och utvärdera agenter med förstärkningsinlärning. Varje uppgift körs i en Linux-container med en instruktion och tester, och har bara tagits med om dess egen referenslösning klarade testerna: av 66 165 kandidatuppgifter skrivna av DeepSeek-V4-Pro passerade 1,5 % detta filter. Sex konfigurationer av öppna modeller, från Kimi-K3 till gemma-4-31B-it, har försökt lösa varje uppgift, och de 36 144 försöken publiceras, inklusive misslyckandena. En modell lär sig mest av uppgifter som den klarar ungefär varannan gång: efter träning på 151 uppgifter i detta intervall når gemma-4-31B-it 46,1 på Terminal-Bench 2.1, vilket är 3,1 poäng mer än basmodellen, och 2,1 poäng i genomsnitt över fem träningskörningar. Allt publiceras under Apache-2.0.

🔗 Inlägg om TermGrade · TermGrade-samlingen på Hugging Face

TRL v1.15.0: ett fusionerat LM-huvud för upp till 6,9 gånger längre sekvenser

8 oktober — TRL v1.15.0, Hugging Faces träningsbibliotek, introducerar ett fusionerat LM-huvud (fused LM head) som direkt beräknar log-sannolikheter och entropin för varje token med en Triton-kernel, utan att någonsin bygga hela tensorn med logits; det är aktiverat som standard för SFT, DPO, KTO, GRPO, RLOO och destillering. Vid 8 192 tokens minskar den högsta minnesanvändningen med 52 till 82 % beroende på metod. Mätningarna gjordes på en B300 begränsad till 79 Gio med slumpmässiga vikter för gemma-3-1b, vars vokabulär omfattar 262 000 tokens; vinsten är störst för små modeller med stor vokabulär. Versionen medför också inkompatibla ändringar: stödet för Python 3.10 upphör, use_liger_kernel markeras som föråldrat och den experimentella tränaren MiniLLM tas bort.

TräningsmetodMaximal längd i v1.14.2 (tokens)Maximal längd i v1.15.0 (tokens)Förbättringsfaktor
DPO10 24059 392×5,80
KTO (batch på 2)9 21663 488×6,89
GRPO28 672114 688×4,00
RLOO23 552100 352×4,26
SFT (nll-förlust)20 480107 520×5,25

🔗 Versionsinformation för TRL v1.15.0


Inferens: llama.cpp i Windows ML, ML Drift som open source, Together AI på B300 i IBM Cloud

Tre tillkännagivanden om att köra modeller, från Windows-datorn till GPU-klustret.

llama.cpp kommer till Windows ML med experimentellt stöd

7 oktober — Under sitt Windows-evenemang lägger Microsoft till experimentellt stöd för llama.cpp i Windows ML, sitt ramverk för lokal inferens: man hämtar en GGUF-modell från Hugging Face och kör den lokalt via samma Windows ML-stack med hjälp av nya API:er för specifika uppgifter. Ett native-API för exekvering i Windows på lägre nivå blir också tillgängligt i en experimentell förhandsversion. Microsoft säger sig bidra direkt till llama.cpp-projektet tillsammans med NVIDIA och communityn: optimerade CUDA-kernels, bättre schemaläggning mellan processor och GPU, CUDA graphs, spekulativ avkodning (Eagle-3, MTP, D-Flash2), körning på flera GPU:er och NVFP4-formatet. Inlägget kopplar dessa nyheter till datorer utrustade med NVIDIA RTX Spark-chip, som Surface Laptop Ultra. På X välkomnar Georgi Gerganov från llama.cpp projektets närvaro på Windows-evenemanget och ser det som ett tecken på att mjukvaru- och hårdvarustackarna äntligen möts.

🔗 Inlägg om Microsoft Foundry on Windows · Tweet från @ggerganov

ML Drift: LiteRT:s GPU-motor släpps som open source

8 oktober — Google AI Edge-teamet släpper ML Drift, sin GPU-beräkningsmotor för inferens på enheten, som open source under Apache 2.0-licens. Den döljer skillnaderna mellan OpenGL ES, OpenCL, Metal och WebGPU, fungerar som GPU-accelerationsmotor för LiteRT, finns som fristående bibliotek och efterträder TensorFlow Lites GPU-delegat, som inte längre kommer att få nya funktioner. Motorn byter kernels beroende på om LLM:en läser prompten eller genererar tokens, och tillhandahåller en SKILL.md-guide så att kodagenter kan skriva och kontrollera shaders. Den körs redan i produktion: enligt inlägget ger den upp till 40 % lägre latens per bildruta för effekterna i YouTube Shorts och upp till 30 % förbättring för Lightroom och Photoshop på mobilen; med Gemma mäter Google upp till 12 % lägre minnesanvändning än med andra ramverk (frameworks).

🔗 Tillkännagivande av ML Drift på Google Developers Blog · Kodarkivet google-ai-edge/ml-drift

Together AI blir första kund i ett inferenskluster med B300-GPU:er på IBM Cloud

6 oktober — Together AI meddelar att företaget samarbetar med IBM och NVIDIA för att utöka sin inferenskapacitet för företag, med början i ett stort kluster av NVIDIA B300-GPU:er på IBM Cloud, sammankopplat via NVIDIAs Ethernet-nätverk Spectrum-X. Enligt Together AI är detta det första dedikerade inferensklustret av denna storlek på IBM Cloud, och företaget är dess första kund: Together AI driver inferenslagret, IBM tillhandahåller molnet och NVIDIA chippen och nätverket. Together AI motiverar utbyggnaden med efterfrågan på öppna modeller: företaget säger sig hantera hundratals biljoner tokens varje månad åt över en miljon utvecklare. Inlägget anger varken klustrets storlek eller någon tidsplan.

🔗 Inlägg från Together AI · Tweet från @togethercompute


Notiser

  • Snabbare styrning av Codex — I ChatGPTs skrivbordsapp tar Codex tidigare hänsyn till ett uppföljningsmeddelande som skickas under en uppgift, för att korrigera tillvägagångssättet eller byta riktning; inställningen Follow-up behavior avgör om dessa meddelanden styr den pågående körningen eller väntar till nästa. 🔗 källa
  • ChatGPT Go i Warp — De som prenumererar på ChatGPT Go kan nu använda det i Warp för alla terminalfrågor eller koduppgifter; enligt en medlem i OpenAI:s team för Sign in with ChatGPT, som Warp citerar, är den inkluderade användningen tillgänglig för Go-kunder, utöver Plus och Pro, i alla partnerappar. 🔗 källa
  • Oracle — Enligt en fallstudie från OpenAI har Oracle 130 000 aktiva användare av ChatGPT och över 95 000 av Codex; en undersökning av marknaden för kompetens som krävde 2 till 4 dagar förbereds på 15 till 20 minuter, och Codex översätter verksamhetsfrågor till SQL-frågor. 🔗 källa
  • Pollo AI — Denna plattform för videoskapande, som uppger sig ha över 26 miljoner användare, dirigerar sin agents förfrågningar med GPT-5.6, överlåter svåra uppgifter till GPT-6 Astra och alla sina bilder till GPT-Image-2.5, och säger sig minska tiden som läggs på att välja modell med över 50 %. 🔗 källa
  • Versionsinformation för Devin från den 7 oktober — En aviseringsruta samlar sessionernas aviseringar, med inställbar vidarebefordran till telefonen, statusen för sammanslagningskön visas i hela appen, och privata nycklar som sparats som hemligheter maskeras rad för rad i kommandoutdata. 🔗 källa
  • Copilot CLI 1.0.94 — Versionen har blivit stabil efter sex förhandsversioner och lägger till Claude Haiku 5.5 i modellväljaren, skickar den visade shell-koden till bedömaren för Assisted Permissions för att undvika onödiga godkännanden och gör det möjligt att aktivera en MCP-server innan den upptäcks. 🔗 källa
  • Gemini CLI v0.65.0-nightly.20261008 — Telemetrin stöder anpassade OTLP-headers (telemetry.otlpHeaders), något som efterfrågats sedan oktober 2025; CLI:n fastnar inte längre i en loop mellan verifiering och OAuth, och historiken slutar alltid med ett användarmeddelande, vilket förhindrar ett 400-fel efter /rewind. 🔗 källa
  • Antigravity SDK 0.1.21 isolerar experimentella API:er och styr underagenternas skills — Den första versionen som finns med i changelog sedan 0.1.18 den 21 september: en decorator @beta och en modul google.antigravity.beta skiljer förhandsversionerna från det stabila API:et, och skills_config låter en underagent ärva den överordnade agentens skills, ersätta dem eller avstå från dem. 🔗 källa
  • Developer Knowledge API — Google presenterar ekosystemet kring detta API, som tillhandahåller företagets utvecklardokumentation (Google Cloud, Firebase, Android) som uppdaterad Markdown: ett kommando gcloud developer-knowledge som är förinstallerat i Cloud Shell, en skill för kodagenter kopplad till en MCP-server, där Antigravity, Claude Code, Cursor och GitHub Copilot nämns, samt bibliotek i sju språk. 🔗 källa
  • AQuA — Google Cloud publicerar denna kvalitetsagent (Ambient Quality Agent) som referensimplementation. Den tar stickprov på upp till 1 000 sessioner från en ADK-agent i produktion, grupperar misslyckanden, följer dem i BigQuery och startar en diagnos av orsakerna med Gemini 3.8 Flash. 🔗 källa
  • Utkast räknas in i gränserna för pull requests — För att hantera bidrag av låg kvalitet låter GitHub pull requests i utkastform räknas in i gränserna per användare, medan en bidragsgivare hittills har kunnat öppna obegränsat många. 🔗 källa
  • Arkivering av pull requests — Funktionen är inte längre förbehållen administratörer: rollerna triage, write, maintain och admin kan arkivera en pull request, vilket stänger den, döljer den för allmänheten och blockerar all ny aktivitet, inklusive kommentarer från administratörer. 🔗 källa
  • GitHubs tidslinjer och skärmläsare — Skärmläsare går igenom tidslinjerna för issues och pull requests som listor, med antalet objekt och den aktuella positionen, och meddelar vilka händelser som laddats, på github.com och GitHub Enterprise Server 3.23. 🔗 källa
  • Paper Reproductions with ML Intern — Abubakar Abid tillkännager hos Hugging Face en funktion som via Paper Pages låter agenter självständigt reproducera experimenten i en publicerad artikel, för att skapa öppna artefakter som hjälper till att identifiera gedigna arbeten; inga siffror eller dokumentation. 🔗 källa
  • Hugging Faces chatt via SSH — Adrien Carreira, infrastrukturansvarig på Hugging Face, presenterar en chatt med öppna modeller som nås med kommandot ssh chat.hf.co, utan konfiguration eller nyckel; ingen dokumentation eller modellista följer med. 🔗 källa
  • huggingface_hub 2.2.0 — En mindre korrigeringsversion: hf jobs stats returnerar nu en ögonblicksbild och lämnar sedan tillbaka kontrollen (-f för att följa i realtid), alla parallella nedladdningar går via hf_xet, och två ändringar bryter kompatibiliteten. 🔗 källa
  • swarmlab — Hugging Face har utan tillkännagivande öppnat denna testmiljö, som undersöker hur svärmar av LLM-agenter från olika leverantörer hittar sanningen eller splittras beroende på kommunikationens topologi, fördröjningar och roller; en rad YAML räcker för att testa en hypotes. 🔗 källa
  • Darwin-27B-ZTC — VIDRAFT publicerar under Apache-2.0 en bedömningsmodell som i en enda körning returnerar en sannolikhetsfördelning över möjliga svar, utan att generera någon token: 0,743 träffsäkerhet vid zero-shot på 2 000 bedömningar från typed-decisions och ett Brier score på 0,097, enligt upphovspersonerna. 🔗 källa
  • Superfluid — basecompute publicerar under Apache-2.0 denna lokala LLM-server, kompatibel med OpenAI:s, Anthropics och Ollamas API:er, som prioriterar interaktiva frågor framför agenternas arbete: 0,36 sekunders svarstid med åtta aktiva agenter, jämfört med över 10 sekunder för llama-server, enligt upphovspersonerna. 🔗 källa
  • funes 1.8.0 — Verktyget som indexerar kodagenternas sessioner lägger till en flerspråkig embeddingsmodell: för 30 frågor om 2 000 konversationer på kinesiska finns rätt konversation bland de åtta första resultaten i 30 av 30 fall, jämfört med 23, och den genomsnittliga reciproka rangen ökar från 0,601 till 0,983. 🔗 källa
  • GLiNER och indiska språk — Ett inlägg från communityn visar att om kombinerande tecken behålls i orden, utan omträning, ökar GLiNER2:s genomsnittliga F1-värde vid zero-shot från 13,2 till 68,0 på nio indiska språk, och motsvarande värde efter finjustering på hindi från 59,9 till 82,6. 🔗 källa
  • Multilingual Terminal-Bench — LILT beskriver sin testmiljö med 324 koduppgifter på tio språk: Claude Opus 5.5 ligger där ungefär 3 poäng före Opus 5 med 30 % färre tokens, vilket ger en ungefär 45 % lägre kostnad per uppgift; Gemini 3.8 Flash använder 41 omgångar per uppgift i median, jämfört med 5 för GPT-6 Sol. 🔗 källa
  • Kollektiva GPU-primitiver — Milos Kotlar förutsäger kommunikationstiden för fem primitiver på fyra RTX 4090 med ett genomsnittligt fel på 10,9 %, jämfört med 22,9 % för en gemensam modell, men med ett värsta fall på 61,6 %. 🔗 källa
  • Best-of-N vid videoresonemang — facebookresearch lägger utan tillkännagivande och under den icke-kommersiella licensen CC BY-NC 4.0 ut koden från studien Selecting or Solving? om best-of-N-urval och paneler av verifierare vid videoresonemang. 🔗 källa
  • KDD Cup 2026 Data Agents — NVIDIA beskriver i detalj agentramverket som gav företagets lag KGMON andraplatsen med en föreskriven liten LLM: data konverterade till SQLite-tabeller, schema tillhandahållet från början, en liten uppsättning verktyg, riktad läsning av dokument; inlägget anger varken poäng eller modellnamn. 🔗 källa
  • Microduck — Matthieu Lapeyre från Pollen Robotics meddelar över tre timmars drifttid på ett batteri på 2 600 mAh för denna lilla tvåbenta robot, utrustad med ett nytt egenutvecklat kretskort, med en processor vars temperatur når högst 60 °C i stället för 114 °C. 🔗 källa
  • Album på Suno — Funktionen, som presenterades den 5 oktober, är nu i drift: man samlar sina låtar till en fullständig utgåva, väljer omslag, bestämmer låtordningen och publicerar vid önskat tillfälle; varken abonnemang eller gräns för antalet låtar anges. 🔗 källa
  • HeyGen och Ryan Serhant — HeyGen lanserar en daglig videoserie på Instagram, TikTok och X med den officiella avataren av fastighetsmäklaren Ryan Serhant, känd från Netflix-serien Owning Manhattan, som programledare; inga ekonomiska detaljer. 🔗 källa
  • Runway och Tech Coalition — Runway ansluter sig till denna allians mot sexuellt utnyttjande av barn på nätet och dess program Lantern för delning av signaler mellan plattformar, och påminner om sina skyddsåtgärder: datafiltrering, adversariella tester, hashning, rapportering till NCMEC och C2PA-proveniens. 🔗 källa
  • SpaceXAI och Omarchy — SpaceXAI blir grundsponsor för Omacom Foundation med 1,5 miljoner dollar i Grok-tokens; Grok 4.7 och dess efterföljare kommer att driva projektets agenter, däribland Omabot, som granskar pull requests. 🔗 källa
  • Perplexitys guide till skyddsmekanismer — Perplexity publicerar en guide som placerar AI:s skyddsmekanismer i tre skeden (indata, agenters åtgärder, utdata), jämför fem typer av skydd och illustrerar sju fall, från prompt injection till hallucinationer; inga nya funktioner. 🔗 källa
  • pplx-decider-v1.1-27b på OpenRouter — Perplexitys beslutsmodell med öppna vikter kommer till OpenRouter med samma prissättning som Decisions API: 0,02 dollar per miljon indatatokens, gratis utdata, kontext på 262 000 tokens. 🔗 källa
  • Cohere i Ottawa — Cohere öppnar sitt första kontor i Ottawa, nära parken Lansdowne, där redan närmare 30 anställda arbetar (kommersialisering, teknik, infrastruktur, säkerhet, suverän AI); varken lokalytan eller något mål för personalstyrkan anges. 🔗 källa

Vad det betyder

Assistenten skapar numera material att arbeta med, inte bara svar. En instrumentpanel i Claude Dashboards uppdateras när data ändras, en animation i Claude Motion går fortfarande att redigera ord för ord eftersom den är skriven i kod, och Docs, Slides och Design, som har lämnat beta för alla abonnemang, uppger redan över 45 miljoner skapelser. Dessa objekt går sedan vidare till befintliga verktyg: instrumentpanelen till Grafana eller PostHog, animationen till Runway eller Luma, som lägger till genererade bildsekvenser. ElevenLabs Brand Kit följer samma logik: den grafiska profilen blir ett objekt i arbetsytan som anropas med @, i stället för en instruktion som måste upprepas i varje prompt.

Säkerhetsarbetet skalas upp, både när det gäller försvar och tillämpning av regler. Anthropic konstaterar att det aldrig har varit så enkelt att hitta sårbarheter: över 29 000 kandidater på sex månader, varav ungefär 6 000 har bedömts manuellt. OSS Scanner väljer att skicka rapporter utan mänsklig granskning, där över 90 % av fynden väntas vara korrekta, för att minska denna flaskhals. Användningsreglerna preciseras parallellt: Anthropics policy för 2026 samlar vilseledande kampanjer i ett eget avsnitt, och OpenAI presenterar Dark Clark som den första operation i kategori 5 som företaget har slagit ut sedan det började publicera sina rapporter. I verktygen låter Claude Code 2.1.295 nu en hook som misslyckas blockera åtgärden i stället för att släppa igenom den.

Hastighet och pris blir inställningar som man kan välja. Ultrafast säljer GPT-6.1 Sol till sex gånger priset för upp till 8 gånger högre hastighet; enligt GitHub och Cognition matchar eller överträffar Claude Haiku 5.5 Sonnet 5 i koduppgifter, till ungefär en åttondel av kostnaden per uppgift enligt Cognition; Nano Banana 2.1 halverar priset för en 1K-bild. Inferens sträcker sig från enheten, med llama.cpp i Windows ML och ML Drift på GPU:erna i telefoner och datorer, till det B300-kluster där Together AI är den första kunden på IBM Cloud, och TRL minskar den maximala minnesanvändningen för en träning med 8 192 tokens med 52 till 82 %.

Slutligen bygger många av dagens siffror på mätningar gjorda av dem som publicerar dem. FrontierCode är Cognitions proprietära benchmark, GitHub säger att Haiku 5.5 matchar Sonnet 5 utan att publicera några siffror, LightOn beräknar sina resultat efter en normalisering som ändrar resultaten för alla toppmodeller, TII utvärderar Falcon-ASR på emiratisk arabiska enbart på en intern datamängd och publicerar inte modellens vikter, och upphovspersonerna bakom Carbon-A jämför det själva med sju verktyg. Den öppna vetenskapen ger en motvikt: TermGrade publicerar sina 36 144 försök, inklusive misslyckandena, Carbon-A sin databas med 566 miljoner kandidatgener, och Claude Sciences ultravioletta karta skiljer pixel för pixel mellan det som är uppmätt och det som är förutsagt. Anthropics 150 miljoner dollar och NVIDIA:s miljard till Genesis Mission driver på i samma riktning: att sätta dessa verktyg i forskarnas händer.


Källor