Sveriges veckotidning om artificiell intelligens — en utgåva i veckan.
Redaktör Anton Swall · Nästa nummer söndag
I detta nummerModellerVerktygFöretagDatacenterForskning
01
Veckans verktyg
Modeller, releaser och verktyg som ändrar din AI-vardag
AI-BladetFoto · xAI (pressbild)
Modeller· 10 källor
Grok 4.6 flyttar in i Amazon Bedrock
xAI:s flaggskeppsmodell Grok 4.6 är nu allmänt tillgänglig via Amazon Bedrock. Ett kontextfönster på 500 000 token och fyra valbara resoneringsnivåer gör lanseringen särskilt relevant för långvariga agentflöden.
AI-BladetFoto · Hugging Face Blog (pressbild)
Modeller
Liquid AI: upp till 3,18 gånger högre GPU-genomströmning
Liquid AI släpper öppna DSpark-utkastmodeller för tre modeller i LFM2.5-familjen. Spekulativ avkodning ska enligt bolaget ge upp till 3,18 gånger högre genomströmning på GPU, med en liten minnesökning men utan förändrad kvalitet på modellens utdata.
De lägger till en väg för spekulativ avkodning som byter en minimal minnesökning mot en stor hastighetsökning utan att förändra kvaliteten på utdata.
Liquid AI
Liquid AI lanserar DSpark-checkpoints för LFM2.5-1.2B-Instruct, LFM2.5-2.6B och LFM2.5-8B-A1B. Utkastmodellerna används för spekulativ avkodning: en mindre modell föreslår kommande token, som därefter verifieras av huvudmodellen. Varje DSpark-modell har fem lager, ett block om nio och omkring 300 miljoner parametrar. Arkitekturen kombinerar en parallell backbone, ett sekventiellt Markov-huvud och en konfidensstyrd verifierare. Integrationen har stöd i llama.cpp och SGLang och har publicerats som öppen källkod.
Resultaten kommer från Liquid AI. Bolaget uppger upp till 3,18 gånger förbättrad genomströmning på GPU och upp till 2,87 gånger snabbare inferens på enhet. För funktionsanrop med LFM2.5-2.6B anges den genomsnittliga latensen ha minskat med 57 procent. Vinsten kräver en mindre ökning av minnesanvändningen, men ska inte förändra kvaliteten på modellens utdata. Det gör tekniken relevant i arbetsflöden där svarstid eller mängden genererade token per sekund är flaskhalsen, särskilt när LFM2.5 redan körs lokalt eller i egen infrastruktur. Stödet i två etablerade inferensramverk minskar samtidigt arbetet som krävs för att prova utkastmodellerna i befintliga miljöer.
AI-BladetFoto · OpenAI (pressbild)
Verktyg
Replit öppnar kostnadsfritt byggläge med GPT-5.6 Luna
GPT-5.6 Luna driver nu Replits Free Mode, där projekt kan planeras, utvecklas och analyseras utan att användning förbrukas. Mer avancerade uppgifter kan skickas vidare till GPT-5.6 Sol och sedan återvända till det kostnadsfria läget med projektkontexten bevarad.
Tack vare OpenAI och de prissänkningar ni nyligen gjorde kan vi erbjuda detta till miljontals användare i Free Mode.
Amjad Masad, medgrundare och vd för Replit
Replit använder GPT-5.6 Luna som motor i Free Mode, ett läge där användare kan planera, utveckla och utforska programvaruidéer utan att förbruka användning. Modellen ger svar, förslag, återkoppling och analyser med tillgång till hela projektkontexten. När en uppgift kräver mer avancerad bearbetning kan den dirigeras till GPT-5.6 Sol. Därefter går det att återvända till det Luna-baserade läget utan att projektets sammanhang försvinner. Replit uppger att OpenAI:s prissänkningar och modellens förhållande mellan pris och prestanda gör det möjligt att erbjuda funktionen till miljontals användare.
För den som bygger med AI blir modellväxlingen en central del av produkten. Luna hanterar det löpande arbetet i det kostnadsfria läget, medan Sol reserveras för mer avancerade uppgifter. Det ger Replit ett sätt att hålla kvar samma projektkontext trots att olika modeller används under arbetets gång. Bolaget placerar därmed kostnadsstyrning och modellrouting bakom gränssnittet i stället för att låta användaren hantera varje modellbyte separat. Replit var tidigt ute med GPT-3, men den konkreta förändringen nu är att AI-stött programvarubyggande erbjuds utan löpande användningsförbrukning i Free Mode.
För svenska privatpersoner, entreprenörer och småföretag kan det kostnadsfria läget sänka både kostnads- och kunskapströskeln för att testa programvaruidéer. Researchunderlaget anger däremot ingen särskild svensk lanseringsplan eller tillgänglighet.
02
Bransch i korthet
Politik, reglering och pengar — med konsekvensen för dig
OpenAI uppger att ChatGPT Ads nästa vecka expanderar till 31 europeiska länder, däribland Sverige. Annonserna ska visas för användare av Free- och Go-planerna, medan Plus, Pro och Enterprise förblir annonsfria; initial åtkomst för annonsörer går genom OpenAI Ads Solutions samt byrå- och teknikpartner.
Vad betyder det för dig: svenska team som bygger annonsflöden får inledningsvis gå via dessa partnerkanaler, eftersom självbetjäning i Ads Manager ska lanseras först senare under sommaren.
NVIDIA beskriver DSX MaxLPS, en tekniksvit för att öka AI-genomströmningen inom en fast effektbudget genom dynamisk effektfördelning, mjukvaruoptimering och vätskekylning med 45-gradigt vatten. I bolagets exempel används en AI-fabrik på 100 MW, där omkring 60 procent av den levererade effekten avsätts till beräkningar för AI-resultat och 20 MW går till anläggningens overhead.
Vad betyder det för dig: den som bygger AI-infrastruktur under ett fast effekttak kan behöva optimera för AI-resultat per megawatt, inte enbart för antalet installerade GPU:er.
03
Värt att veta
Forskning och metod som förtjänar en rad
NVIDIA uppger att agentarkitekturen AVO nådde 100 procent på ARC-AGI-3 genom att behålla samma grundagent men byta miljöspecifika verktyg och utvärdering; arkitekturen använder beständigt minne, verktyg och en övervakare som kan ingripa när arbetet stannar.