Sveriges veckotidning om artificiell intelligens — en utgåva i veckan.
Redaktör Anton Swall · Nästa nummer söndag
I detta nummerVerktygModellerAgenter
01
Veckans verktyg
Modeller, releaser och verktyg som ändrar din AI-vardag
AI-BladetFoto · xAI (pressbild)
Verktyg· 10 källor
Grok kliver in i ditt kalkylblad
xAI lanserar Grok som ett kostnadsfritt tillägg för Microsoft Excel. Du kan ställa frågor om celldata på vanlig engelska, generera formler från beskrivningar och köra scenarier — direkt i arbetsboken, utan att lämna Microsoft 365.
AI-BladetFoto · xAI (pressbild)
Modeller
Grok 4.5: xAI:s mest kapabla modell rullas ut överallt
xAI lanserar Grok 4.5 på grok.com, X och i apparna för iOS och Android. Enligt företaget hanterar modellen längre samtal, resonerar bättre kring svåra frågor och kan producera kalkylblad, presentationer och PDF-sammanfattningar direkt i Microsoft 365-tillägg.
Grok 4.5 är vår mest kapabla modell hittills.
xAI
xAI har lanserat Grok 4.5 och gjort den tillgänglig på grok.com, X samt i iOS- och Android-apparna. Enligt xAI är det företagets mest kapabla modell hittills. Modellen uppges följa längre konversationer och resonera effektivare kring komplexa frågor. Den kan också arbeta direkt i Word, Excel, PowerPoint och Outlook via Microsoft 365-tillägg.
Lanseringen av Grok 4.5 sker i tätt samband med Excel-tillägget och signalerar en bredare strategi från xAI: att ta sig in i produktivitetsverktyg som redan används dagligen i företag. Tidigare Grok-versioner har i huvudsak levt på X-plattformen och grok.com, men integrationen med Microsoft 365-sviten öppnar en helt ny distributionskanal. Det är en direkt utmaning mot OpenAI, som länge haft ett exklusivt partnerskap med Microsoft.
Grok 4.5 är nu den modell som driver Grok i alla kanaler, enligt xAI. För svenska Microsoft 365-användare innebär det att en ny AI-motor finns tillgänglig i de verktyg de redan betalar för — utan extra kostnad för själva Grok-tillägget.
turbovec: vektorindex som krymper 31 GB till 4 GB — och söker snabbare
Det Rust-skrivna open source-projektet turbovec lovar att lagra tio miljoner dokument på 4 GB istället för 31 GB med float32 — och ändå söka snabbare än FAISS. Allt körs lokalt, utan att data lämnar din maskin eller VPC.
En korpus med tio miljoner dokument tar 31 GB RAM som float32. turbovec får plats på 4 GB — och söker snabbare än FAISS.
turbovec-projektets README
turbovec är ett lokalt vektorindex skrivet i Rust med Python-bindningar, baserat på Google Researchs TurboQuant-algoritm. Vektorer indexeras direkt när de läggs till — ingen separat träningsfas, ingen parameterjustering och ingen ombyggnad när datamängden växer. Sökningen använder handskrivna SIMD-kärnor för NEON på ARM och AVX-512BW på x86. Sökresultat kan begränsas med en lista över tillåtna id:n eller en bitmask för filtrerad sökning.
Minneseffektiviteten är projektets tydligaste säljargument: en korpus på tio miljoner dokument uppges ta 31 GB RAM med float32, men bara 4 GB med turbovec. För team som bygger RAG-pipelines eller semantisk sökning på begränsad hårdvara är det en konkret skillnad. Att indexet körs helt lokalt — utan att data behöver lämna maskinen eller VPC:n — gör det relevant för organisationer med strikta datakrav.
Projektet saknar en explicit svensk eller EU-vinkel i research, men datalokaliseringskravet är direkt relevant för svenska organisationer som lyder under GDPR och vill undvika att känsliga vektorembeddings skickas till externa tjänster.
AI-BladetFoto · OpenAI (pressbild)
Verktyg
OpenAI Presence: agenter som löser 75 procent av supportärendena
OpenAI lanserar Presence, en produkt för att driftsätta röst- och chattagenter i produktion. Systemet kombinerar modellresonemang med policyer och mänsklig eskalering — och uppges redan lösa tre av fyra inkommande ärenden i OpenAI:s egen telefonsupport utan mänsklig hjälp.
Utmaningen för företag är inte längre att bevisa att AI-agenter kan fungera — det handlar om att göra dem tillförlitliga nog för högvärdigt arbete i produktion.
OpenAI
OpenAI Presence är en produkt för att driftsätta AI-agenter i realtid, för både röst och chatt. Varje driftsättning utgår från en avgränsad arbetsuppgift och ger agenten bara den kunskap och systemåtkomst som behövs. Företaget sätter policyer för vad agenten får göra, när godkännande krävs och när en människa ska ta över. Codex föreslår löpande uppdateringar baserade på produktionssessioner och eskaleringar, men teamen kan testa och godkänna ändringarna innan de rullas ut.
OpenAI uppger att deras egna engelskspråkiga telefonsupport — nåbar på 1-888-GPT-0090 — drivs med Presence och löser 75 procent av inkommande ärenden utan mänsklig hjälp. Systemet uppges ha nått eller överträffat riktmärkena för mänsklig förstalinjesupport inom några veckor. Det är ett ovanligt konkret produktionsdatum från ett AI-bolag, och det gör Presence mer trovärdig som enterprise-produkt än många liknande lanseringar.
Presence är tillgängligt för realtidsbaserade röst- och chattagenter. För svenska företag som vill använda AI-agenter i kundservice eller interna arbetsflöden erbjuder produkten en strukturerad modell med styrda behörigheter och inbyggd eskalering — något som kan underlätta efterlevnad av krav på mänsklig kontroll i känsliga processer.
03
Värt att veta
Forskning och metod som förtjänar en rad
Kronos — öppen grundmodell för finansiella candlestick-sekvenser, tränad på data från över 45 globala börser. Accepterad till AAAI 2026. Demonstrerar 24-timmarsprognoser för BTC/USDT. Relevant för team som bygger finansiella tidsseriemodeller och vill ha en öppen bas att finjustera från.
NVIDIA ModelExpress (MX) minskar kallstartstiden för stora modeller genom att prioritera direkt GPU-till-GPU-överföring med P2P RDMA via NIXL. I ett test överfördes DeepSeek-V4 Pro-vikter och JIT-kernelcache från en aktiv replik på under 10 sekunder, med en total starttid på 1 minut 44 sekunder. Relevant för team som skallar stora modeller i GPU-kluster och vill minska väntetiden vid nya instanser.