Vecka 32 · 2026

Sveriges veckotidning om artificiell intelligens — en utgåva i veckan.

Redaktör Anton Swall · Nästa nummer söndag
I detta nummerModellerVerktygSäkerhet

Veckans verktyg

Modeller, releaser och verktyg som ändrar din AI-vardag
OpenAI uppdaterar GPT-5.6: färre faktafel och nytt resonemangsspjäll
Foto · OpenAI (pressbild)
Modeller· 10 källor

OpenAI uppdaterar GPT-5.6: färre faktafel och nytt resonemangsspjäll

GPT-5.6 Sol får mer fokuserade svar och ett reglage för resonemangsnivå. Gratis- och Go-användare uppgraderas till Luna som standardmodell. Enligt OpenAIs egna interna utvärderingar minskar andelen svar med minst ett faktafel markant jämfört med GPT-5.5 Instant.

xAI vill in i kreativa flöden med Imagine Image 2.0
Foto · xAI (pressbild)
Modeller

xAI vill in i kreativa flöden med Imagine Image 2.0

xAI lanserar Imagine Image 2.0 som nytt Quality Mode i Grok — tillgängligt via webb, iOS och Android. Modellen är byggd för att följa detaljerade instruktioner, hantera typografi i komplexa bilder och bevara innehåll mellan redigeringar.

Vi byggde Image 2.0 kring ett enkelt mål: skapa bilder du faktiskt kan använda i riktigt arbete.

xAI

xAI har lanserat Imagine Image 2.0 som det nya Quality Mode på Groks webbplats och i apparna för iOS och Android. Enligt xAI är modellen utvecklad för praktiskt kreativt arbete och ska kunna följa detaljerade instruktioner. Bolaget uppger att den planerar typografi och layout för komplexa bilder med flera delar och liten text, samt bevarar användarens innehåll mellan olika genereringar och redigeringar.

Bildgenerering har länge varit ett område där konkurrensen är hård — Midjourney, Adobe Firefly och Googles Imagen är etablerade alternativ. Det som xAI lyfter fram är inte råkvalitet utan arbetsflödesanpassning: att modellen ska hålla ihop ett kreativt projekt över flera steg snarare än att leverera enstaka bilder. Det är en positionering mot den som faktiskt producerar material i ett löpande flöde, inte bara testar prompts.

Tjänsten är tillgänglig globalt via Groks befintliga plattformar, vilket innebär att svenska användare kan nå den direkt via webb eller app utan någon separat registrering. Någon särskild svensk lansering eller lokalisering nämns inte i underlaget.

Prime Agent: öppen kodagent med minne och bakgrundssessioner
Foto · GitHub Trending (daily) (pressbild)
Verktyg

Prime Agent: öppen kodagent med minne och bakgrundssessioner

Prime Agent från PrimeIntellect är en öppen källkods-agent för kodning och forskning som kan köra långvariga uppgifter i bakgrunden — och återanslutas till en session efter att terminalen kopplats från. En varning: den är ingen säkerhetssandlåda.

De är inte en säkerhetssandlåda.

Prime Agent-dokumentationen

PrimeIntellect har publicerat Prime Agent, en öppen kodnings- och forskningsagent byggd för långvariga arbetsuppgifter. Verktyget bygger på två kärnabstraktioner — Recursive Language Model och Continual Harness — och kombinerar en beständig Python-miljö med sparat tillstånd. Underagenter kan köras parallellt eller i bakgrunden och kommunicera direkt med varandra. Sessioner kan fortsätta efter att terminalen kopplats från och återanslutas senare.

Det som skiljer Prime Agent från enklare agentramverk är betoningen på kontinuitet: tillståndet lever kvar mellan sessioner, vilket gör det möjligt att delegera uppgifter som tar timmar eller dagar utan att hålla en terminal öppen. Underagenterna kan dessutom kommunicera direkt med varandra, vilket öppnar för mer komplexa arbetsflöden än vad en enskild agent klarar. För den som bygger automatiserade pipelines är det en arkitektur värd att titta på.

Dokumentationen är tydlig med en viktig begränsning: Prime Agent är inte en säkerhetssandlåda. Genererad Python och projektkommandon körs med användarens egna behörigheter. Det innebär att verktyget kräver samma försiktighet som vilken annan kodexekvering som helst i en produktionsmiljö — och bör inte köras med utökade rättigheter utan noggrann genomgång.

agent-skills: 24 produktionsfärdigheter för AI-kodningsagenter
Foto · GitHub Trending (daily) (pressbild)
Verktyg

agent-skills: 24 produktionsfärdigheter för AI-kodningsagenter

Projektet addyosmani/agent-skills samlar 24 färdigheter och åtta slash-kommandon som täcker hela utvecklingscykeln — från spec och plan till test och driftsättning. Kommandot /build kan genomföra hela planen efter ett enda godkännande, med testdriven kod och separata commits.

GitHub-projektet addyosmani/agent-skills erbjuder 24 produktionsinriktade färdigheter och åtta slash-kommandon för AI-kodningsagenter. Kommandona spänner över hela utvecklingscykeln: /spec, /plan, /build, /test, /review, /webperf, /code-simplify och /ship. Kommandot /build kan automatiskt skapa planen och genomföra alla uppgifter efter ett enda godkännande, där varje uppgift committas separat och flödet pausar vid misslyckanden eller riskfyllda steg.

Projektet positionerar sig som ett lager ovanpå befintliga AI-kodningsagenter snarare än ett eget ramverk. Enligt projektbeskrivningen ska färdigheterna kunna installeras i över 70 olika AI-agenter via open skills CLI. Filosofin sammanfattas i frasen "spec before code" — agenten ska förstå vad som ska byggas innan den börjar skriva. Det är ett svar på ett välkänt problem: agenter som kastar sig in i implementationen utan tillräcklig förståelse för kravbilden.

Ingen svensk eller EU-specifik vinkel framgår av underlaget, men verktyget är relevant för alla som arbetar med agentbaserad kodutveckling oavsett geografi. Att färdigheterna aktiveras automatiskt utifrån arbetsuppgiften — exempelvis API-design eller gränssnittsarbete — minskar den manuella konfigurationen och gör det enklare att komma igång i ett befintligt projekt.

Bransch i korthet

Politik, reglering och pengar — med konsekvensen för dig
Säkerhet

OpenAI: kommande modellen Astra kan inte uteslutas ha kritisk cyberkapacitet

Interna utvärderingar av den ännu ej lanserade modellen Astra visar så starka framsteg inom agentisk kodning och cybersäkerhet att OpenAI inte kan utesluta kritisk cyberkapacitet. Bolaget skärper nu säkerhetskontrollerna och pausar interna aktiviteter som inte uppfyller de nya kraven.

OpenAI uppger att preliminära interna utvärderingar av den kommande modellen Astra visar framsteg inom agentisk kodning och cybersäkerhet som är tillräckligt starka för att kritisk cyberkapacitet inte ska kunna uteslutas enligt bolagets eget Preparedness Framework. Kritisk cyberkapacitet definieras som förmågan att utan mänsklig hjälp utveckla fungerande zero-day-exploater mot härdade, verkliga kritiska system, eller självständigt genomföra nya end-to-end-angreppsstrategier mot härdade mål.

Tidigare modeller, inklusive GPT-5.6 Sol, bedömdes ligga på nivån High snarare än Critical. Som svar inför OpenAI isolerade testmiljöer, begränsad nätverks- och verktygsåtkomst, starkare skydd och kryptering av modellvikter, utökad övervakning samt sandboxad exekvering. Universell övervakning har också införts för riskfyllda handlingar och felanpassning i Astras agentiska användningar. OpenAI klargör att Astra inte var inblandad i den tidigare exploateringen av Hugging Face.

Det är ovanligt att ett AI-bolag offentligt kommunicerar att en kommande modell kan ha nått en säkerhetströskel av det här slaget innan lansering. Signalen är att Preparedness Framework faktiskt används som styrmedel — inte bara som dokument.

Vad betyder det för dig: om du integrerar OpenAI-modeller i säkerhetskänsliga miljöer är det värt att följa hur Astras säkerhetsprofil kommuniceras inför lansering — bolagets egna tröskeldefinitioner påverkar vilka begränsningar som kan följa med modellen.

Värt att veta

Forskning och metod som förtjänar en rad