AI-masterclasspodden vecka 30: vanan kan avgöra nästa AI-vinnare

AI-masterclasspodden vecka 30: vanan kan avgöra nästa AI-vinnare

Ett jämförelsetest kan visa vilken modell som vann. Det säger inte vilken assistent du faktiskt använder klockan 08.17, när prognosen är öppen, mötet nyss tog slut och arbetet redan ligger i Excel.

Vecka 30 pekar mot en annan sorts AI-konkurrens. Google flyttar Gemini djupare in i Samsung-enheter. Grok dyker upp i Excel och Outlook. Claude kopplar röstläget till verktyg. OpenAI bygger hälso- och företagsflöden runt ChatGPT. Perplexity gör återanvändbara färdigheter till en del av sitt agent-API. Manus låter en agent arbeta över flera Google-konton.

Veckans tes är att nästa AI-vinnare kan avgöras mer av vana än av resultat i jämförelsetester. Om den stämmer blir den viktiga frågan inte bara ”vilken modell är smartast?”, utan ”vilken tjänst finns redan på rätt plats när jobbet ska bli gjort?”

AI-kampen flyttar dit vanan redan finns

Den tydligaste signalen kommer från Google. I företagets egen rapportering hade Gemini-appen 950 miljoner aktiva användare per månad, medan över 40 appar ingår i Samsungs växande AI-yta. Siffrorna är leverantörsuppgifter, inte ett oberoende mått på värde. De visar ändå vilken fördel en aktör får när AI:n sitter i telefonen, dokumenten och operativsystemet.

Samma rörelse syns på kontoret. Grok har lanserat tillägg för Excel och Outlook för betalande X- och SuperGrok-användare. Anthropic har breddat Claudes röstläge med verktygsanslutningar. OpenAI Health samlar hälsorelaterad kontext i ChatGPT för vuxna användare i USA, medan företagsprodukten Presence paketerar agenter, överlämningar och stöd från implementatörer i en begränsad lansering.

Det är ingen enhetlig marknad. Det är flera försök att vinna samma ögonblick: stunden då användaren redan har öppnat filen, inkorgen, kalendern eller telefonen.

Placering ger modellen första chansen

En bättre modell kan fortfarande vinna på kvalitet. Men en modell som kräver att användaren lämnar sitt arbetsflöde måste först vinna en extra kamp: den måste bli ihågkommen, öppnad och matad med rätt sammanhang.

Det är därför distribution börjar likna en vallgrav. Mistral stärker sin väg in i företag genom Microsoft Foundry och Copilot Studio. OpenAI använder partners som KPMG och en mer tjänstetung produkt som Presence. Google kombinerar Android, Samsung, Workspace och egna modeller. Manus går en annan väg och gör agenten till en router mellan upp till tio Google Workspace-konton.

Om tesen håller kommer inköpsbeslut att handla mindre om en ensam topplacering och mer om tre vardagliga frågor:

  • Var startar arbetet? I ett dokument, ett mejl, ett samtal eller ett affärssystem?
  • Följer sammanhanget med? Eller måste någon återbygga uppgiften i en ny chatt varje gång?
  • Går rutinen att flytta? En vana som bara fungerar hos en leverantör kan bli dyr när pris, modell eller villkor ändras.

Återanvändbara rutiner blir motvikten till inlåsning

Perplexitys Agent API visar den andra halvan av konkurrensen. API:t kan använda färdigheter som beskriver hur ett återkommande jobb ska göras och skapa Office-filer i en beständig arbetsmiljö. Samtidigt styr Perplexity utvecklare bort från det äldre Sonar-gränssnittet mot den nya agentplattformen.

Det är bekvämt, men bekvämlighet och inlåsning växer ofta tillsammans. När instruktioner, filer och körhistorik blir en del av plattformen kostar det mer att byta än att ändra ett modellnamn.

Det praktiska motdraget är inte en stor kontrollövning. Det är att skilja på rutinen och motorn. Beskriv vilket underlag som går in, vad ett färdigt resultat är och vilka delar som måste överleva ett leverantörsbyte. Då kan samma arbetssätt provas i ChatGPT, Gemini, Claude, Grok, Perplexity eller Manus utan att verksamheten börjar om från noll.

Massanvändning är inte samma sak som djupt arbete

Veckans tes har en tydlig svaghet. Googles ATLAS-studie omfattade omkring 15 miljoner interaktioner och fann bred användning över många yrken, men färre än en tiondel av interaktionerna försökte automatisera en uppgift hela vägen. De flesta använde fortfarande AI som stöd i ett samarbete.

Det betyder att en plats i telefonen eller kontorspaketet inte automatiskt skapar ett bra arbetsflöde. Rå modellförmåga spelar fortfarande roll. Dessutom kan en modell tappa funktioner när den säljs genom en annan plattform; Perplexity varnar exempelvis för att alla Gemini-funktioner inte följer med genom Agent API.

Vanan kan alltså avgöra vem som får första försöket. Kvalitet, kostnad och förmågan att slutföra jobbet avgör vem som får stanna.

Ett bättre test än ännu en modellranking

Välj ett återkommande jobb som redan sker i ett verktyg ni använder: sammanfatta en kundtråd, jämför prognos mot utfall eller bygg ett första mötesunderlag. Kör uppgiften där arbetet redan finns och jämför med ert nuvarande sätt.

Mät två saker: tid till ett resultat som går att granska och hur mycket som behöver göras om. Spara själva arbetsbeskrivningen utanför leverantörens chatt. Om testet fungerar har ni lärt er något om både nyttan och byteskostnaden.

Om ert arbete fastnar mellan flera verktyg kan Hammers Verktygssmide hjälpa er göra rutinen tydlig och praktisk, utan att börja med en stor plattformsinvestering.

Avsnittet är en AI-genererad masterclass byggd på Hammers djupa dagliga research om AI-leverantörers uppdateringar och funktioner, bearbetad med NotebookLM. Artikeln kompletterar podden och bygger på källmaterialet samt en separat NotebookLM-syntes; ingen ljudtranskription har använts.

Vanliga frågor

Vad är huvudtesen i AI-masterclasspodden vecka 30?

Att distribution och vana kan bli en starkare konkurrensfördel än en ensam topplacering i ett modelltest. Den tjänst som finns där arbetet redan sker får ofta första chansen.

Betyder det att modellkvalitet inte längre spelar någon roll?

Nej. Vana kan avgöra vilken tjänst som provas först, men kvalitet, kostnad och förmågan att slutföra uppgiften avgör om den får stanna i arbetsflödet.

Vad kan ett mindre företag prova efter avsnittet?

Välj en återkommande uppgift i ett verktyg ni redan använder. Jämför tid till ett resultat som går att granska och hur mycket som måste göras om. Spara arbetsbeskrivningen utanför leverantörens chatt så att rutinen går att flytta.

Smedjans nyhetsbrev

Få nya artiklar i inkorgen

Välj de ämnen som intresserar dig. Inget brus, max ett mejl i veckan.

Få nya artiklar i inkorgen

Vi följer GDPR. Avsluta när du vill.