Jalapeños första resultat visar branschledande hastighet och effektivitet inom AI-inferens ↗
OpenAI publicerade de första prestandaresultaten för Jalapeño, deras anpassade inferenschip. På GPT-OSS 120B levererade chipet ungefär 1,9 gånger mer toppdata per kilowatt och cirka 1,7 gånger lägre end-to-end-latens än jämförelsesystemet.
Vinsterna överfördes även till DeepSeek R1 och Kimi K2.5. OpenAI planerar att driftsätta Jalapeño i sin egen datorinfrastruktur, medan andra och tredje generationens design redan är på gång... så ja, OpenAI blir alltmer ett chipföretag också, på sätt och vis. (OpenAI)
Claude Cowork kommer äntligen ihåg vad du sa till appen i chatten ↗
Anthropic förenade Claudes minne i vanlig chatt och Cowork. Information som lärs in under samtal kan nu följa användare in i agentuppgifter, vilket eliminerar den milt irriterande ritualen att förklara samma projekt om och om igen.
Användare kan granska, redigera och ta bort minnesämnen, medan minnen uppdateras medan konversationer fortfarande pågår. Funktionen är aktiverad som standard i Free-, Pro- och Max-abonnemangen. (TechCrunch)
Google Cloud lanserar Gemini Enterprise för juridik ↗
Google Cloud presenterade ett specialutvecklat Gemini Enterprise-paket för jurister, vilket gör att deras agenter kan gå bortom generisk chatt och även omfatta kontraktsgranskning, juridisk forskning, regelövervakning, sekretessförfrågningar och utarbetande av dokument.
Den inkluderar kopplingar för plattformar som Harvey, iManage, Docusign, RelativityOne och Thomson Reuters, samtidigt som företagens befintliga åtkomstkontroller och etiska murar bevaras. AI-agenternas markrofferi har nått den juridiska avdelningen... förutsägbart, men fortfarande ganska snabbt. (Google Cloud Press Corner)
Google Cloud lanserar Gemini Enterprise för finansiella tjänster ↗
Google lanserade också ett finansspecifikt Gemini Enterprise-erbjudande, inklusive en hanterad finansiell analysagent, mer än 50 specialiserade färdigheter och 13 kopplingar till finansiella system och marknadsdatasystem.
Plattformen riktar sig mot arbetsflöden som inkluderar kreditriskbedömning, portföljövervakning, KYC-undersökningar och marknadsanalyser. CME Group och Deutsche Bank är bland de organisationer som redan är involverade – företagsagenter blir alltmer specialiserade, nästan som programvara i kostym. (Google Cloud Press Corner)
NVIDIA presenterar Jetson Orin Nano 2 robotdator för att omdefiniera Edge AI på instegsnivå ↗
Nvidia introducerade Jetson Orin Nano 2, en kompakt dator avsedd för robotar, drönare och andra fysiska AI-system. Den erbjuder 78 biljoner operationer per sekund, 8 GB minne och en åttakärnig Arm-processor.
Nvidia säger att inferensprestanda fördubblas jämfört med den tidigare Nano Super, medan det kan kräva 40 % mindre ström. Att mindre modeller verkligen kan hantera kompakt hårdvara är det intressanta här – AI:n behöver inte alltid ringa upp det gigantiska datacentret längre. (NVIDIA Newsroom)
Perplexity samarbetar med Nvidia för att lansera Portable Computer, en helt lokal AI-agent utan tokenkostnader ↗
Perplexity lanserade Portable Computer, som tar sin agentiska datorupplevelse med till Nvidia-driven lokal hårdvara. Modeller, filer och agentkörning kan finnas kvar på användarens maskin, och lokalt utfört arbete kräver inga molnfaktureringskrediter.
Uppgifter börjar lokalt, och systemet frågar om tillstånd innan det eskalerar ett steg till en molnmodell i frontlinjen. Det lanseras runt Nvidia DGX Spark och Linux-system med tillräckligt kraftfulla RTX-grafikprocessorer – integritet och kostnad blir plötsligt en del av den lokala AI-försäljningsargumenten, inte bara hastighet. (Venturebeat)
Anthropic förväntas berätta för investerare att de ser över 30 biljoner dollar i potentiella intäkter, rapporterar WSJ ↗
Anthropic förbereder sig enligt uppgift på att informera investerare om att deras totala adresserbara marknad kan överstiga 30 biljoner dollar. Viktig skillnad – det är den teoretiska årliga möjligheten om AI fångar upp det relevanta arbetet, inte Anthropic som förutspår att de kommer att fortsätta att tjäna 30 biljoner dollar. (Reuters)
Den enorma siffran hjälper till att rama in Anthropics infrastrukturinvesteringar, dess konkurrens med OpenAI och Google, och den bredare investerarhistorien. Det är ett spektakulärt stort antal ... även med AI-branschens siffror i åtanke. (Reuters)
Vanliga frågor
Vad betyder OpenAIs resultat från Jalapeño-chipet för AI-inferens?
OpenAI säger att Jalapeño levererade högre toppdata per kilowatt och lägre end-to-end-latens än deras jämförelsesystem när det körde GPT-OSS 120B. Liknande vinster rapporterades med DeepSeek R1 och Kimi K2.5. Resultaten tyder på att OpenAI i allt högre grad designar hårdvara kring de specifika effektivitets- och hastighetskraven för storskalig AI-inferens.
Hur fungerar Claudes delade minne i chatten och Cowork?
Claude kan nu föra över information som lärts in i vanliga samtal till Cowork-uppgifter, vilket minskar behovet av att förklara samma projekt eller sammanhang upprepade gånger. Användare kan granska, redigera och ta bort minnena, medan dessa minnen kan fortsätta uppdateras allt eftersom samtalen utvecklas. Enligt tillkännagivandet i artikeln är funktionen aktiverad som standard i Free-, Pro- och Max-planerna.
Vad kan Gemini Enterprise för juridiska och finansiella tjänster göra?
Google Clouds specialiserade Gemini Enterprise-erbjudanden riktar sig till branschspecifika arbetsflöden snarare än generisk AI-chatt. Det juridiska paketet täcker områden som kontraktsgranskning, forskning, regulatorisk övervakning, sekretessförfrågningar och utformning, medan versionen för finansiella tjänster stöder arbetsflöden inklusive kreditriskbedömning, portföljövervakning, KYC-forskning och marknadsanalys. Båda kan också ansluta till befintliga professionella data- och programvarusystem.
Varför blir lokal AI-inferens allt viktigare?
Lokal AI-inferens kan stärka integriteten, minska beroendet av molninfrastruktur och potentiellt sänka kostnaderna för kontinuerlig användning. Nvidias Jetson Orin Nano 2 riktar sig mot robotar, drönare och andra edge-system, medan Perplexitys bärbara dator lagrar modeller, filer och agentkörning på kompatibel lokal hårdvara. I många arbetsflöden kan molnmodeller sedan reserveras för uppgifter som kräver ytterligare kapacitet.
Hur bestämmer Perplexity Portable Computer när molnbaserad AI ska användas?
Uppgifter är utformade för att starta på användarens lokala Nvidia-drivna hårdvara, vilket bibehåller kompatibel modellkörning och filer på maskinen. Om ett steg kräver en frontier-molnmodell frågar systemet användaren om tillstånd innan det eskaleras. Arbete som utförs lokalt förbrukar inte molnfaktureringskrediter, vilket gör tillvägagångssättet relevant för användare som är bekymrade över både integritet och återkommande inferenskostnader.
Vad betyder Anthropics rapporterade uppskattning av AI-marknaden på 30 biljoner dollar?
Den rapporterade siffran hänvisar till Anthropics syn på den potentiella totala adresserbara marknaden för AI, inte en förutsägelse om att Anthropic självt kommer att generera 30 biljoner dollar i årliga intäkter. Den representerar det teoretiska värdet av arbete som AI potentiellt skulle kunna adressera i hela ekonomin. Uppskattningen bidrar också till att förklara varför ledande AI-företag investerar så kraftigt i infrastruktur och företagskapacitet.