Jalapeños første resultater viser brancheførende hastighed og effektivitet inden for AI-inferens ↗
OpenAI har offentliggjort de første resultater for Jalapeño, deres brugerdefinerede inferenschip. På GPT-OSS 120B leverer chippen cirka 1,9 gange mere peak throughput pr. kilowatt og omkring 1,7 gange lavere end-to-end latency end sammenligningssystemet.
Gevinsterne blev også overført til DeepSeek R1 og Kimi K2.5. OpenAI planlægger at implementere Jalapeño i sin egen computerinfrastruktur, mens anden- og tredjegenerationsdesign allerede er undervejs... så ja, OpenAI er i stigende grad også ved at blive en slags chipvirksomhed. (OpenAI)
Claude Cowork husker endelig, hvad du fortalte appen i chatten ↗
Anthropic forenede Claudes hukommelse på tværs af almindelig chat og Cowork. Information lært under samtaler kan nu følge brugerne ind i agentopgaver, hvilket fjerner det mildt vanvittige ritual med at forklare det samme projekt igen og igen.
Brugere kan inspicere, redigere og slette gemte emner, mens minderne opdateres, mens samtaler stadig foregår. Funktionen er som standard aktiveret på tværs af Free-, Pro- og Max-abonnementerne. (TechCrunch)
Google Cloud lancerer Gemini Enterprise til juridiske formål ↗
Google Cloud afslørede en specialudviklet Gemini Enterprise-pakke til advokater, der skubber deres agenter ud over generisk chat og ind i kontraktgennemgang, juridisk research, lovgivningsmæssig overvågning, privatlivsanmodninger og udarbejdelse af dokumenter.
Det inkluderer forbindelser til platforme som Harvey, iManage, Docusign, RelativityOne og Thomson Reuters, samtidig med at virksomhedernes eksisterende adgangskontroller og etiske mure bevares. AI-agenternes landbeslag er nået til den juridiske afdeling ... forudsigeligt, men stadig ret hurtigt. (Google Cloud Press Corner)
Google Cloud lancerer Gemini Enterprise til finansielle tjenester ↗
Google lancerede også et finansspecifikt Gemini Enterprise-tilbud, herunder en administreret finansiel researchagent, mere end 50 specialiserede færdigheder og 13 forbindelser til finansielle og markedsdatasystemer.
Platformen er rettet mod arbejdsgange, herunder kreditrisikovurdering, porteføljeovervågning, KYC-research og markedsanalyse. CME Group og Deutsche Bank er blandt de organisationer, der allerede er involveret - virksomhedsagenter bliver mere og mere specialiserede, næsten som software iført et jakkesæt. (Google Cloud Press Corner)
NVIDIA annoncerer Jetson Orin Nano 2 robotcomputer, der skal redefinere Edge AI på begynderniveau ↗
Nvidia introducerede Jetson Orin Nano 2, en kompakt computer rettet mod robotter, droner og andre fysiske AI-systemer. Den tilbyder 78 billioner operationer i sekundet, 8 GB hukommelse og en otte-kernet Arm CPU.
Nvidia siger, at inferensydelsen fordobles i forhold til den tidligere Nano Super, mens det kan kræve 40 % mindre strøm. Det interessante her er, at mindre modeller virkelig bliver kapable på kompakt hardware - AI'en behøver ikke altid at ringe til det gigantiske datacenter længere. (NVIDIA Newsroom)
Perplexity samarbejder med Nvidia om at lancere Portable Computer, en fuldt lokal AI-agent med nul tokenomkostninger ↗
Perplexity lancerede Portable Computer, der bragte deres agentiske computeroplevelse over på Nvidia-drevet lokal hardware. Modeller, filer og agentudførelse kan forblive på brugerens maskine, hvor lokalt udført arbejde ikke bruger cloud-faktureringskreditter.
Opgaver starter lokalt, og systemet beder om tilladelse, før det eskalerer et skridt til en frontier-cloud-model. Det lanceres omkring Nvidia DGX Spark og Linux-systemer med tilstrækkeligt kraftfulde RTX GPU'er - privatliv og omkostninger bliver pludselig en del af den lokale AI-salgstale, ikke kun hastighed. (Venturebeat)
Anthropic forventes at fortælle investorer, at de ser over 30 billioner dollars i potentiel omsætning, rapporterer WSJ ↗
Anthropic forbereder sig angiveligt på at fortælle investorer, at det samlede adresserbare marked kan overstige 30 billioner dollars. Vigtig forskel - det er den teoretiske årlige mulighed, hvis AI fangede det relevante arbejde, ikke Anthropic forudsiger, at det vil fortsætte med at tjene 30 billioner dollars. (Reuters)
Det enorme tal er med til at danne rammen for Anthropics infrastrukturudgifter, konkurrencen med OpenAI og Google og den bredere investorhistorie. Det er et spektakulært stort tal ... selv efter AI-industriens talstandarder. (Reuters)
Ofte stillede spørgsmål
Hvad betyder OpenAIs Jalapeño-chipresultater for AI-inferens?
OpenAI siger, at Jalapeño leverede højere peak-gennemstrømning pr. kilowatt og lavere end-to-end-latens end deres sammenligningssystem, mens de kørte GPT-OSS 120B. Lignende gevinster blev rapporteret med DeepSeek R1 og Kimi K2.5. Resultaterne tyder på, at OpenAI i stigende grad designer hardware omkring de særlige effektivitets- og hastighedskrav, der stilles til storstilet AI-inferens.
Hvordan fungerer Claudes delte hukommelse på tværs af chat og Cowork?
Claude kan nu overføre information, der er lært i almindelige samtaler, til Cowork-opgaver, hvilket reducerer behovet for at forklare det samme projekt eller den samme kontekst gentagne gange. Brugere kan inspicere, redigere og slette huskede emner, mens disse minder kan fortsætte med at opdateres, efterhånden som samtalerne udvikler sig. Ifølge meddelelsen i artiklen er funktionen aktiveret som standard på tværs af Free-, Pro- og Max-abonnementerne.
Hvad kan Gemini Enterprise for juridiske og finansielle tjenester gøre?
Google Clouds specialiserede Gemini Enterprise-tilbud er rettet mod branchespecifikke arbejdsgange snarere end generisk AI-chat. Den juridiske pakke dækker områder som kontraktgennemgang, research, regulatorisk overvågning, privatlivsanmodninger og udarbejdelse, mens versionen til finansielle tjenester understøtter arbejdsgange, herunder kreditrisikovurdering, porteføljeovervågning, KYC-research og markedsanalyse. Begge kan også oprette forbindelse til eksisterende professionelle data- og softwaresystemer.
Hvorfor bliver lokal AI-inferens vigtigere?
Lokal AI-inferens kan styrke privatlivets fred, reducere afhængigheden af cloud-infrastruktur og potentielt sænke de løbende forbrugsomkostninger. Nvidias Jetson Orin Nano 2 er rettet mod robotter, droner og andre edge-systemer, mens Perplexitys bærbare computer opbevarer modeller, filer og agentudførelse på kompatibel lokal hardware. I mange arbejdsgange kan cloud-modeller derefter reserveres til opgaver, der kræver yderligere kapacitet.
Hvordan beslutter Perplexity Portable Computer, hvornår den skal bruge cloud-AI?
Opgaver er designet til at starte på brugerens lokale Nvidia-drevne hardware, hvor kompatibel modeludførelse og filer forbliver på maskinen. Hvis et trin kræver en frontier cloud-model, beder systemet brugeren om tilladelse, før det eskaleres. Arbejde udført lokalt forbruger ikke cloud-faktureringskreditter, hvilket gør tilgangen relevant for brugere, der er bekymrede over både privatliv og tilbagevendende inferensomkostninger.
Hvad betyder Anthropics rapporterede estimat af AI-markedet på 30 billioner dollars?
Det rapporterede tal refererer til Anthropics syn på det potentielle samlede adresserbare marked for AI, ikke en forudsigelse af, at Anthropic selv vil generere en årlig omsætning på 30 billioner dollars. Det repræsenterer den teoretiske værdi af det arbejde, som AI potentielt kan løse på tværs af økonomien. Skønnet er også med til at forklare, hvorfor førende AI-virksomheder investerer så kraftigt i infrastruktur og virksomhedskapacitet.