Primele rezultate ale Jalapeño arată viteză și eficiență de vârf în industrie în inferența inteligenței artificiale ↗
OpenAI a publicat primele rezultate de performanță pentru Jalapeño, cipul său personalizat de inferență. Pe GPT-OSS 120B, se spune că cipul a oferit un debit de vârf per kilowatt de aproximativ 1,9 ori mai mare și o latență end-to-end de aproximativ 1,7 ori mai mică decât sistemul de comparație.
Câștigurile s-au reflectat și în DeepSeek R1 și Kimi K2.5. OpenAI intenționează să implementeze Jalapeño în propria infrastructură de calcul, în timp ce proiectele de a doua și a treia generație sunt deja în curs de desfășurare... așa că da, OpenAI devine din ce în ce mai mult o companie de cipuri, într-un fel. (OpenAI)
Claude Cowork își amintește în sfârșit ce i-ai spus aplicației în chat ↗
Anthropic a unificat memoria lui Claude în chat-ul obișnuit și în Cowork. Informațiile învățate în timpul conversațiilor pot acum urmări utilizatorii în sarcini de tip agent, eliminând acel ritual ușor enervant de a explica același proiect iar și iar.
Utilizatorii pot inspecta, edita și șterge subiectele memorate, în timp ce amintirile se actualizează pe măsură ce conversațiile sunt încă în desfășurare. Funcția este activată în mod implicit în abonamentele Free, Pro și Max. (TechCrunch)
Google Cloud lansează Gemini Enterprise pentru domeniul juridic ↗
Google Cloud a lansat un pachet Gemini Enterprise special conceput pentru avocați, împingându-și agenții dincolo de chat-ul generic și implicându-i în revizuirea contractelor, cercetarea juridică, monitorizarea reglementărilor, solicitările de confidențialitate și redactarea documentelor.
Include conectori pentru platforme precum Harvey, iManage, Docusign, RelativityOne și Thomson Reuters, păstrând în același timp controalele de acces și barierele etice existente ale firmelor. Acapararea terenurilor prin intermediul agenților inteligenți artificiali a ajuns la departamentul juridic... previzibil, dar totuși destul de rapid. (Google Cloud Press Corner)
Google Cloud lansează Gemini Enterprise pentru servicii financiare ↗
Google a lansat, de asemenea, o ofertă Gemini Enterprise specifică domeniului financiar, care include un agent de cercetare financiară gestionat, peste 50 de competențe specializate și 13 conectori la sisteme financiare și de date de piață.
Platforma vizează fluxuri de lucru care includ evaluarea riscului de credit, monitorizarea portofoliului, cercetarea KYC și analiza pieței. CME Group și Deutsche Bank se numără printre organizațiile deja implicate - agenții din companii devin din ce în ce mai specializați, aproape ca un software care poartă costum. (Google Cloud Press Corner)
NVIDIA anunță computerul robotic Jetson Orin Nano 2, care va redefini inteligența artificială de nivel de bază ↗
Nvidia a lansat Jetson Orin Nano 2, un computer compact destinat roboților, dronelor și altor sisteme de inteligență artificială fizică. Acesta oferă 78 de trilioane de operații pe secundă, 8 GB de memorie și un procesor Arm cu opt nuclee.
Nvidia spune că performanța inferenței se dublează față de precedentul Nano Super, în timp ce egalarea performanței sale poate necesita cu 40% mai puțină energie. Partea interesantă aici este că modelele mai mici devin cu adevărat capabile pe hardware compact - inteligența artificială nu mai trebuie întotdeauna să sune la centrul de date gigantic. (NVIDIA Newsroom)
Perplexity colaborează cu Nvidia pentru a lansa Portable Computer, un agent AI complet local, fără costuri tokenice ↗
Perplexity a lansat Portable Computer, aducând experiența sa de utilizare a agenților pe hardware local bazat pe Nvidia. Modelele, fișierele și execuția agenților pot rămâne pe mașina utilizatorului, iar munca finalizată local nu consumă credite de facturare în cloud.
Sarcinile încep local, iar sistemul cere permisiunea înainte de a trece la un model cloud de frontieră. Se lansează în jurul sistemelor Nvidia DGX Spark și Linux cu GPU-uri RTX suficient de puternice - confidențialitatea și costul devin brusc parte a argumentului de vânzare al inteligenței artificiale locale, nu doar viteza. (Venturebeat)
Anthropic ar trebui să anunțe investitorii că vede venituri potențiale de peste 30 de trilioane de dolari, relatează WSJ ↗
Se pare că Anthropic se pregătește să anunțe investitorii că piața sa totală adresabilă ar putea depăși 30 de trilioane de dolari. O distincție importantă - aceasta este oportunitatea teoretică anuală în cazul în care inteligența artificială ar captura munca relevantă, nu Anthropic care prezice că va ajunge să facă 30 de trilioane de dolari. (Reuters)
Cifra enormă ajută la încadrarea cheltuielilor cu infrastructura ale Anthropic, a concurenței sale cu OpenAI și Google și a poveștii investitorilor în sens mai larg. Este o cifră spectaculos de mare... chiar și după standardele numerice din industria inteligenței artificiale. (Reuters)
FAQ
Ce înseamnă rezultatele cipului Jalapeño ale OpenAI pentru inferența AI?
OpenAI afirmă că Jalapeño a oferit un debit de vârf per kilowatt mai mare și o latență end-to-end mai mică decât sistemul său de comparație, atunci când a rulat GPT-OSS 120B. Câștiguri similare au fost raportate cu DeepSeek R1 și Kimi K2.5. Rezultatele sugerează că OpenAI proiectează din ce în ce mai mult hardware în jurul cerințelor specifice de eficiență și viteză ale inferenței AI la scară largă.
Cum funcționează memoria partajată a lui Claude în chat și în Cowork?
Claude poate acum să includă informații învățate în conversațiile obișnuite în sarcinile de colaborare, reducând nevoia de a explica în mod repetat același proiect sau context. Utilizatorii pot inspecta, edita și șterge subiectele amintite, în timp ce aceste amintiri pot continua să se actualizeze pe măsură ce conversațiile se desfășoară. Conform anunțului menționat în articol, funcția este activată în mod implicit în abonamentele Free, Pro și Max.
Ce poate face Gemini Enterprise pentru servicii juridice și financiare?
Ofertele specializate Gemini Enterprise de la Google Cloud sunt destinate fluxurilor de lucru specifice industriei, mai degrabă decât chat-ului generic bazat pe inteligență artificială. Pachetul juridic acoperă domenii precum revizuirea contractelor, cercetarea, monitorizarea reglementărilor, solicitările de confidențialitate și redactarea documentelor, în timp ce versiunea pentru servicii financiare acceptă fluxuri de lucru care includ evaluarea riscului de credit, monitorizarea portofoliului, cercetarea KYC și analiza pieței. Ambele se pot conecta și cu sistemele de date și software profesionale existente.
De ce devine mai importantă inferența locală a inteligenței artificiale?
Inferența locală bazată pe inteligența artificială poate consolida confidențialitatea, reduce dependența de infrastructura cloud și poate reduce costurile de utilizare continuă. Jetson Orin Nano 2 de la Nvidia vizează roboții, dronele și alte sisteme edge, în timp ce Portable Computer de la Perplexity păstrează modelele, fișierele și execuția agenților pe hardware local compatibil. În multe fluxuri de lucru, modelele cloud pot fi apoi rezervate pentru sarcini care necesită capacități suplimentare.
Cum decide Perplexity Portable Computer când să utilizeze inteligența artificială în cloud?
Sarcinile sunt concepute să înceapă pe hardware-ul local al utilizatorului, bazat pe Nvidia, păstrând execuția modelului și fișierele compatibile pe mașină. Dacă o etapă necesită un model de cloud de frontieră, sistemul solicită permisiunea utilizatorului înainte de a o escalada. Lucrările finalizate local nu consumă credite de facturare cloud, ceea ce face ca abordarea să fie relevantă pentru utilizatorii preocupați atât de confidențialitate, cât și de costurile recurente ale inferenței.
Ce semnifică estimarea pieței de inteligență artificială de 30 de trilioane de dolari raportată de Anthropic?
Cifra raportată se referă la viziunea Anthropic asupra pieței totale potențiale adresabile pentru IA, nu la o predicție că Anthropic în sine va genera venituri anuale de 30 de trilioane de dolari. Aceasta reprezintă valoarea teoretică a muncii pe care IA ar putea-o aborda în întreaga economie. Estimarea ajută, de asemenea, la explicarea motivului pentru care companiile de top din domeniul IA investesc atât de mult în infrastructură și capabilități ale întreprinderilor.