E-BUZZ ME Logo
Inteligenta ArtificialaAnaliza tehnica

Hugging Face extinde Text Generation Inference cu suport multi-backend

Publicat
Hugging Face extinde Text Generation Inference cu suport multi-backend
1 min de citit177 cuvinte

Pe scurt

Framework-ul Text Generation Inference (TGI) suportă acum backend-urile NVIDIA TensorRT-LLM și vLLM, oferind dezvoltatorilor o flexibilitate sporită pentru implementări AI de înaltă performanță.

Hugging Face a anunțat o actualizare semnificativă pentru framework-ul său Text Generation Inference (TGI), introducând suport nativ pentru multiple backend-uri, în special NVIDIA TensorRT-LLM și vLLM. Această inițiativă vizează oferirea unui set de instrumente mai versatil pentru dezvoltatorii care implementează modele de limbaj de mari dimensiuni (LLM) în medii de producție.

Performanță și flexibilitate sporite

Prin integrarea TensorRT-LLM, utilizatorii TGI pot acum să profite de biblioteca optimizată a NVIDIA pentru inferența deep learning, concepută pentru a maximiza fluxul de date și a reduce latența pe unitățile de procesare grafică (GPU) NVIDIA. În paralel, adăugarea suportului vLLM aduce un management eficient al memoriei prin PagedAttention, o tehnică ce îmbunătățește semnificativ utilizarea hardware-ului în timpul sarcinilor de lucru cu un nivel ridicat de concurență.

Implementare simplificată

Introducerea acestor backend-uri permite echipelor tehnice să comute între motoarele de optimizare fără a modifica structura API-ului de bază. Acest lucru asigură faptul că TGI rămâne o interfață unificată pentru servirea modelelor, permițând în același timp utilizatorilor să aleagă backend-ul specific care se potrivește cel mai bine constrângerilor hardware și cerințelor de performanță.

Articole similare

Articole asemanatoare, ordonate semantic dupa subiect si actualitate.

Actualizare Sentence Transformers: Modele de Static Embedding antrenate de 400 de ori mai rapid
Inteligenta Artificiala70%

Actualizare Sentence Transformers: Modele de Static Embedding antrenate de 400 de ori mai rapid

O nouă descoperire în biblioteca Sentence Transformers permite antrenarea modelelor de tip static embedding la viteze de până la 400 de ori mai mari față de metodele anterioare.

Hugging Face colaborează cu FriendliAI pentru a optimiza implementarea modelelor
Inteligenta Artificiala66%

Hugging Face colaborează cu FriendliAI pentru a optimiza implementarea modelelor

Un nou parteneriat între Hugging Face și FriendliAI vizează simplificarea procesului de implementare a modelelor AI de mari dimensiuni direct prin intermediul Hugging Face Hub.

Optimizarea Raționamentului: Cum Două Setări API au Triplat Rezultatele pe Benchmark-ul ARC-AGI-3
Inteligenta Artificiala66%

Optimizarea Raționamentului: Cum Două Setări API au Triplat Rezultatele pe Benchmark-ul ARC-AGI-3

Noi descoperiri relevă faptul că ajustarea unor parametri API specifici pentru GPT-5.6 poate îmbunătăți semnificativ capacitățile de raționament și eficiența în cadrul complexului benchmark ARC-AGI-3.

Modelele Timm, integrate direct în ecosistemul Hugging Face Transformers
Inteligenta Artificiala65%

Modelele Timm, integrate direct în ecosistemul Hugging Face Transformers

O nouă integrare permite utilizatorilor să încarce orice model de viziune artificială din biblioteca 'timm' folosind biblioteca standard Hugging Face Transformers.

Ascensiunea agenților AI: Navigarea către noua frontieră a automatizării
Inteligenta Artificiala63%

Ascensiunea agenților AI: Navigarea către noua frontieră a automatizării

Pe măsură ce agenții AI autonomi trec de la concepte teoretice la instrumente funcționale, industria se confruntă cu noi întrebări privind integrarea și supravegherea acestora.

OpenAI oferă acces gratuit la modele AI avansate pentru 100.000 de cercetători universitari
Inteligenta Artificiala62%

OpenAI oferă acces gratuit la modele AI avansate pentru 100.000 de cercetători universitari

OpenAI lansează o inițiativă majoră pentru a accelera descoperirile științifice, oferind acces gratuit la funcțiile premium ChatGPT pentru comunitatea globală de cercetare.

Lilian Weng revine la OpenAI după o scurtă plecare la startup-ul Thinking Machines
Inteligenta Artificiala60%

Lilian Weng revine la OpenAI după o scurtă plecare la startup-ul Thinking Machines

Lilian Weng, fost VP al departamentului de AI Safety Research din cadrul OpenAI, s-a reîntors în organizație după o scurtă perioadă petrecută la Thinking Machines.

Zuckerberg conturează ambițiile extinse ale Meta pentru AI-ul de tip enterprise, dincolo de simplii agenți
Inteligenta Artificiala60%

Zuckerberg conturează ambițiile extinse ale Meta pentru AI-ul de tip enterprise, dincolo de simplii agenți

CEO-ul Mark Zuckerberg a dezvăluit că Meta vizează o oportunitate masivă în sectorul enterprise, care include infrastructură AI, API-uri și dezvoltarea de software intern.