Într-o mișcare semnificativă pentru ecosistemul infrastructurii AI, Intel a anunțat integrarea oficială a soluției Text Generation Inference (TGI) de la Hugging Face cu platforma Intel Gaudi. Această dezvoltare vizează eficientizarea implementării Modelelor de Limbaj de Mari Dimensiuni (LLM) pe hardware de înaltă performanță, oferind dezvoltatorilor o cale mai rapidă de la etapa de antrenare la cea de producție.
Performanță sporită pentru AI Generativ
Text Generation Inference este un set de instrumente specializat, conceput pentru implementarea și servirea LLM-urilor cu un flux mare de date (high throughput). Prin optimizarea TGI pentru acceleratoarele Intel Gaudi, utilizatorii pot beneficia acum de funcții avansate, precum batching continuu, PagedAttention și kernel-uri optimizate special pentru arhitectura Gaudi. Această integrare asigură rularea modelelor populare, inclusiv Llama și Mistral, cu o latență redusă semnificativ.
O soluție scalabilă pentru AI-ul de tip Enterprise
Colaborarea răspunde cererii tot mai mari pentru scalarea rentabilă a inteligenței artificiale. Intel Gaudi oferă o alternativă competitivă la configurațiile GPU tradiționale, iar prin suportul TGI, oferă o experiență software fluidă pentru dezvoltatorii familiarizați deja cu ecosistemul Hugging Face. Se estimează că această inițiativă va reduce barierele de intrare pentru companiile care doresc să implementeze soluții private de AI generativ de înaltă performanță.








