E-BUZZ ME Logo
Inteligenta ArtificialaAnaliza tehnica

SGLang integrează backend-ul Transformers pentru o compatibilitate extinsă a modelelor

Publicat
SGLang integrează backend-ul Transformers pentru o compatibilitate extinsă a modelelor
1 min de citit179 cuvinte

Pe scurt

O nouă integrare aduce backend-ul Hugging Face Transformers în SGLang, extinzând versatilitatea framework-ului pentru dezvoltatorii de inteligență artificială.

SGLang, framework-ul de înaltă performanță conceput pentru servirea și dirijarea modelelor de limbaj mari (LLM), a integrat oficial backend-ul Transformers. Această actualizare marchează o schimbare semnificativă în modul în care dezvoltatorii pot interacționa cu și implementa modele în cadrul ecosistemului SGLang.

Extinderea suportului pentru modele

Prin încorporarea backend-ului Transformers, SGLang oferă acum o compatibilitate perfectă cu biblioteca vastă de modele găzduite pe Hugging Face Hub. Această integrare permite utilizatorilor să profite de tehnicile avansate de optimizare ale SGLang — cum ar fi RadixAttention și cache-urile KV comprimate — pe o gamă mult mai largă de arhitecturi care anterior erau limitate la backend-uri specifice.

Performanță și flexibilitate

Integrarea are ca scop reducerea decalajului dintre ușurința în utilizare și viteza de execuție. Deși SGLang este recunoscut pentru capacitățile sale de transfer ridicat (high-throughput), adăugarea backend-ului Transformers asigură cercetătorilor posibilitatea de a prototipa și testa rapid noi modele fără a sacrifica beneficiile de infrastructură oferite de runtime-ul SGLang. Această mișcare este așteptată să eficientizeze fluxurile de lucru pentru echipele care lucrează la dirijarea complexă a IA și la generarea de output-uri structurate.

Articole similare

Articole asemanatoare, ordonate semantic dupa subiect si actualitate.

Google DeepMind lansează SigLIP 2: Un nou standard în procesarea multilingvă viziune-limbaj
Inteligenta Artificiala70%

Google DeepMind lansează SigLIP 2: Un nou standard în procesarea multilingvă viziune-limbaj

Google DeepMind a prezentat SigLIP 2, un codificator viziune-limbaj de ultimă generație, conceput să îmbunătățească semnificativ performanța în sarcinile multilingve și cross-modale.

Optimizarea performanței LLM prin gestionarea eficientă a cozilor de așteptare
Inteligenta Artificiala64%

Optimizarea performanței LLM prin gestionarea eficientă a cozilor de așteptare

Noile strategii de gestionare a solicitărilor ajută dezvoltatorii să maximizeze capacitatea de procesare a modelelor de limbaj mari, minimizând în același timp latența.

Google lansează PaliGemma 2 Mix: Modele avansate de limbaj vizual optimizate prin instrucțiuni
Inteligenta Artificiala64%

Google lansează PaliGemma 2 Mix: Modele avansate de limbaj vizual optimizate prin instrucțiuni

Google și-a extins portofoliul de modele de limbaj vizual cu PaliGemma 2 Mix, o nouă serie optimizată pentru a urma instrucțiuni vizuale complexe.

SmolVLM2: Înțelegere video avansată pentru dispozitive Edge
Inteligenta Artificiala63%

SmolVLM2: Înțelegere video avansată pentru dispozitive Edge

Hugging Face a lansat SmolVLM2, o familie de modele compacte de limbaj vizual concepute pentru a aduce analiza video și de imagine de înaltă performanță pe hardware-ul de consum.

Extinderea ecosistemului de inferență Serverless: Hyperbolic, Nebius AI Studio și Novita se alătură pieței
Inteligenta Artificiala62%

Extinderea ecosistemului de inferență Serverless: Hyperbolic, Nebius AI Studio și Novita se alătură pieței

Peisajul inteligenței artificiale serverless se extinde prin adăugarea a trei noi furnizori de inferență: Hyperbolic, Nebius AI Studio și Novita.

OpenAI dezvăluie Project Camellia: Un nou hub de infrastructură AI în Georgia
Inteligenta Artificiala61%

OpenAI dezvăluie Project Camellia: Un nou hub de infrastructură AI în Georgia

OpenAI a anunțat o inițiativă majoră de infrastructură în comitatul Effingham, Georgia, punând accent pe energia responsabilă și dezvoltarea economică locală.

NVIDIA Cosmos-H-Dreams: Simulare Generativă în Timp Real pentru Robotica Chirurgicală
Inteligenta Artificiala59%

NVIDIA Cosmos-H-Dreams: Simulare Generativă în Timp Real pentru Robotica Chirurgicală

Noul cadru Cosmos-H-Dreams de la NVIDIA utilizează inteligența artificială generativă pentru a crea simulări de înaltă fidelitate în timp real, destinate instruirii roboților chirurgicali avansați.

SoftBank extinde împrumutul de 40 de miliarde de dolari pentru OpenAI cu 21 de noi creditori
Tech si Gadgeturi57%

SoftBank extinde împrumutul de 40 de miliarde de dolari pentru OpenAI cu 21 de noi creditori

Împrumutul-punte masiv de 40 de miliarde de dolari al SoftBank pentru investiția în OpenAI a atras cu succes un sindicat larg de 21 de creditori suplimentari.