E-BUZZ ME Logo
Inteligenta ArtificialaAnaliza tehnica

Intel lansează AutoRound: Cuantificare avansată pentru modelele LLM și VLM

Publicat
Intel lansează AutoRound: Cuantificare avansată pentru modelele LLM și VLM
2 min de citit227 cuvinte

Pe scurt

Intel a prezentat AutoRound, un algoritm sofisticat de cuantificare a ponderilor conceput pentru a optimiza modelele de limbaj mari și modelele viziune-limbaj.

Intel a lansat oficial AutoRound, un algoritm de cuantificare a ponderilor (weight-only quantization - WOQ) de înaltă performanță, menit să îmbunătățească semnificativ eficiența modelelor de limbaj mari (LLM) și a modelelor viziune-limbaj (VLM). Pe măsură ce modelele de AI generativ continuă să crească în dimensiune, cererea pentru tehnici de compresie eficiente, care să păstreze acuratețea reducând în același timp cerințele hardware, a devenit critică.

Precizie prin optimizare avansată

AutoRound se distinge de metodele tradiționale de rotunjire printr-o abordare mult mai nuanțată a cuantificării. Spre deosebire de tehnicile standard de tip „rotunjire la cel mai apropiat întreg”, AutoRound utilizează un proces de reglare automatizat pentru a găsi valorile optime de rotunjire pentru ponderile modelului. Acest lucru asigură faptul că modelele comprimate mențin un nivel ridicat de performanță și precizie, chiar și atunci când sunt reduse la formate de biți mici, cum ar fi întregii pe 4 sau 8 biți.

Compatibilitate extinsă și performanță

Conceput pentru a fi versatil, AutoRound suportă o gamă largă de arhitecturi populare, inclusiv Llama, Mistral și diverse modele integrate cu funcții de viziune computerizată. Prin reducerea amprentei de memorie a acestor modele, Intel permite cercetătorilor și dezvoltatorilor să implementeze soluții AI de ultimă generație pe o varietate mai mare de echipamente hardware, inclusiv dispozitive edge și procesoare (CPU) sau plăci grafice (GPU) de larg consum, fără degradarea tipică a performanței asociată cu compresia masivă.

Articole similare

Articole asemanatoare, ordonate semantic dupa subiect si actualitate.

Lansarea HELMET: Un nou etalon pentru evaluarea modelelor de limbaj cu context extins
Inteligenta Artificiala70%

Lansarea HELMET: Un nou etalon pentru evaluarea modelelor de limbaj cu context extins

Cercetătorii au prezentat HELMET, un cadru de evaluare holistic conceput pentru a testa riguros modul în care modelele AI gestionează volume masive de date și secvențe lungi.

Optimizarea performanței LLM: Înțelegerea fazelor Prefill și Decode pentru solicitări concurente
Inteligenta Artificiala70%

Optimizarea performanței LLM: Înțelegerea fazelor Prefill și Decode pentru solicitări concurente

O analiză detaliată despre modul în care optimizarea fazelor de prefill și decode ale inferenței LLM poate îmbunătăți semnificativ performanța pentru solicitările simultane ale utilizatorilor.

Modelele Cohere sunt acum disponibile prin Hugging Face Inference Providers
Inteligenta Artificiala66%

Modelele Cohere sunt acum disponibile prin Hugging Face Inference Providers

Modelele de limbaj de mari dimensiuni de la Cohere pot fi acum accesate direct prin infrastructura gestionată de Hugging Face, simplificând procesul de implementare pentru dezvoltatori.

Raport Protect AI și Hugging Face: 4 milioane de modele scanate pentru riscuri de securitate
Inteligenta Artificiala63%

Raport Protect AI și Hugging Face: 4 milioane de modele scanate pentru riscuri de securitate

La șase luni de la începutul parteneriatului lor, Protect AI și Hugging Face au analizat peste 4 milioane de modele de machine learning pentru a identifica vulnerabilități critice de securitate.

Anthropic solicită cipuri de memorie de la SK Hynix pentru dezvoltarea propriilor procesoare AI
Tech si Gadgeturi60%

Anthropic solicită cipuri de memorie de la SK Hynix pentru dezvoltarea propriilor procesoare AI

Dezvoltatorul de inteligență artificială Anthropic a contactat SK Hynix pentru furnizarea de cipuri de memorie, în contextul în care startup-ul explorează crearea propriilor semiconductori.

Hugging Face intră pe piața de hardware pentru robotică prin achiziția Pollen Robotics
Inteligenta Artificiala60%

Hugging Face intră pe piața de hardware pentru robotică prin achiziția Pollen Robotics

Liderul AI open-source Hugging Face se extinde în zona hardware-ului fizic în urma achiziției startup-ului francez Pollen Robotics.

Nvidia investește 1 miliard de dolari în Naver pentru a stimula infrastructura AI din Coreea de Sud
Tech si Gadgeturi60%

Nvidia investește 1 miliard de dolari în Naver pentru a stimula infrastructura AI din Coreea de Sud

Nvidia își consolidează prezența în Coreea de Sud printr-o investiție de 1 miliard de dolari în Naver Corp., destinată finanțării unui nou centru de date masiv pentru inteligență artificială.

Analiza Qwen-3: Patru concluzii esențiale din noile șabloane de chat
Inteligenta Artificiala59%

Analiza Qwen-3: Patru concluzii esențiale din noile șabloane de chat

O analiză tehnică a șabloanelor de chat actualizate ale Qwen-3 dezvăluie schimbări semnificative în modul în care modelul gestionează conversațiile cu mai multe replici și instrucțiunile de sistem.