Nous Research a lansat NousCoder-14B, un nou model AI open-source, conceput pentru programarea competitivă, care a obținut o acuratețe impresionantă de 67,87% pe benchmark-ul LiveCodeBench v6. Această performanță reprezintă o îmbunătățire de 7,08 puncte procentuale față de modelul său de bază, Qwen3-14B de la Alibaba.
Modelul a fost antrenat în doar patru zile, folosind 48 de procesoare grafice Nvidia B200 și învățare prin consolidare (reinforcement learning) cu recompense verificabile, pe o bază de 24.000 de probleme de programare competitivă validate. Această abordare subliniază un salt de performanță, atribuit atât eficienței antrenamentului, cât și utilizării unui set de date vast și curat.
Cu toate acestea, cercetătorii avertizează că disponibilitatea datelor de înaltă calitate pentru programarea competitivă se apropie de limite. Acest lucru indică o necesitate urgentă de a genera date sintetice și de a implementează tehnici de învățare prin consolidare multi-turn pentru a susține progresele viitoare.
Un aspect crucial este că Nous Research a optat pentru un model open-source, punând la dispoziție întregul stack de antrenament și ponderile modelului. Această decizie vizează promovarea transparenței și reproductibilității, diferențiind NousCoder-14B de concurenții proprietari.











