Pereikite, Deepseek. Mieste yra naujas AI čempionas – ir jie yra amerikiečiai.
Ketvirtadienį Sietle įsikūręs ne pelno siekiančio AI tyrimų institutas AI2 išleido modelį, kuris, jo teigimu, pralenkia „Deepseek V3“ – vieną iš Kinijos AI bendrovės „Deepseek“ pirmaujančių sistemų.
Remiantis AI2 vidiniu bandymu, AI2 modelis, vadinamas TULU3-405B, taip pat įveikia „Openai“ GPT-4O tam tikrus AI etalonus. Be to, skirtingai nuo „GPT-4o“ (ir net „Deepseek V3“), „Tulu3-405B“ yra atviras kodas, tai reiškia, kad visi komponentai, reikalingi jį atkartoti nuo nulio, yra laisvai prieinami ir leistinai licencijuoti.
„AI2“ atstovas „TechCrunch“ teigė, kad laboratorija mano, kad „Tulu3-405B“ „pabrėžia JAV galimybes vadovauti pasaulinei geriausios klasės generacinių AI modelių vystymuisi“.
„Šis etapas yra pagrindinis atviros AI ateities momentas, sustiprinantis JAV kaip konkurencingų, atviro kodo modelių lyderės poziciją“,-teigė atstovas. „Vykdydamas šį paleidimą, AI2 pristato galingą, JAV sukurtą alternatyvą„ Deepseek “modeliams-žymi pagrindinę akimirką ne tik plėtojant AI, bet ir parodydama, kad JAV gali vadovauti konkurencingam, atvirojo kodo AI, nepriklausomai nuo technologijų milžinų. “
„Tulu3-405B“ yra gana didelis modelis. Remiantis AI2, turint 405 milijardų parametrų, reikia 256 GPU, veikiančių lygiagrečiai treniruotėms. Parametrai apytiksliai atitinka modelio problemų sprendimo įgūdžius, o modeliai, kurių parametrai yra daugiau, paprastai veikia geriau nei tie, kurių parametrai yra mažiau.
Anot AI2, vienas iš raktų, kaip pasiekti konkurencingą rezultatą su TULU3-405B, buvo technika, vadinama stiprinimo mokymuisi su patikrinamu atlygiu. Stiprinimo mokymasis naudojant patikrinamą atlygį arba RLVR moko modelius užduotims su „tikrinamais“ rezultatais, tokiais kaip matematikos problemų sprendimas ir vykdomos instrukcijos.
AI2 teigia, kad „PopQA“ etaloniniame rinkinyje 14 000 specializuotų žinių klausimų, pateiktų iš Vikipedijos, „Tulu3-405B“ įveikė ne tik „Deepseeek V3“ ir „GPT-4o“, bet ir „Meta“ lamos 3.1 405B modelį. „Tulu3-405B“ taip pat turėjo aukščiausią bet kurio modelio „GSM8K“ modelį-testą, kuriame yra klasės mokyklinio lygio matematikos žodžių problemos.
„Tulu3-405B“ galima išbandyti naudojant AI2 „ChatBot Web“ programą, o modelio modelio treniruotės ir patobulinimo kodas yra „GitHub“. Gaukite tai, kol karšta-prieš tai prieš ateis kitas etaloninis mušimo pavyzdinis AI modelis.