Google және Meta сәрсенбі күні бірнеше сағат ішінде өздерінің соңғы шекаралық ЖИ модельдерін таныстырды. Google Gemini 3,8 Flash моделін киберқауіпсіздік нұсқасымен бірге ұсынды, ал Meta Muse Spark 1,3 шығарды.
Осы екі іске қосу тікелей салыстыру жасауға мүмкіндік береді. Artificial Analysis зертханасының тәуелсіз сынақтары нәтижені екіге бөледі: Meta агенттік білім жұмысы мен ғылыми пайымдау бойынша алда болса, Google фактілерді еске сақтау мен терминалдық код жазуда басымдыққа ие.
Екі шекаралық модель бір күнде таныстырылды
Gemini 3,8 Flash – бұл Google-дың алты апта ішінде үшінші Flash шығарылымы. Модельдің 1 млн енгізу токеніне құны 0,75 доллар, ал 1 млн шығару токеніне 3,75 долларға тең.
X платформасындағы парақшамызға жазылыңыз, жаңалықтарды уақтылы білу үшін
Кіріспе тариф 31 желтоқсан, 2026 жылға дейін қолданылады. Осы мерзімнен кейін баға екі есе өсіп, 1,50 доллар және 7,50 долларға жетеді.
Google бұл жалпы модельді Gemini 3,8 Flash Cyber-мен біріктірді. Модель сенімді қорғанушылар тізіміне енгізілгендерге қолжетімді. Ол CyberGym тестілеуінде, осалдықты анықтауға арналған бенчмаркта, 86,2%-ға жетті.
Кибернұсқа CWE-Bench, патчингке арналған бенчмаркта, 47,2%-ды көрсеткен. Google бұл модель Chrome осалдықтарына қатысты дұрысырақ патчтарды үлкен коммерциялық модельдерге қарағанда 2,6 есе жиі жасайтынын атап өтті.
Қол жеткізу құқықтары Fairwind бағдарламасы арқылы шектелген, яғни модель тек мемлекеттік органдар мен маңызды инфрақұрылым операторларына қолжетімді. OpenAI бұған ұқсас шектеуді бір күн бұрын Astra-ға енгізді, оны дағдарыстық киберқауіпсіздік деңгейінде деп бағалады.
Сонымен қатар Meta Muse Spark 1,3-ті Muse Code және Meta Model API арқылы көпшілікке ұсынды. Компания инженерлері құралды шақыру көрсеткіші 1,2-нұсқамен салыстырғанда шамамен 20%-ға төмендегенін көрсетті.
Gemini 3,8 Flash пен Muse Spark 1,3: тәуелсіз бенчмарктер нәтижені екіге бөледі
Artificial Analysis модельдерді сынақтан өткізді, нәтижелерінде олардың рейтингтегі орны анық көрсетілген. Muse Spark 1,3 максималды режимде GDPval-AA v2 бенчмаркінен 1 754 Elo жинаса, Gemini 3,8 Flash (жоғары) — 1 545 жинаған.
Meta сонымен қатар Sierra Research банк агенті тестінде (52,4%-ға 44,9%) және CritPt физикасын пайымдау бойынша көш бастап тұр. Gemini 3,8 Flash Terminal-Bench 2,1-де 87,6%-ды, AA-LCR ұзақ контекстте 81%-ды және AA-Omniscience дәлдігінде 55%-ды көрсетті.
Gemini 3,8 Flash тестіленген модельдер арасында GPQA Diamond бойынша ең жоғары көрсеткішке — 95%-ға жетті. Humanity’s Last Exam барысында екі модель бір-бірінен небәрі бір ұпайға ғана айырмашылықпен аяқтады.
Meta-ның ең жақсы көрсеткіш иесі қазіргі таңда қолжетімсіз. Компания максималды пайымдау нұсқасы қосымша қауіпсіздік тексерулерінен кейін келеді деп жариялаған, қазір xhigh нұсқасы ғана қолжетімді.
Аталған нұсқа Artificial Analysis Intelligence Index бойынша 61 ұпай жинап, Muse Spark 1,2-ден төрт ұпай алда. Дегенмен, бұл нәтижесі Claude Fable 5,1-дегі 66 және Claude Opus 5-тегі 63 ұпайдан төмен.
Тағы бірнеше жаңа шығарылымдар кезек күтіп тұр. Илон Маск Grok 4,7 нұсқасы жақында шығады деп мәлімдеген, осылайша екі апта ішінде төрт шекаралық модель іске қосылмақ.
YouTube арнамызға жазылыңыз, сарапшылар мен журналистердің кәсіби түсіндірмесін көру үшін









