Google va Meta soatlab farq bilan raqobatchi sun’iy intellekt (AI) modellarini chiqardi. Hech biri ustun kela olmadi: Kim yetakchilik qilmoqda?

  • Google va Meta 2-sentabr kuni raqobatlashayotgan ilg‘or sunʼiy intellekt modellari chiqarildi.
  • Gemini 3.8 Flash har 1 million kiritilgan token uchun 0,75 dollar turadi.
  • Muse Spark 1.3 sunʼiy tahlil intellekti indeksi bo‘yicha 61 ball to‘pladi.

«Google» kompaniyasi (texnologik kompaniya) va «Meta» kompaniyasi (ijtimoiy tarmoqlar sohasidagi texnologik kompaniya) chorshanba kuni o‘zlarining eng oxirgi «Sunʼiy intellekt» (AI) modellarini bir necha soat oraliqda taqdim qildi. «Google» – Gemini 3.8 Flash hamda kiberxavfsizlikka oid qo‘shimcha yangi modelini chiqardi, «Meta» esa Muse Spark 1.3 modelini e’lon qildi.

Ushbu modellar bir kunda chiqarilgani ularni bevosita taqqoslash imkonini beradi. Mustaqil «Artificial Analysis» tashkiloti (tahlil markazi) tomonidan o‘tkazilgan sinov natijalari har ikki tomon uchun o‘ziga xos ustunliklarni ko‘rsatdi. «Meta» agentlik darajasidagi bilim va ilmiy tahlil sohasida peshqadamlik qildi, «Google» esa faktlarni aniqlik bilan eslab qolish va tugatish kodlarini yozishda o‘z ustunligini saqlab qoldi.

Bir kunda ikki ilg‘or «Sunʼiy intellekt» modelining taqdimoti

Gemini 3.8 Flash — bu «Google» kompaniyasining so‘nggi olti haftadagi uchinchi Flash modeli hisoblanadi. Mazkur modeldan foydalanish narxi har bir millionta kirish tokeni uchun $0,75 va chiqish tokeni uchun $3,75 ni tashkil qiladi.

Bizni «X» ijtimoiy tarmog‘ida kuzating – barcha eng so‘nggi yangiliklarni birinchilardan bo‘lib biling

Bu boshlang‘ich tarif 2026 yil 31 dekabrga qadar amal qiladi. Keyin esa narx ikki barobarga oshib, bir million token uchun mos ravishda $1,50 va $7,50 ni tashkil etadi.

«Google» umumiy model bilan birga Gemini 3.8 Flash Cyber varianti — kiberxavfsizlikka yo‘naltirilgan modelni ham taqdim etdi. Ushbu model faqat ishonchli va malakali himoyachilar uchun foydalanishga ochiq. Model «CyberGym» platformasida (zaifliklarni topish bo‘yicha indikator) 86,2% natijaga erishdi.

Kiberxavfsizlik varianti yana bir muhim sinalgan indikator — «CWE-Bench» (yamoqlash sinovi) bo‘yicha 47,2% natija ko‘rsatdi. «Google» kompaniyasi ta’kidlashicha, ushbu model «Chrome» dasturi uchun yirik tijorat modellari bilan taqqoslaganda, zaifliklarni to‘g‘irlashda 2,6 barobar ko‘proq to‘g‘ri natijalar berdi.

Modelga kirish «Fairwind Program» dasturi orqali cheklanadi – bu model davlat idoralari va hayotiy muhim infratuzilmani boshqaruvchi tashkilotlar uchun mo‘ljallangan. «OpenAI» kompaniyasi (sun’iy intellekt ishlab chiquvchi tashkilot) ham bir kun oldin «Astra» modeliga nisbatan shunday cheklov qo‘ydi. «Astra» bu kompaniya tomonidan ilk bor kiberxavfsizlikka nisbatan kritik darajadagi xavfsizlik ko‘rsatkichiga erishgan modeldir.

Shu bilan bir qatorda, «Meta» Muse Spark 1.3 modelini Muse Code hamda Meta Model API orqali foydalanish uchun taqdim etdi. Kompaniya muhandislari bu model avvalgi 1.2 versiyaga nisbatan taxminan 20% kamroq asbob chaqiriqlari ishlatilganini aniqlashdi.

Gemini 3.8 Flash va Muse Spark 1.3: Mustaqil indikatorlar natijani ajratdi

«Artificial Analysis» tashkiloti bu modellarni sinovdan o‘tkazdi. Natijalar shuni ko‘rsatadiki, Muse Spark 1.3 modelining «max» rejimida ishlaganda GDPval-AA v2 indikatorida 1 754 ball yig‘ildi. «Gemini 3.8 Flash» (yuqori versiyada) esa 1 545 ballga ega bo‘ldi.

Bundan tashqari, «Meta» kompaniyasi Sierra Research bank agenti sinovida hamda CritPt fizik tahlil sohasida yetakchilik qildi (52,4% ga 44,9%). «Gemini 3.8 Flash» esa Terminal-Bench 2.1 indikatorida 87,6%, AA-LCR (uzun kontekst) bo‘yicha 81%, va AA-Omniscience (aniqlik%) bo‘yicha 55% natija ko‘rsatdi.

Shuningdek, Gemini 3.8 Flash tahlil qilingan modellar orasida GPQA Diamond indikatorida eng yuqori — 95% natijani qayd etdi. Har ikki model Humanity’s Last Exam indikatorida bir-biridan deyarli bir ball farq bilan yakunladi.

«Meta» korxonasining eng kuchli modeli hozircha xalq ommasiga chiqmagan. Kompaniyaning ma’lum qilishicha, «max reasoning» — chuqur tahlil rejimi xavfsizlik bo‘yicha yana ko‘plab sinovlardan to‘liq o‘tgandan so‘ng ishlab chiqariladi. Hozirda esa «xhigh» varianti ochiq.

Sho‘ba variant «Artificial Analysis Intelligence Index» (Sun’iy intellekt indikator indeksi) bo‘yicha 61 ballga erishdi. Bu natija Muse Spark 1.2 dan to‘rt pog‘ona yuqori. Ammo u hali ham 66 ballga ega «Claude Fable 5.1» va 63 ballga ega «Claude Opus 5» (ikkalasi – sun’iy intellekt kompaniyalarining ilg‘or modellari) dan pastroqda turadi.

Yaqinda yangi modellarning chiqqani bilan yana ko‘plab yangiliklar kutilyapti. Ilon Mask («SpaceX» va boshqa texnologik kompaniyalar asoschisi) yaqinda Grok 4.7 modelining bozorga chiqishini e’lon qildi. Shunday qilib, ikki haftadan kamroq vaqt ichida to‘rtta ilg‘or «Sunʼiy intellekt» modeli taqdim etilishi mumkin.

Bizning YouTube kanalimizga obuna bo‘ling — bu yerda soha yetakchilari va jurnalistlari o‘z tajribalarini baham ko‘radi


BeInCrypto’dan kriptovalyuta bozorining so‘nggi tahlilini o‘qish uchun, bu yerni bosing.

Diskleymer

BeInCrypto faqat xolis va haqqoniy ma’lumotlarni taqdim etishga intiladi. Ushbu yangilik maqolasining maqsadi voqeani aniq va o‘z vaqtida yoritishdir. Shunga qaramay, BeInCrypto o‘quvchilarga ushbu kontent asosida moliyaviy qaror qabul qilishdan oldin ma’lumotni mustaqil ravishda tekshirishni va mutaxassis bilan maslahatlashishni tavsiya qiladi. Shuningdek, Shartlar va qoidalar, Maxfiylik siyosati va Diskleymerlar yangilandi.