«Anthropic» sunʼiy intellekt kompaniyasi 28-sentabr kuni Claude Sonnet 5.5 sunʼiy intellekt modelini chiqarib, uni Sonnet 5 modeli bilan bir xil narxda taklif etdi. Kompaniyaning ta’kidlashicha, yangi model oldingisidan 30 foizga tezroq ishlaydi va har bir vazifa uchun narxini 30 foizgacha arzonlashtiradi.
Mustaqil baholovchi tashkilot bu modelni imkoniyatining eng yuqori darajasigacha sinab ko‘rganida, narxi haqida boshqacha xulosaga keldi.
Yangiliklarni birinchi boʻlib olish uchun bizni «X» ijtimoiy tarmogʻi orqali kuzatib boring
«Anthropic» kompaniyasining ikkinchi 5.5 modeli «Opus»dan bir necha kun o‘tib chiqdi
Sonnet 5.5 Claude 5.5 oilasining ikkinchi modeli hisoblanadi. «Anthropic» sunʼiy intellekt kompaniyasi Opus 5.5 modelini 22-sentabr kuni chiqargan edi. O‘sha kunning o‘zida «OpenAI» sunʼiy intellekt kompaniyasi ham GPT-6 Sol va Luna modellarini taqdim etdi.
Yangi model Sonnet 5 narxini saqlab qolgan: har million kiruvchi token uchun $2 va har million chiquvchi token uchun $10. «Anthropic» kompaniyasi Terminal-Bench 4.0 — kod yozish testida 70,6% natija ko‘rsatganini bildirdi. Sonnet 5 esa faqat 10,3% natija bergan, Opus 5.5 — 66,4% ko‘rsatkichga yetgan.
“Opus 5.5 murakkab va chuqur tahlil talab qiladigan ishlar uchun mo‘ljallangan boʻlsa, Sonnet 5.5 kundalik aniq belgilangan vazifalar, xatolarni tuzatish, hujjatlar, slaydlar va jadval fayllarini sifatli tayyorlashda kuchli”, — deydi jamoa.
«Anthropic» sunʼiy intellekt kompaniyasi Sonnet 5.5 modeli oldingi chegaralarini oshirmaganini maʼlum qildi. Shuning uchun ko‘proq xavflar, masalan, foydalanuvchilarni aldash yoki noto‘g‘ri ma’lumotga yordam berish ehtimollari bo‘yicha tekshiruvga e’tibor qaratilgan.
Sonnet 5.5 modeli kiberxavfsizlik uchun himoya va maxsus tahlilchilar bilan birga chiqmoqda. Ular raqib tizimlarni modelning ishlash usulini yechib olishdan himoya qiladi. Yaqin haftalarda Claude Haiku 5.5 modeli ham chiqariladi.
Biroq, shu orada «OpenAI» sunʼiy intellekt kompaniyasi yangi GPT-6.1 Astra modelini chiqarishni to‘xtatdi. «CNBC» axborot agentligi (media tashkiloti) dushanba kuni bu model kompaniya talablariga javob bermaganini tasdiqladi (OpenAI kompaniyasi uchun belgilangan standartlar).
«Artificial Analysis» sunʼiy intellekt kompaniyasi maksimal ishlashda ko‘proq token sarflanishini aniqladi
«Artificial Analysis» mustaqil baholovchi tashkiloti, Grok 4.7 modelini to‘rtinchi o‘ringa qoʻygan tashkilot, Sonnet 5.5 modeliga Intellekt indeksi bo‘yicha 56 ball berdi. Bu natija bo‘yicha u eng yaxshi ikkinchi o‘rinni egalladi, Opus 5.5 modelidan faqat 2 ball ortda qoldi (maksimal ishda).
Bu tashkilot Terminal-Bench 4.0 testida Sonnet 5.5 uchun 64%, Opus 5.5 va GPT-6 Astra modellariga esa 60% natija qayd etdi. GDPval-AA kabi bilim va tahlil testlarida Sonnet 5.5 va Opus 5.5 deyarli bir xil darajada ekanligi aniqlandi.
Biroq, mustaqil baholovchi tashkilot Sonnet 5.5 yuqori natija ko‘rsatishi uchun juda ko‘p token sarflaganini taʼkidladi.
“Maksimal harakatda, yaʼni Opus 5.5 natijasiga yaqin ishlashda Claude Sonnet 5.5 har bir Intellekt indeksi vazifasi uchun taxminan 193 ming output token ishlatdi,” — deyiladi postda («Artificial Analysis» sunʼiy intellekt kompaniyasining «X» ijtimoiy tarmogʻi sahifasi).
Bu miqdor Opus 5.5 va Sonnet 5 modellariga nisbatan deyarli 60% ko‘proq. Bundan tashqari, GPT-6 Astra maksimal ish uchun sarflagan tokenidan yetti baravar ko‘p.
Biroq, «Anthropic» sunʼiy intellekt kompaniyasi tomonidan keltirilgan dastlabki foydalanuvchilar boshqa natijani bildirgan. Masalan, «Balyasny Asset Management» investitsiya kompaniyasi moliyaviy vazifalarda token sarfi ancha past bo‘lganini qayd etdi.
“Bizda mavjud bo‘lgan 2 441 moliyaviy vazifada – savol-javoblar, ma’lumot ajratish, tahlil hamda prognoz sohalarini o‘z ichiga olgan vazifalarda Claude Sonnet 5.5 Sonnet 5 dan yuqori natija ko‘rsatdi va har bir javob uchun atigi 121 ming token ishlatdi, Sonnet 5 esa 497 ming token sarflagan edi,” — deydi Jo Poirye, «Balyasny Asset Management» investitsiya kompaniyasining katta AI muhandisi.
«Artificial Analysis» sunʼiy intellekt kompaniyasi testda oldindan chiqarilgan, tuzilgan natijalarni noto‘g‘ri ko‘rsatishga olib keladigan xato (strukturaviy output xatosi) bo‘lgan modeldan foydalangan. «Anthropic» kompaniyasi esa bu xatoni bartaraf etganini aytdi va baholash testlari tez orada yangidan oʻtkaziladi.
Mutaxassislar fikrlarini ko‘rish uchun «YouTube» kanalimizga obuna bo‘ling









