OpenAI tomonidan oktabr oyi boshida eʻlon qilingan yuzlab matematik yechimlar soha standartlariga javob bermayapti — bunday bahoni 8-oktabr kuni matematika hamjamiyatining taniqli vakillari va mustaqil tahlilchilar bildirdi. Tanqid markazida uchta masala turibdi: modelning fikrlash zanjiri deyarli ochiqlanmagani, isbotlarning katta qismining formalizatsiyadan oʻtmagani va Navier-Stokes yechimida aniqlangan nomuvofiqliklar.

Tanqidning mohiyati

OpenAI 2026-yil 5-oktabr haftasida dunyoning eng qiyin matematik masalalari boʻyicha yuzlab yechimlarni eʻlon qildi. Kompaniya avvalgi mojaroni takrorlamaslik maqsadida elita matematiklardan iborat maslahat guruhi bilan hamkorlik qilganini maʻlum qildi. Biroq eʻlon qilingan materiallarning tahlili boshqacha manzarani koʻrsatdi: TechCrunch xabariga koʻra, 719 ta qoʻlyozmaning bor-yoʻgʻi 10 tasida modelning fikrlash zanjiri (chain of thought) ochiq eʻlon qilingan, isbotlarning 42 foizi esa umuman formalizatsiyadan oʻtmagan.

Formalizatsiya — isbotni kompyuterda avtomatik tekshiriladigan shaklga, masalan Lean dasturlash tiliga oʻtkazish jarayonidir. Aynan shu bosqich isbot ichidagi yashirin xato va boʻshliqlarni aniqlash imkonini beradi, shuning uchun hamjamiyat uni standart amaliyot deb hisoblaydi.

Tahlil 8-oktabr kuni TechCrunch saytida chop etildi. Unda qayd etilishicha, OpenAI nashr oldidan elita matematiklardan iborat maslahat guruhi bilan maslahatlashgan va shu orqali avvalgi mojaroni takrorlamaslikni maqsad qilgan — biroq eʻlon qilingan materiallar mazkur guruh tavsiyalariga toʻliq mos kelmadi.

6-oktabr kuni London Kings kolleji tadqiqotchisi Aleksandr Bastunis hamda Kembrij universiteti olimlari Fabian Sirselli va Anders Hansen arXivʻda chop etgan maqolada OpenAIʻning Navier-Stokes yechimi batafsil tahlil qilindi. Mualliflar tabiiy tildagi isbot bilan unga mos Lean kodi oʻrtasida kamida ikkita farqni hujjatlashtirdi va formalizatsiyalangan Lean isbot tabiiy tildagi isbotga mos kelmaydi, degan xulosaga keldi.

Agar formalizatsiya qilingan variant asl matnga mos kelmasa, isbotning aynan qaysi qismi tekshirilganligi noaniq boʻlib qoladi — bu esa eʻlon qilingan natijaning ilmiy ishonchliligiga bevosita taʻsir qiladi.

Tavsiyalar qanday bajarildi

Prinston universiteti qoshidagi Ilgʻor tadqiqotlar institutida faoliyat yurituvchi, toʻqqiz nafar taniqli tadqiqotchidan iborat AGMAI (Advisory Group on Mathematics and Artificial Intelligence) guruhi sentabr oyi oxirida ilgʻor laboratoriyalar uchun tavsiyalar eʻlon qilgan edi. Birinchi tavsiya ilgʻor matematik masalalarni xususiy modellarda sinashni toʻxtatishdan iborat edi, yana bir muhim talab esa formalizatsiyani standart amaliyotga aylantirish edi.

Nashr etilgan materiallar bu talablarga toʻliq javob bermadi: isbotlarning 42 foizi formalizatsiyadan oʻtmagan, 719 ta qoʻlyozmadan esa faqat 10 tasida modelning fikrlash zanjiri ochiqlangan. AGMAI tavsiyalarining qay darajada bajarilganini baholash yakunda matematik hamjamiyatning oʻziga tegishli ekanini bildirdi:

"Ultimately up to the mathematical community to assess the extent to which our recommendations were followed successfully." — AGMAI bayonoti.

Guruh shuningdek OpenAI oʻz yechimlarini mazmunli qilish uchun zarur boʻlgan inson matematiklarining ishini moliyalashtirishda yordam berishi kerakligini taklif qildi.

Tao tanqidi va kengroq munozara

Fields medali sohibi Terens Tao OpenAIʻning yondashuvini tanqid qildi. Uning yozishicha, masalalar natijani yetarlicha chuqur tushunmaydigan, olingan natija yuzasidan savollarga javob bera olmaydigan yoki soha mutaxassislari oldida maʻruza qila olmaydigan "SI koʻrsatmalovchilari" (AI prompters) tomonidan avtonom tarzda yechilmoqda.

OpenAI bu safar avvalgi mojaroni takrorlamaslik uchun elita matematiklardan iborat maslahat guruhi bilan ishlaganini taʻkidladi. Shunga qaramay, nashrdan keyingi birinchi kunlardayoq hamjamiyat tanqidi boshlandi — bu sunʻiy intellekt yordamida olingan matematik natijalarni ilmiy nashr etish mezonlari atrofidagi munozaraning davom etayotganidan dalolat beradi.

AGMAI sentabr oyi oxirida eʻlon qilgan koʻrsatmalarida formalizatsiyani standartga aylantirish talabi ham bor edi. Shunga qaramay, nashr etilgan isbotlarning 42 foizi formalizatsiyadan oʻtmagan — bu tavsiya bilan amaliyot oʻrtasidagi eng katta tafovut sifatida qayd etilmoqda.

Asosiy raqamlar

Eʻlon qilingan 719 ta qoʻlyozma ichida modelning fikrlash zanjiri faqat 10 tasida ochiqlandi — bu umumiy hajmning bir yarim foiziga ham yetmaydi. Isbotlarning 42 foizi formalizatsiyadan oʻtmagan, yaʻni deyarli har ikki isbotdan biri kompyuterda avtomatik tekshiruvdan oʻtmagan shaklda qoldi.

AGMAIʻning formalizatsiyani standart amaliyotga aylantirish haqidagi tavsiyasi inobatga olinganda, bu koʻrsatkichlar guruh tavsiyalari bilan eʻlon qilingan amaliyot oʻrtasidagi farqni yaqqol koʻrsatadi. Tahlilchilarning qayd etishicha, fikrlash zanjirining ochiqlanmasligi tashqi ekspertlarning modelning xulosa chiqarish yoʻlini mustaqil tekshirish imkonini keskin cheklaydi.