Yapay zeka artık ödev çözmüyor, teorem kanıtlıyor. OpenAI, henüz kullanıma açılmamış yeni model ailesi Astra'nın on yıldır çözülemeyen 10 matematik, kuantum karmaşıklık ve teorik bilgisayar bilimi problemini çözdüğünü duyurdu. Şirket sonuçları 249 sayfalık bir teknik dokümanla ve GitHub üzerinden makine tarafından doğrulanabilir Lean 4 sertifikalarıyla paylaştı; aralarında ilk kez bir non-sofic grup inşası ve Connes rigidity conjecture'ın çürütülmesi gibi sonuçlar var.
Burada kritik nokta, çıktıların doğrulanabilir olması. Bugüne kadar büyük dil modellerinin matematikteki en zayıf noktası, akıl yürütmesinin denetlenememesiydi. Lean sertifikalarıyla birlikte yayınlanan sonuçlar, akademinin yıllardır süren "AI matematik yapabilir mi" tartışmasını farklı bir noktaya taşıyor. Üstelik TheNextWeb'in aktardığına göre bu sonuçlar yaklaşık 2.000 dolarlık işlem maliyetiyle üretildi. Yani mesele sadece model kapasitesi değil, bilimsel araştırmanın birim maliyetinin çökmesi.
Bu gelişme, uygulamalı AI'dan bilimsel akıl yürütmeye doğru net bir yön değişimi işaret ediyor. Kazananlar, temel araştırmayı hızlandırmak için altyapı katmanına yatırım yapan büyük laboratuvarlar olacak. Zorlanacak olanlar ise yalnızca API üzerine ince katman ürün kuran girişimler; çünkü değer, uygulamadan çok akıl yürütme motorunun kendisine kayıyor. Matematik gibi doğrulanabilir alanlarda çalışan AI dikeyleri, önümüzdeki dönemde en agresif sermaye girişini görecek. Astra piyasaya çıkmadan bile denklemi değiştirdi; ürün konuştuğunda tartışma bitecek.