Tüm gelişmeler
yapay zekaaraştırma

OpenAI, Yayınlanmamış "Astra" Modeliyle 10 Açık Matematik Probleminde Sonuç Aldığını Açıkladı

OpenAI, henüz yayınlanmamış modeli Astra'nın iç bir sürümünün, matematik ve teorik bilgisayar biliminde yıllardır açık duran 10 problemde sonuç ürettiğini açıkladı. İddianın alışılmış "benchmark skoru" haberlerinden farkı şu: her argüman Lean adlı bir sistemde makine tarafından kontrol edilecek biçimde formelleştirildi.

Kısaca

  • Ne iddia ediliyor: İç "Astra" modeli, yüksek boyutlu geometriden kodlama teorisine, grup teorisinden operatör cebirlerine, kuantum karmaşıklığından kafes kriptografisine kadar 10 açık problemi çözdü ya da ilerletti. Bunların bazıları ünlü Erdős problemleri (183, 146, 180). Connes'in bir varsayımı çürütülüyor, çok-renkli Ramsey sayılarına yeni alt sınır getiriliyor.
  • Doğrulama: Argümanların her biri Lean sertifikasında formelleştirildi — yani ispat makinece kontrol edildi. Bu, şirketin kendi söylediği bir skordan çok daha güçlü bir kanıt; ama "formel ifade problemi gerçekten yakalıyor mu" sorusunu ve asıl değerlendirmeyi matematik camiası yapacak.
  • İnsan payı: Taslakları insanlar hazırladı, ama OpenAI net konuşuyor: "Matematiksel argümanları sistem üretti; doğruluğun sorumluluğu bizde." AI ürettiğinde insan yazarlığı iddia etmenin yanlış olacağını da ekliyor.
  • Ölçek: Çözümleri bulmak için gereken token, Sol API fiyatlarıyla kabaca 2.000 dolar tutarmış. OpenAI Mayıs'ta da AI-üretimi bir çürütme (Erdős'ün birim-uzaklık varsayımı) paylaşmıştı.

Bizim yorumumuz

Bu, "yeni model şu testte şu puanı aldı" haberlerinden farklı bir şey. Lean'de formelleştirme, ispatın makinece kontrol edilmesi demek — yani "gerçekten çözdü mü" sorusu, kendi beyan ettiği bir skordan çok daha sağlam bir zemine oturuyor. Yine de asıl sınav camianın bu sonuçları inceleyip bağlama oturtması; OpenAI'ın kendisi de haberi tam olarak böyle çerçeveliyor. Bizim kitlemiz (işini büyütmeye çalışan profesyonel/KOBİ) için burada yarın kullanacağın bir araç yok — bu sınır-bilim, günlük bir yazılım değil. Ama yön çarpıcı: AI, "insanın yazdığını düzelten asistan" olmaktan çıkıp "insan bilgisinin sınırında özgün sonuç üreten sistem"e doğru gidiyor, üstelik bunu birkaç bin dolarlık hesaplamayla yapıyor. Nereye gittiğini görmek için iyi bir işaret; kesin hüküm için camianın incelemesini bekleyelim.

Kaynak: OpenAI

ÜCRETSİZ TOPLULUK

AI ile işini büyütenlerin topluluğuna katıl

Güncel AI gelişmeleri, gerçek uygulama örnekleri ve seninle aynı yolda yürüyen profesyonellerle bağlan. Katılım ücretsiz.

💬 Topluluğa Ücretsiz Katıl →