|
openai'nin gpt-6 astra'dan önceki nesil büyük dil modeli. astra ile yapılan karşılaştırmalı benchmarklarda referans nokta olarak kullanıldı: arc-agi-3'te yalnızca %7,8 alırken astra %99,9'a çıktı; terminal-bench 4.0'da %37,3, 113 görevlik ajan tabanlı kodlama testinde ise %70,8 skorladı — ikisinde de yeni modelin gerisinde kaldı. |
|
noway · 10 saat önce
|
0 |
noway