GPT-6 Astra görevleri yüzde 47 daha kısa sürede bitiriyor ama akıl yürütmesi daha zor izleniyor
OpenAI’ın kendi ölçümüne göre model bilgisayar kullanımında 72,6 puanı görev başına yaklaşık 40 dakikada alıyor; GPT-5.6 Sol 65,7 puanı 75 dakikada alıyordu. Kodlamada token kullanımı da belirgin düştü. Aynı sistem kartı, düşünce zincirinin izlenebilirliğinin ölçülebilir biçimde gerilediğini kaydediyor.
Kaynaklar
- OpenAI, “GPT-6 Astra: A new generation of intelligence”, (openai.com)
- OpenAI, “GPT-6 Astra System Card”, (deploymentsafety.openai.com)
- Artificial Analysis, “Benchmarking GPT-6 Astra”, (artificialanalysis.ai)
Bu haber hakkında
Bu haber Instagram’da @jarrus.ai hesabında 10 Eylül 2026 tarihinde paylaşıldı.
Bu haberde bir hata mı var? [email protected] · Instagram
Kısa link: thejarrus.com/gpt-6-astra-izlenebilirlik
Aynı konuda
Robot testleri: en iyi model bile 84 robot görevinin sadece %19’unu başardı, 63 görev hiçbir model tarafından çözülemedi
7 Ekim’de yayımlanan RobotWorld testinde en iyi model GPT-6 Astra, 84 simülasyon görevinin yalnızca 16’sını tamamladı; 63 görevi hiçbir model çözemedi.
OpenAI’ın görsel modeli, yoğun metin içeren görsellerde neredeyse kusursuz skor aldı
Westlake Üniversitesi öncülüğündeki UltraText Bench testinde OpenAI’ın GPT Image 2 modeli 100 üzerinden 99,35 puanla 24 yapılandırma arasında birinci oldu.
AWS, Çin’in GLM 5.3 modelini kendi platformuna ekledi
AWS, Pekin merkezli Z.ai’nin (eski adıyla Zhipu AI) 753 milyar parametreli GLM 5.3 modelini 5 Ekim’de uygun kurumsal müşteriler için Amazon Bedrock’a ekledi.