AI Evaluator Forum’un AEF-1 standardı bağımsız değerlendirmelerde kullanılmaya başladı
Bu haber yayımlandıktan sonra düzeltildi (9 Ekim 2026). Ayrıntılar
Aralık 2025’te kurulan AI Evaluator Forum’un standardı beş sütun tanımlıyor: yeterli erişim ve kaynak, çıkar çatışmasının asgariye indirilmesi, analitik özerklik, şeffaf yöntem ve sonuçlar, hassas bilginin korunması. Standart Anthropic, Google, Meta ve OpenAI’ı kapsayan bağımsız değerlendirmelerde kullanılmaya başladı. Karşı okuma aynı hafta geldi: yüzden fazla uzman imzaladıkları açık mektupta Anthropic ve OpenAI’ın gerçekten bağımsız güvenlik değerlendiricilerine ihtiyacı olduğunu söyledi.
Kaynaklar
- AI Evaluator Forum, “AEF-1: Minimum Operating Conditions for Independent Third Party AI Evaluations”, (aievaluatorforum.org)
- AI Evaluator Forum, “Minimum Conditions for Embedding Evaluators”, açık mektup, (aievaluatorforum.org)
- International Business Times, “More Than 100 AI Experts Sign a Letter Saying that OpenAI & Anthropic Need Independent AI Safety Evaluators”, (ibtimes.com)
Düzeltmeler ve güncellemeler
- Instagram’da yayımlanan ilk metnin başlığında xAI, OpenAI ve Anthropic’in AEF-1 standardını birlikte imzaladığı yazıyordu. AI Evaluator Forum’un sayfasında imzacı şirket listesi yok ve şirketlerin standardı imzaladığını gösteren bir kaynak bulunamadı; başlık düzeltildi.
Bu haber hakkında
Bu haber Instagram’da @jarrus.ai hesabında 21 Eylül 2026 tarihinde paylaşıldı.
Bu haberde bir hata mı var? [email protected] · Instagram
Kısa link: thejarrus.com/h6-27
Bu haberin İngilizcesi: The AI Evaluator Forum’s AEF-1 standard has started appearing in independent assessments
Aynı konuda
Anthropic %90 daha ucuz Claude Haiku 5.5 modelini çıkardı
Anthropic’in 7 Ekim’de çıkardığı Claude Haiku 5.5, 100 bin token’a kadar Haiku 4.5’ten %90 ucuz. Testlerde öne geçiyor ama görev başına daha çok token harcıyor.
OpenAI GPT-6’yı ChatGPT’de herkese açmaya başladı
OpenAI, 7 Ekim’de GPT-6’yı ChatGPT’de herkese açmaya başladı. Yeni Intelligent UI, cevapları metin, görsel ve etkileşimli öğeleri birleştirerek kuruyor.
OpenAI’ın modeli 722 matematik makalesi yazdı
OpenAI 6 Ekim’de yayınlanmamış bir iç modelin ürettiği 722 matematik makalesini GitHub’da yayımladı; 7 Ekim’de 3’ünü geri çekti, katalogda 719 makale kaldı.