Gemini’ın yeni ses modeli sohbetin ortasında 97 dil arasında geçiş yapabiliyor
Google 15 Eylül’de Gemini 3.8 Live ve Gemini 3.8 Live Extended Thinking’i duyurdu. İkisi de 97 dili destekliyor ve cümlenin ortasında dili kendiliğinden algılayıp geçiyor; model görüntüyü de gerçek zamanlıya yakın işliyor. Extended Thinking sürümü veri çekerken susmak yerine “bir bakayım” gibi sesli işaretlerle ilerlemeyi anlatıyor. Modeller Search Live, Workspace, AI Studio ve geliştirici API’lerine yayılıyor.
Kaynaklar
- Google, “Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking”, (blog.google)
Bu haber hakkında
Bu haber Instagram’da @jarrus.ai hesabında 22 Eylül 2026 tarihinde paylaşıldı.
Bu haberde bir hata mı var? [email protected] · Instagram
Kısa link: thejarrus.com/gemini-live-diller
Bu haberin İngilizcesi: Gemini’s new voice model can switch between 97 languages mid-conversation
Aynı konuda
OpenAI’ın görsel modeli, yoğun metin içeren görsellerde neredeyse kusursuz skor aldı
Westlake Üniversitesi öncülüğündeki UltraText Bench testinde OpenAI’ın GPT Image 2 modeli 100 üzerinden 99,35 puanla 24 yapılandırma arasında birinci oldu.
AWS, Çin’in GLM 5.3 modelini kendi platformuna ekledi
AWS, Pekin merkezli Z.ai’nin (eski adıyla Zhipu AI) 753 milyar parametreli GLM 5.3 modelini 5 Ekim’de uygun kurumsal müşteriler için Amazon Bedrock’a ekledi.
Microsoft, biri 60 dilde gerçek zamanlı yazıya döken üç yeni ses modeli çıkardı
Microsoft AI 1 Ekim’de üç ses modeli duyurdu: 60 dilde gerçek zamanlı yazıya döken MAI-Transcribe-2-Streaming ve 23 dilli MAI-Voice-2.1 ile Flash sürümü.