Google, konuşurken düşünen yeni sesli model serisini tanıttı: Gemini 3.8 Live

Gemini 3.8 Live ve Gemini 3.8 Live Extended Thinking, kullanıcıların yapay zekayla daha doğal konuşmalar yürütmesini hedefliyor.

Google, Gemini yapay zekâ ailesinin yeni sesli modelini ve gelişmiş akıl yürütme özelliğine sahip versiyonunu tanıttı. Gemini 3.8 Live ve Gemini 3.8 Live Extended Thinking, kullanıcıların yapay zekayla daha doğal konuşmalar yürütmesini ve karmaşık görevleri konuşma sırasında gerçekleştirmesini hedefliyor.

Gemini 3.8 Live, hızlı ve akıcı konuşmaların yanı sıra gerçek zamanlı görsel bağlamı destekliyor. Model, 97 dil arasında konuşma sırasında geçiş yapabiliyor ve kullanıcıyla iletişimini sürdürürken araçları ve API çağrılarını arka planda çalıştırabiliyor.

Gemini 3.8 Live Extended Thinking ise daha karmaşık görevler için geliştirildi. Model, yanıt üretirken akıl yürütme süreçlerini konuşmayla eş zamanlı yürütebiliyor. Google, bu özelliğin çok adımlı görevlerde kullanıcıya ilerleme hakkında sözlü bilgi vermesini ve görev tamamlanırken konuşmanın kesintiye uğramamasını sağladığını belirtiyor.

Şirketin paylaştığı test sonuçlarına göre Gemini 3.8 Live Extended Thinking, Artificial Analysis'in Speech to Speech Quality Index değerlendirmesinde 82,6 puan aldı. Model, τ-Voice testinde yüzde 68,6, Sierra'nın τ-Voice-banking testinde ise yüzde 35,1 başarı oranına ulaştı. Bu sonuçlar Google'ın paylaştığı değerlendirmelere dayanıyor.

Google, yeni modelleri geliştiriciler için Gemini API ve Google AI Studio üzerinden kullanıma açmaya başladı. Gemini 3.8 Live, Search Live'a da sunulurken Extended Thinking özelliği Gemini Live'da kullanılabiliyor. Google Workspace tarafında ise Docs, Gmail ve Keep için farklı abonelik koşulları geçerli.

İlginizi çekebilir

© 2023 swipeline.co, Tüm Haklar Saklıdır.