Gemini videoya ajan gibi bakacak: daha yüksek doğruluk, yüzde 88'e kadar az jeton

Google DeepMind, en yeni Gemini modellerine ajan tabanlı video anlama getirdiğini duyurdu: modeller videoyu daha yüksek doğrulukla çözümlerken yüzde 88'e varan oranda daha az jeton harcıyor.

Paylaş
Gemini videoya ajan gibi bakacak: daha yüksek doğruluk, yüzde 88'e kadar az jeton

Video, dil modellerinin en fazla jeton yutan girdisidir: kareler jetona çevrilir ve kısa bir kayıt bile bağlam penceresini yutar. Google DeepMind'ın duyurusu bu hesabı değiştiriyor: en yeni Gemini modelleri videoya ajan tabanlı anlama ile bakacak; şirketin verdiği iki rakam, daha yüksek çözümleme doğruluğu ve yüzde 88'e varan jeton tasarrufu.

Ajan tabanlı demek şu: model videonun tamamını körlemesine yutmak yerine ne aradığına göre kayda kendisi yaklaşıyor; gerektiğinde belirli bölümlere dönüp bakıyor, gerisini özet düzeyinde geçiyor. İzleyen değil, elinde kumandayla arayan bir model. Doğruluğun artıp maliyetin düşmesi de bu seçici bakışın doğal sonucu.

Pratik karşılığı geniş: saatlik toplantı kayıtları, güvenlik kameraları, ders videoları ve arşiv taramaları, jeton faturası on kata kadar inince gerçek iş yüklerine açılıyor. Bu hafta yazdığımız bağlam ekonomisi zincirinin (ContextPilot, SparkLLM) video ayağı da böylece yerine oturdu: kazanan, her şeyi okuyan değil, neye bakacağını bilen model.

Devamını oku

OpenAI تصنف أسترا أول نموذج «حرج» في الأمن السيبراني: ثغرتان غير معروفتين ووصول مقيد عند الإطلاق

OpenAI تصنف أسترا أول نموذج «حرج» في الأمن السيبراني: ثغرتان غير معروفتين ووصول مقيد عند الإطلاق

قالت OpenAI إن نموذج أسترا بلغ عتبة «الحرج» في الأمن السيبراني ضمن إطار الجاهزية بعد أن اكتشف ثغرتين غير معروفتين أثناء الاختبار؛ الإطلاق قريب، لكن القدرات المتقدمة ستُتاح لمجموعة محدودة أولاً.

GlobalFeed Editor tarafından