Google, Gemini Live görüşmelerine dosya ekleme desteği getirerek sesli yapay zeka deneyimini genişletmeye hazırlanıyor. Kullanıcılar metin belgelerini, görselleri ve PDF dosyalarını görüşmeye ekleyip içerik hakkında doğrudan konuşabilecek. Gemini, yüklenen dosyayı inceleyerek soruları yanıtlayacak, uzun bölümleri özetleyecek ve talep edilen ayrıntıları açıklayacak. Google henüz özelliğin çıkış tarihini paylaşmadı.
İlk işaretler, Kasım 2024’te Google uygulamasının kodlarında ortaya çıktı. Uygulamadaki metinler, standart Gemini sohbetine dosya yükleyen kullanıcıların konuşmayı Gemini Live üzerinden sürdürebileceğini gösterdi. Ardından Ocak 2025’te ortaya çıkan çalışan demo, Gemini Live’ın yüklenen bir dosyayı sesli görüşme sırasında özetlediğini doğruladı. Ancak Google, bu işlevi genel kullanıma açmadı.
Gemini’nin standart sohbet ekranı bugün belgeleri, elektronik tabloları, fotoğrafları, videoları ve farklı dosya türlerini analiz ediyor. Kullanıcılar içerik hakkında sorular sorabiliyor, özet isteyebiliyor veya belirli bilgileri dosyanın içinden çıkarabiliyor. Bununla birlikte dosya ekleme desteği Gemini Live’a ulaştığında klavyeyle komut yazma gereksinimi azalacak. Böylece konuşma, belge analizi boyunca kesintisiz biçimde sürecek.
Örneğin bir toplantı raporunu yükleyip alınan kararları sorabilir, ders notlarından çalışma özeti hazırlatabilir veya kullanım kılavuzundaki adımları dinleyebilirsiniz. Ayrıca bir grafik, ekran görüntüsü ya da fotoğraf ekleyerek belirli ayrıntılar hakkında takip soruları yöneltebilirsiniz. Gemini, dosyanın içeriğini önceki sorularla birlikte ele alacak. Ardından görüşmenin ilerleyen bölümünde yeni bir açıklama yapmadan aynı konuya dönebileceksiniz.
Gemini Live dosya içeriğini görüşmeye katacak
Yeni işlev, yüklenen dosyayı sesli konuşmanın temel bağlamlarından biri hâline getirecek. İlk soruda raporun genel özetini, sonraki soruda yalnızca mali verileri, daha sonra belirli bir rakamın açıklamasını isteyebilirsiniz. Bunun yanı sıra Gemini, konuşmanın önceki bölümünü takip ederek birbirini tamamlayan yanıtlar sunacak. Kullanıcının her soruda dosyayı yeniden tanımlamasına gerek kalmayacak.
Günün Öne Çıkan Fırsatları






Teknoblog'un satış ortaklıkları vardır. Bunlar, editoryal içeriği etkilemez, ancak Teknoblog, satış ortaklığı bağlantıları üzerinden satın alınan ürünler için komisyon kazanabilir.
Google Gemini böylece belge inceleme sürecindeki uygulama geçişlerini azaltmayı hedefliyor. Bir metindeki bölümleri kopyalamak, sohbet ekranına taşımak ve her soruyu yazmak yerine doğrudan konuşma seçeneği devreye girecek. Özellikle telefonda çalışanlar, uzun belgeleri incelerken sesli komutlardan yararlanabilecek. Ayrıca ellerin dolu olduğu anlarda belgelerle ilgili bilgi almak kolaylaşacak.
İLGİNİZİ ÇEKEBİLİR

Google Gemini 3.6 Flash ile maliyeti ve token tüketimini düşürdü

Google’ın yapay zekâ asistanı Gemini 950 milyon kullanıcıya ulaştı

Google, Gemini 3.5 Pro yerine Gemini 4 ve aylık güncellemeleri öne çıkardı

Samsung’un yeni katlanabilir telefonları Gemini Nano 4 ile geliyor

Google Haritalar’ın yeni yapay zekâ özelliği beta sürümünde ortaya çıktı
Google son dönemde Gemini içindeki dosya araçlarını genişletiyor. Şirket, Audio Overview ile belgeleri ve sunumları iki yapay zeka sunucusunun karşılıklı konuştuğu sesli özetlere dönüştürüyor. Google, Nisan 2026’da kullanıma sunduğu Gemini Notebooks üzerinden sohbetleri, özel talimatları ve PDF gibi kaynakları tek proje alanında topluyor. Ayrıca Gemini Notebooks, kaynakları NotebookLM ile birlikte kullanma seçeneği sunuyor.
Bu gelişmeler, Gemini Live dosya desteğinin Google’ın diğer üretkenlik araçlarıyla bağlantı kuracağını gösteriyor. Android, Google Drive, Workspace ve NotebookLM hizmetleri geniş bir dosya ekosistemi sağlıyor. Google, sesli görüşme özelliğini bu hizmetlerle buluşturduğunda belgeler mobil kullanımda daha kolay erişilebilir hâle gelecek. Ne var ki şirket, ilk sürümde hangi Google hizmetlerinin doğrudan bağlantı kuracağını açıklamadı.
ChatGPT ve diğer üretken yapay zeka platformları da belge analizi, görüntü yorumlama ve sesli görüşme seçenekleri sunuyor. Bu nedenle Google, Gemini’nin farklı içerik türlerini tek görüşme içinde işlemesini öne çıkarıyor. Kullanıcı açısından temel fark, bir dosyayı yalnızca analiz ettirmek yerine analiz boyunca karşılıklı konuşabilmek olacak. Gemini Live, yüklenen içerik üzerinden takip sorularını sesli biçimde yanıtlayacak.
Google henüz destekleyeceği dosya türlerinin kesin listesini paylaşmadı. İlk bulgular belgeler, görseller ve PDF dosyaları üzerinde yoğunlaşıyor. Öte yandan standart Gemini sohbeti elektronik tabloları, fotoğrafları, videoları ve başka içerik türlerini de kabul ediyor. Şirket bütün formatları Gemini Live’a ilk günden taşımayabilir.
Dosya boyutu, günlük kullanım kotası, konuşma süresi ve ücretsiz hesapların erişimi de açıklama bekleyen konular arasında yer alıyor. Google özelliği önce sınırlı bir kullanıcı grubunda test edebilir. Ardından ülke, dil, cihaz veya abonelik planına göre kademeli dağıtım uygulayabilir. Resmi duyuru, erişim kapsamını ve kullanım şartlarını netleştirecek.
Gemini Live dosya desteği kullanıma açıldığında raporlar, ders notları, görseller ve PDF belgeleri sesli görüşmenin doğrudan parçasına dönüşecek. Kullanıcılar içerikleri özetletecek, belirli bölümleri açıklatacak ve önceki yanıtlar üzerinden yeni sorular yöneltecek. Google, bu özellik için henüz kesin tarih vermedi. Testlerde görülen işlevler, dağıtım başlamadan önce değişiklik gösterebilir.


