Google, 15 Eylül 2026'da iki yeni konuşmadan konuşmaya modelini piyasaya sürdü ve Hacker News başlığı bir gün içinde 337 puanı aştı. Bu, bir ses API lansmanı için büyük bir tepkiydi ve tartışmanın çoğu demo videosu hakkında değildi. Geliştiriciler aynı soruyu soruyordu: bunu kullanarak geliştirmenin maliyeti nedir ve ona nasıl bağlanılır?
Bu, o rehberdir. gemini-3.8-live ve gemini-3.8-live-extended-thinking modelleri şu anda Gemini API ve Google AI Studio'da kullanıma sunuluyor; Gemini Enterprise ve Search Live erişimi ise özel ön izlemede. Her iki model de, jeton başına ve dakika başına ücretlendirilen ücretli katmanın yanı sıra ücretsiz giriş ve çıkış jetonları alıyor; bu, canlı bir ses modeli için yeterince sıra dışı olduğundan, yalnızca fiyatlandırma sayfasını değil, WebSocket oturumunun kendisini de incelemeye değer. Tüketici sesli asistanlarını GPT-Live vs Gemini Live makalesinde zaten karşılaştırmıştık; bu yazı, o karşılaştırmanın bir tarafındaki API'ye geliştirici yolu sunuyor.
15 Eylül'de Gerçekte Ne Piyasaya Sürüldü
Google'ın duyurusu iki modeli kapsıyor. gemini-3.8-live standart konuşmadan konuşmaya modelidir. gemini-3.8-live-extended-thinking, model konuşurken çalışan ve aşağıda açıklanan bir akıl yürütme katmanı ekler. Her ikisi de, bir arayanın bir cümleye İngilizce başlayıp manuel bir dil bayrağı olmadan İspanyolca bitirebilmesi anlamına gelen, konuşma ortasında otomatik geçişle 97 dili destekler.

Lansmandaki kullanılabilirlik: Gemini API ve Google AI Studio (genel erişim), ayrıca Gemini Enterprise ve Search Live (özel ön izleme, bu nedenle bunu okuyan çoğu geliştirici API veya AI Studio'dan başlayacak). Hem giriş hem de çıkış için her iki modelde de ücretsiz jetonlar uygulanır, bu da bir kredi kartına dokunmadan önce gerçek bir prototipi ulaşılabilir kılar.
Google'ın yayınlamadığı bir detay: iki Live modeli için ücretsiz katman hız limitleri. Hız limitleri sayfası, bunları listelediğinde doğruluk kaynağı olacaktır; başka bir yerde gördüğünüz herhangi bir sayıyı kendiniz kontrol edene kadar onaylanmamış kabul edin.
Search Live ve Gemini Enterprise erişiminin API gibi açık olmak yerine yalnızca özel ön izleme olması, okunması gereken bir sinyaldir: Google, aynı modeli tüketici aramasına veya ücretli kurumsal koltuklara taahhüt etmeden önce geliştiricilerin bununla üretime yakın şekillerde geliştirme yapmasına izin vermekte rahat. Bu, bir konuşma modeli dağıtımı için normaldir ve API yüzeyinin şu anda kararlı başlangıç noktası olduğu, daha sonra gelecek daha iyi bir tüketici deneyiminin basitleştirilmiş bir ön izlemesi olmadığı anlamına gelir.
Ücretsiz bir API anahtarı alın ve bir oturum açın
Bir Gemini API anahtarı, bir Google hesabına bağlı olarak Google AI Studio'dan gelir ve ücretsiz katman için ayrı bir onay adımı olmadığından, piyasaya sürüldükleri gün Live modelleri üzerinde çalışır. Anahtarı aldıktan sonra, bağlantı noktası bir REST uç noktası değil, bir WebSocket'tir; bu, generateContent çağrılarına alışkınsanız ayarlamanız gereken ilk şeydir:
wss://generativelanguage.googleapis.com/ws/google.ai.generativelanguage.v1alpha.GenerativeService.BidiGenerateContent
Bu URL, Simon Willison'ın lansman gününde yayınlanan ve yeni bir API'ye yönelik alışıldık detaylı incelemesinin yanında yer alan uygulamalı makalesinden alınmıştır. Kendisi ayrıca, bunun etrafında bir UI oluşturmadan önce bilmeniz gereken bir şeyi de işaret etti: modeli ortada konuşan bir kişiyi böldüğünüz gibi kesintiye uğratabilirsiniz ve geri gelen metin dökümü, modelin oluşturmaya başladığı ancak çalmayı hiç bitirmediği konuşmayı içerebilir, çünkü oynatma sizin kesintinizle kesilmiştir. Her konuşma metni satırının tamamının duyulduğunu varsaymak yerine, bunu istemcinizde ayrı bir durum olarak ele alın.
Bu soket üzerinden çift yönlü bir oturum, her WebSocket tabanlı akış API'sinin kullandığı şekli takip eder: önce modeli ve oluşturma yapılandırmasını tanımlayan bir kurulum mesajı, ardından her iki yönde ses parçacıkları veya metin taşıyan bir içerik mesaj akışı ve sunucunun hazır oldukça kısmi ve nihai yanıt segmentlerini geri göndermesi. Tam mesaj şeması, Google'ın hassas bir şekilde belgeleyeceği bir şeydir ve önizleme ile genel kullanılabilirlik arasında değişebilir, bu nedenle üretim istemcisine geçmeden önce alan adlarını canlı Gemini API belgeleri ve SDK'nızın referansıyla doğrulayın. Kararlı olan desen şudur: bağlan, kurulumu gönder, içeriği akıt, akıtılan yanıtları oku ve kesintiyi bir hata durumu yerine normal bir olay olarak bekleyin.
Pratikte bu, ilk çalışan oturumunuzun mümkün olan en küçük döngüyü hedeflemesi gerektiği anlamına gelir: soketi açın, istediğiniz modeli adlandıran tek bir kurulum mesajı gönderin (gemini-3.8-live veya gemini-3.8-live-extended-thinking), tek bir kısa sesli veya metin girişi gönderin ve yeniden deneme mantığı, yeniden bağlanma işleme veya bir UI eklemeden önce akıtılan bir yanıt aldığınızı onaylayın. Mutlu yol çalıştığında kesinti yolunu ikinci olarak oluşturun, çünkü bunu iyi test etmek, modelin ortasında kasıtlı olarak konuşmayı ve istemcinizin kesilen metin dökümünü tamamlanmış bir metin olarak ele almak yerine doğru şekilde işaretlediğini kontrol etmek demektir.
Genişletilmiş düşünme: akıl yürütme sesli olduğunda
Sade gemini-3.8-live modeli doğrudan yanıt verir. gemini-3.8-live-extended-thinking farklı bir şey yapar: Google, model çalışırken boşluk bırakmak yerine "Bunu kontrol edeyim" gibi sözlü ipuçlarıyla akıl yürütme süresini doldurarak "kesintisiz sohbet akışı" dediği şeyi koruyarak "aynı anda akıl yürütür ve konuşur" diyor.
Bu, belirli bir uygulama sınıfı için önemlidir: konuşma ortasında araçları çağıran veya harici API'lere erişen sesli ajanlar. Genişletilmiş düşünme modeli, "konuşmaya devam ederken araçları ve API çağrılarını arka planda yürütür" ve her iki modelde de fonksiyon çağrısı desteklenir. Takvim API'sine karşı uygunluğu kontrol etmesi gereken bir rezervasyon ajanı düşünün: arama çalışırken iki saniye sessiz kalmak yerine, model isteği yüksek sesle onaylayabilir ve arama arkada tamamlanırken alışverişi devam ettirebilir.
Oturumunuz araç çağrıları, çok adımlı aramalar veya sessiz bir boşluğun bozuk hissettireceği akıl yürütme ağırlıklı cevaplar içeriyorsa genişletilmiş düşünmeyi seçin. Akıl yürütme ek yükünün gerekmediği daha kısa, düşük gecikmeli alışverişler için sade modeli seçin. Her ikisi de jeton başına aynı maliyete sahiptir, bu nedenle seçim davranışla ilgilidir, bütçeyle değil. Ajanınız özellikle fonksiyon çağırmaya dayanıyorsa, Gemini 3.8 Flash için fonksiyon çağırma rehberimiz Google'ın mevcut Gemini 3.8 ailesinde kullandığı istek şeklini kapsar, ancak metin ve konuşma API'lerinin bir şemayı paylaşması garanti edilmediğinden, dağıtımdan önce Live'a özgü fonksiyon çağırma yükünü Live API belgelerine göre doğrulayın.
Maliyeti, hesaplandı
Her iki Live modeli de aynı standart fiyatlandırmayı paylaşır:
| Tip | Oran |
|---|---|
| Metin girişi | 1M jeton başına 0,75 $ |
| Ses girişi | 1M jeton başına 3,00 $, veya dakika başına 0,005 $ |
| Görüntü/video girişi | 1M jeton başına 1,00 $, veya dakika başına 0,002 $ |
| Metin çıkışı | 1M jeton başına 4,50 $ |
| Ses çıkışı | 1M jeton başına 12,00 $, veya dakika başına 0,018 $ |
Düşünme jetonları, diğer tüm Gemini 3.x modelleri gibi çıkış olarak faturalandırılır, bu nedenle genişletilmiş düşünmenin arka plan akıl yürütmesi ayrı bir ücret yerine çıkış satırında görünür.
Çalışan örnek: ücretli standart katmanda, baştan sona sesli giriş ve sesli çıkış içeren 10 dakikalık bir sesli görüşme. Ses girişi: 10 dakika x 0,005 $ = 0,05 $. Ses çıkışı: 10 dakika x 0,018 $ = 0,18 $. Toplam: tam 10 dakikalık karşılıklı sohbet için 0,23 $, herhangi bir metin veya araç çağrısı jetonu eklenmeden önce. Aynı aramayı prototipleme sırasında ücretsiz katmanda çalıştırın ve jeton maliyeti sıfır olur, Google'ın bunun için yayınlayacağı hız limitine tabi olmak kaydıyla.
Aynı fiyatlandırma sayfasındaki gemini-3.1-flash-live-preview modeli, her iki yeni Live modeliyle de aynı oranları taşıyor, bu da o eski modelde zaten bir Live entegrasyonunuz varsa kontrol etmeye değer; fiyatlandırma kararı, geçişi erteleme nedeni değildir.
Geliştiricilerin Şu Ana Kadar Söyledikleri
Hacker News tartışması tamamen olumlu değil. Tekrarlayan bir şikayet: Ücretli Google Workspace ve Google AI Plus aboneleri, ödeme yapan müşteriler olsalar bile yeni Live deneyimine henüz tüketici erişimine sahip değilken, API ve AI Studio erişimi açık. Konu başlığından bir rapor, modelin orijinal görevin bir parçası olmayan ekstra gereksinimler icat ettiği ajantik bir döngüyü tanımladı; bu, Live'ı insan döngüsünde bir sesli asistan yerine otonom bir ajana bağlıyorsanız özellikle test etmeye değer bir hata modudur. Denetimli bir asistandan çok otonom bir döngüye yakın bir şey inşa ediyorsanız, modelin belirttiği gereksinimlerine olduğu gibi güvenmek yerine, modelin neye ihtiyacı olduğunu iddia ettiğini verdiğiniz görev tanımıyla karşılaştıran açık bir kontrol ekleyin. Her iki noktayı da tek bir konudan gelen ilk gün sinyali olarak kabul edin, doğrulanmış bir kusur raporu olarak değil, ve genelleme yapmadan önce kendi kullanım durumunuza göre tekrar test edin.

Client Kodu Yazmadan Önce Ham Protokolü Görün
Bir istemci kütüphanesine bağlanmadan önce, kablo üzerinden geçen gerçek çerçeveleri izlemek yardımcı olur. Apidog, BidiGenerateContent uç noktasına bir WebSocket bağlantısı açabilir, JSON kurulum mesajını ve sonraki içerik mesajlarını elle gönderebilir ve gerçek zamanlı olarak geri gelen akış çerçevelerini gösterebilir; bu, tek bir SDK kodu satırı yazmadan önce kurulum-sonra-akış modelini anlamanın en hızlı yoludur. Apidog sizin için mikrofon sesini yakalamaz; ses veya metin yüklerini kendiniz sağlarsınız ve bağlantıyı sunucunun ne gönderdiğini incelemek, kurulum mesajınızın kabul edildiğini onaylamak ve üretimde hata yönetimi oluşturmadan önce kesintinin nasıl davrandığını izlemek için kullanırsınız. WebSocket API'lerini bu şekilde oluşturma ve test etme için tam protokol referansı docs.apidog.com adresindedir. İlk istemci geliştirmenizi yapmadan önce bağlantıyı kendiniz denemek için Apidog'u indirin.
Karşılaştırma için, WebSocket vs WebRTC analizimiz, Google'ın bu çift yönlü akış için neden bazı rakip ses API'lerinin kullandığı WebRTC yolunu değil de bir WebSocket'i seçtiğini ve bu karşılığın özellikle tarayıcı istemcileri için ne anlama geldiğini kapsar.
SSS
Gemini 3.8 Live API ücretsiz mi? Evet, her iki model için de ücretsiz katmanda giriş ve çıkış jetonları ücretsizdir. Google'ın belirlediği hız limitini aştığınızda ücretli standart tarifeler uygulanır ve bu ücretsiz katman limiti henüz yayınlanmadığından, hız limitleri sayfasını doğrudan kontrol edin.
İki yeni model arasındaki fark nedir? gemini-3.8-live doğrudan yanıt verir. gemini-3.8-live-extended-thinking, aynı jeton fiyatıyla, arka plan araç çağrılarını ve çok adımlı aramaları örtmek için sözel dolgular kullanarak konuşurken akıl yürütür.
Bunu kullanmak için WebRTC'ye ihtiyacım var mı? Hayır. API WebSocket tabanlıdır ve bir WebRTC eş bağlantısı yerine bir BidiGenerateContent uç noktasına bağlanır.
Bir istemci yazmadan bunu test edebilir miyim? Evet. Apidog'da WebSocket'i açın, kurulum ve içerik mesajlarını manuel olarak gönderin ve etrafında gerçek bir istemci oluşturmadan önce akışlı yanıtı okuyun.
