Gemini 3.8 Flash API: Fiyat, Düşünme Maliyeti ve TL ile Kullanım
Google'ın 2 Eylül 2026'da yayımladığı Gemini 3.8 Flash, altı hafta içinde gelen üçüncü Flash sürümü: 3.6 → 3.7 → 3.8. Google'ın duyurusuna göre model 3.7 Flash üzerine kuruldu. Metin, görsel, ses, video ve PDF girdisi kabul ediyor, 1M token bağlam ve 64K çıktıyla geliyor. Google, yayımladığı her benchmark satırında 3.8'in 3.7 Flash'ı geçtiğini söylüyor. Duyurunun daha az konuşulan kısmı da en az bunun kadar önemli: model bilerek daha fazla düşünüyor. Yani aynı iş için daha fazla çıktı tokeni harcayabilir.
Bu rehberde üç soruya net yanıt veriyoruz. Üç Flash sürümü de Onysoft kataloğunda aktif ve aynı satış fiyatındayken hangisini seçmelisiniz? Fazladan düşünme faturaya nasıl yansır ve max_tokens ile nasıl tavan koyarsınız? Gemini 3.1 Pro ve DeepSeek V4.1 Flash karşısında hangi iş hangi modele gider? Sonunda Türkiye'den TL ile adım adım erişimi ve Python + curl + streaming örneklerini bulacaksınız.
Gemini 3.8 Flash Ne Getiriyor?
Onysoft kataloğundaki teknik özet: API kimliği google/gemini-3.8-flash, 1.048.576 token girdi bağlamı ve 65.536 token (64K) maksimum çıktı. Google'ın duyurduğu öne çıkan başlıklar şunlar:
- Çok modlu girdi: metin, görsel, ses, video ve PDF, tek modelde. Bir fatura görüntüsünü, sözleşme PDF'ini ya da toplantı kaydını ayrı araçlara bölmeden aynı isteğe koyabilirsiniz.
- 3.7 Flash üzerine kurulu: Google, yayımladığı her benchmark satırında 3.8'in 3.7 Flash'ı geçtiğini, üç benchmarkta ise Claude Opus 5'i geride bıraktığını açıklıyor. Bunlar sağlayıcının kendi yayımladığı sonuçlar; kendi iş yükünüzde doğrulamanızı öneririz.
- Bilerek daha fazla düşünme: kalite artışının bir kısmı, modelin yanıt vermeden önce daha fazla düşünme tokeni harcamasından geliyor. Bunun maliyet tarafını aşağıda ayrı bir bölümde açıyoruz.
Google aynı dönemde erişimi kısıtlı bir "Cyber" kardeş model de duyurdu. Bu varyant Onysoft kataloğunda yok. Bu yazıdaki her bilgi ve örnek, standart google/gemini-3.8-flash içindir.
Flash temposu da ayrıca not edilmeli: altı haftada üç sürüm. Bu hız, model seçimini bir kereye mahsus bir karar olmaktan çıkarıp düzenli bir test rutinine dönüştürüyor. Aşağıdaki bölümler bu rutini kurmanıza yardım edecek.
3.6, 3.7 mi 3.8 mi? Aynı Fiyatta Üç Flash
Onysoft kataloğunda üç Flash sürümü de aktif ve token başına aynı satış fiyatına sahip. Karşılaştırma için Gemini ailesinin üst sınıfı 3.1 Pro'yu ve ekonomik alternatif DeepSeek V4.1 Flash'ı da tabloya ekledik:
| Model | API kimliği | Bağlam | Maks. çıktı | 1M girdi | 1M çıktı | 1M girdi (TL) | 1M çıktı (TL) |
|---|---|---|---|---|---|---|---|
| Gemini 3.8 Flash | google/gemini-3.8-flash | 1.048.576 | 65.536 | $1,125 | $5,625 | 54,56 TL | 272,78 TL |
| Gemini 3.7 Flash | google/gemini-3.7-flash | 1.048.576 | 65.536 | $1,125 | $5,625 | 54,56 TL | 272,78 TL |
| Gemini 3.6 Flash | google/gemini-3.6-flash | 1.048.576 | 65.536 | $1,125 | $5,625 | 54,56 TL | 272,78 TL |
| Gemini 3.1 Pro Preview | google/gemini-3.1-pro-preview | 1.048.576 | 65.536 | $3 | $18 | 145,48 TL | 872,89 TL |
| DeepSeek V4.1 Flash | deepseek/deepseek-v4.1-flash | 1.048.576 | 384.000 | $0,225 | $0,90 | 10,91 TL | 43,64 TL |
Fiyatlar 13 Eylül 2026 itibarıyla Onysoft satış fiyatlarıdır; güncel fiyat için /models. TL karşılıkları TCMB 11 Eylül 2026 kuru (1 USD = 48,4941 TL) ile hesaplanmıştır; ölçüm tarihi 13 Eylül 2026.
Token başına fiyat aynı olunca seçim, kaliteye ve toplam token tüketimine kalıyor:
- Yeni proje başlatıyorsanız:
google/gemini-3.8-flashile başlayın. Google'ın yayımladığı sonuçlara göre öncülünü her benchmark satırında geçen en yeni Flash bu. - 3.6 veya 3.7 Flash üzerinde doğrulanmış bir üretim hattınız varsa: hemen geçmeyin. Aynı test setini 3.8 ile koşturun, kalite farkını ve istek başına çıktı tokenini birlikte ölçün. Fiyat listesi aynı olsa da görev başına maliyet farklı çıkabilir.
- Kısa, kalıplaşmış, yüksek hacimli işlerde (etiketleme, basit sınıflandırma) ek düşünme çoğu zaman kaliteye yansımaz. Mevcut sürümde kalmak ya da daha ekonomik bir modele geçmek mantıklı olabilir.
Model kimliğini kodda açıkça sabitleyin. Böylece Google yeni bir Flash yayımladığında üretim davranışınız siz test edene kadar değişmez. Gemini ailesinin genel tablosu için Gemini API Türkiye rehberine ve Gemini kataloğuna bakabilirsiniz.
Daha Fazla Düşünme, Daha Fazla Çıktı Tokeni: Maliyeti Nasıl Kontrol Edersiniz?
Onysoft her isteği iki kalem üzerinden faturalar: girdi token sayısı × girdi fiyatı ve çıktı token sayısı × çıktı fiyatı. Modelin yanıt öncesi ürettiği düşünme tokenları da çıktı tokeni olarak sayılır. 3.8 Flash'ta çıktı fiyatı girdinin 5 katı ($5,625'e karşı $1,125). Bu yüzden fazladan düşünme maliyete en çok çıktı tarafında yansır.
Etkiyi kaba bir hesapla görelim (varsayımsal örnektir, ölçüm değildir). İstek başına 2.000 girdi ve 500 çıktı tokeni olan 1.000 istek, 3.8 Flash fiyatıyla $5,0625 tutar: girdi $2,25 + çıktı $2,8125, yaklaşık 245,50 TL. Aynı işte istek başına çıktı 1.000 tokene çıkarsa toplam $7,875 olur: girdi $2,25 + çıktı $5,625, yaklaşık 381,89 TL. Bu senaryoda çıktı tokeninin iki katına çıkması faturayı yaklaşık %56 artırır. Gerçek fark iş yükünüze göre değişir, o yüzden kendi verinizle ölçmeden varsaymayın.
Kontrol için dört pratik adım:
max_tokensile tavan koyun. Tek bir isteğin üretebileceği çıktı tokenini sınırlar ve beklenmedik uzun yanıtların faturaya yansımasını önler. Dikkat: düşünme tokenları da bu bütçeden harcandığı için tavanı çok düşük tutarsanız görünür yanıt kesilebilir. Yanıttakifinish_reasondeğerilengthise tavanı yükseltin.- Geçmeden önce ölçün. Temsili 50–100 isteği 3.7 ve 3.8 Flash ile ayrı ayrı gönderin ve yanıttaki
usage.completion_tokensdeğerlerini karşılaştırın. - Kısa yanıt isteyin. Görünür yanıtın uzunluğunu istemde sınırlamak ("en fazla üç madde" gibi) çıktı tokeninin kontrol edebildiğiniz kısmını azaltır.
- İşi doğru modele verin. Düşünmenin getiri sağlamadığı basit işleri daha ekonomik modellere yönlendirin (aşağıdaki karar matrisine bakın).
Anahtar bazlı limitler ve istek düzeyinde harcama görünürlüğü için yapay zeka API maliyet kontrolü rehberimize göz atın.
Karar Matrisi: 3.8 Flash mı, 3.1 Pro mu, DeepSeek V4.1 Flash mı?
Flash'ın iki yanında iki makul alternatif var. Gemini 3.1 Pro Preview, Onysoft satış fiyatında 3.8 Flash'tan girdide yaklaşık 2,67 kat, çıktıda 3,2 kat daha pahalı; Flash'ın yetmediği vakalar için. DeepSeek V4.1 Flash ise girdide 5 kat, çıktıda 6,25 kat daha ucuz. DeepSeek'in duyurusuna göre 10 Eylül 2026'da genel erişime açılan V4.1 Flash, 552B parametreli çok modlu bir MoE modeli; yerel görsel anlama sunuyor ve ağırlıkları MIT lisanslı. Katalogda 384.000 tokenlik çıktı tavanıyla listeleniyor.
| İş yükü | Önerilen model | Gerekçe ve dikkat |
|---|---|---|
| Fatura, sözleşme PDF'i, toplantı kaydı veya kısa video içeren analiz | google/gemini-3.8-flash | Google'ın duyurusuna göre metin, görsel, ses, video ve PDF girdisini tek modelde kabul ediyor. |
| Yüksek hacimli, yalnız metin: sınıflandırma, etiketleme, kısa özet | deepseek/deepseek-v4.1-flash | Girdi 5 kat, çıktı 6,25 kat daha ucuz. Kaliteyi kendi örnekleminizde doğrulayın. |
| Yalnız görsel girdili, bütçe öncelikli işler (ürün fotoğrafı etiketleme vb.) | deepseek/deepseek-v4.1-flash | DeepSeek yerel görsel anlama duyuruyor; üretime almadan önce görsel girdiyi Onysoft üzerinden kendi örneklerinizle test edin. Ses, video veya PDF de gerekiyorsa 3.8 Flash'a yönelin. |
| 3.6 veya 3.7 Flash üzerinde doğrulanmış mevcut hat | Mevcut sürüm (3.8'i paralel test edin) | Token başı fiyat aynı, ama çıktı tokeni artabilir. Görev başı maliyeti ölçmeden geçmeyin. |
| Flash'ın yetmediği uzun ve karmaşık akıl yürütme, kritik kararlar | google/gemini-3.1-pro-preview | Daha pahalı; yalnız Flash'tan yükseltilen vakalara ayırın. Kimlik "preview" etiketli. |
| Tek yanıtta 64K tokenin üzerinde çıktı (uzun rapor, büyük kod üretimi) | deepseek/deepseek-v4.1-flash | Katalogdaki çıktı tavanı 384.000 token; Gemini Flash ve 3.1 Pro'da 65.536. |
| Model seçimine istek bazında kafa yormak istemiyorsanız | onysoft/auto | OnyRouter modeli sizin yerinize seçer; yönlendirme ücretsizdir, seçilen modelin fiyatı uygulanır. |
3.8 Flash'ı ne zaman kullanmamalı?
- İş kısa ve kalıplaşmışsa ve ek düşünme kaliteye yansımıyorsa: kazanç olmadan fazladan çıktı tokeni ödersiniz.
- Bütçe tek kriterse ve iş yalnız metinse: DeepSeek V4.1 Flash çok daha ekonomik.
- Tek yanıtta 64K tokenden uzun çıktı gerekiyorsa: Flash'ın çıktı tavanı buna izin vermez.
- Siber güvenliğe özel kısıtlı yetenekler arıyorsanız: Cyber varyantı Onysoft kataloğunda yok.
Üst sınıf seçenek için Gemini 3.1 Pro API rehberine, ekonomik tarafın ayrıntıları için DeepSeek API Türkiye rehberine ve DeepSeek kataloğuna bakın.
Gemini 3.8 Flash API'ye Türkiye'den TL ile Adım Adım Erişim
Gemini 3.8 Flash'a erişmek için Google ile ayrı bir sözleşme, yabancı kart ya da VPN gerekmiyor. Onysoft AI Gateway üzerinden birkaç dakikada başlayabilirsiniz:
- Ücretsiz hesap oluşturun. Kurumsal e-fatura ve KVKK uyumu standarttır.
- Panelden
sk-ony-önekli API anahtarınızı üretin. - TL bakiye yükleyin. Kullanım TCMB kuru üzerinden, kullandıkça öde modeliyle düşülür; abonelik yok.
- Kod yazmadan önce Playground'da
google/gemini-3.8-flashilegoogle/gemini-3.7-flash'i aynı istemle yan yana deneyin. Kalite farkını ve yanıt uzunluğunu ilk elden görmenin en hızlı yolu bu. - Uygulamanızda
base_urldeğerinihttps://api.onysoft.com/v1yapın ve model adını verin.
Mevcut bir OpenAI entegrasyonunuz varsa geçiş iki satırlık değişikliktir: base_url ve model. Aynı anahtar katalogdaki 754+ modelin tamamına erişir: tek bakiye, tek fatura, tek API. Genel çerçeve için yapay zeka API rehberine göz atabilirsiniz. Takıldığınız yerde 7/24 Türkçe destek ekibi yanınızda.
Python, curl ve Streaming ile İlk İstek
Onysoft ucu OpenAI şemasını izler; resmi openai Python paketiyle çalışırsınız. Streaming yanıtlar ham OpenAI chunk'ları olarak aktığı için SDK ile doğrudan uyumludur. Başlamanın en pratik yolu bu:
from openai import OpenAI
client = OpenAI(
base_url="https://api.onysoft.com/v1",
api_key="sk-ony-ANAHTARINIZ",
)
stream = client.chat.completions.create(
model="google/gemini-3.8-flash",
messages=[{"role": "user", "content": "Bu destek talebini kategorize et ve tek cümlede özetle: Siparişim üç gündür kargoya verilmedi."}],
max_tokens=2048,
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="")Görsel girdi: İçeriği OpenAI şemasındaki parçalar halinde gönderin. Metin ve görseli aynı mesajda birleştirebilirsiniz:
import base64
with open("fatura.png", "rb") as f:
b64 = base64.b64encode(f.read()).decode()
stream = client.chat.completions.create(
model="google/gemini-3.8-flash",
messages=[{
"role": "user",
"content": [
{"type": "text", "text": "Bu faturadaki satıcı adını, tarihi ve toplam tutarı çıkar."},
{"type": "image_url", "image_url": {"url": f"data:image/png;base64,{b64}"}},
],
}],
max_tokens=1024,
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="")Google ses, video ve PDF girdisini de duyurdu. Bu türleri üretim hattına almadan önce kendi dosyalarınızla küçük bir test isteği yapın; istek biçimi ayrıntıları için API dokümantasyonuna bakın.
Stream kullanmayan istekler: Onysoft non-stream yanıtları success/data zarfında döndürür; içerik data.choices[0].message.content alanındadır. Python SDK ile ham gövdeyi okuyup maliyet ölçümü için token kullanımını da görebilirsiniz:
raw = client.chat.completions.with_raw_response.create(
model="google/gemini-3.8-flash",
messages=[{"role": "user", "content": "Bu sözleşme maddesini sade Türkçeyle açıkla: ..."}],
max_tokens=2048,
)
data = raw.http_response.json()["data"]
print(data["choices"][0]["message"]["content"])
print("finish_reason:", data["choices"][0].get("finish_reason"))
print("cikti tokeni:", data["usage"]["completion_tokens"])Aynı istek curl ile. Yanıtta içerik data alanının altındadır; akış için gövdeye "stream": true eklemeniz yeterli:
curl https://api.onysoft.com/v1/chat/completions \
-H "Authorization: Bearer sk-ony-ANAHTARINIZ" \
-H "Content-Type: application/json" \
-d '{
"model": "google/gemini-3.8-flash",
"max_tokens": 2048,
"messages": [{"role": "user", "content": "Su sozlesme maddesini sade Turkceyle acikla."}]
}'OnyRouter ipucu: Her istek için modeli kendiniz seçmek istemiyorsanız model değerini onysoft/auto yapın. OnyRouter isteğe uygun modeli seçer; yönlendirme ücretsizdir, faturaya seçilen modelin fiyatı yansır ve yanıttaki model alanı hangi modelin kullanıldığını gösterir. Görsel veya PDF gibi çok modlu girdilerde, ya da maliyetini ölçtüğünüz bir hatta, modeli google/gemini-3.8-flash olarak sabitlemek daha öngörülebilirdir. Ayrıntılar için OnyRouter rehberine bakın.
Sık Sorulan Sorular
Gemini 3.8 Flash API fiyatı ne kadar?
Onysoft üzerinde google/gemini-3.8-flash için 1M girdi tokeni $1,125 (54,56 TL), 1M çıktı tokeni $5,625 (272,78 TL) olarak fiyatlanır. Gemini 3.7 Flash ve 3.6 Flash da aynı satış fiyatındadır. Fiyatlar 13 Eylül 2026 itibarıyla Onysoft satış fiyatlarıdır, TL karşılıkları 11 Eylül 2026 TCMB kuruyla (1 USD = 48,4941 TL) hesaplanmıştır; güncel fiyat için /models sayfasına bakın.
Gemini 3.8 Flash API'ye Türkiye'den nasıl erişirim?
Onysoft AI Gateway'e ücretsiz kayıt olun, panelden sk-ony- önekli bir API anahtarı üretin ve TL bakiye yükleyin. base_url olarak https://api.onysoft.com/v1, model olarak google/gemini-3.8-flash kullanmanız yeterli. Google ile ayrı sözleşme, yabancı kart veya VPN gerekmez; kullanım TCMB kuru üzerinden TL bakiyenizden düşülür, abonelik yoktur, kurumsal e-fatura kesilir.
3.6, 3.7 ve 3.8 Flash aynı fiyattaysa hangisini seçmeliyim?
Yeni projelerde 3.8 Flash ile başlayın; Google'ın yayımladığı sonuçlara göre her benchmark satırında 3.7 Flash'ı geçiyor. 3.6 veya 3.7 üzerinde doğrulanmış bir üretim hattınız varsa aynı test setini 3.8 ile koşturup kaliteyi ve istek başına çıktı tokenini birlikte ölçmeden geçmeyin. Token başına fiyat aynı olsa da 3.8 daha fazla düşündüğü için görev başına maliyet farklı çıkabilir.
Gemini 3.8 Flash neden daha fazla çıktı tokeni harcayabilir, maliyeti nasıl sınırlarım?
Google'ın duyurusuna göre 3.8 Flash kaliteyi artırmak için bilerek daha fazla düşünme tokeni harcıyor. Onysoft girdi ve çıktı tokenlerini ayrı ayrı faturalar ve düşünme tokenları çıktı tokeni olarak sayılır. max_tokens ile istek başına tavan koyun, ama çok düşük tutarsanız yanıt kesilebilir; finish_reason değeri length ise tavanı yükseltin. Geçiş öncesi usage.completion_tokens değerlerini 3.7 ile karşılaştırın.
Gemini 3.8 Flash hangi girdileri destekliyor, Cyber sürümü Onysoft'ta var mı?
Google'ın duyurusuna göre model metin, görsel, ses, video ve PDF girdisi kabul eder; Onysoft kataloğunda bağlam 1.048.576 token, maksimum çıktı 65.536 tokendir. Görsel girdiyi OpenAI şemasındaki image_url parçalarıyla gönderebilirsiniz. Google'ın erişimi kısıtlı tuttuğu Gemini 3.8 Flash Cyber varyantı ise Onysoft kataloğunda yoktur.
Ne zaman Gemini 3.1 Pro veya DeepSeek V4.1 Flash daha doğru seçim olur?
Flash'ın yetmediği uzun ve karmaşık akıl yürütme adımlarında google/gemini-3.1-pro-preview daha uygundur; girdi 2,67 kat, çıktı 3,2 kat daha pahalıdır. Yalnız metin içeren yüksek hacimli işlerde veya tek yanıtta 64K tokenden uzun çıktı gerektiğinde deepseek/deepseek-v4.1-flash öne çıkar; girdi 5 kat, çıktı 6,25 kat daha ucuzdur ve katalogdaki çıktı tavanı 384.000 tokendir. Kaliteyi her durumda kendi örnekleminizde doğrulayın.
Bu yazıyı paylaş
İlgili sayfalar
Denemeye hazır mısınız?
754+ AI modeline tek API ile erişin. TL bakiye yükleyin, kullandıkça ödeyin — abonelik yok.