Sora 2, Veo 3.1, Kling 3.0: Tek API'den Yapay Zeka Video Üretimi
Yapay zeka ile video üretimi 2026'da deneysel olmaktan çıktı: Sora 2, Veo 3.1 ve Kling 3.0 artık reklam, ürün tanıtımı, sosyal medya ve oyun prototipleme akışlarının doğal parçası. Asıl sorun teknik değil operasyonel — her model farklı bir sağlayıcının arkasında yaşıyor: ayrı hesap, ayrı API sözleşmesi, ayrı faturalama ve çoğu zaman yurt dışı kart zorunluluğu.
Onysoft AI Gateway bu üç aileyi (ve Runway Aleph dahil fazlasını) tek OpenAI-uyumlu API'nin arkasında topluyor: aynı base_url (https://api.onysoft.com/v1), aynı sk-ony- anahtarı, TL bakiye ve kullandıkça öde. Bu yazıda üç video ailesini karşılaştırıyor, asenkron üretim akışını curl ve Python örnekleriyle adım adım anlatıyor ve daha iyi klipler için prompt kalıpları paylaşıyoruz.
Üç video ailesi: Veo 3.1, Sora 2, Kling 3.0 (ve Runway Aleph)
Üç aile de metinden (text-to-video) ve görselden (image-to-video) video üretiyor; fark, çıktının karakterinde ve iş akışına oturduğu yerde:
- Veo 3.1 (Google): Sinematik görüntü dili ve yerleşik ses — diyalog, ortam sesi ve efektler videoyla birlikte üretilir. Reklam ve ürün tanıtımı gibi "yayına yakın" işlerde ilk tercih. Google'ın metin tarafındaki modelleri için Gemini sayfasına bakabilirsiniz.
- Sora 2 (OpenAI): Yaratıcı sahne kurgusu ve fizik tutarlılığı. Sıra dışı kamera açıları, hayal gücü isteyen konseptler ve karakter odaklı anlatımlarda güçlü.
- Kling 3.0: Hız ve süre. Daha uzun klipler ve hızlı iterasyon isteyen üretim hatları için pratik seçim; sosyal medya hacmi üretenlerin favorisi.
- Runway Aleph: Sıfırdan üretimden çok düzenleme modeli — mevcut videoda nesne değiştirme, sahne dönüştürme, stil aktarımı.
Doğru model senaryoya göre değişir; çoğu ekip birkaçını birlikte kullanıyor. Video, görsel ve müzik dahil tüm seçenekleri model kataloğunda görebilirsiniz.
Asenkron akış: task_id ve polling
Video üretimi milisaniyeler değil dakikalar sürer; bu yüzden endpoint asenkron çalışır. Akış üç adımdır:
POST /v1/video/generateçağrısı yaparsınız; gövdedemodel,promptve süre gibi parametreler bulunur. Yanıt anında döner ve birtask_idiçerir — HTTP bağlantısı açık beklemez.GET /v1/video/status/{task_id}ile durumu sorgularsınız. İş kuyruğa alınır, işlenir ve tamamlanır ya da hata döner.- Üretim tamamlandığında durum yanıtında videonun URL'si yer alır; dosyayı indirip kendi depolamanıza (S3, CDN vb.) taşımanız iyi bir pratiktir.
Polling aralığı için 5-15 saniye makul bir denge kurar: daha sık sorgu sonucu hızlandırmaz, sadece istek sayısını artırır. Üretim hattı kuruyorsanız task_id'yi veritabanına yazın; böylece uygulamanız yeniden başlasa bile işi kaldığı yerden takip edebilirsiniz. Parametrelerin tam listesi ve hata kodları için API dokümantasyonuna bakın.
curl ve Python ile ilk videonuz
Önce curl ile üretimi başlatalım — anahtar formatı sk-ony- ile başlar:
curl https://api.onysoft.com/v1/video/generate \
-H "Authorization: Bearer sk-ony-ANAHTARINIZ" \
-H "Content-Type: application/json" \
-d '{
"model": "google-veo-3.1-text-to-video-fast-720p",
"prompt": "Aerial drone shot over the Bosphorus at golden hour, cinematic, slow push-in, ambient city sound",
"duration": 8
}'
Yanıt bir task_id döndürür. Python'da polling dahil uçtan uca akış:
import requests, time
BASE = "https://api.onysoft.com/v1"
HEADERS = {"Authorization": "Bearer sk-ony-ANAHTARINIZ"}
r = requests.post(BASE + "/video/generate", headers=HEADERS, json={
"model": "kling/v2-1-pro-5s",
"prompt": "Macro shot of coffee pouring into a glass cup, slow motion, soft window light",
"duration": 10,
})
task_id = r.json()["task_id"]
while True:
status = requests.get(BASE + "/video/status/" + task_id, headers=HEADERS).json()
if status["status"] in ("completed", "failed"):
break
time.sleep(10)
print(status)
Modeli değiştirmek için sadece model alanını google-veo-3.1-text-to-video-quality-1080p yapmanız yeterli. Kod yazmadan denemek isterseniz Playground aynı endpoint'i tarayıcıdan çalıştırır.
Prompt ipuçları: kamera, ışık, süre
Video modellerinde prompt bir yönetmen notu gibi çalışır: ne kadar somut çekim dili kullanırsanız sonuç o kadar öngörülebilir olur. İşe yarayan kalıplar:
- Kamera: "aerial drone shot", "slow dolly-in", "handheld", "macro lens" gibi terimler çekimi netleştirir. Tek klipte tek kamera hareketi isteyin; iki hareket çoğu zaman ikisinin de bozulmasıyla biter.
- Işık: "golden hour", "soft window light", "neon reflections", "overcast" gibi tanımlar görüntünün karakterini belirleyen en güçlü kaldıraçtır.
- Süre ve tempo: Kısa klipte tek olay anlatın — 8 saniyeye üç sahne sığdırmaya çalışmayın. Uzun anlatılar için klipleri ayrı üretip kurguda birleştirin; tutarlılık için aynı karakter ve ışık tanımını her prompt'ta tekrarlayın.
- Ses (Veo 3.1): Ortam sesini ve diyaloğu prompt'a yazın — "waves crashing, distant seagulls" gibi.
- İstenmeyenler: "no text overlays, no watermark" gibi net dışlamalar ekleyin.
Prompt'ları İngilizce yazmak çoğu modelde daha tutarlı sonuç verir; Türkçe konsepti önce İngilizce çekim diline çevirmek küçük ama etkili bir adımdır.
Aynı endpoint'ten görsel ve müzik
Video endpoint'i aslında genel bir üretim endpoint'idir: aynı POST /v1/video/generate + task_id + polling kalıbı görsel ve müzik modellerinde de geçerli. Değişen tek şey model parametresi:
- Görsel:
flux-2,imagen4ve Seedream 4.5 — storyboard kareleri, kapak görselleri, image-to-video için başlangıç karesi. - Müzik ve ses:
suno-v4ile şarkı/fon müziği, ElevenLabs ile seslendirme.
Bu tekillik altyapı tarafında ciddi kolaylık sağlar: tek kimlik doğrulama, tek hata modeli, tek worker kuyruğu, tek muhasebe. Tipik bir akışta storyboard'u flux-2 ile, klibi veo3 ile, fon müziğini suno-v4 ile aynı koddan üretirsiniz. Metin tarafı da aynı anahtarla çalışır: POST /v1/chat/completions üzerinden Claude, GPT, Gemini, DeepSeek dahil 708+ model — senaryo yazımından prompt üretimine kadar tüm hattı tek API'de tutabilirsiniz.
Maliyet mantığı: üretim başına ücret
Metin modelleri token başına ücretlendirilir; video, görsel ve müzikte mantık farklıdır: üretim başına ücret ödersiniz. Tutar modele ve istediğiniz çıktının özelliklerine (örneğin videoda süre) göre değişir — güncel TL fiyatları her zaman /models sayfasındadır ve TCMB kuru üzerinden hesaplanır.
Bütçeleme yaparken pratik yaklaşım şudur: önce prompt'unuzu kısa ve düşük maliyetli denemelerle oturtun, finale yaklaştıkça uzun/yüksek kaliteli üretime geçin. Aylık senaryonuzu — kaç klip, kaç görsel, kaç şarkı — maliyet hesaplayıcıda modelleyebilirsiniz.
Faturalama tarafında abonelik yoktur: TL bakiye yükler, kullandıkça harcarsınız. Yurt dışı kart veya VPN gerekmez; kurumsal tarafta e-fatura kesilir, veri işleme KVKK uyumludur ve 7/24 Türkçe destek vardır. Bu, özellikle ajans ve SaaS ekipleri için video maliyetini müşteri bazında raporlamayı kolaylaştırır.
Sık Sorulan Sorular
Sora 2 API'ye Türkiye'den nasıl erişirim?
Onysoft AI Gateway üzerinden tek hesapla erişirsiniz: yurt dışı kart veya VPN gerekmez, TL bakiye yükler ve sk-ony- formatındaki anahtarınızla POST /v1/video/generate endpoint'ine istek atarsınız. Aynı anahtar Veo 3.1, Kling 3.0 ve Runway Aleph için de geçerlidir.
Video üretimi ne kadar sürer, sonucu nasıl alırım?
Üretim asenkrondur ve genellikle dakikalar mertebesindedir. POST /v1/video/generate anında bir task_id döndürür; GET /v1/video/status/{task_id} ile 5-15 saniye aralıkla durumu sorgularsınız. İş tamamlandığında yanıtta video URL'si bulunur.
Veo 3.1, Sora 2 ve Kling 3.0 arasında nasıl seçim yaparım?
Kaba kural: yayına yakın, sesli ve sinematik işler için Veo 3.1; yaratıcı sahne kurgusu ve sıra dışı konseptler için Sora 2; hız ve daha uzun klipler için Kling 3.0. Mevcut bir videoyu düzenlemek içinse Runway Aleph. Model parametresini değiştirerek aynı prompt'u üçünde de deneyebilirsiniz.
Video API fiyatlandırması nasıl çalışıyor?
Video, görsel ve müzik üretiminde token değil üretim başına ücret ödersiniz; tutar modele ve çıktı özelliklerine göre değişir. Güncel TL fiyatları /models sayfasında yayınlanır, TCMB kuru üzerinden hesaplanır. Abonelik yoktur; bakiye yükleyip kullandıkça ödersiniz.
Aynı API'den görsel ve müzik de üretebilir miyim?
Evet. Aynı POST /v1/video/generate + task_id + polling kalıbı flux-2, imagen4 ve Seedream 4.5 ile görsel, suno-v4 ve ElevenLabs ile müzik/ses üretiminde de geçerlidir. Metin modelleri (Claude, GPT, Gemini vb.) ise aynı anahtarla /v1/chat/completions üzerinden çalışır.
İlgili sayfalar
Denemeye hazır mısınız?
708+ AI modeline tek API ile erişin. TL bakiye yükleyin, kullandıkça ödeyin — abonelik yok.