
Apple, Görüntü Tanımada Verimlilik Devrimi: FastVLM Tanıtıldı
Apple, yapay zeka alanında önemli bir gelişme kaydederek yüksek çözünürlüklü görsellerde verimliliği artıran yeni bir model olan FastVLM'i duyurdu. CVPR 2025'te tanıtılan FastVLM, daha hızlı ve doğru görsel sorgu işleme sunarak özellikle gerçek zamanlı ve cihaz üzerinde çalışan uygulamalar için önemli fırsatlar yaratıyor.

Google Gemini'a "Nano Banana" Gücü: Fotoğraf Düzenlemede Yeni Dönem!
Google, Gemini uygulamasına entegre ettiği "Nano Banana" (Gemini 2.5 Flash Image) adlı yeni yapay zeka modeliyle fotoğraf düzenleme alanında önemli bir adım attı. Kullanıcıların görsellerde karakter tutarlılığını koruyarak kıyafet değişikliği, stil transferi ve yaratıcı harmanlamalar yapmasına olanak tanıyan bu gelişmiş model, kısa sürede yapay zeka kıyaslama platformlarında zirveye yerleşti.

Google'dan Hamle: Yapay Zekâda "Küçük Ama Etkili" Dönem Başlıyor
Google, yapay zeka alanında yeni bir çığır açarak, geliştiricilerin belirli görevlere odaklanarak hızlı ve verimli çözümler üretmesini sağlayacak küçük boyutlu ve güçlü Gemma 3 270M modelini tanıttı. Bu model, düşük güç tüketimi, çevrimdışı çalışma yeteneği ve kolay ince ayar imkanı sunarak yapay zekanın mobil cihazlardan küçük ölçekli uygulamalara kadar geniş bir alanda kullanımını hedefliyor.

GPT-5: Düşünmeyi Seçen Yapay Zeka — Hızlı, Derin ve Daha Güvenilir.
OpenAI, 7 Ağustos 2025’te GPT-5’i tanıttı: tek bir çatı altında “hızlı” ve “düşünen” modları gerçek zamanlı olarak yöneten bir sistem. GPT-5, kodlama, matematik, yazı, sağlık ve çoklu modal algılamada önceki modellere göre belirgin iyileşmeler sunuyor; bazı benchmark’larda (AIME, SWE-bench, MMMU, HealthBench vb.) üst sıralara yerleşiyor. Ayrıca “GPT-5 thinking” olarak adlandırılan derin muhakeme modu ile uzun, karmaşık ve hataya açık sorgularda daha doğru ve daha dürüst cevaplar üretme yönünde somut kazanımlar bildiriliyor. Model ailesi üç ana varyanta (regular/mini/nano) ayrılmış; yüksek token limitleri ve API’de görünen “reasoning” seçenekleri geliştiricilere yeni kontrol imkânları veriyor. Fiyatlandırma rekabetçi seviyede konumlanmış; token maliyetlerinde düşüşler ve kısa süreli token-cache indirimleri dikkat çekiyor. Ancak prompt-injection ve güvenlik testlerinde hâlâ kayda değer zorluklar olduğu; güvenlik yaklaşımlarının (örn. “safe-completions”) üretkenlik ile güvenlik arasında yeni dengeler aradığı vurgulanıyor.

Anthropic, Claude Opus 4.1’i duyurdu: Kodlama doğruluğu yüzde 74,5’e çıktı, güvenli ajansal arama güçlendi
Anthropic, en gelişmiş modeli Claude Opus 4.1’i yayınladı. Model, gerçek dünya kodlama görevlerinde doğruluğu SWE-bench Verified’da yüzde 74,5’e yükseltiyor; detay takibi, ajansal arama, derin araştırma ve veri analizi becerilerini belirgin biçimde güçlendiriyor. Opus 4.1; GitHub, Rakuten ve Windsurf gibi kurumsal geri bildirimlerde çok dosyalı refaktoring ve büyük kod tabanlarında nokta atışı düzeltmelerle öne çıkıyor. Model, Claude Code, API, Amazon Bedrock ve Google Cloud Vertex AI üzerinden aynı fiyatla kullanılabiliyor.

OpenAI, Apache 2.0 lisanslı GPT-OSS-120B ve 20B açık ağırlıklarını yayımladı: Ücretsiz indirme, yüksek akıl yürütme performansı
OpenAI, altı yıl sonra ilk kez açık ağırlıklı iki büyük dil modelini, GPT-OSS-120B ve GPT-OSS-20B’yi Apache 2.0 lisansı ile ücretsiz indirmeye sundu. MoE mimarisi, 128K bağlam, yüksek akıl yürütme ve araç kullanımı performansı, düşük donanım gereksinimleri ve geniş dağıtım seçenekleriyle modeller; geliştiriciler, kurumlar ve araştırmacılar için dikkat çekici bir alternatif sunuyor. Güvenlik tarafında CBRN filtreleri, denetimsiz CoT izlenebilirliği ve 500 bin dolarlık red teaming yarışması öne çıkıyor.

Google DeepMind, gerçek zamanlı etkileşimli dünyalar üreten “Genie 3”ü tanıttı
Google DeepMind, metin komutlarından dakikalarca tutarlı, 720p çözünürlükte ve 24 fps hızında gezilebilir etkileşimli ortamlar üretebilen yeni dünya modeli Genie 3’ü duyurdu. Model; doğal fizik, animasyon ve tarihi mekân simülasyonlarında gerçek zamanlı kontrol sunuyor, “promptable world events” ile hava durumunu değiştirme veya yeni nesneler ekleme gibi sahne içi olayları metinle tetiklemeyi mümkün kılıyor. Sınırlı bir araştırma ön izlemesi olarak sunulan Genie 3, uzun ufukta çevresel tutarlılık, eylem-sebep-sonuç ilişkisi ve temsil öğrenimiyle AGI yolunda önemli bir adım olarak konumlanıyor.

Zhipu’dan Yapay Zeka Atılımı: GLM-4.5 Açık Kaynak Olarak Yayınlandı
Çinli yapay zeka girişimi Zhipu, yeni nesil açık kaynaklı dil modeli GLM-4.5’i kamuya sundu. Amiral gemisi modelin 355 milyar parametresi bulunurken, daha hafif versiyon GLM-4.5-Air ise 12 milyar aktif, toplamda 106 milyar parametreyle daha az donanım gereksinimiyle benzer yetenekleri sağlıyor. GLM-4.5 özellikle akıllı ajan uygulamaları için geliştirildi ve dünya çapında geliştiricilerin erişimine açıldı.

