Google, Gemini 3.8 Flash modelini duyurdu. Yeni model, yazılım mühendisliği ve çok adımlı akıl yürütme gibi alanlarda önemli iyileştirmeler sunarak daha pahalı modellerin performansına yaklaşıyor.
Google, yapay zeka alanındaki Gemini ailesini hızla güncellemeyi sürdürüyor. Şirket, Gemini 3.7 Flash’ın piyasaya sürülmesinden yalnızca üç hafta sonra Gemini 3.8 Flash modelini duyurdu. Yeni model, özellikle yazılım mühendisliği, ajan tabanlı görevler ve çok adımlı akıl yürütme gerektiren alanlarda önemli iyileştirmeler vaat ediyor.
Google’ın açıklamalarına göre Gemini 3.8 Flash, çeşitli kıyaslama testlerinde selefine göre kayda değer performans artışları sergiliyor. Model, bazı alanlarda daha pahalı ve gelişmiş ‘frontier’ modellerinin performansına yaklaşıyor. DeepSWE v1.1 testinde, uzun süreli yazılım mühendisliği görevlerini otonom olarak çözme kabiliyetiyle birçok büyük modeli geride bırakıyor. Bu başarıyı, daha maliyetli modellerin yalnızca küçük bir kısmıyla gerçekleştiriyor.
Profesyonel alanlardaki analiz ve raporlama yetenekleri de gelişen model, Vals Finance Agent V2 ve Harvey’s Legal Agent Benchmark gibi testlerde hem Gemini 3.7 Flash’ı hem de diğer frontier modellerini geride bırakmayı başarıyor. STEM, beşeri bilimler ve profesyonel alanlardaki çok adımlı akıl yürütme becerilerini ölçen HLE-Verified testinde ise yüzde 54,9 puan elde etti.
Google, performanstaki artışın temelinde, karmaşık görevlerde daha fazla akıl yürütme adımı gerçekleştiren ve araçları tekrar tekrar kullanan bir tasarım tercihi olduğunu belirtiyor. Bu durum, modelin özellikle yüksek efor gerektiren durumlarda daha fazla token tüketmesine yol açabiliyor. Gemini 3.8 Flash’ın bilgi kesim tarihi, bazı alanlarda Mart 2026’ya kadar uzanırken, bazı alanlarda Ocak 2025’e kadar olan bilgilerle sınırlı kalabiliyor.
Model, 31 Aralık’a kadar sürecek tanıtım fiyatlandırmasıyla 1 milyon giriş tokenı için 0,75 dolar ve 1 milyon çıkış tokenı için 3,75 dolardan sunuluyor. Gemini 3.8 Flash, Gemini uygulamasında Google AI Pro ve Ultra aboneleri için kullanıma sunuldu. Geliştiriciler ise Google Antigravity, AI Studio ve Gemini API üzerinden erişim sağlayabiliyor.
Google ayrıca, siber güvenlik alanına özel Gemini 3.8 Flash Cyber modelini de duyurdu. Bu yeni model, otonom güvenlik açığı keşfinde frontier seviyesinde performans gösteriyor. Chrome Security ekibinin testlerinde, Chrome’daki güvenlik açıklarına yönelik daha büyük ticari modellere kıyasla 2,6 kat daha fazla doğru yama ürettiği belirtildi. Wiz tarafından yapılan dahili testlerde ise diğer önde gelen frontier modellere kıyasla yüzde 7,5 ila 9,7 daha yüksek recall değerine, 2,3 ila 5,2 kat daha düşük maliyetle ulaştı.
Reklam & İşbirliği: [email protected]