Google, yapay zeka alanındaki hızlı çıkışlarına bir yenisini daha ekleyerek yeni nesil modelleri Gemini 3.8 Flash ve siber güvenlik odaklı Gemini 3.8 Flash Cyber sürümlerini duyurdu. Gemini 3.7 Flash’ın tanıtımının üzerinden henüz üç hafta geçmişken gelen bu hamle, özellikle otonom yazılım geliştirme, çok adımlı mantıksal akıl yürütme ve siber savunma alanlarında ciddi bir performans artışı vadediyor.
Üstelik Google, yeni modelleri önceki sürümle aynı uygun fiyat ve yüksek hız avantajıyla geliştiricilerin kullanımına açıyor. Gemini 3.8 Flash, hafif ve hızlı Flash serisinin şu ana kadarki en yetenekli sürümü olarak konumlanıyor.
Google, bu modeli özellikle uçtan uca yazılım mühendisliği, otonom yapay zeka ajanları (agentic workflows) ve kurumsal düzeydeki karmaşık veri işleme süreçleri için özel olarak optimize ediyor. Model, önceki sürüme kıyasla zorlu görevlerde daha fazla muhakeme adımı uyguluyor, araçları arka arkaya çalıştırıyor ve hata payını azaltmak için ara kontroller gerçekleştiriyor.
Modelin öne çıkan en büyük artısı ise zorlu görevlerde gösterdiği yüksek başarı oranı. Yapılan kıyaslamalara göre 3.8 Flash, uzun soluklu yazılım mühendisliği kıyaslaması DeepSWE v1.1 üzerinde pek çok büyük boyutlu amiral gemisi modeli geride bırakıyor.
Bunun yanı sıra finans analizi (Vals Finance Agent V2) ve hukuk metinleri analizi (Harvey’s Legal Agent Benchmark) gibi uzmanlık gerektiren profesyonel iş yüklerinde de kayda değer bir üstünlük sergiliyor. Model ayrıca fen ve beşeri bilimleri kapsayan HLE-Verified testinde yüzde 54,9’luk bir skor elde ediyor.
Geliştiricilerin işini kolaylaştıracak temel teknik özellikler şu şekilde sıralanıyor: Duyurunun en kritik parçalarından biri de doğrudan siber güvenlik uzmanlarına ve savunma ekiplerine yönelik geliştirilen Gemini 3.8 Flash Cyber oldu. Bu özel sürüm; kodlardaki güvenlik açıklarını tespit etme, analiz etme ve bu açıkları otomatik olarak yamama (patching) konularında uzmanlaşıyor.
Google, modelin saldırgan amaçlarla suistimal edilmesini önlemek adına Flash Cyber sürümünü “Fairwind Programı” kapsamında yalnızca doğrulanmış güvenlik kurumlarına, kritik altyapı yöneticilerine ve yazılım geliştiricilerine açıyor. Sektör standardı güvenlik kıyaslaması CyberGym’de büyük boyutlu öncü modelleri dahi geride bırakan sürüm, 20 farklı programlama dilini kapsayan geniş çaplı güvenlik testlerinde yüzde 70’in üzerinde açık tespit başarı oranına ulaşıyor.
Otomatik yama geliştirme tarafında ise CWE-Bench testinde yüzde 47,2 başarı göstererek çok daha pahalı amiral gemisi modellerle başa baş bir tablo çiziyor. Google, yeni güvenlik modelini kendi altyapısında da aktif olarak devreye alıyor.
Paylaşılan verilere göre Chrome Güvenlik Ekibi, 3.8 Flash Cyber ile bilinen açıklara karşı piyasadaki büyük ticari modellere kıyasla 2,6 kat daha fazla doğru güvenlik yaması ürettiğini belirtiyor. Benzer şekilde siber güvenlik şirketi Wiz, kendi penetrasyon testlerinde modelin yüzde 7,5 ila 9,7 arasında daha yüksek açık yakalama oranına ulaştığını ve bunu 2 ila 5 kat daha düşük maliyetle başardığını bildiriyor.
Hatta Google Bulut Güvenlik Araştırma Grubu, aylar sürebilecek kritik bir altyapı açığını bu model yardımıyla 2 saatten kısa bir sürede tespit ettiklerini aktarıyor. Gemini 3.8 Flash; Google AI Studio, Gemini API, Android Studio ve Google Cloud üzerinden geliştiricilerin kullanımına açılırken, son kullanıcı tarafında ise Google AI Pro ve Ultra abonelerine sunuluyor.
Google’ın model geliştirme döngüsünü haftalara indirmesi, yapay zekada hız ve verimlilik rekabetinin önümüzdeki dönemde çok daha kızışacağını gösteriyor. Yorumunuz gönderildi,onaylandıktan sonra yayımlanacak. Δ document.getElementById( "ak_js_1" ).setAttribute( "value", ( new Date() ).getTime() );
💬 Yorumlar (0) Siz de düşüncelerinizi paylaşın
Bu haber henüz yorumlanmadı. İlk yorumu siz yapın!
✍️ Yorum Yapın