Google Gemini 4 Argon ile Yeni Nesil Modelini Tanıttı
Google, uzun süredir beklenen yeni sınır modeli Gemini 4 Argon’u resmi olarak duyurdu. Şirket, modeli ilk etapta Fairwind Programı kapsamındaki güvenilir siber savunma ekiplerine sunuyor ve erişimi kademeli olarak genişletmeyi planlıyor.
Duyuru, Google’ın yapay zeka yarışında son dönemde geride kaldığı yönündeki değerlendirmelerin ardından geldi. Sürekli ertelenen Gemini 3.5 Pro nihayetinde iptal edilmiş, şirket GPT-6 Astra ve Claude Opus 5.5 ile rekabet edecek bir modeli bir süre ortaya koyamamıştı. Gemini 3.8 Flash gibi ara modeller ise beklenen etkiyi yaratmamıştı. Son günlerde çıkan söylentiler ise Gemini 4 Argon’un güçlü bir performans sergilediği yönündeydi.

Gemini 4 Argon Özellikleri ve Çıktı Limiti
Google’a göre Argon, gerçek dünya yazılım mühendisliği, hukuk ve finans gibi kurumsal bilgi işleri ile siber güvenlik savunmasında sınır düzeyinde performans sunuyor. Model, karmaşık ve uzun soluklu iş akışlarında derin akıl yürütmeyi sürdürebilecek şekilde tasarlandı.
Modelin en dikkat çeken yeniliklerinden biri çıktı token limiti. Google, Argon’un çıktı limitini önceki 64 bin tokendan sektörde lider konumdaki 1 milyon tokene çıkardı. Şirkete göre bu, modelin tek bir akışta yüz binlerce token üreterek zor problemleri tek seferde çözmesine olanak tanıyor.
Argon, Google’ın kendi iç iş akışlarında da kullanılmaya başlandı. Şirkete göre binlerce Google çalışanı, modelin özelleşmiş kodlama görevlerindeki, derin araştırmadaki ve yazım kalitesindeki güçlü yönlerini öne çıkarıyor:
- Kuantum algoritma optimizasyonu: Argon, kuantum bilişim araştırmacılarının darboğaz oluşturan alt rutinlerin uzay-zaman kaynaklarını (kübit çarpı kapı) optimize etmesine yardımcı oluyor. Bir örnekte yayınlanmış temel değeri dakikalar içinde yüzde 40 oranında geçti.
- Bellek verimliliği: Bir Argon ajan ekibi, Google veri merkezlerinde bellek optimizasyonlarını otonom olarak tespit edip uyguladı. Devreye alındığında 300 TiB’ın üzerinde bellek serbest bırakıldı, toplamda 500 TiB ile 1 PiB arası tasarruf öngörülüyor.
- Büyük ölçekli kod tabanı taşıma işlemleri: Argon ajanları, Google genelinde C ve C++ kod tabanlarını Rust’a taşıma üzerinde çalışıyor. Ölçek, re2 ve libgav1 gibi çekirdek kütüphanelerde on binlerce satırdan, Fuchsia OS Zircon çekirdeğinde 800 binden fazla satıra kadar uzanıyor.
Gemini 4 Argon Benchmark Sonuçları
Google, Argon’un performansını çeşitli kategorilerde rakip modellerle karşılaştırdı. Şirketin paylaştığı verilere göre model, özellikle bilgi işleri, ajan tabanlı kodlama ve çok modlu anlama alanlarında öne çıkıyor.
| Kategori | Benchmark | Gemini 4 Argon | GPT-6 Astra | Claude Fable 5.1 | Claude Opus 5.5 |
|---|---|---|---|---|---|
| Bilgi işleri | Vals Index | 68.9% | 63.1% | 65.8% | 67.0% |
| AutomationBench (Skor) | 51.3% | 41.4% | 31.4% | 42.5% | |
| Vals Finance Agent v2 | 65.4% | 53.5% | 58.9% | 58.6% | |
| Harvey’s Legal Agent Benchmark | 19.6% | 5.4% | 6.7% | 3.8% | |
| Ajan tabanlı kodlama | DeepSWE v1.1 | 77.9% | 74.1% | 67.4% | 74.2% |
| FrontierSWE v2 | 55.0% | 65.5% | 56.3% | 62.3% | |
| Vibe Code Bench | 91.9% | 89.6% | 90.3% | 90.3% | |
| Terminal-bench 4.0 | 57.4% | 58.2% | 57.9% | 66.4% | |
| ML mühendisliği | PostTrainBench | 45.3% | 44.3% | 40.2% | 49.3% |
| Bilim ve matematik | Terminal-Bench Science 0.1 | 57.6% | 68.1% | 52.6% | 63.3% |
| LABBench 2 | 88.8% | 85.4% | 68.6% | 73.1% | |
| RiemannBench | 76.0% | 72.0% | 65.6% | 69.6% | |
| Uzun bağlam | GraphWalks (128k’ya kadar, BFS F1) | 99.7% | 98.7% | 91.4% | 90.6% |
| GraphWalks (256k ile 1M, BFS F1) | 84.2% | 71.8% | 65.0% | 66.8% | |
| Bilgisayar kullanımı | Agent’s Last Exam (Geçme oranı) | 39.5% | 34.2% | , | 38.2% |
| Çok modlu anlama | Chartography | 71.6% | 71.0% | 46.2% | 66.3% |
| LVBench | 91.7% | 87.5% | 79.7% | 83.7% | |
| Siber güvenlik | CWE-bench v1 | 68.0% | 68.0% | 58.0% | 67.0% |
Tabloya göre Argon, DeepSWE v1.1’de yüzde 77.9 ile yeni bir seviye belirliyor. Model ayrıca Zapier’in AutomationBench testinde yüzde 51.3 ile birinci sırada yer alıyor. Uzun video anlamayı ölçen LVBench’te ise yüzde 91.7 ile en iyi sonucu elde ediyor.
Siber Savunmada Gemini 4 Argon
Google, Argon’u siber saldırıların yeni döneminde savunma ekiplerini güçlendirmek için özellikle eğitti. Modele göre Argon, kritik yazılım açıklarını otonom olarak bulabiliyor, doğrulayabiliyor ve yamayabiliyor. Şirket, güvenilir savunma ekipleri ve kendi iç ekipleri için Argon’u siber korkuluklar olmadan sunacağını belirtti.
Wiz, Scan for Good girişimi kapsamında Argon’u halihazırda kullanıyor. Bu girişim, kritik kamu altyapısını yüksek riskli açıkları bulup gidererek ücretsiz korumayı amaçlıyor. Erken bir gösterimde model, dünya genelindeki hastanelerin kullandığı sağlık yazılımında hassas kişisel bilgileri açıkta bırakan kritik bir açığı ortaya çıkardı. Google’a göre bu risk, önceki sınır modellerinin gözden kaçırdığı bir zafiyetti.

Fiyatlandırma ve Güvenlik Önlemleri
Argon, tanıtım fiyatlandırmasıyla milyon giriş tokenı başına 2 dolar ve milyon çıkış tokenı başına 10 dolar olarak sunuluyor. Önbelleğe alınmış giriş tokenları ise giriş tokenı fiyatının yüzde 95 indirimiyle fiyatlandırılıyor. Tanıtım döneminin sona ermesinin ardından milyon giriş tokenı için 4 dolar, milyon çıkış tokenı için 20 dolar geçerli olacak.
Google, bu düzeydeki sınır yeteneklerini güvenli şekilde yayınlamanın aşamalı bir yaklaşım gerektirdiğini belirtti. Şirket, erişimi kademeli olarak genişletirken ABD hükümetinin yayın öncesi model erişimi sürecine dahil olduğunu aktardı.
Yayın öncesi güvenlik çalışmaları dört ana alanda sürdürülüyor:
- Kötüye kullanıma karşı savunma: Model, siber ile kimyasal, biyolojik, radyolojik ve nükleer (CBRN) saldırılar için kullanılmasını engellemek üzere zararlı talepleri reddedecek şekilde tasarlandı.
- İstem enjeksiyonu saldırılarına karşı savunma: Argon, dolaylı istem enjeksiyonlarına karşı Google’ın en dayanıklı modeli olarak tanıtılıyor.
- Uyumsuzluğun izlenmesi: Modelin kullanıcı niyetinin dışına çıkmasını önlemek için akıl yürütme zinciri ve eylemleri izleniyor, gerektiğinde yürütme durduruluyor.
- Sistemleri sertleştirme: Yüksek riskli eğitim veya değerlendirmeler başlamadan önce sanal ortamlar izole edilip kapatılıyor.
Gemini 4 Argon Ne Zaman Kullanıma Açılacak?
Argon şu anda Fairwind Programı kapsamındaki güvenilir siber savunma ekiplerine sunuluyor. Google, modeli geliştiriciler, kurumlar ve tüketiciler için mümkün olan en kısa sürede kullanıma açmayı hedefliyor. Yayının ilk aşamasında ücretli API müşterileri ve Google AI Ultra aboneleri öncelikli olacak.
Model, kodlama, bilgi işleri, siber güvenlik savunması ve yaratıcı yazarlık alanlarında sınır düzeyinde yetenekler sunacak şekilde geliştirildi. Google, erken test edenlerden gelen geri bildirimlerin geniş yayın öncesinde sistemi güçlendirmeye yardımcı olacağını belirtti.
Sizce Gemini 4 Argon, GPT-6 Astra ve Claude Opus 5.5 karşısında yapay zeka yarışını değiştirebilir mi? Görüşlerinizi yorumlarda paylaşabilirsiniz.
