Haberler (TR)

Google, mantıkta sıçrama ve otonom görsel sistemlerin oluşturulmasıyla Gemini güncellemesini yayınladı

Gemini
Foto: Gemini - Mehaniq/shutterstock.com

Google DeepMind bölümü, bu Perşembe (19) ana yapay zeka modelleri ailesi için yeni bir yinelemenin gelişini resmileştirdi. Gemini 3.1 Pro olarak adlandırılan güncelleme, karmaşık akıl yürütme yeteneklerinin genişletilmesine öncelikli olarak odaklanılarak geliştirildi ve veri sentezi ve gelişmiş mantık gerektiren görevlerde önceki sürümlerin sınırlamalarının üstesinden gelme sözü verdi.

Lansman, basit metin oluşturmanın yerini eksiksiz iş akışlarını yürütebilen aracılara olan talebin bıraktığı teknoloji sektörü için stratejik bir anda gerçekleşiyor. Yeni araç artık geliştiriciler ve gelişmiş plan aboneleri için ön izleme aşamasında mevcut ve programlama kodlarından video ve ses yorumlamaya kadar çok modlu işlemede önemli iyileştirmeler sunuyor.

Gemini Inteligência Artificial
İkizler Inteligência Artificial – Ju Jae-young/ Shutterstock.com

Uzmanlar, bu sürümdeki farkın, yeni sorunları çözmek için optimize edilmiş mimarisinde yattığını ve eğitim sırasında ezberlenen kalıplara özel bağımlılıktan uzaklaştığını belirtiyor. Teknoloji, hem şirketin tescilli uygulaması aracılığıyla son kullanıcılara hem de API aracılığıyla güçlü otomasyon gerektiren kurumsal ortamlara hizmet edecek şekilde tasarlandı.

Dahili doğrulama testleri, modelin, işlevsel özerk etmenlerin geliştirilmesi için temel bir özellik olan uzun düşünce zincirlerinde tutarlılığı koruyabildiğini gösterdi. Anında kullanılabilirlik, bu yeteneklerin üçüncü taraf ürünlere ve şirketin bulut platformlarına entegrasyonunu hızlandırmayı amaçlıyor.

Mantık testlerinde performans artışı

Duyuru sırasında sunulan en önemli ölçüm, bir yapay zekanın daha önce görülmemiş mantıksal kalıpları çözme yeteneğini değerlendirmek için tasarlanmış sıkı bir test olan ARC-AGI-2 kıyaslamasındaki performansa atıfta bulunuyor. Gemini 3.1 Pro bu bağlamda %77,1’lik bir puan kaydetti; bu sonuç, selefi olan Gemini’in elde ettiği performansın iki katından fazlasını temsil ediyor.

Soyut mantıktaki evrime ek olarak model, piyasadaki diğer ileri teknolojilerle doğrudan karşılaştırmalı değerlendirmelere tabi tutuldu. “Humanity’s Last Exam” olarak bilinen testte yeni sürüm, %44,4 başarı elde ederek, firmanın geliştirdiği rakip çözümleri geride bıraktı.

Mantıksal akıl yürütmedeki bu tutarlılık, aracın basit bilgi erişiminin yeterli olmadığı durumlarda uygulanmasına olanak tanır. Güncellemenin odak noktası, sistemin çok yönlü sorunları bağlamı kaybetmeden veya halüsinasyonlu yanıtlar vermeden çözebilmesini sağlamak ve profesyonel ve akademik kullanım için güvenilirlik çıtasını yükseltmektir.

Gezinme ve sanal aracılarda özerklik

Bu güncellemede özerk bir aracı olarak çalışma yeteneği büyük ölçüde genişletildi ve gerçek profesyonel faaliyetleri simüle eden karşılaştırmalı değerlendirmelerde etkileyici sonuçlar elde edildi. Uzun ufuklu görevlerde verimliliği ölçen APEX-Agents testinde model %33,5’e ulaştı ve bu, birden fazla adımın tamamlanmasını gerektiren hedefleri yönetme konusunda üstün bir yeteneğe işaret ediyor.

Öne çıkan bir diğer husus, Python gibi programlama araçlarının kullanımıyla birlikte ajansal internet aramasına odaklanan bir değerlendirme olanBrowseComp’taki performanstı. Gemini 3.1 Pro %85,9 etkililik elde ederek web’deki ilgili bilgileri bağımsız bir şekilde arama, filtreleme ve çıkarma ve bu verileri doğrudan iş akışlarına entegre etme yeteneğini gösterdi.

Yeni sistemin geliştirilmiş yeteneklerini göstermek için şirket, bu sürümde aracıların çalışmasını destekleyen üç temel sütunu vurguladı:

  • Kapsamlı uygulamalar boyunca, amaçtan sapmadan, karmaşık hedeflere odaklanmayı sürdürme yeteneği.
  • Gerçek zamanlı veri doğrulama için web araması ile kod yürütme arasında sorunsuz entegrasyon.
  • Birden fazla dijital aracın eş zamanlı olarak koordineli kullanımını gerektiren iş akışlarının önceliklendirilmesi.

Görsel sistemlerin oluşturulması ve kodlama

Modelin çok yönlülüğü, basit metin komutlarından karmaşık görsel sistemlerin sentezine kadar uzanıyor. Durante teknik gösterimleri sayesinde yapay zeka, web arayüzleri ve mobil uygulamalar için geleneksel video formatlarına etkili bir alternatif sunan, ölçeklenebilir ve hafif SVG formatında animasyonlar oluşturmayı başardı.

Gösterilen pratik örneklerden biri, gerçek zamanlı bir telemetri kontrol panelinin kurulmasını içeriyordu. Model, Estação Espacial Internacional’in yörüngesini görselleştiren işlevsel bir arayüzü sıfırdan oluşturmak için genel API’leri ve ham verileri işledi. Süreç, giriş verilerinin yorumlanmasından son grafik arayüzün kodlanmasına kadar her şeyi içeriyordu.

Yaratıcı yorumlama alanında sistem, klasik edebi tanımlamaları modern dijital ürünlere dönüştürdü. Yapay zeka, “The Morro of the Ventos Uivantes” kitabından alıntıları işleyerek kitabın anlatı atmosferini yakaladı ve soyut ve sanatsal kavramları yürütülebilir koda ve işlevsel tasarıma dönüştüren çağdaş bir portföy web sitesi tasarladı.

Araç aynı zamanda üç boyutlu etkileşimli deneyimler yaratma konusundaki yetkinliği de ortaya koydu. Foi, bir sanal kuş sürüsünün kullanıcının el takibine dinamik olarak tepki verdiği bir simülasyon sunarak, modelin bilgisayar görüşünü karmaşık animasyon mantığıyla bütünleştirme yeteneğini kanıtladı.

Kurumsal erişim ve entegrasyonla ilgili ayrıntılar

Gemini 3.1 Pro dağıtımı, bu ilk aşamada geliştiricilere ve kurumsal müşterilere öncelik veren kademeli bir modeli takip ediyor. Sürüme AI Studio ve Vertex AI gibi platformlar üzerinden erişilebiliyor ve bu sayede şirketlerin teknolojiyi kendi ortamlarında test etmelerine ve ürünlerini yeni akıl yürütme motorunu kullanacak şekilde uyarlamalarına olanak sağlanıyor.

Bireysel kullanıcılar için, kullanım limitleri artırılan Google AI Pro ve Ultra planlarının abonelerine erişim serbest bırakıldı. Araç aynı zamanda NotebookLM ile de entegre edilerek, platformu araştırma ve çalışmalar için kullanan ücretli kullanıcılar için belge sentezi ve içgörü oluşturma işlevleri geliştirildi.

İlgili bir teknik nokta, seri 3’ün önceki nesillerinden miras alınan bir özellik olan 1 milyon token içerik penceresinin bakımıdır.

Paylaş

Daha fazla haber: Haberler (TR)

Daha fazla