Ana SayfaYapay ZekaDeepSeek, Yapay Zeka Ajanları İçin İlk Görsel Modeli V4-Flash-Vision-Exp'i Açık Kaynak Yaptı

DeepSeek, Yapay Zeka Ajanları İçin İlk Görsel Modeli V4-Flash-Vision-Exp’i Açık Kaynak Yaptı

Yayımlandı:

- Bu Alana Reklam Vermek İçin: bilgi@dijitaliyidir.comspot_img

DeepSeek, ilk çok modlu modeli V4-Flash-Vision-Exp’in ağırlıklarını açık kaynak olarak paylaştı. 305 milyar parametreli model, MIT Lisansı kapsamında Hugging Face üzerinden erişime açıldı. 31 Ağustos’ta yayımlanan model, 21 Ağustos’ta yalnızca API erişimiyle başlayan sürecin son adımını oluşturuyor ve yapay zeka ajanlarının web arayüzlerini, ekran görüntülerini ve grafikleri okuyabilmesini hedefliyor.

Ajanlar İçin Tasarlandı, Sohbet Botları İçin Değil

Görsel soru yanıtlama için geliştirilen geleneksel görsel-dil modellerinin aksine V4-Flash-Vision-Exp, ajantik iş akışları için tasarlandı. Model; web ekran görüntülerini, yazılım arayüzlerini ve grafikleri okuyarak yapay zeka ajanlarının araç çağrıları üzerinden görevleri tamamlamasını sağlıyor. Başka bir deyişle bu modelin “gözleri” insanların değil, otonom ajanların kullanımı için tasarlandı. DeepSeek, modelin çok modlu ajan yeteneklerini Anthropic’in amiral gemisi modeli Opus-4.8’e “yakın” olarak nitelendiriyor. Şirket bu iddiayı, modelin Hugging Face sayfasında paylaştığı kıyaslama sonuçlarıyla destekliyor; ancak bazı testlerde model, rakibinin gerisinde kalıyor.

Kıyaslama Sonuçları: Bazı Testlerde Öne Geçti, Bazılarında Geride Kaldı

Hugging Face’te paylaşılan verilere göre V4-Flash-Vision-Exp, ApexBench Pass@1 testinde 36,5 puan alarak Opus-4.8’in 39,4 puanının gerisinde kaldı. Buna karşılık Agents’ Last Exam testinde 27,3 puanla Opus-4.8’in 25,7 puanını geride bıraktı. Yalnızca metin tabanlı ajan performansını ölçen Terminal Bench 2.1’de ise görsel yeteneklerin eklenmesiyle skor 82,7’den 83,9’a yükseldi; yani görüş yeteneği, modelin metin tabanlı becerilerini geriletmedi. DeepSeek, modelin zayıf yönlerini de gizlemedi: NL2Repo testinde model yalnızca 57,7 puan alarak Opus-4.8’in 69,7 puanının oldukça gerisinde kaldı.

Maliyet Avantajı ve Erişim Seçenekleri

The New Stack’in yaptığı erken karşılaştırmada V4-Flash-Vision-Exp, dokuz görsel görevde Google’ın Gemini 3.7 Flash modeliyle doğruluk açısından eşit çıktı; ancak toplam maliyette yaklaşık üç kat daha ucuza geldi (0,0039 dolara karşı 0,0122 dolar), buna karşın yanıt süresi iki kattan uzun sürdü. OpenRouter’da model, milyonda 0,22 dolar giriş ve 0,66 dolar çıkış token fiyatıyla listelenirken, Gemini 3.7 Flash için bu rakamlar sırasıyla 0,75 ve 3,75 dolar. Açık kaynak paket; model ağırlıklarını, tokenizer’ı ve minimal bir PyTorch çıkarım uygulamasını içeriyor. Model; llama.cpp, LM Studio, Ollama, Tencent Cloud ve OpenRouter üzerinden de kullanılabiliyor.

Günde sadece 1 TL'ye abone olarak tüm içeriklerimize sınırsız erişebilir ve bağımsız haberciliğe destek olabilirsiniz! Hemen Abone Ol

Son Eklenenler

Meta, Yapay Zeka Ajanları İçin Google Chat’i Bırakıp Slack’e Geçiyor

Meta, şirket içi iletişimde Google Chat'ten Slack'e geçiyor. Yapay zeka şefi Alexandr Wang imzalı kararın gerekçesi, Slack'in yapay zeka ajanlarına sunduğu güçlü altyapı. Geçiş, Salesforce için önemli bir prestij zaferi sayılıyor.

AB’den Yapay Zeka Şirketlerine Tarihi Hamle: 30’dan Fazla Firmaya Resmi Bilgi Talebi

Avrupa Komisyonu, Yapay Zeka Yasası kapsamında elde ettiği yeni denetim yetkilerini ilk kez kullanarak OpenAI, Anthropic ve Google'ın da aralarında bulunduğu 30'dan fazla şirketten güvenlik ve telif hakkı uygulamalarına dair resmi bilgi istedi. Yanıltıcı cevaplara milyonlarca euroluk ceza riski eşlik ediyor.

Google’dan Kodlama Hamlesi: Gemini 3.8 Flash Bu Hafta Geliyor

Google, şirket içinde "Skimaki" kod adıyla bilinen Gemini 3.8 Flash modelini en erken çarşamba günü kullanıma sunmaya hazırlanıyor. Wall Street Journal'a göre model, Google mühendislerinin iç testlerde Anthropic'in Claude Opus'una tercih ettiği bir kodlama aracı olarak öne çıkıyor.

Anthropic’ten Kritik Hamle: Claude Verileri Artık Şirketlerin Kendi Sunucusunda Saklanacak

Anthropic, kurumsal müşterilerden gelen gizlilik tepkileri üzerine Enterprise Frontier Safeguards adlı yeni bir sistem duyurdu. Bankacılık, sağlık ve hukuk sektöründeki şirketler artık Claude günlüklerini Anthropic yerine kendi bulut altyapılarında saklayabilecek. Değişiklik bu sonbahar hayata geçecek.

Buna benzer diğer içerikler

Meta, Yapay Zeka Ajanları İçin Google Chat’i Bırakıp Slack’e Geçiyor

Meta, şirket içi iletişimde Google Chat'ten Slack'e geçiyor. Yapay zeka şefi Alexandr Wang imzalı kararın gerekçesi, Slack'in yapay zeka ajanlarına sunduğu güçlü altyapı. Geçiş, Salesforce için önemli bir prestij zaferi sayılıyor.

AB’den Yapay Zeka Şirketlerine Tarihi Hamle: 30’dan Fazla Firmaya Resmi Bilgi Talebi

Avrupa Komisyonu, Yapay Zeka Yasası kapsamında elde ettiği yeni denetim yetkilerini ilk kez kullanarak OpenAI, Anthropic ve Google'ın da aralarında bulunduğu 30'dan fazla şirketten güvenlik ve telif hakkı uygulamalarına dair resmi bilgi istedi. Yanıltıcı cevaplara milyonlarca euroluk ceza riski eşlik ediyor.

Google’dan Kodlama Hamlesi: Gemini 3.8 Flash Bu Hafta Geliyor

Google, şirket içinde "Skimaki" kod adıyla bilinen Gemini 3.8 Flash modelini en erken çarşamba günü kullanıma sunmaya hazırlanıyor. Wall Street Journal'a göre model, Google mühendislerinin iç testlerde Anthropic'in Claude Opus'una tercih ettiği bir kodlama aracı olarak öne çıkıyor.