Çin'in yapay zeka atılımı: "Düşünebilen model, OpenAI'yı geride bıraktı"

ABD'nin çip kısıtlamaları Asya devini durduramıyor

ABD, gelişmiş yapay zeka teknolojilerinin Çin'e girmesini daha sıkı kontrol etme hazırlığı yapıyor (Reuters)
ABD, gelişmiş yapay zeka teknolojilerinin Çin'e girmesini daha sıkı kontrol etme hazırlığı yapıyor (Reuters)
TT

Çin'in yapay zeka atılımı: "Düşünebilen model, OpenAI'yı geride bıraktı"

ABD, gelişmiş yapay zeka teknolojilerinin Çin'e girmesini daha sıkı kontrol etme hazırlığı yapıyor (Reuters)
ABD, gelişmiş yapay zeka teknolojilerinin Çin'e girmesini daha sıkı kontrol etme hazırlığı yapıyor (Reuters)

Çin merkezli teknoloji şirketi DeepSeek, yeni yapay zeka modelini açık kaynaklı olarak yayımladı. Şirket yeni araçlarının, OpenAI'ın benzer modellerini geride bıraktığını öne sürüyor.

DeepSeek, Kasım 2024'te önizleme versiyonunu kullanıma sunduğu R1 serisini, açık bir MIT lisansı altında 20 Ocak Pazartesi günü piyasaya sürdü. 

MIT lisansı sayesinde yapay zeka modelinin kodu incelenebiliyor, değiştirilebiliyor ve ticari olarak kullanılabiliyor. 

R1, OpenAI'ın geçen yıl çıkan o1 serisi gibi "düşünebilen" veya "mantık yürüten" yapay zeka sınıfında yer alıyor. 

ChatGPT gibi geniş dil modellerinden farklı çalışan bu araçlar, verdikleri yanıtların doğruluğunu kontrol ediyor ve bu nedenle cevap vermeleri biraz daha zaman alıyor. Ancak hata yapma ihtimalini azaltan "düşünce zinciri" sistemi, özellikle bilimsel çalışmalarda ciddi fayda sağlıyor. 

DeepSeek, R1'in matematik, kelime problemleri ve programlama gibi testlerde OpenAI'ın o1'inden daha iyi performans gösterdiğini bildiriyor. Şirketin verilerine göre R1'in geride kaldığı testlerde bile iki model arasında çok az fark var.

Diğer yandan Ars Technica, yapay zeka testlerinin gerçek performansı her zaman yeterince iyi yansıtmadığını ve bu sonuçların henüz bağımsız bir şekilde doğrulanmadığını ifade ediyor.

R1 ailesinin en gelişmiş versiyonu 671 milyar parametre içeriyor. Parametreler temelde modelin problem çözme becerilerinin ne kadar iyi olduğunu gösteriyor. 

Şirket, R1'in 1,5 milyarla 70 milyar parametre arasında değişen "damıtılmış" versiyonlarını da yayımladı. Bunların en küçüğü dizüstü bilgisayarda çalışabilirken, en gelişmiş versiyonu daha güçlü bir donanım gerektiriyor. 

TechCrunch'a göre DeepSeek'in yeni yapay zeka ailesi, performansının yanı sıra o1'den yüzde 90 civarında daha ucuza satılmasıyla da öne çıkıyor. Ayrıca açık kaynaklı modeller genellikle o1 gibi muadillerinin gerisinde kaldığı için R1, teknoloji meraklılarının dikkatini çekti. 

George Mason Üniversitesi'nde yapay zeka alanında çalışan Dean Ball, X'teki gönderisinde şöyle yazdı:

DeepSeek'in damıtılmış modellerinin etkileyici performansı, çok yetenekli muhakeme cihazlarının yaygın bir şekilde çoğalmaya devam edeceği ve yukarıdan aşağıya herhangi bir kontrol rejiminin gözünden uzakta, yerel donanımlarda çalıştırılabileceği anlamına geliyor.

Yeni yapay zeka modelinin, Çin merkezli diğer araçlar gibi karşılaştığı bir sorun var. Asya ülkesindeki yasalara göre "temel sosyalist değerleri içermesi" gereken araçlar, Tayvan'ın özerkliği gibi belirli konular hakkında yanıt vermiyor. Ancak model bulutta değil, Çin dışında yerel olarak çalıştırıldığında böyle bir sınırlama yaşanmıyor. 

ABD ve Çin arasındaki yapay zeka yarışı

DeepSeek'in son serisi, ABD'nin yapay zeka teknolojilerini Çin'e satışına daha fazla kısıtlama getirmeyi düşündüğü bir dönemde çıktı. 

Çin'deki şirketlerin gelişmiş yapay zeka çipleri satın alması daha önce engellenmişti. Ancak görevden ayrılan Joe Biden yönetiminin teklif ettiği yeni düzenlemeler yürürlüğe girerse kısıtlamaların kapsamı genişleyecek. Uzmanlar bu değişikliğin, Çin'in özellikle Ortadoğu'daki ülkeler aracılığıyla ABD çiplerine erişmesini engellemeyi amaçladığını söylüyor. 20 Ocak'ta göreve başlayan Donald Trump, bu teklifle ilgili henüz yorum yapmadı.

Ancak son gelişmelere bakılırsa ABD'nin kısıtlamaları Çin merkezli teknolojilerin önüne geçemiyor. 

TechCrunch, DeepSeek'in yanı sıra Çin merkezli Alibaba ve Kimi'nin de o1'i geride bıraktığı öne sürülen yapay zeka modelleri geliştirdiğini aktarıyor. 

Ayrıca DeepSeek, Aralık 2024'te DeepSeek-V3 adlı başka bir yapay zeka modelini piyasaya sürmüştü. ChatGPT'ye rakip olan araç, GPT-4o ve Anthropic'in Claude Sonnet 3.5'ini yakalamış, Meta ve Alibaba teknolojilerini geride bırakmıştı. 

Şirket, V3'ü sadece iki ayda 5,5 milyon dolara geliştirdiğini öne sürüyor. Uzmanlar bu miktarın, Silikon Vadisi'nde üretilen araçlara harcananın çok altında kaldığını ifade ediyor.

New York Times'a göre ABD'nin kısıtlamalarının, Çinli bilim insanlarını daha yaratıcı yöntemler bulmaya itmesiyle gelişmiş teknolojiler ortaya çıkıyor olabilir. 

ChatGPT'nin eğitim verilerini işlemek için 10 bin Nvidia GPU'ya ihtiyaç duyduğu tahmin edilirken, DeepSeek mühendisleri V3'ün sadece 2 bin çiple eğitildiğini söylüyor.

OpenAI'ın stratejik ortaklarından Microsoft'un CEO'su Satya Nadella, bu hafta İsviçre'nin Davos kentinde düzenlenen Dünya Ekonomik Forumu'nda "Çin'deki gelişmeleri çok ama çok ciddiye almalıyız" ifadelerini kullandı.

Independent Türkçe, TechCrunch, Ars Technica, Live Science, New York Times, CNN



Kafa üstü kara dalan tilkiler yaralanmamayı nasıl başarıyor?

Tilkiler, avlarını kar tabakasının derinlerinde bile rahat bırakmıyor (Unsplash)
Tilkiler, avlarını kar tabakasının derinlerinde bile rahat bırakmıyor (Unsplash)
TT

Kafa üstü kara dalan tilkiler yaralanmamayı nasıl başarıyor?

Tilkiler, avlarını kar tabakasının derinlerinde bile rahat bırakmıyor (Unsplash)
Tilkiler, avlarını kar tabakasının derinlerinde bile rahat bırakmıyor (Unsplash)

Bilim insanları kara dalıp yaralanmamayı başaran tilkilerin bu beceriyi burunlarının şekline borçlu olduğunu tespit etti.

Soğuk iklimlerde fareler gibi küçük kemirgenler, karın altında sığınacak yerler buluyor. Ancak kızıl tilki (Vulpes vulpes) ve kutup tilkileri (Vulpes lagopus), geliştirdikleri özel bir teknikle bu hayvanları avlamayı başarıyor. 

Güçlü kulaklarıyla kemirgenlerin yerini saptayıp havaya zıplayan tilkiler, saniyede 4 metreye varan hızla yüksek kar yığınlarına yüzüstü dalarak onları gafil avlıyor. 

Cornell Üniversitesi'nden Sunghwan Jung, bu "ilginç ve benzersiz" davranışı bütün tilkilerin sergilemediğini ifade ediyor.

Hayvanların kara dalınca yüzlerinin nasıl yaralanmadığını anlamak isteyen Jung ve ekip arkadaşları bir araştırma yürüttü.

Bulgularını hakemli dergi PNAS'te yayımlayan bilim insanları, müzelerdeki puma gibi büyük kedi türleri ve tilkilerin kafataslarını tarayarak üç boyutlu yazıcıdan çıkardı. 

Ardından kafataslarına çarpma kuvvetini ölçen sensörler yerleştirerek bunları laboratuvarda karın içine attılar.

Jung, karın sıkıştığı zaman kartopu gibi katı veya bir araba camından silindiği zamanki gibi sıvı özellikler sergileyebildiğini açıklıyor. 

Araştırmada tilkilerin keskin burnunun karı sıkıştırmak yerine sıvı gibi kenara ittiği gözlemlendi. Bu sayede çarpma kuvveti azalarak yaralanma ihtimali düşüyor.

Diğer yandan kedigillerin, tilkilere kıyasla daha geniş ve kısa burunları karı sıkıştırıyor. Jung bu burun tipinin, daha iyi ısırma avantajı sağlayarak genellikle yalnız avlanan kedigillerin işine yaradığını söylüyor.

Sürüler halinde avlanan tilkilerinse daha uzun burunları, ısırma becerilerini zayıflatıyor. Ancak karın içine dalma imkanı veriyor.

Jung, "Tilki böylece bilincini kaybetmeden avlanma görevine odaklanabiliyor" diyerek ekliyor:

Uzun burunları, karda daha derine inerek avlarına daha erken ve daha hızlı ulaşmalarına yardımcı oluyor.

Independent Türkçe, Wall Street Journal, New Scientist, PNAS