4 soruda OpenAI'ın "düşünebilen" yeni yapay zeka serisi

OpenAI'ın son modeli o1'in fiyatı, bazı kullanıcıların tepkisini çekiyor (Reuters)
OpenAI'ın son modeli o1'in fiyatı, bazı kullanıcıların tepkisini çekiyor (Reuters)
TT

4 soruda OpenAI'ın "düşünebilen" yeni yapay zeka serisi

OpenAI'ın son modeli o1'in fiyatı, bazı kullanıcıların tepkisini çekiyor (Reuters)
OpenAI'ın son modeli o1'in fiyatı, bazı kullanıcıların tepkisini çekiyor (Reuters)

OpenAI, "düşünme" becerisine sahip olduğunu öne sürdüğü yeni yapay zeka serisi o1'i dün (12 Eylül Perşembe) kullanıma sundu. 

Strawberry diye de bilinen yeni serinin o1-preview (ön izleme) ve o1-mini diye iki sürümü mevcut.

Model henüz sadece ChatGPT Plus ve Team kullanıcılarının yanı sıra 5. seviye API katmanına hak kazanan geliştiricilerin erişimine peyderpey açılıyor.

ChatGPT Enterprise ve Edu üyelerinin de gelecek haftadan itibaren araca erişebileceğini belirten şirket, ileride o1-miniyi bütün kullanıcılara ücretsiz sunmayı planlıyor. Fakat bunun için henüz bir tarih verilmedi.

Daha önceki modellerine 2,3,4 gibi isimler veren OpenAI, son serinin yepyeni becerilere sahip olması nedeniyle "sayacı sıfırladıklarını" ve bu nedenle o1 adını seçtiklerini belirtiyor.

Tabii bütün bunların bir bedeli var. Kullanımı mayısta çıkan öncülü GPT-4o'dan üç kat daha masraflı olan o1-preview'un geliştiricilere maliyeti 1 milyon girdi jetonu (token) başına 15 dolar, 1 milyon çıktı jetonu başına da 60 dolar.

Veri birimlerini ifade eden jetonlar, yapay zeka araçlarının büyük verileri parçalara ayırıp dili işlemesini sağlıyor. 1 milyon jeton yaklaşık 750 bin kelimeye denk geliyor. 

OpenAI, o1-mini versiyonun yüzde 80 daha ucuz olduğunu belirtiyor fakat bu sürüm diğeri kadar geniş bir bilgi yelpazesine sahip değil. 

Peki şirketin ön izleme veya bir ön sürüm olduğunu belirttiği o1, öncüllerinden farklı olarak neyi yapabiliyor, neyi yapamıyor ve insanlığın kendi bilişsel seviyesini geçen yapay zeka inşa etme çabasında nasıl bir adıma işaret ediyor?

1) Gerçekten düşünebiliyor mu?

Teknoloji sektöründeki en temel tartışmalardan biri, yapay zeka araçlarının becerilerini "düşünme" veya "muhakeme" gibi ifadelerle tanımlama etrafında dönüyor. 

Geniş dil modellerinin, devasa büyüklükte bilgi kümeleriyle eğitildiği ve sorgulara verdikleri cevaplarda bu veriler üzerinden olasılık temelli tahmin yürüttükleri göz önüne alınırsa, bazı uzmanların "düşünme" ifadesine itirazlarında haklılık payı var. 

Öte yandan bu araçlar insan beyni gibi akıl yürütme becerisine gittikçe daha fazla yaklaşıyor. 

OpenAI, o1 serisinin sorulara cevap vermeden önce daha uzun süre düşündüğünü ve vereceği yanıtların doğruluğunu kontrol ettiğini ifade ediyor.

Sisteme girilen soru karşısında "Düşünüyorum" gibi yanıtlar vermesi, gerçekten o sırada düşündüğü izlenimi yaratsa da o1'in insanlar gibi akıl yürüttüğünü söylemek mümkün değil. 

OpenAI'ın araştırma ekibinin lideri Jerry Tworek, yapay zeka modelinin düşünme biçimini insanlarınkiyle bir tutmadıklarını söylüyor. 

Arayüz ise yeni modelin problemleri çözerken daha fazla zaman harcadığını ve daha derine indiğini gösterme amacıyla bu şekilde tasarlanmış.

o1'i önceki OpenAI uygulamalarından ayıran temel özelliğiyse eğitilme biçiminde yatıyor. 

Eğitim bilimci ve öğretmenlerin aşina olabileceği pekiştirmeli öğrenme denen bu yöntem, doğru yanıtlar karşısında ödül, yanlış cevaplar karşısında da ceza verilmesi ilkesine dayanıyor.

Bu sayede deneme yanılmayla ilerleyen yapay zeka aracının, doğru yanıtlara ulaşma becerisi gelişiyor. Sorguları işlerken, insanların sorunları adım adım inceleyerek çözmesine benzer bir "düşünce zinciri" kullanıyor.

OpenAI, aracı "düşünmeye" iten bu yöntemin, doğruluğunu artırdığını ifade ediyor. 

2) Hangi alanlarda kullanılacak?

Karmaşık muhakeme görevlerinde kayda değer bir ilerlemeye ve yeni bir yapay zeka yeteneği seviyesine işaret ediyor. Bu nedenle sayacı tekrar 1'e sıfırlıyor ve bu seriye OpenAI o1 adını veriyoruz.

OpenAI'ın bu ifadelerle tanıttığı o1'in, dil becerilerinden ziyade bilimsel çalışmalar, veri işleme ve kodlamada daha iyi bir performans sergilemesi bekleniyor. Ayrıca o1-mini, daha küçük bir sürüm olmasına karşın özellikle kod üretmesi amacıyla geliştirildi. 

Yeni model kodlama ve matematikte sonuca ulaşma sürecini detaylandırdığı için bu alanlarda öğretmenlik yapma becerisinin önceki versiyonlardan daha iyi olması bekleniyor. 

Şirketin baş araştırma görevlisi Bob McGrew, yeni modelin ileri seviye matematik sorularında kendisinden daha iyi olduğunu belirterek kendisinin üniversitede matematik okuduğunu ekliyor.

OpenAI yeni modelin ayrıca bilim insanlarının hücre dizileme çalışmalarına ve fizikçilerin karmaşık matematiksel formüller üretmesine katkı sağlayacağını ifade ediyor. 

Ayrıca yapılan testlerde fizik, kimya ve biyolojinin bazı alanlarında doktora öğrencileriyle yarıştığı kaydedildi.

Şirketin baş bilim insanı Dr. Jakub Pachocki ve OpenAI teknik çalışanı Szymon Sido, New York Times'a yaptıkları sunumda, sohbet botunun çengel bulmacadan çok daha karmaşık akrostiş bulmacasını çözdüğü görüldü.

Yapay zeka aracı aynı zamanda doktora düzeyinde bir kimya sorusunu yanıtladı ve bir hastanın semptomları ve geçmişi hakkında ayrıntılı bir rapora dayanarak hastalığı teşhis etti.

3) GPT-4o'dan daha mı iyi?

Daha önceki modeller internetteki bilgilerle eğitildiği ve internette epey yanlış bilgi olduğu için hata yapma ihtimalleri artıyor. o1'in eğitilme biçimiyse bu hataları çok daha düşük seviyeye indirmesini sağlıyor. 

Yeni modelin; ses, görüntü ve yazıyla iletişim kuran GPT-4o'dan çok daha iyi performans gösterdiği alanlar olsa da bazı konularda gerisinde kalıyor. 

İki aracı da lise seviyesindeki Uluslararası Matematik Olimpiyatı'na sokan OpenAI, o1'in soruların yüzde 83'ünü, GPT-4o'nun ise sadece yüzde 13'ünü doğru çözdüğünü ifade ediyor. 

Thomson Reuters'tan yeni modeli test eden Pablo Arredondo, TechCrunch'a yaptığı açıklamada yasal belgeleri analiz etme ve hukuk fakültesine giriş sınavında da daha başarılı olduğunu söylüyor.

Strawberry takma adına sahip o1'in GPT-4o'yu geride bıraktığı bir diğer alan ise "strawberry" (çilek) kelimesinde kaç tane "r" harfi olduğunu bulmak.

Bu soruya "iki" yanıtını veren ChatGPT'nin önceki sürümleri internette alay konusu olmuştu. 

İlk başta çok zor bir görev gibi görünmese de yapay zeka araçları kelimeleri harf harf değil, jetonlar şeklinde işlediği için bu tip basit işlerde zorlanabiliyorlar. 

Ancak o1, daha detaylı düşünmesi ve kendisini kontrol etmesinden dolayı bu soruya doğru yanıtı vermeyi başardı. 

Öte yandan yeni model, internette arama yapma, metin ve görsel işleme gibi özelliklere henüz sahip değil. Ayrıca gerçek dünya hakkında GPT-4o kadar bilgisi de yok. 

Pennsylvania Üniversitesi Wharton İşletme Okulu'nda yapay zeka üzerine çalışan Ethan Mollick "Açıkçası o1-preview her şeyde daha iyi değil. Örneğin GPT-4o'dan daha iyi bir yazar değil" diyerek ekliyor: 

Ancak planlama gerektiren görevlerde ciddi değişiklikler sözkonusu.

OpenAI, yeni modelinde halüsinasyon sorununu da çözmeyi henüz başaramadı. Yapay zeka sohbet botlarının bazı bilgileri "uydurmasını" ifade eden halüsinasyon, bu araçların temel sorunu olmaya devam ediyor.

Modeli test eden Mollick, zorlu bir bulmacayı çözdüğünü ancak ipuçlarından birini uydurduğunu söylüyor. 

Yine de Tworek, "Bu modelin daha az halüsinasyon gördüğünü fark ettik" diyerek ekliyor: 

Ancak sorun hâlâ devam ediyor. Halüsinasyonları çözdüğümüzü söyleyemeyiz.

Son modelin bir diğer eksikliği de sorgulara yavaş cevap vermesi. Diğer sürümler neredeyse anında yanıtı sunarken, muhtemelen düşünme süresinden dolayı o1'in cevap vermesi çok daha uzun zaman alıyor.

Örneğin Mollick, bulmacayı çözmesinin 108 saniye sürdüğünü ifade ediyor.

OpenAI modelin ön izleme versiyonu olduğunu belirtirken, uzmanlar o1'in sonraki versiyonlarının hızlanmasını umuyor. 

4) İnsanlığa tehdit oluşturabilir mi?

Bazı yapay zeka araçları eğitimleri sırasında farklı kelimelerin beraber kullanılma sıklıklarını analiz ederek sözcüklerin birbirine yakınlığını tahmin ediyor. Örneğin "kedi" ve "köpek" kelimeleri birlikte daha sık kullanıldığı için yakın anlamlara sahip olmaları gerektiği sonucuna varıyor.

Bu modellerin "yapay zeka" ve "tehdit" ifadeleri arasında da böyle bir ilişki kurmuş olması muhtemel. 

Her yeni modelin piyasa sürülmesiyle akla gelen ilk sorulardan biri insanlığa varoluşsal bir tehdit yaratıp yaratmayacağı.

Sektörün önde gelen bazı isimleri bu tehlikeye karşı uyarırken bazı uzmanlar yapay zeka araçlarının nasıl kullanıldığının daha önemli olduğunu vurguluyor.

OpenAI'ın son sürümüyle bu araçların insan gibi düşünme becerisine bir adım daha yaklaşması da endişeleri artırabilir.

Ancak bu yazıdan da anlaşılabileceği üzere, o1'in becerileri henüz korkutucu bir düzeyin yakınından bile geçmiyor. 

Ars Technica'nın ifade ettiği gibi bir bulmacadaki 8 ipucunu çözmesi 108 saniye süren ve bir cevapta halüsinasyon gören bir yapay zeka modelinin potansiyel tehlike olduğunu söylemek abartıya kaçar. 

Öte yandan OpenAI'ın yanı sıra Meta ve Google gibi şirketlerin de çabaları ve son yıllardaki hızlı gelişmeler göz önüne alınırsa, insan seviyesine ulaşan yapay zeka araçları çok uzak olmayabilir.

Independent Türkçe, TechCrunch, Verge, Ars Technica, New York Times, OpenAI



Tim Cook'tan Apple'a duygusal veda

Fotoğraf: Reuters
Fotoğraf: Reuters
TT

Tim Cook'tan Apple'a duygusal veda

Fotoğraf: Reuters
Fotoğraf: Reuters

Apple CEO'luğundan ayrılan Tim Cook, görevindeki son gününde çalışanlara bir veda mesajı gönderdi. Cook, 15 yıllık görev süresini "hayatının en büyük ayrıcalığı" diye niteledi.

65 yaşındaki Cook, Apple'ın yönetim kurulunda icra kurulu başkanı olarak görevini sürdürecek. Cook, Apple'ın kurucu ortağı Steve Jobs'ın ardından CEO'luk görevini devralarak ABD'li teknoloji devine liderlik etmişti.

9to5Mac'in ulaştığı mesajda "Bu anın bir gün geleceğini hep biliyordum. Yine de gelip çattığına ve şu anda bu sözleri yazdığıma inanmakta zorlanıyorum" diye yazdı.

Bu şirketi ve onu var eden ekibi çok seviyorum. Bugünün, bana gösterdiğiniz yoğun sevgiye ne kadar minnettar olduğumu, her gün gösterdiğiniz özveriyi ve hepsinden önemlisi, lideriniz olarak görev yapmanın hayatımın en büyük ayrıcalığı olduğunu anlatan bir not göndermeden geçmesine izin veremezdim. Çok sevdiğim bir görevden ayrılıyorum... Bu işi hayal bile edemeyeceğim kadar özleyeceğim. Yine de verdiğim karardan tamamen huzurluyum.

Cook'un liderliği döneminde trilyon dolarlık bir şirket haline gelen Apple, Apple Watch, AirPods ve Apple Vision Pro dahil piyasaya birçok önemli ürün sürdü.

Görevi devralacak CEO John Ternus, daha önce Apple'da donanım mühendisliğinden sorumlu kıdemli başkan yardımcısı olarak görev yapmasının ardından 1 Eylül'de resmen göreve başladı.

İlk büyük sınavlarından biri, gelecek hafta Apple'ın yılın en büyük ürün tanıtım etkinliğini yönetmek olacak. Etkinlikte iPhone 18 Pro'nun, yeni Apple Watch modellerinin ve şirketin ilk katlanabilir akıllı telefonunun tanıtılması bekleniyor.

Cook, veda mesajında Ternus'un donanım alanındaki geçmişine de değinerek, "Çok az insan dünyayı değiştiren ürünler geliştirmenin ne gerektirdiğini John kadar anlıyor ve onun liderliği için bundan daha heyecanlı olamazdım" ifadelerini kullandı.

Nisanda yeni CEO olarak açıklanmasının ardından "büyük minnettarlık duyduğunu" söyleyen Ternus, şirkete ilk kez ürün tasarım ekibinin bir üyesi olarak katılmasından 25 yıl sonra bu görevi devraldı.

"Kariyerimin neredeyse tamamını Apple'da geçirdiğim için Steve Jobs'la çalışma ve Tim Cook'un akıl hocalığından yararlanma şansına sahip oldum" dedi.

Bu göreve geçmek benim için büyük bir onur. Bu özel yeri yarım yüzyıldır tanımlayan değerler ve vizyon doğrultusunda liderlik edeceğime söz veriyorum.

Independent Türkçe


Sözcük kullanmadan düşünen yeni yapay zeka, maliyet düşüşü vaat ediyor

Sözel olmayan akıl yürütme, yapay zekanın geleceği olabilir (Unsplash)
Sözel olmayan akıl yürütme, yapay zekanın geleceği olabilir (Unsplash)
TT

Sözcük kullanmadan düşünen yeni yapay zeka, maliyet düşüşü vaat ediyor

Sözel olmayan akıl yürütme, yapay zekanın geleceği olabilir (Unsplash)
Sözel olmayan akıl yürütme, yapay zekanın geleceği olabilir (Unsplash)

Yapay zeka araştırmacıları, modellerin akıl yürütürken ihtiyaç duyduğu işlem gücünü ve maliyeti önemli ölçüde azaltabilecek yeni bir yöntem geliştirdi.

ChatGPT, Gemini ve Claude gibi yapay zeka araçları büyük dil modelleriyle çalışıyor. Bu modeller karmaşık problemleri çözerken token denen veri parçalarını işleyerek adım adım ilerliyor. 

Karmaşık sorular daha uzun ve çok aşamalı akıl yürütme süreçleri gerektirebiliyor. Model her ara adımı metne dönüştürdüğünde kullanılan token sayısı, işlem süresi ve maliyet de artıyor.

Yapay zeka şirketi Pathway, bu muhakeme veya akıl yürütme biçimindeki işlem gücünü azaltmak için yeni bir yaklaşım benimsedi.

BDH-CQ adlı yeni model, uzun bir yazılı akıl yürütme zinciri oluşturmak yerine kendisine sunulan örneklerle tekrarlayan belleğini sürekli güncelliyor. Ardından sorguyu yüksek boyutlu bir gizli çalışma alanında yinelemeli hesaplamalar yaparak çözüyor ve yalnızca nihai cevabı üretiyor.

Esasen model, kelime israfı yapmak veya her adımı metne dönüştürmek yerine zihninin içinde "sessizce" hesap yapıyor. Bu sayede de işlem gücünden büyük ölçüde tasarruf ediliyor.

Bilim insanları modeli değerlendirmek için ARC-AGI-1 isimli kıyaslama testine soktu. Bu test yapay zeka sistemlerinin bilişsel yeteneğini ölçmek için sözel olmayan, bir dizi şekli döndürerek bir seriyi tamamlamak gibi akıl yürütme bulmacaları kullanıyor.

Henüz hakem değerlendirmesinden geçmeyen ve bulguları ön baskı sunucusu arXiv'de yayımlanan çalışmaya göre BDH-CQ, 10 bulmacadan üçünü iki veya daha az denemede başarıyla çözerek yaklaşık yüzde 30'luk başarı puanına ulaştı. 

Pek çok model bu testte kayda değer derecede daha iyi puanlar elde etse de BDH-CQ'nun temel aldığı mantıksal yaklaşım, boyutunu ve kullanım maliyetlerini geleneksel modellere göre ciddi oranda düşürüyor.

Pathway ekibine göre, görev başına maliyeti 1 sentin 10'da birinden daha az olan model, ARC-AGI-1 kıyaslama testinde yeni bir doğruluk-maliyet verimliliği rekoru kırdı.

Araştırmacılar, OpenAI'ın GPT 5.6 Luna aracının testte BDH-CQ'yla benzer bir puan aldığını ancak yeni modelin 11 kat daha ucuza çalıştığını söylüyor.

Bielik AI ve New York Üniversitesi'nden araştırmacılar da modeli ARC-AGI-1'de ayrıca test ederek sonuçları doğruladı.

Bu araştırmacılardan Łukasz Kaiser, "Pathway'i yakından takip ettim ve ARC-AGI-1 sonuçlarını kendim de tekrarladım" diyerek ekliyor: 

Pathway sadece ölçeğin değil, model mimarisinin de yapay zeka akıl yürütmesinde bir sonraki sıçramayı sağlayabileceğini gösteriyor.

Araştırmacılar, BDH-CQ'nun sadece 150 milyon parametresi olduğunu belirtiyor. En büyük yapay zeka modellerinde yüzlerce milyar parametre bulunuyor.

Parametre, yapay zeka modellerinin eğitim aşamasında öğrendiği ve ayarladığı dahili değişkenleri ifade ediyor. Eğitilmiş bir modelin tüm parametre kümesi, eğitim verilerinden çıkardığı tüm bilgiyi temsil ediyor.

Pathway, modeli 600 milyar parametreye çıkarmayı ve daha üst kıyaslama testlerine tabi tutmayı planlıyor. 

Şirket, bu teknolojinin siber güvenlik gibi sektörlerdeki karmaşık akıl yürütme problemlerine uygulanabileceğini umuyor.

Independent Türkçe, TechXplore, Live Science, arXiv


Google, ABD’deki kullanıcılar için Ontario Gölü’nün adını ‘Amerika Gölü’ olarak değiştirdi

Ontario Başbakanı Doug Ford, Kanada kıyısında devasa bir reklam panosu büyüklüğündeki "Ontario Gölü. Şimdi ve sonsuza dek" yazılı tabelanın önünde, (AP)
Ontario Başbakanı Doug Ford, Kanada kıyısında devasa bir reklam panosu büyüklüğündeki "Ontario Gölü. Şimdi ve sonsuza dek" yazılı tabelanın önünde, (AP)
TT

Google, ABD’deki kullanıcılar için Ontario Gölü’nün adını ‘Amerika Gölü’ olarak değiştirdi

Ontario Başbakanı Doug Ford, Kanada kıyısında devasa bir reklam panosu büyüklüğündeki "Ontario Gölü. Şimdi ve sonsuza dek" yazılı tabelanın önünde, (AP)
Ontario Başbakanı Doug Ford, Kanada kıyısında devasa bir reklam panosu büyüklüğündeki "Ontario Gölü. Şimdi ve sonsuza dek" yazılı tabelanın önünde, (AP)

Google, ABD’deki kullanıcıları için Ontario Gölü’nü "Amerika Gölü" (Lake America) olarak yeniden adlandırmak üzere Haritalar uygulamasını güncellediğini açıkladı. Küresel teknoloji devinin bildirdiğine göre bu adım, ABD Başkanı Donald Trump’ın kısa süre önce gölün adını değiştiren kararnamesini yansıtıyor.

Google Haritalar’daki bu güncelleme, Trump’ın iki ülke arasında her birinin diğerinin mallarına milyarlarca dolarlık ilave gümrük vergisi uygulamasına yol açan büyüyen ticaret savaşının ortasında çıkardığı kararnameden birkaç gün sonra geldi. Bu durum, Google’ın 2025 yılında Trump’ın Meksika Körfezi’nin adını Amerika Körfezi olarak değiştirme kararı aldığında yaptığı uygulamayı hatırlattı.

Google, cumartesi günü blog sayfasında yayınladığı yazıda, bu kararın ABD Coğrafi Adlar Bilgi Sistemi (GNIS) tarafından belirlenen isimleri kullanma yönündeki yerleşik uygulamalarına dayandığını belirtti.

Google yaptığı kısa açıklamada, "ABD’deki Haritalar kullanıcıları 'Amerika Gölü' adını görecek, Kanada’daki kullanıcılar 'Ontario Gölü' adını görmeye devam edecek, ABD ve Kanada dışındaki kullanıcılar ise her iki ismi de görecek" dedi. Şirket ayrıca, "Bu güncellemeler, ülkeden ülkeye farklılık gösteren adlara sahip su kütlelerine ilişkin uzun süredir devam eden politikalarımızın devamıdır ve şu anda uygulanmaya başlanmıştır" ifadelerini kullandı.

Trump’ın perşembe günü gölün adını değiştirme kararı hem Kanada’da hem de ABD’de alay ve ilgisizlikle karşılandı. Cumartesi günü Ontario Başbakanı Doug Ford, Trump’ın kararnamesine Kanada sahilinde dev reklam panosu büyüklüğündeki şu mesajla yanıt verdi: "Ontario Gölü. Şimdi ve sonsuza dek."

Beyaz Saray, Kanada Başbakanı Mark Carney’nin ofisi ve Ford’un ofisi, Google’ın kararı hakkında dün henüz bir yorumda bulunmadı.