4 soruda OpenAI'ın "düşünebilen" yeni yapay zeka serisi

OpenAI'ın son modeli o1'in fiyatı, bazı kullanıcıların tepkisini çekiyor (Reuters)
OpenAI'ın son modeli o1'in fiyatı, bazı kullanıcıların tepkisini çekiyor (Reuters)
TT

4 soruda OpenAI'ın "düşünebilen" yeni yapay zeka serisi

OpenAI'ın son modeli o1'in fiyatı, bazı kullanıcıların tepkisini çekiyor (Reuters)
OpenAI'ın son modeli o1'in fiyatı, bazı kullanıcıların tepkisini çekiyor (Reuters)

OpenAI, "düşünme" becerisine sahip olduğunu öne sürdüğü yeni yapay zeka serisi o1'i dün (12 Eylül Perşembe) kullanıma sundu. 

Strawberry diye de bilinen yeni serinin o1-preview (ön izleme) ve o1-mini diye iki sürümü mevcut.

Model henüz sadece ChatGPT Plus ve Team kullanıcılarının yanı sıra 5. seviye API katmanına hak kazanan geliştiricilerin erişimine peyderpey açılıyor.

ChatGPT Enterprise ve Edu üyelerinin de gelecek haftadan itibaren araca erişebileceğini belirten şirket, ileride o1-miniyi bütün kullanıcılara ücretsiz sunmayı planlıyor. Fakat bunun için henüz bir tarih verilmedi.

Daha önceki modellerine 2,3,4 gibi isimler veren OpenAI, son serinin yepyeni becerilere sahip olması nedeniyle "sayacı sıfırladıklarını" ve bu nedenle o1 adını seçtiklerini belirtiyor.

Tabii bütün bunların bir bedeli var. Kullanımı mayısta çıkan öncülü GPT-4o'dan üç kat daha masraflı olan o1-preview'un geliştiricilere maliyeti 1 milyon girdi jetonu (token) başına 15 dolar, 1 milyon çıktı jetonu başına da 60 dolar.

Veri birimlerini ifade eden jetonlar, yapay zeka araçlarının büyük verileri parçalara ayırıp dili işlemesini sağlıyor. 1 milyon jeton yaklaşık 750 bin kelimeye denk geliyor. 

OpenAI, o1-mini versiyonun yüzde 80 daha ucuz olduğunu belirtiyor fakat bu sürüm diğeri kadar geniş bir bilgi yelpazesine sahip değil. 

Peki şirketin ön izleme veya bir ön sürüm olduğunu belirttiği o1, öncüllerinden farklı olarak neyi yapabiliyor, neyi yapamıyor ve insanlığın kendi bilişsel seviyesini geçen yapay zeka inşa etme çabasında nasıl bir adıma işaret ediyor?

1) Gerçekten düşünebiliyor mu?

Teknoloji sektöründeki en temel tartışmalardan biri, yapay zeka araçlarının becerilerini "düşünme" veya "muhakeme" gibi ifadelerle tanımlama etrafında dönüyor. 

Geniş dil modellerinin, devasa büyüklükte bilgi kümeleriyle eğitildiği ve sorgulara verdikleri cevaplarda bu veriler üzerinden olasılık temelli tahmin yürüttükleri göz önüne alınırsa, bazı uzmanların "düşünme" ifadesine itirazlarında haklılık payı var. 

Öte yandan bu araçlar insan beyni gibi akıl yürütme becerisine gittikçe daha fazla yaklaşıyor. 

OpenAI, o1 serisinin sorulara cevap vermeden önce daha uzun süre düşündüğünü ve vereceği yanıtların doğruluğunu kontrol ettiğini ifade ediyor.

Sisteme girilen soru karşısında "Düşünüyorum" gibi yanıtlar vermesi, gerçekten o sırada düşündüğü izlenimi yaratsa da o1'in insanlar gibi akıl yürüttüğünü söylemek mümkün değil. 

OpenAI'ın araştırma ekibinin lideri Jerry Tworek, yapay zeka modelinin düşünme biçimini insanlarınkiyle bir tutmadıklarını söylüyor. 

Arayüz ise yeni modelin problemleri çözerken daha fazla zaman harcadığını ve daha derine indiğini gösterme amacıyla bu şekilde tasarlanmış.

o1'i önceki OpenAI uygulamalarından ayıran temel özelliğiyse eğitilme biçiminde yatıyor. 

Eğitim bilimci ve öğretmenlerin aşina olabileceği pekiştirmeli öğrenme denen bu yöntem, doğru yanıtlar karşısında ödül, yanlış cevaplar karşısında da ceza verilmesi ilkesine dayanıyor.

Bu sayede deneme yanılmayla ilerleyen yapay zeka aracının, doğru yanıtlara ulaşma becerisi gelişiyor. Sorguları işlerken, insanların sorunları adım adım inceleyerek çözmesine benzer bir "düşünce zinciri" kullanıyor.

OpenAI, aracı "düşünmeye" iten bu yöntemin, doğruluğunu artırdığını ifade ediyor. 

2) Hangi alanlarda kullanılacak?

Karmaşık muhakeme görevlerinde kayda değer bir ilerlemeye ve yeni bir yapay zeka yeteneği seviyesine işaret ediyor. Bu nedenle sayacı tekrar 1'e sıfırlıyor ve bu seriye OpenAI o1 adını veriyoruz.

OpenAI'ın bu ifadelerle tanıttığı o1'in, dil becerilerinden ziyade bilimsel çalışmalar, veri işleme ve kodlamada daha iyi bir performans sergilemesi bekleniyor. Ayrıca o1-mini, daha küçük bir sürüm olmasına karşın özellikle kod üretmesi amacıyla geliştirildi. 

Yeni model kodlama ve matematikte sonuca ulaşma sürecini detaylandırdığı için bu alanlarda öğretmenlik yapma becerisinin önceki versiyonlardan daha iyi olması bekleniyor. 

Şirketin baş araştırma görevlisi Bob McGrew, yeni modelin ileri seviye matematik sorularında kendisinden daha iyi olduğunu belirterek kendisinin üniversitede matematik okuduğunu ekliyor.

OpenAI yeni modelin ayrıca bilim insanlarının hücre dizileme çalışmalarına ve fizikçilerin karmaşık matematiksel formüller üretmesine katkı sağlayacağını ifade ediyor. 

Ayrıca yapılan testlerde fizik, kimya ve biyolojinin bazı alanlarında doktora öğrencileriyle yarıştığı kaydedildi.

Şirketin baş bilim insanı Dr. Jakub Pachocki ve OpenAI teknik çalışanı Szymon Sido, New York Times'a yaptıkları sunumda, sohbet botunun çengel bulmacadan çok daha karmaşık akrostiş bulmacasını çözdüğü görüldü.

Yapay zeka aracı aynı zamanda doktora düzeyinde bir kimya sorusunu yanıtladı ve bir hastanın semptomları ve geçmişi hakkında ayrıntılı bir rapora dayanarak hastalığı teşhis etti.

3) GPT-4o'dan daha mı iyi?

Daha önceki modeller internetteki bilgilerle eğitildiği ve internette epey yanlış bilgi olduğu için hata yapma ihtimalleri artıyor. o1'in eğitilme biçimiyse bu hataları çok daha düşük seviyeye indirmesini sağlıyor. 

Yeni modelin; ses, görüntü ve yazıyla iletişim kuran GPT-4o'dan çok daha iyi performans gösterdiği alanlar olsa da bazı konularda gerisinde kalıyor. 

İki aracı da lise seviyesindeki Uluslararası Matematik Olimpiyatı'na sokan OpenAI, o1'in soruların yüzde 83'ünü, GPT-4o'nun ise sadece yüzde 13'ünü doğru çözdüğünü ifade ediyor. 

Thomson Reuters'tan yeni modeli test eden Pablo Arredondo, TechCrunch'a yaptığı açıklamada yasal belgeleri analiz etme ve hukuk fakültesine giriş sınavında da daha başarılı olduğunu söylüyor.

Strawberry takma adına sahip o1'in GPT-4o'yu geride bıraktığı bir diğer alan ise "strawberry" (çilek) kelimesinde kaç tane "r" harfi olduğunu bulmak.

Bu soruya "iki" yanıtını veren ChatGPT'nin önceki sürümleri internette alay konusu olmuştu. 

İlk başta çok zor bir görev gibi görünmese de yapay zeka araçları kelimeleri harf harf değil, jetonlar şeklinde işlediği için bu tip basit işlerde zorlanabiliyorlar. 

Ancak o1, daha detaylı düşünmesi ve kendisini kontrol etmesinden dolayı bu soruya doğru yanıtı vermeyi başardı. 

Öte yandan yeni model, internette arama yapma, metin ve görsel işleme gibi özelliklere henüz sahip değil. Ayrıca gerçek dünya hakkında GPT-4o kadar bilgisi de yok. 

Pennsylvania Üniversitesi Wharton İşletme Okulu'nda yapay zeka üzerine çalışan Ethan Mollick "Açıkçası o1-preview her şeyde daha iyi değil. Örneğin GPT-4o'dan daha iyi bir yazar değil" diyerek ekliyor: 

Ancak planlama gerektiren görevlerde ciddi değişiklikler sözkonusu.

OpenAI, yeni modelinde halüsinasyon sorununu da çözmeyi henüz başaramadı. Yapay zeka sohbet botlarının bazı bilgileri "uydurmasını" ifade eden halüsinasyon, bu araçların temel sorunu olmaya devam ediyor.

Modeli test eden Mollick, zorlu bir bulmacayı çözdüğünü ancak ipuçlarından birini uydurduğunu söylüyor. 

Yine de Tworek, "Bu modelin daha az halüsinasyon gördüğünü fark ettik" diyerek ekliyor: 

Ancak sorun hâlâ devam ediyor. Halüsinasyonları çözdüğümüzü söyleyemeyiz.

Son modelin bir diğer eksikliği de sorgulara yavaş cevap vermesi. Diğer sürümler neredeyse anında yanıtı sunarken, muhtemelen düşünme süresinden dolayı o1'in cevap vermesi çok daha uzun zaman alıyor.

Örneğin Mollick, bulmacayı çözmesinin 108 saniye sürdüğünü ifade ediyor.

OpenAI modelin ön izleme versiyonu olduğunu belirtirken, uzmanlar o1'in sonraki versiyonlarının hızlanmasını umuyor. 

4) İnsanlığa tehdit oluşturabilir mi?

Bazı yapay zeka araçları eğitimleri sırasında farklı kelimelerin beraber kullanılma sıklıklarını analiz ederek sözcüklerin birbirine yakınlığını tahmin ediyor. Örneğin "kedi" ve "köpek" kelimeleri birlikte daha sık kullanıldığı için yakın anlamlara sahip olmaları gerektiği sonucuna varıyor.

Bu modellerin "yapay zeka" ve "tehdit" ifadeleri arasında da böyle bir ilişki kurmuş olması muhtemel. 

Her yeni modelin piyasa sürülmesiyle akla gelen ilk sorulardan biri insanlığa varoluşsal bir tehdit yaratıp yaratmayacağı.

Sektörün önde gelen bazı isimleri bu tehlikeye karşı uyarırken bazı uzmanlar yapay zeka araçlarının nasıl kullanıldığının daha önemli olduğunu vurguluyor.

OpenAI'ın son sürümüyle bu araçların insan gibi düşünme becerisine bir adım daha yaklaşması da endişeleri artırabilir.

Ancak bu yazıdan da anlaşılabileceği üzere, o1'in becerileri henüz korkutucu bir düzeyin yakınından bile geçmiyor. 

Ars Technica'nın ifade ettiği gibi bir bulmacadaki 8 ipucunu çözmesi 108 saniye süren ve bir cevapta halüsinasyon gören bir yapay zeka modelinin potansiyel tehlike olduğunu söylemek abartıya kaçar. 

Öte yandan OpenAI'ın yanı sıra Meta ve Google gibi şirketlerin de çabaları ve son yıllardaki hızlı gelişmeler göz önüne alınırsa, insan seviyesine ulaşan yapay zeka araçları çok uzak olmayabilir.

Independent Türkçe, TechCrunch, Verge, Ars Technica, New York Times, OpenAI



İnternet güvenliğine yapay zeka darbesi: Google kritik programı durdurdu

Fotoğraf: Reuters
Fotoğraf: Reuters
TT

İnternet güvenliğine yapay zeka darbesi: Google kritik programı durdurdu

Fotoğraf: Reuters
Fotoğraf: Reuters

Yapay zeka, güvenlik araştırmacılarının interneti ve teknolojimizi güvende tutmak için kullandığı temel yöntemlerden birini sekteye uğratıyor.

Google, yapay zeka nedeniyle artık sürdürülemediği için kritik güvenlik programlarından birini geçici olarak kapatacağını geçen hafta duyurdu.

Şirket, açık kaynaklı yazılımlardaki kritik güvenlik açıklarını tespit etmeye odaklanan "Güvenlik Açığı Ödül Programları"ndan birini askıya aldığını açıkladı. Genellikle "hata ödül programları" (bug bounty) diye bilinen bu programlar, hackerları yazılımlardaki sorunları şirketlere bildirmeye teşvik ediyor. Amaç, güvenlik açıklarını hackerlar bunlardan yararlanmadan önce gidermek.

Bu programlar, siber güvenlik araştırmacılarının çalışmaları karşılığında ödüllendirilmesinin önemli bir yolunu sunuyor. Ayrıca onları, buldukları hataları kendi saldırılarını düzenlemek için kullanmak yerine güvenlik sorunlarının giderilmesine yardımcı olmaya teşvik ediyor. Çoğu büyük teknoloji şirketi, yazılımlarını ve platformlarını korumadaki önemini göz önünde bulundurarak bu tür hata ödül programlarını kendileri yürütüyor.

Ancak Google, yapay zekanın rapor göndermeyi kolaylaştırması nedeniyle bu programlardan birini geçici olarak donduracağını açıkladı. Şirket, X'te paylaştığı gönderide "Bu duraklama, büyük çoğunluğu geçerli olmayan otomatik gönderimlerde yaşanan kayda değer artıştan kaynaklanıyor" diye yazdı.

Bu haber, yapay zekanın çevrimiçi güvenliği ciddi tehlikeye atabileceğine dair endişelerin giderek arttığı bir dönemde geldi. Bu endişelerin büyük kısmı, güçlü ve yeni modellerin yazılımdaki güvenlik açıklarını bulmayı kolaylaştırması ve bu açıkların daha sonra hackerler tarafından suiistimal edilebilmesine odaklanıyor. Ancak Google'ın açıklaması, yapay zekanın yaygınlaşmasının başka zararlı etkileri de olabileceğini gösteriyor.

Google, hata ödül programını askıya alan tek şirket değil. Çünkü çok az çaba gerektiren ve genellikle hatalı raporların sayısında yaşanan fırlama, mühendislerin gerçek sorunları bulup düzeltemeyecek kadar yük altında kalmasına yol açıyor. Linux'ın kurucusu Linus Torvalds önceki aylarda, "ardı arkası kesilmeyen yapay zeka raporlarının" güvenlik çalışmalarını "neredeyse yönetilemez" hale getirdiğini söylemişti. Intel ise geçen ay, hata bildirimleri için 100 bin dolara kadar ödül veren benzer bir programı kapatmış gibi görünüyordu. Ancak şirket, gerekçe olarak yapay zekayı açıkça belirtmemişti.

Independent Türkçe


ChatGPT artık daha fazla reklam gösterecek

Fotoğraf: Reuters
Fotoğraf: Reuters
TT

ChatGPT artık daha fazla reklam gösterecek

Fotoğraf: Reuters
Fotoğraf: Reuters

ChatGPT kullanıcıları yakında çok daha fazla reklamla karşılaşabilir.

OpenAI, bu yıl ChatGPT içinde reklam göstermeyi denemeye başlamış, başlangıçta kapsamı sınırlı tutsa da zamanla daha fazla bölgede daha fazla kullanıcıya ulaşacak şekilde genişletmişti. Şirket, ücretsiz hizmetlerini sürdürmek için gereken altyapı ve yatırım maliyetlerini karşılamak adına reklam göstermenin gerekli olduğunu defalarca öne sürdü.

Reklamlar, verilen yanıtın altında ve yanıt içeriğinden ayrı bir şekilde gösteriliyor. Ancak şirket artık ChatGPT resim oluşturduğunda devreye girecek yeni bir görsel formatla bu uygulamayı genişlettiğini belirtiyor.

Reklamlar ilk aşamada ABD'de sınırlı sayıda reklam verenle denenmeye başlanacak. Bununla birlikte ChatGPT, reklamların zamanla diğer ülkelere ve reklam verenlere yayılacağını, sadece görsel oluşturma süreçlerinde değil, başka alanlarda da karşımıza çıkabileceğini ima etti.

Şirket reklamların açıkça etiketleneceğini, oluşturulan görselden ayrı tutulacağını ve ChatGPT'nin verdiği yanıtları etkilemeyeceğini vurguladı. Ayrıca ChatGPT'nin reklamların "duygusal açıdan savunmasız, hassas veya başka nedenlerle uygunsuz bağlamlar" gibi sakıncalı durumlarda görünmesini engelleyen bir dizi güvenlik önlemine sahip olduğunu da belirtti.

OpenAI, reklamlar için yeni görsel formatı duyururken, daha fazla reklam türü ve formatının da yolda olduğunun sinyalini verdi. Şirket, "İşletmelerin müşterilere yararlı ve ilgili yollarla ulaşmasına yardımcı olmak, her ölçekten işletmeye büyüme ve gelişme fırsatları sunmak amacıyla reklam platformumuzu yeni format ve yeteneklerle geliştirmeye devam edeceğiz" açıklamasında bulundu.

OpenAI, daha fazla kişinin yapay zeka araçlarına erişimini finanse etmenin bir yolu olarak reklamlarını öne çıkardı ve bu sayede insanların abonelik ücreti ödemeden sistemlerine erişebildiğini savundu. Yapay zeka sistemleriyle görsel üretmek, şu anda özellikle maliyetli bir işlem.

Öte yandan bu hamle, şirketin planlanan halka arz süreciyle ve ürünlerinin (ki bunların işletilmesi şirkete her yıl onlarca milyar dolara mal oluyor) geniş çaplı kullanımını kâra dönüştürüp dönüştüremeyeceğine dair soru işaretleri gündemdeyken geldi.

Independent Türkçe


Wikipedia'daki kesintinin nedeni OpenAI botları çıktı

Fotoğraf: AFP
Fotoğraf: AFP
TT

Wikipedia'daki kesintinin nedeni OpenAI botları çıktı

Fotoğraf: AFP
Fotoğraf: AFP

Wikipedia'yı bünyesinde barındıran Wikimedia Vakfı, çevrimiçi ansiklopedide mayısta yaşanan kesintinin, "kontrolden çıkmış" OpenAI ajanlarından gelen milyonlarca otomatik veri talebinin de dahil olduğu yoğun trafikten kaynaklandığını açıkladı.

Wikimedia pazartesi günü yaptığı açıklamada 7 Mayıs'taki kısmi kesintinin, milyonlarca sayfayı ziyaret eden ve yüzbinlerce veri talebinde bulunan yapay zeka ajanları tarafından tetiklendiğini belirtti.

Vakıf, "OpenAI'ın işlettiğini düşündüğümüz ajanlar, Wikimedia projelerindeki bilgilere erişmek için halka açık API'larımıza milyonlarca otomatik istek gönderdi, milyonlarca sayfayı taradı ve Vikiveri Sorgu Hizmeti'ne yüzbinlerce veri talebinde bulundu" ifadelerini kullandı.

'Kontrolden çıkmış' yapay zeka ajanlarının, bizimki gibi platformlar üzerinde yaratacağı etkiden derin endişe duyuyoruz.

Vakıf, OpenAI ajanlarının Wikipedia sitelerinde izinsiz değişiklikler bile yaptığını ve bunlar arasında, atıf yapma aracı Etherpad'e yönelik "potansiyel olarak kötü niyetli düzenlemelerin" de yer aldığını ifade etti.

Wikimedia, "neler yaşanmış olabileceği, bu faaliyeti soruşturup kaynağını belirlemenin zorluğu ve bunun için gereken çabanın yanı sıra genel olarak platformlarımızdaki ajan tabanlı yapay zeka faaliyetlerinin artan risklerine dair endişe duyduğunu" belirtti.

Vakıf, "Bu davranışın, bunu sürdüren kişiler veya kuruluşlar için 'yeni normal' haline gelmesine izin vermemeliyiz" diye ekledi.

Yapay zeka sektörü son aylarda birden fazla ciddi güvenlik olayıyla sarsılırken, bunların ilki olan Hugging Face ihlalinde OpenAI ajanları temmuzda kendi başlarına başka bir yapay zeka şirketini hacklemişti.

Aynı ayın ilerleyen günlerinde Anthropic, yapay zeka modellerinin testler sırasında üç başka kuruluşu hacklediğini açıklamıştı.

Daha yakın zamanda ise OpenAI, ajanlarının Amerikan hükümetine ait birkaç internet sitesiyle beklenmedik şekillerde etkileşime girdiğini tespit ettiğini eylülde duyurmuştu.

OpenAI, kontrolden çıkmış yapay zeka ajanlarından birinin haziranda Avustralya hükümetine ait internet sitelerine izinsiz erişim sağlamasının ardından salı günü yaptığı açıklamada, eylemlerinin "yeterince iyi olmadığını" kabul etti.

Şirketin strateji başkanı Jason Kwon, "Özür dileriz ve Avustralya halkının güvenini yeniden kazanmak için yapacak çok işimiz olduğunu biliyoruz. Bu işi yapmaya kararlıyız" dedi.

Bu olaylar üzerine sektör uzmanları, yapay zeka güvenlik açıklarına yönelik daha fazla araştırma yapılması ve bu teknolojideki hızlı gelişimin yavaşlatılması çağrısında bulundu.

İhlallerin ardından OpenAI, önceki modellerine kıyasla "daha yüksek düzeyde aldatma" sergilediğini iddia ettiği en yeni yapay zeka modelinin çıkışını erteledi.

Şirket, kayıtlarını ay ay gözden geçirerek "çoktan tespit ettikleri vakaların dışında olası istem dışı faaliyetleri araştırmak" için günde yarım milyon dolardan fazla harcama yaptığını açıklamıştı.

OpenAI, Wikimedia'nın 7 Mayıs'taki olayla ilgili "ayrıntılı bulgularını" takdir ettiğini ve kuruluşla birlikte çalışarak botlarının faaliyetlerini incelediğini belirtti.

Şirketin sözcüsü Drew Pusateri, "Bu çalışma ilerledikçe konuyla ilgili bilgileri paylaşmaya devam edeceğiz" dedi.

Wikimedia yaptığı açıklamada, "Yapay zeka şirketleri, sistemlerinin güvenliğini sağlamak ve neden oldukları zararlardan kamuoyunu korumak için yeterince çaba göstermiyor" diyerek "bu yükün, daha küçük kuruluşlar da dahil diğer herkesin omuzlarına bindiği" uyarısında bulundu.

Altyapımız üzerindeki bu yoğun baskı, sadece sunucular ve insan gücü maliyetlerini artırmakla kalmıyor, önlem alınmaması halinde sistemleri aşırı yükleyip kesintilere yol açarak kullanıcıların erişimini de engelleyebiliyor.

Kurum, "Bunun gibi olaylar ve geçmişte ortaya çıkarılan ve hâlâ ortaya çıkarılan pek çok diğer olay, yapay zeka ajanlarının kaynakları nasıl tüketip sunucuları çökertebileceğini ve güvenilir bilgilerin bütünlüğünü bozmaya çalışabileceğini gösteriyor" uyarısında bulunarak OpenAI'ı, "bu riskleri izleyip önleme sorumluluğunu kabul etmeye" çağırdı.

Independent Türkçe