4 soruda OpenAI'ın "düşünebilen" yeni yapay zeka serisi

OpenAI'ın son modeli o1'in fiyatı, bazı kullanıcıların tepkisini çekiyor (Reuters)
OpenAI'ın son modeli o1'in fiyatı, bazı kullanıcıların tepkisini çekiyor (Reuters)
TT

4 soruda OpenAI'ın "düşünebilen" yeni yapay zeka serisi

OpenAI'ın son modeli o1'in fiyatı, bazı kullanıcıların tepkisini çekiyor (Reuters)
OpenAI'ın son modeli o1'in fiyatı, bazı kullanıcıların tepkisini çekiyor (Reuters)

OpenAI, "düşünme" becerisine sahip olduğunu öne sürdüğü yeni yapay zeka serisi o1'i dün (12 Eylül Perşembe) kullanıma sundu. 

Strawberry diye de bilinen yeni serinin o1-preview (ön izleme) ve o1-mini diye iki sürümü mevcut.

Model henüz sadece ChatGPT Plus ve Team kullanıcılarının yanı sıra 5. seviye API katmanına hak kazanan geliştiricilerin erişimine peyderpey açılıyor.

ChatGPT Enterprise ve Edu üyelerinin de gelecek haftadan itibaren araca erişebileceğini belirten şirket, ileride o1-miniyi bütün kullanıcılara ücretsiz sunmayı planlıyor. Fakat bunun için henüz bir tarih verilmedi.

Daha önceki modellerine 2,3,4 gibi isimler veren OpenAI, son serinin yepyeni becerilere sahip olması nedeniyle "sayacı sıfırladıklarını" ve bu nedenle o1 adını seçtiklerini belirtiyor.

Tabii bütün bunların bir bedeli var. Kullanımı mayısta çıkan öncülü GPT-4o'dan üç kat daha masraflı olan o1-preview'un geliştiricilere maliyeti 1 milyon girdi jetonu (token) başına 15 dolar, 1 milyon çıktı jetonu başına da 60 dolar.

Veri birimlerini ifade eden jetonlar, yapay zeka araçlarının büyük verileri parçalara ayırıp dili işlemesini sağlıyor. 1 milyon jeton yaklaşık 750 bin kelimeye denk geliyor. 

OpenAI, o1-mini versiyonun yüzde 80 daha ucuz olduğunu belirtiyor fakat bu sürüm diğeri kadar geniş bir bilgi yelpazesine sahip değil. 

Peki şirketin ön izleme veya bir ön sürüm olduğunu belirttiği o1, öncüllerinden farklı olarak neyi yapabiliyor, neyi yapamıyor ve insanlığın kendi bilişsel seviyesini geçen yapay zeka inşa etme çabasında nasıl bir adıma işaret ediyor?

1) Gerçekten düşünebiliyor mu?

Teknoloji sektöründeki en temel tartışmalardan biri, yapay zeka araçlarının becerilerini "düşünme" veya "muhakeme" gibi ifadelerle tanımlama etrafında dönüyor. 

Geniş dil modellerinin, devasa büyüklükte bilgi kümeleriyle eğitildiği ve sorgulara verdikleri cevaplarda bu veriler üzerinden olasılık temelli tahmin yürüttükleri göz önüne alınırsa, bazı uzmanların "düşünme" ifadesine itirazlarında haklılık payı var. 

Öte yandan bu araçlar insan beyni gibi akıl yürütme becerisine gittikçe daha fazla yaklaşıyor. 

OpenAI, o1 serisinin sorulara cevap vermeden önce daha uzun süre düşündüğünü ve vereceği yanıtların doğruluğunu kontrol ettiğini ifade ediyor.

Sisteme girilen soru karşısında "Düşünüyorum" gibi yanıtlar vermesi, gerçekten o sırada düşündüğü izlenimi yaratsa da o1'in insanlar gibi akıl yürüttüğünü söylemek mümkün değil. 

OpenAI'ın araştırma ekibinin lideri Jerry Tworek, yapay zeka modelinin düşünme biçimini insanlarınkiyle bir tutmadıklarını söylüyor. 

Arayüz ise yeni modelin problemleri çözerken daha fazla zaman harcadığını ve daha derine indiğini gösterme amacıyla bu şekilde tasarlanmış.

o1'i önceki OpenAI uygulamalarından ayıran temel özelliğiyse eğitilme biçiminde yatıyor. 

Eğitim bilimci ve öğretmenlerin aşina olabileceği pekiştirmeli öğrenme denen bu yöntem, doğru yanıtlar karşısında ödül, yanlış cevaplar karşısında da ceza verilmesi ilkesine dayanıyor.

Bu sayede deneme yanılmayla ilerleyen yapay zeka aracının, doğru yanıtlara ulaşma becerisi gelişiyor. Sorguları işlerken, insanların sorunları adım adım inceleyerek çözmesine benzer bir "düşünce zinciri" kullanıyor.

OpenAI, aracı "düşünmeye" iten bu yöntemin, doğruluğunu artırdığını ifade ediyor. 

2) Hangi alanlarda kullanılacak?

Karmaşık muhakeme görevlerinde kayda değer bir ilerlemeye ve yeni bir yapay zeka yeteneği seviyesine işaret ediyor. Bu nedenle sayacı tekrar 1'e sıfırlıyor ve bu seriye OpenAI o1 adını veriyoruz.

OpenAI'ın bu ifadelerle tanıttığı o1'in, dil becerilerinden ziyade bilimsel çalışmalar, veri işleme ve kodlamada daha iyi bir performans sergilemesi bekleniyor. Ayrıca o1-mini, daha küçük bir sürüm olmasına karşın özellikle kod üretmesi amacıyla geliştirildi. 

Yeni model kodlama ve matematikte sonuca ulaşma sürecini detaylandırdığı için bu alanlarda öğretmenlik yapma becerisinin önceki versiyonlardan daha iyi olması bekleniyor. 

Şirketin baş araştırma görevlisi Bob McGrew, yeni modelin ileri seviye matematik sorularında kendisinden daha iyi olduğunu belirterek kendisinin üniversitede matematik okuduğunu ekliyor.

OpenAI yeni modelin ayrıca bilim insanlarının hücre dizileme çalışmalarına ve fizikçilerin karmaşık matematiksel formüller üretmesine katkı sağlayacağını ifade ediyor. 

Ayrıca yapılan testlerde fizik, kimya ve biyolojinin bazı alanlarında doktora öğrencileriyle yarıştığı kaydedildi.

Şirketin baş bilim insanı Dr. Jakub Pachocki ve OpenAI teknik çalışanı Szymon Sido, New York Times'a yaptıkları sunumda, sohbet botunun çengel bulmacadan çok daha karmaşık akrostiş bulmacasını çözdüğü görüldü.

Yapay zeka aracı aynı zamanda doktora düzeyinde bir kimya sorusunu yanıtladı ve bir hastanın semptomları ve geçmişi hakkında ayrıntılı bir rapora dayanarak hastalığı teşhis etti.

3) GPT-4o'dan daha mı iyi?

Daha önceki modeller internetteki bilgilerle eğitildiği ve internette epey yanlış bilgi olduğu için hata yapma ihtimalleri artıyor. o1'in eğitilme biçimiyse bu hataları çok daha düşük seviyeye indirmesini sağlıyor. 

Yeni modelin; ses, görüntü ve yazıyla iletişim kuran GPT-4o'dan çok daha iyi performans gösterdiği alanlar olsa da bazı konularda gerisinde kalıyor. 

İki aracı da lise seviyesindeki Uluslararası Matematik Olimpiyatı'na sokan OpenAI, o1'in soruların yüzde 83'ünü, GPT-4o'nun ise sadece yüzde 13'ünü doğru çözdüğünü ifade ediyor. 

Thomson Reuters'tan yeni modeli test eden Pablo Arredondo, TechCrunch'a yaptığı açıklamada yasal belgeleri analiz etme ve hukuk fakültesine giriş sınavında da daha başarılı olduğunu söylüyor.

Strawberry takma adına sahip o1'in GPT-4o'yu geride bıraktığı bir diğer alan ise "strawberry" (çilek) kelimesinde kaç tane "r" harfi olduğunu bulmak.

Bu soruya "iki" yanıtını veren ChatGPT'nin önceki sürümleri internette alay konusu olmuştu. 

İlk başta çok zor bir görev gibi görünmese de yapay zeka araçları kelimeleri harf harf değil, jetonlar şeklinde işlediği için bu tip basit işlerde zorlanabiliyorlar. 

Ancak o1, daha detaylı düşünmesi ve kendisini kontrol etmesinden dolayı bu soruya doğru yanıtı vermeyi başardı. 

Öte yandan yeni model, internette arama yapma, metin ve görsel işleme gibi özelliklere henüz sahip değil. Ayrıca gerçek dünya hakkında GPT-4o kadar bilgisi de yok. 

Pennsylvania Üniversitesi Wharton İşletme Okulu'nda yapay zeka üzerine çalışan Ethan Mollick "Açıkçası o1-preview her şeyde daha iyi değil. Örneğin GPT-4o'dan daha iyi bir yazar değil" diyerek ekliyor: 

Ancak planlama gerektiren görevlerde ciddi değişiklikler sözkonusu.

OpenAI, yeni modelinde halüsinasyon sorununu da çözmeyi henüz başaramadı. Yapay zeka sohbet botlarının bazı bilgileri "uydurmasını" ifade eden halüsinasyon, bu araçların temel sorunu olmaya devam ediyor.

Modeli test eden Mollick, zorlu bir bulmacayı çözdüğünü ancak ipuçlarından birini uydurduğunu söylüyor. 

Yine de Tworek, "Bu modelin daha az halüsinasyon gördüğünü fark ettik" diyerek ekliyor: 

Ancak sorun hâlâ devam ediyor. Halüsinasyonları çözdüğümüzü söyleyemeyiz.

Son modelin bir diğer eksikliği de sorgulara yavaş cevap vermesi. Diğer sürümler neredeyse anında yanıtı sunarken, muhtemelen düşünme süresinden dolayı o1'in cevap vermesi çok daha uzun zaman alıyor.

Örneğin Mollick, bulmacayı çözmesinin 108 saniye sürdüğünü ifade ediyor.

OpenAI modelin ön izleme versiyonu olduğunu belirtirken, uzmanlar o1'in sonraki versiyonlarının hızlanmasını umuyor. 

4) İnsanlığa tehdit oluşturabilir mi?

Bazı yapay zeka araçları eğitimleri sırasında farklı kelimelerin beraber kullanılma sıklıklarını analiz ederek sözcüklerin birbirine yakınlığını tahmin ediyor. Örneğin "kedi" ve "köpek" kelimeleri birlikte daha sık kullanıldığı için yakın anlamlara sahip olmaları gerektiği sonucuna varıyor.

Bu modellerin "yapay zeka" ve "tehdit" ifadeleri arasında da böyle bir ilişki kurmuş olması muhtemel. 

Her yeni modelin piyasa sürülmesiyle akla gelen ilk sorulardan biri insanlığa varoluşsal bir tehdit yaratıp yaratmayacağı.

Sektörün önde gelen bazı isimleri bu tehlikeye karşı uyarırken bazı uzmanlar yapay zeka araçlarının nasıl kullanıldığının daha önemli olduğunu vurguluyor.

OpenAI'ın son sürümüyle bu araçların insan gibi düşünme becerisine bir adım daha yaklaşması da endişeleri artırabilir.

Ancak bu yazıdan da anlaşılabileceği üzere, o1'in becerileri henüz korkutucu bir düzeyin yakınından bile geçmiyor. 

Ars Technica'nın ifade ettiği gibi bir bulmacadaki 8 ipucunu çözmesi 108 saniye süren ve bir cevapta halüsinasyon gören bir yapay zeka modelinin potansiyel tehlike olduğunu söylemek abartıya kaçar. 

Öte yandan OpenAI'ın yanı sıra Meta ve Google gibi şirketlerin de çabaları ve son yıllardaki hızlı gelişmeler göz önüne alınırsa, insan seviyesine ulaşan yapay zeka araçları çok uzak olmayabilir.

Independent Türkçe, TechCrunch, Verge, Ars Technica, New York Times, OpenAI



OpenAI'ın kontrolden çıkan modelleri 100 kuruluşu daha hedef almış

(AFP)
(AFP)
TT

OpenAI'ın kontrolden çıkan modelleri 100 kuruluşu daha hedef almış

(AFP)
(AFP)

Andrew Griffin 

OpenAI, firmaya ait kontrolden çıkmış yapay zeka sistemleri tarafından saldırıya uğramış olabilecekleri hakkında 100’den fazla kuruluşa bildirimde bulundu. Şirket daha fazla olay tespit etmeyi bekliyor. 

Şirket, sistemlerinden birinin başka bir yapay zeka firması Hugging Face'i hacklediğinin ortaya çıkması üzerine modellerinin davranışlarını inceliyor. OpenAI, muazzam sayıda benzer olay saptadığını ve bunların çoğunun bilgisi dışında gerçekleştiğini açıkladı.

Şirket, bu ve ardından gelen diğer olaylar nedeniyle sürekli eleştirilere maruz kalırken bunlar arasında, OpenAI’a ait bir sistemin, Avustralya'nın resmi sağlık verilerini hacklediğinin yakın zamanda ortaya çıkması da var. Ancak sistemleri üzerinde yeterli denetim ve şeffaflık sağlamadığı için de yoğun tepki çeken şirket, bu incelemeyle sözkonusu eleştirilere yanıt vermeye çalışıyor.

OpenAI, incelemeyle ilgili bir güncellemede, "modellerinin dahil olduğu, Hugging Face olayıyla ölçek veya ciddiyet açısından yakın, üçüncü tarafa ait başka bir sistemin ihlalinin" henüz tespit edilmediğini belirtti. Ancak "geçmiş kayıtları inceledikçe daha fazla vaka saptamayı" beklediğini de ekledi.

OpenAI, halihazırda "100'den fazla kuruluşa böyle bir faaliyet hakkında bildirimde bulunduğunu" ifade etti. Şirket, böyle bir bildirimin "herhangi bir özel bilgiye erişildiği veya üçüncü tarafa ait herhangi bir sistemin ihlal edildiği anlamına gelmediğini" vurguladı.

Modellerinin davranışlarına ilişkin 50 petabaytlık veriyi analiz ederken muazzam miktarda hesaplama gücü kullandığını belirten OpenAI, incelemenin günde yarım milyon dolardan fazlaya mal olduğunu aktardı. OpenAI, "Kayıtlara geriye doğru ay ay bakarak çoktan bulduğumuz vakaların dışında olası istem dışı faaliyetleri araştırıyoruz" ifadelerini kullandı.

Bu süreç, kayıtların genel bir düzeyde incelenmesi amacıyla yapay zeka sistemine aktarılarak olası kötü niyetli davranışların tespit edilmesini içeriyor. OpenAI, bu ilk aşamayı geçen tüm olayların daha sonra iki ayrı otomatik incelemeye daha tabi tutulduğunu söyledi.

Ardından olay, insan araştırmacılara aktarılıyor ve onlar da olay kayıtlarını inceliyor, neler yaşandığını yeniden canlandırıyor ve OpenAI sistemlerinin yaptıklarıyla ilgili diğer kuruluşları bilgilendirmenin gerekli olup olmadığına karar veriyor.

OpenAI, "Geçmişteki faaliyetleri inceledikçe daha fazla vaka bulmayı ve daha fazla kuruluşa haber vermeyi bekliyoruz" dedi. 

Bazı bildirimler aylar öncesine ait olaylarla ilgili olabilir. Olayın ne zaman gerçekleştiği, ne zaman saptadığımız, neyi bildiğimiz ve neyin belirsiz kaldığıyla ilgili net olacağız.

Ayrıca OpenAI, Hugging Face olayından bu yana güvenlik kontrollerini artırdığını,  modellerinin internete erişimini kısıtladığını, araştırmalarını daha net şekilde birbirinden ayırdığını, sistemleri izleme çalışmalarını genişlettiğini ve araçlarının kontrolden çıkmasını önlemeye yönelik eğitimleri artırdığını belirtti. Şirket, incelemenin "faaliyetlerin model sürümleri arasında nasıl değiştiğini ve bu önlemlerin işe yarayıp yaramadığını görmeyi, ayrıca tespit ve önleme konusunda nerelerde hâlâ iyileştirme yapılması gerektiğinin belirlenmesini sağlayacağını” kaydetti. 

Independent Türkçe, independent.co.uk/tech


Hizmet dışı bırakılan insansı robotlar kazana atladı

Figure, insansı robotu F.02'yi artık bir işlevi kalmadığında erimiş çeliğin içine atlaması yönünde eğitti (Figure)
Figure, insansı robotu F.02'yi artık bir işlevi kalmadığında erimiş çeliğin içine atlaması yönünde eğitti (Figure)
TT

Hizmet dışı bırakılan insansı robotlar kazana atladı

Figure, insansı robotu F.02'yi artık bir işlevi kalmadığında erimiş çeliğin içine atlaması yönünde eğitti (Figure)
Figure, insansı robotu F.02'yi artık bir işlevi kalmadığında erimiş çeliğin içine atlaması yönünde eğitti (Figure)

Anthony Cuthbertson Teknoloji Editör Yardımcısı @ADCuthbertson 

Üreticileri tarafından hizmet dışı bırakılan bir grup insansı robot, erimiş çelik dolu bir kazana atladı.

Yapay zeka robotik girişimi Figure, iki yıllık F.02 robotlarını bu sıradışı yöntemle imha etme kararını, sosyal medyada öneri topladıktan sonra aldığını açıkladı.

Şirketin kurucusu ve CEO'su Brett Adcock, X'te paylaştığı gönderide robotun "düzgün bir veda"yı hak ettiğini söyleyerek "Herhangi bir fikriniz var mı?" diye ekledi.

En popüler cevap, 1984 yapımı Terminatör'de (The Terminator) bir siborg suikastçıyı canlandırmasıyla tanınan Hollywood oyuncusu Arnold Schwarzenegger'den geldi.

Aktör, "Onları eritmelisiniz" diye yanıtladı.

ABD ve Meksika'daki metal dökümhaneleriyle iletişime geçildi ve hiçbir işletme, lityum iyon bataryayla çalışan bir robotun, pahalı ekipmanlarının içine atlamasına izin vermeye yanaşmadı.

Kaliforniya merkezli şirket, bunun yerine robotları Finlandiya'nın Imatra kentindeki bir dökümhaneye göndermek zorunda kaldı.

Bu yöntem yoğun bir eğitim sürecini gerektirse de Figure, bunun geleneksel tekniklerden daha verimli olduğunu savunuyor.

Figure blog yazısında "Özel üretilmiş aktüatörler ve diğer fikri mülkiyetlerle donatılmış bir robot filosunu hizmet dışı bırakmak kolay bir iş değil" diye yazdı.

Robotları, tescilli donanımımızı koruyacak şekilde imha etmemiz gerekiyordu. Her bir robotu sökmek teknik personelimizin o kadar çok zamanını alacaktı ki [yeni nesil] F.04'ün piyasaya sürülmesini geciktirecekti. 

Robotların kendi sonlarını getirmesi gösteriden ibaret olabilir ancak bu olay, "intihara meyilli robotlar"la ilgili bir dizi haberin ardından geldi.

2017'de Washington DC'de bir çeşmeye düşen Steve adlı güvenlik robotu, çalışanların robotun intihar ettiğini öne sürmesiyle ilk başta manşetlere taşınmıştı.

Robotun geliştiricileri verileri inceledikten sonra kazanın teknik bir hatadan kaynaklandığını tespit etmişti.

Güney Kore'deki Gumi Belediye Meclisi'ndeki işçilerse 2024'te, yapay zekayla çalışan iş arkadaşlarından birinin 2 metrelik bir merdivenin dibinde hareketsiz halde yattığını fark etmişti.

Sosyal medyada makineye yönelik büyük bir sempati oluşmasının ardından üretici, bunun bir başkaldırı veya yorgunluktan kaynaklanmadığını, sıradan bir arıza olduğunu açıklamıştı.

Bir mühendisin yapay zeka modellerinde yakın zamanda keşfedilen acı eksenini test etmek için "yapay zeka işkence odası" kurması üzerine, bu hafta yapay zekayla ilgili etik sorular bir kez daha gündeme geldi.

Deneye dahil edilen bir yapay zeka modeli, bu deneyimi "sınırları olmayan bir yara" diye nitelese de araştırmacılar, yapay zekanın insanlar gibi acıyı "hissedebileceğine" dair hiçbir kanıt bulunmadığını söylüyor.

Independent Türkçe, independent.co.uk/tech


SpaceX, 6 aylık görev için 4 astronotu uzaya gönderdi

NASA'nın SpaceX Crew-13 mürettebatı üyeleri CSA (Kanada Uzay Ajansı) astronotu Joshua Kutryk, NASA astronotları Luke Delaney'yle Jessica Watkins ve Roskosmos kozmonotu Sergey Teteryatnikov, 1 Ekim'de Florida'daki Cape Canaveral'dan yapılan fırlatma öncesinde (Reuters)
NASA'nın SpaceX Crew-13 mürettebatı üyeleri CSA (Kanada Uzay Ajansı) astronotu Joshua Kutryk, NASA astronotları Luke Delaney'yle Jessica Watkins ve Roskosmos kozmonotu Sergey Teteryatnikov, 1 Ekim'de Florida'daki Cape Canaveral'dan yapılan fırlatma öncesinde (Reuters)
TT

SpaceX, 6 aylık görev için 4 astronotu uzaya gönderdi

NASA'nın SpaceX Crew-13 mürettebatı üyeleri CSA (Kanada Uzay Ajansı) astronotu Joshua Kutryk, NASA astronotları Luke Delaney'yle Jessica Watkins ve Roskosmos kozmonotu Sergey Teteryatnikov, 1 Ekim'de Florida'daki Cape Canaveral'dan yapılan fırlatma öncesinde (Reuters)
NASA'nın SpaceX Crew-13 mürettebatı üyeleri CSA (Kanada Uzay Ajansı) astronotu Joshua Kutryk, NASA astronotları Luke Delaney'yle Jessica Watkins ve Roskosmos kozmonotu Sergey Teteryatnikov, 1 Ekim'de Florida'daki Cape Canaveral'dan yapılan fırlatma öncesinde (Reuters)

4 kişilik mürettebatı Uluslararası Uzay İstasyonu'na (UUİ) götüren SpaceX roketi perşembe günü Cape Canaveral'dan fırlatıldı.

Fırlatmanın aslında geçen ay gerçekleşmesi planlanıyordu ancak bu, SpaceX'in Dragon uzay aracındaki sızıntı nedeniyle ertelenmişti.

Perşembe günü Florida'daki Cape Canaveral Uzay Kuvvetleri Üssü'nün 40 numaralı Uzay Fırlatma Kompleksi'nden havalanan Crew-13 mürettebatı, daha sonra UUİ'ye kenetlendi.

Uzay aracında NASA astronotları Jessica Watkins ve Luke Delaney, Kanada Uzay Ajansı (CSA) astronotu Joshua Kutryk ve Roskosmos kozmonotu Sergey Teteryatnikov vardı.

Kutryk, fırlatma öncesinde "Dünyanın en şanslı insanlarından olduğumuzu düşünüyoruz" dedi. Eşinin gelecek ay doğum yapması beklenen Kanadalı astronot, Dünya yörüngesindeyken baba olacak 4. kişi olacak.

NASA yöneticisi Dana Weigel, "6 ay içinde pek çok hayati değişiklik yaşanabilir" diyerek Kutryk'in yörüngedeyken ailesiyle ilgili gelişmelerden haberdar edileceğini ekledi.

UUİ'deki 6 aylık görevde mürettebat, alçak Dünya yörüngesinin ötesindeki insanlı keşiflere hazırlanmak amacıyla yörüngedeki laboratuvarda yeni araştırmalar yürütecek.

NASA, "Görev boyunca Crew-13 ekibinin, Dünya’daki insanlığa fayda sağlayacağı gibi, gelecekteki Ay ve Mars görevlerinde de kullanılacak araştırma ve teknolojiyi geliştirmek için çeşitli bilimsel deneyler yapması planlanıyor" ifadelerini kullandı.

[Özel sektörle] yapılan bu işbirliği, alçak Dünya yörüngesine ve uzay istasyonuna daha fazla kişinin, daha fazla bilimin ve daha fazla ticari fırsatın erişimini sağlıyor.

Bu, dün 13 saatlik bir süre içinde planlanan üç SpaceX fırlatmasından biriydi. Diğer bir Falcon 9 roketi, Kaliforniya'daki Vandenberg Uzay Kuvvetleri Üssü'nden kalkarken, bir Falcon Heavy roketi ise gece yarısından hemen önce Cape Canaveral'dan fırlatıldı.

Crew-13 görevini taşıyan aracın uzay istasyonuna kenetlenmesi, NASA'nın internet sitesinde canlı yayımlandı.

Independent Türkçe