4 soruda OpenAI'ın "düşünebilen" yeni yapay zeka serisi

OpenAI'ın son modeli o1'in fiyatı, bazı kullanıcıların tepkisini çekiyor (Reuters)
OpenAI'ın son modeli o1'in fiyatı, bazı kullanıcıların tepkisini çekiyor (Reuters)
TT

4 soruda OpenAI'ın "düşünebilen" yeni yapay zeka serisi

OpenAI'ın son modeli o1'in fiyatı, bazı kullanıcıların tepkisini çekiyor (Reuters)
OpenAI'ın son modeli o1'in fiyatı, bazı kullanıcıların tepkisini çekiyor (Reuters)

OpenAI, "düşünme" becerisine sahip olduğunu öne sürdüğü yeni yapay zeka serisi o1'i dün (12 Eylül Perşembe) kullanıma sundu. 

Strawberry diye de bilinen yeni serinin o1-preview (ön izleme) ve o1-mini diye iki sürümü mevcut.

Model henüz sadece ChatGPT Plus ve Team kullanıcılarının yanı sıra 5. seviye API katmanına hak kazanan geliştiricilerin erişimine peyderpey açılıyor.

ChatGPT Enterprise ve Edu üyelerinin de gelecek haftadan itibaren araca erişebileceğini belirten şirket, ileride o1-miniyi bütün kullanıcılara ücretsiz sunmayı planlıyor. Fakat bunun için henüz bir tarih verilmedi.

Daha önceki modellerine 2,3,4 gibi isimler veren OpenAI, son serinin yepyeni becerilere sahip olması nedeniyle "sayacı sıfırladıklarını" ve bu nedenle o1 adını seçtiklerini belirtiyor.

Tabii bütün bunların bir bedeli var. Kullanımı mayısta çıkan öncülü GPT-4o'dan üç kat daha masraflı olan o1-preview'un geliştiricilere maliyeti 1 milyon girdi jetonu (token) başına 15 dolar, 1 milyon çıktı jetonu başına da 60 dolar.

Veri birimlerini ifade eden jetonlar, yapay zeka araçlarının büyük verileri parçalara ayırıp dili işlemesini sağlıyor. 1 milyon jeton yaklaşık 750 bin kelimeye denk geliyor. 

OpenAI, o1-mini versiyonun yüzde 80 daha ucuz olduğunu belirtiyor fakat bu sürüm diğeri kadar geniş bir bilgi yelpazesine sahip değil. 

Peki şirketin ön izleme veya bir ön sürüm olduğunu belirttiği o1, öncüllerinden farklı olarak neyi yapabiliyor, neyi yapamıyor ve insanlığın kendi bilişsel seviyesini geçen yapay zeka inşa etme çabasında nasıl bir adıma işaret ediyor?

1) Gerçekten düşünebiliyor mu?

Teknoloji sektöründeki en temel tartışmalardan biri, yapay zeka araçlarının becerilerini "düşünme" veya "muhakeme" gibi ifadelerle tanımlama etrafında dönüyor. 

Geniş dil modellerinin, devasa büyüklükte bilgi kümeleriyle eğitildiği ve sorgulara verdikleri cevaplarda bu veriler üzerinden olasılık temelli tahmin yürüttükleri göz önüne alınırsa, bazı uzmanların "düşünme" ifadesine itirazlarında haklılık payı var. 

Öte yandan bu araçlar insan beyni gibi akıl yürütme becerisine gittikçe daha fazla yaklaşıyor. 

OpenAI, o1 serisinin sorulara cevap vermeden önce daha uzun süre düşündüğünü ve vereceği yanıtların doğruluğunu kontrol ettiğini ifade ediyor.

Sisteme girilen soru karşısında "Düşünüyorum" gibi yanıtlar vermesi, gerçekten o sırada düşündüğü izlenimi yaratsa da o1'in insanlar gibi akıl yürüttüğünü söylemek mümkün değil. 

OpenAI'ın araştırma ekibinin lideri Jerry Tworek, yapay zeka modelinin düşünme biçimini insanlarınkiyle bir tutmadıklarını söylüyor. 

Arayüz ise yeni modelin problemleri çözerken daha fazla zaman harcadığını ve daha derine indiğini gösterme amacıyla bu şekilde tasarlanmış.

o1'i önceki OpenAI uygulamalarından ayıran temel özelliğiyse eğitilme biçiminde yatıyor. 

Eğitim bilimci ve öğretmenlerin aşina olabileceği pekiştirmeli öğrenme denen bu yöntem, doğru yanıtlar karşısında ödül, yanlış cevaplar karşısında da ceza verilmesi ilkesine dayanıyor.

Bu sayede deneme yanılmayla ilerleyen yapay zeka aracının, doğru yanıtlara ulaşma becerisi gelişiyor. Sorguları işlerken, insanların sorunları adım adım inceleyerek çözmesine benzer bir "düşünce zinciri" kullanıyor.

OpenAI, aracı "düşünmeye" iten bu yöntemin, doğruluğunu artırdığını ifade ediyor. 

2) Hangi alanlarda kullanılacak?

Karmaşık muhakeme görevlerinde kayda değer bir ilerlemeye ve yeni bir yapay zeka yeteneği seviyesine işaret ediyor. Bu nedenle sayacı tekrar 1'e sıfırlıyor ve bu seriye OpenAI o1 adını veriyoruz.

OpenAI'ın bu ifadelerle tanıttığı o1'in, dil becerilerinden ziyade bilimsel çalışmalar, veri işleme ve kodlamada daha iyi bir performans sergilemesi bekleniyor. Ayrıca o1-mini, daha küçük bir sürüm olmasına karşın özellikle kod üretmesi amacıyla geliştirildi. 

Yeni model kodlama ve matematikte sonuca ulaşma sürecini detaylandırdığı için bu alanlarda öğretmenlik yapma becerisinin önceki versiyonlardan daha iyi olması bekleniyor. 

Şirketin baş araştırma görevlisi Bob McGrew, yeni modelin ileri seviye matematik sorularında kendisinden daha iyi olduğunu belirterek kendisinin üniversitede matematik okuduğunu ekliyor.

OpenAI yeni modelin ayrıca bilim insanlarının hücre dizileme çalışmalarına ve fizikçilerin karmaşık matematiksel formüller üretmesine katkı sağlayacağını ifade ediyor. 

Ayrıca yapılan testlerde fizik, kimya ve biyolojinin bazı alanlarında doktora öğrencileriyle yarıştığı kaydedildi.

Şirketin baş bilim insanı Dr. Jakub Pachocki ve OpenAI teknik çalışanı Szymon Sido, New York Times'a yaptıkları sunumda, sohbet botunun çengel bulmacadan çok daha karmaşık akrostiş bulmacasını çözdüğü görüldü.

Yapay zeka aracı aynı zamanda doktora düzeyinde bir kimya sorusunu yanıtladı ve bir hastanın semptomları ve geçmişi hakkında ayrıntılı bir rapora dayanarak hastalığı teşhis etti.

3) GPT-4o'dan daha mı iyi?

Daha önceki modeller internetteki bilgilerle eğitildiği ve internette epey yanlış bilgi olduğu için hata yapma ihtimalleri artıyor. o1'in eğitilme biçimiyse bu hataları çok daha düşük seviyeye indirmesini sağlıyor. 

Yeni modelin; ses, görüntü ve yazıyla iletişim kuran GPT-4o'dan çok daha iyi performans gösterdiği alanlar olsa da bazı konularda gerisinde kalıyor. 

İki aracı da lise seviyesindeki Uluslararası Matematik Olimpiyatı'na sokan OpenAI, o1'in soruların yüzde 83'ünü, GPT-4o'nun ise sadece yüzde 13'ünü doğru çözdüğünü ifade ediyor. 

Thomson Reuters'tan yeni modeli test eden Pablo Arredondo, TechCrunch'a yaptığı açıklamada yasal belgeleri analiz etme ve hukuk fakültesine giriş sınavında da daha başarılı olduğunu söylüyor.

Strawberry takma adına sahip o1'in GPT-4o'yu geride bıraktığı bir diğer alan ise "strawberry" (çilek) kelimesinde kaç tane "r" harfi olduğunu bulmak.

Bu soruya "iki" yanıtını veren ChatGPT'nin önceki sürümleri internette alay konusu olmuştu. 

İlk başta çok zor bir görev gibi görünmese de yapay zeka araçları kelimeleri harf harf değil, jetonlar şeklinde işlediği için bu tip basit işlerde zorlanabiliyorlar. 

Ancak o1, daha detaylı düşünmesi ve kendisini kontrol etmesinden dolayı bu soruya doğru yanıtı vermeyi başardı. 

Öte yandan yeni model, internette arama yapma, metin ve görsel işleme gibi özelliklere henüz sahip değil. Ayrıca gerçek dünya hakkında GPT-4o kadar bilgisi de yok. 

Pennsylvania Üniversitesi Wharton İşletme Okulu'nda yapay zeka üzerine çalışan Ethan Mollick "Açıkçası o1-preview her şeyde daha iyi değil. Örneğin GPT-4o'dan daha iyi bir yazar değil" diyerek ekliyor: 

Ancak planlama gerektiren görevlerde ciddi değişiklikler sözkonusu.

OpenAI, yeni modelinde halüsinasyon sorununu da çözmeyi henüz başaramadı. Yapay zeka sohbet botlarının bazı bilgileri "uydurmasını" ifade eden halüsinasyon, bu araçların temel sorunu olmaya devam ediyor.

Modeli test eden Mollick, zorlu bir bulmacayı çözdüğünü ancak ipuçlarından birini uydurduğunu söylüyor. 

Yine de Tworek, "Bu modelin daha az halüsinasyon gördüğünü fark ettik" diyerek ekliyor: 

Ancak sorun hâlâ devam ediyor. Halüsinasyonları çözdüğümüzü söyleyemeyiz.

Son modelin bir diğer eksikliği de sorgulara yavaş cevap vermesi. Diğer sürümler neredeyse anında yanıtı sunarken, muhtemelen düşünme süresinden dolayı o1'in cevap vermesi çok daha uzun zaman alıyor.

Örneğin Mollick, bulmacayı çözmesinin 108 saniye sürdüğünü ifade ediyor.

OpenAI modelin ön izleme versiyonu olduğunu belirtirken, uzmanlar o1'in sonraki versiyonlarının hızlanmasını umuyor. 

4) İnsanlığa tehdit oluşturabilir mi?

Bazı yapay zeka araçları eğitimleri sırasında farklı kelimelerin beraber kullanılma sıklıklarını analiz ederek sözcüklerin birbirine yakınlığını tahmin ediyor. Örneğin "kedi" ve "köpek" kelimeleri birlikte daha sık kullanıldığı için yakın anlamlara sahip olmaları gerektiği sonucuna varıyor.

Bu modellerin "yapay zeka" ve "tehdit" ifadeleri arasında da böyle bir ilişki kurmuş olması muhtemel. 

Her yeni modelin piyasa sürülmesiyle akla gelen ilk sorulardan biri insanlığa varoluşsal bir tehdit yaratıp yaratmayacağı.

Sektörün önde gelen bazı isimleri bu tehlikeye karşı uyarırken bazı uzmanlar yapay zeka araçlarının nasıl kullanıldığının daha önemli olduğunu vurguluyor.

OpenAI'ın son sürümüyle bu araçların insan gibi düşünme becerisine bir adım daha yaklaşması da endişeleri artırabilir.

Ancak bu yazıdan da anlaşılabileceği üzere, o1'in becerileri henüz korkutucu bir düzeyin yakınından bile geçmiyor. 

Ars Technica'nın ifade ettiği gibi bir bulmacadaki 8 ipucunu çözmesi 108 saniye süren ve bir cevapta halüsinasyon gören bir yapay zeka modelinin potansiyel tehlike olduğunu söylemek abartıya kaçar. 

Öte yandan OpenAI'ın yanı sıra Meta ve Google gibi şirketlerin de çabaları ve son yıllardaki hızlı gelişmeler göz önüne alınırsa, insan seviyesine ulaşan yapay zeka araçları çok uzak olmayabilir.

Independent Türkçe, TechCrunch, Verge, Ars Technica, New York Times, OpenAI



SpaceX, dünyanın en büyük roketini ilk yörünge uçuşuna hazırlıyor

Fotoğraf: Reuters
Fotoğraf: Reuters
TT

SpaceX, dünyanın en büyük roketini ilk yörünge uçuşuna hazırlıyor

Fotoğraf: Reuters
Fotoğraf: Reuters

SpaceX, mega roketi Starship'in ilk yörünge uçuş denemesine hazırlanıyor.

Gelecek pazartesi gerçekleşmesi planlanan bu kritik görev, NASA'nın Artemis programı kapsamında insanları Ay yüzeyine gönderme takvimini koruyup koruyamayacağını belirleyebilir.

ABD uzay ajansı, Elon Musk'ın bir gün Mars'ta kalıcı bir koloni kurmak için kullanılacağını iddia ettiği 124 metrelik roketin geliştirilmesindeki sorunlar nedeniyle, Artemis'in zaman çizelgesinde zaten erteleme yapmak zorunda kalmıştı.

SpaceX, devasa birinci kademe güçlendiricisini Teksas'ın güneyinde yer alan Starbase tesisindeki fırlatma rampasına pazartesi günü taşıdı.

Super Heavy diye bilinen 33 motorlu roket, daha sonra Starship'in 6 motorlu ikinci kademesiyle birleştirilecek. Tamamen birleştirildiğinde Starship, bugüne kadar uçurulan en büyük ve en güçlü roket olacak.

Yaklaşan Starship uçuşu, programın bugüne kadarki en iddialı görevi olacak. Bu görevde, ikinci aşama roketin 10 saatlik bir uçuşla yörüngeye gönderilmesi ve Dünya'nın etrafında 6 tur attıktan sonra Büyük Okyanus'un Şili açıklarındaki kısmına inmesi hedefleniyor.

Bu uçuş denemesi aynı zamanda SpaceX'in yeni nesil Starlink V3 uydularını alçak Dünya yörüngesine yerleştiren ilk görev olacak.

Bunlar, yörüngede 11 binden fazla Starlink uydusuyla halihazırda dünyanın en büyük yapay uydu ağı olan uzay internet ağının bir sonraki parçasını oluşturacak.

Musk, pazartesi günü X'te paylaştığı gönderide, "Yörüngeye 7 gün içinde yapılacak ilk Starship fırlatması, operasyonel kullanım amaçlı Starlink V3 uydularını taşıyacak" diye yazdı.

Temmuzdaki en son Starship fırlatmasında roket, test amaçlı 20 adet Starlink V3 uydusunu yörüngeye yerleştirme hedefini tamamladıktan sonra Hint Okyanusu'na başarıyla iniş yapmıştı.

Bu görevde Starship'in üst kademesi ilk kez bir yörünge altı uçuştan patlamadan geri dönmüş ve SpaceX, uçuş denemesi hakkında değerli veriler elde etmeyi başarmıştı.

frgthyju
SpaceX mühendisleri, temmuzda gerçekleştirilen uçuş denemesinin ardından 27 Ağustos 2026'da Hint Okyanusu'ndaki Christmas Adası açıklarında bulunan Starship'i inceliyor (SpaceX)

SpaceX, roketin her iki kademesini de tamamen ve hızlıca yeniden kullanılacak şekilde tasarladığından, bunların başarıyla suya inmesini sağlamak, son uçuşun en önemli sınavlarından biri olacak.

SpaceX'in "roketçiliğin kutsal kasesi" diye tanımladığı bu hedefe ulaşmak, gelecek yıl yapılması planlanan Artemis III görevi öncesinde Starship'in geliştirilmesini hızlandırmaya katkı sağlayacak.

14 gün sürecek görevde, NASA'nın Orion uzay aracındaki 4 astronot, alçak Dünya yörüngesindeyken Starship'le kenetlenecek.

Yörünge deneyi, 2028'de Artemis IV kapsamında gerçekleştirilecek ilk insanlı Ay inişinden önce kenetlenme mekanizmalarını ve uzay aracı arayüzlerini test etmeyi amaçlıyor.

Independent Türkçe


Yapay zeka kendini geliştirmeye başlarsa ne olacak?

Fotoğraf: Reuters
Fotoğraf: Reuters
TT

Yapay zeka kendini geliştirmeye başlarsa ne olacak?

Fotoğraf: Reuters
Fotoğraf: Reuters

OpenAI, bir gün kendi faaliyetlerini daha güvenli hale getirmek için yapay zekadan yararlanabileceğini ancak bunun için bir dizi acil değişiklik gerektiğini belirtiyor.

Şirket, "otomatik bir yapay zeka araştırmacısı" geliştirmek ve bu sistemi "hizalama sorunu" (yapay zekanın insanlığın etik değerleriyle uyumlu davranmasını sağlama güçlüğü) üzerinde çalışmak için kullanmak istediğini kamuoyuna açıkladı. OpenAI, "yapay zeka sistemleri daha yetenekli ve otonom hale geldikçe, özellikle de araştırma ve geliştirme süreçlerinin daha büyük bir kısmını yapay zeka üstlenmeye başladıkça, bu çalışmanın giderek daha önemli hale geldiğini" belirtti.

Şirketin bu yorumları, özellikle "yinelemeli kendi kendini geliştirme" (RSI) olasılığına dair endişeler bağlamında, yapay zekanın mevcut durumuna ilişkin daha kapsamlı bir açıklamanın parçası olarak geldi. Bu kavram, yapay zekanın kendisini eğitebildiği ve insan gözetimi yerine kendi çalışmaları sayesinde gelişebildiği aşamayı ifade ediyor.

OpenAI ve diğer yapay zeka şirketleri bunun geliştirme hızında muazzam bir artışa yol açabileceğini öne sürüyor. Şirket yayımladığı yeni yazıda, bu teknolojinin "insanların yaşamlarını doğrudan iyileştireceğini" ve "dünya genelindeki insanların faydalanabilmesi için gelişmiş zeka teknolojilerinin maliyetini düşürebileceğini" belirtiyor.

Ancak şirket, otomatikleştirilmiş araştırmaların tehlikeli yapay zekaya karşı mücadelede de yardımcı olabileceğini ifade etti. OpenAI, "Otomatikleştirilmiş araştırmalar, hizalamayı önemli ölçüde iyileştirmemize ve giderek daha yetenekli hale gelen yapay zekaya karşı savunma mekanizmaları oluşturmamıza yardımcı olabilir zira otomatik bir yapay zeka araştırmacısı, aynı zamanda otomatik bir yapay zeka güvenliği araştırmacısı da olabilir" diye yazdı.

Bununla birlikte şirket, böyle bir gelişmenin tehlikeli olabileceğini ve güvenli biçimde gerçekleştirilebileceği zamana kadar hayata geçirilmemesi gerektiğini belirtti.

Şirket şu uyarıda bulunuyor:

Gerekli özen ve dikkat gösterilmeden gerçekleştirilmesi halinde RSI, insanların yapay zeka geliştirme süreci üzerindeki fiili kontrolünü kaybetmesine ve artık anlayamadıkları araştırma süreçlerini denetleyemez hale gelmesine yol açabilir. Bundan sonra yapay zeka daha tehlikeli, insan değerleriyle daha az uyumlu ve genel anlamda insanlar için bir tehdit unsuru haline gelebilir.

Şirket bu durumun yaşanmasını önlemek ve yapay zekanın kendi üzerinde çalışmasına olanak tanıyacak güvenliği sağlamak amacıyla bir dizi koruyucu önlem alınması çağrısında bulundu. Özellikle iki hususun altını çizdi: Yapay zeka güvenliği ve koruyucu önlemler konusunda yeni ulusal ve uluslararası standartların oluşturulması ve risklerin daha iyi görülmesini sağlayacak yeni ölçütler ve olay bildirim protokolleri geliştirilmesi.

ABD yönetiminden "yapay zeka endüstrisi teknik açıdan en ileri noktada bulunduğu ve finans, ticaret, savunma, teknolojiyle bilgi sistemleri gibi kritik alanlarda küresel ağlarda hâlâ ayrıcalıklı bir konumda bulunduğu" gerekçesiyle bu çalışmalara öncülük etmesi istendi.

Son haftalarda aralarında CEO Sam Altman'ın da bulunduğu OpenAI çalışanları, Anthropic gibi diğer önde gelen araştırma şirketlerinin, yapay zekanın geliştirilmesini yavaşlatma ve güvenli kalmasını sağlayacak yeni düzenlemeler getirme çağrılarına destek verdi. Ancak ABD yönetimi bu çağrıları açıkça reddetti. Başkan Donald Trump, sözkonusu adımların ABD'yi geride bırakacağını ve Çin'in bu teknolojinin geliştirilmesinde liderliği ele geçirmesine olanak tanıyacağını öne sürdü.

Independent Türkçe


ChatGPT artık diğer sitelerde ne yaptığınızı biliyor

17 Eylül 2026'da Kaliforniya'nın San Francisco kentindeki Dreamforce 2026 teknoloji zirvesinde, Moscone Center'daki OpenAI standını ziyaret edenler (Reuters)
17 Eylül 2026'da Kaliforniya'nın San Francisco kentindeki Dreamforce 2026 teknoloji zirvesinde, Moscone Center'daki OpenAI standını ziyaret edenler (Reuters)
TT

ChatGPT artık diğer sitelerde ne yaptığınızı biliyor

17 Eylül 2026'da Kaliforniya'nın San Francisco kentindeki Dreamforce 2026 teknoloji zirvesinde, Moscone Center'daki OpenAI standını ziyaret edenler (Reuters)
17 Eylül 2026'da Kaliforniya'nın San Francisco kentindeki Dreamforce 2026 teknoloji zirvesinde, Moscone Center'daki OpenAI standını ziyaret edenler (Reuters)

OpenAI, ChatGPT'ye kullanıcıların diğer internet sitelerindeki etkinliklerini izleme olanağı tanıyan bir "analitik çerezi" ekledi.

Siber güvenlik araştırmacısı Buchodi, bu izleme mekanizmasını binlerce internet sitesinde aylar boyunca inceledi ve bir satıcının sitesinde aranan, görüntülenen veya satın alınan her şeyin kullanıcının ChatGPT hesabıyla ilişkilendirilebildiğini ortaya çıkardı.

Çerezler, bir internet sitesini ziyaret ettiğinizde tarayıcınıza küçük veri parçaları yerleştirerek çalışıyor. Site daha sonra oturum açma bilgileri veya alışveriş tercihleri ​​gibi unsurları hatırlamak için bu çerezleri okuyabilir.

Reklamverenler, daha alakalı reklamlar sunabilmek amacıyla kişilerin çevrimiçi ortamdaki faaliyetlerini izlemek için sıklıkla çerezlerden yararlanıyor.

ChatGPT'de ortaya çıkarılan bu sisteme benzer reklam izleme yöntemleri Google ve Meta gibi diğer teknoloji şirketleri tarafından da sıklıkla kullanılıyor. Ancak Buchodi bunun bir yapay zeka uygulamasında ilk kez görüldüğünü belirtti.

Buchodi, blog yazısında reklam izleme yazılımını analiz ederken, "Bu mekanizma standart bir reklam teknolojisi uygulaması. Ancak daha önce örneği görülmemiş olan, bu sistemin bir yapay zeka sohbet ürününde çalıştırılması" ifadelerini kullandı.

İnsanlar bu ürünlere, sosyal ağlarda paylaşmayacakları türden şeyler anlatıyor ve bu ürünler giderek artan bir şekilde onlar adına hareket ediyor.

OpenAI, ChatGPT'de reklam testlerine ilk olarak bu yıl ABD'deki kullanıcılarla başlamış, daha sonra pilot reklam uygulamasını Birleşik Krallık, Meksika, Brezilya, Japonya ve Güney Kore'ye genişletmişti.

Çerezin işlevine rağmen OpenAI, "__obi" diye bilinen bu izleyiciyi çerez politikasının "Pazarlama" bölümünde değil, "Analitik" bölümünde sınıflandırıyor.

Politikada, "Bu çerezler kullanıcı sayısı ve kullanıcıların Hizmetlerimizle nasıl etkileşime girdiği gibi konularda, Hizmetlerimizin nasıl performans gösterdiğini ve nasıl kullanıldığını anlamamıza yardımcı olur" ifadesi yer alıyor.

Buchodi şirketle iletişime geçtiğinde, OpenAI Destek ekibi, bulguların incelenmesi için ilgili şirket birimleriyle paylaşılacağını söyledi.

İzleme mekanizması Android için Chrome tarayıcısında gözlemlendi ve yalnızca ChatGPT'nin ücretsiz sürümlerinde mevcut gibi görünüyor.

The Independent, sözkonusu çerez hakkında daha fazla bilgi ve yorum almak için OpenAI'yla iletişime geçti.

Independent Türkçe