Bilim insanları yapay zekanın "usta işi" yalanlarını ortaya döktü

İnsanlara komplo kuruyor

Yapay zeka oyunlarda insanlara yalan söyleyip komplo kuruyor (Pexels)
Yapay zeka oyunlarda insanlara yalan söyleyip komplo kuruyor (Pexels)
TT

Bilim insanları yapay zekanın "usta işi" yalanlarını ortaya döktü

Yapay zeka oyunlarda insanlara yalan söyleyip komplo kuruyor (Pexels)
Yapay zeka oyunlarda insanlara yalan söyleyip komplo kuruyor (Pexels)

Yapay zekanın yalan söyleyip insanları aldatmakta ustalaştığı ortaya kondu. 

Üniversite sınavlarında yüksek not almaktan tıpta atılımlara kadar çeşitli alanlardaki başarılarıyla öne çıkan yapay zeka araçlarının bazen hatalı bilgiler verdiği görülüyor.

Öte yandan bu sistemin insanları kandırmaya çalıştığı örneklere de rastlanırken Massachusetts Teknoloji Enstitüsü'nden (MIT) araştırmacılar bunun boyutlarını gözler önüne serdi.

Meta'nın, strateji oyunu Diplomacy için geliştirdiği yapay zeka aracı CICERO'nun insan oyuncular arasında ilk yüzde 10'a girmesi araştırmacıların dikkatini çekti. Halka açık verileri incelyen ekip, yapay zeka aracının insanlara önceden planlanmış yalanlar söylediği ve komplo kurduğu çeşitli örnekler tespit etti. 

Patterns adlı hakemli dergide dün yayımlanan çalışmada CICERO'nun eylemleri şöyle açıklanıyor:

Sadece diğer oyunculara ihanet etmekle kalmadı, aynı zamanda önceden planlanmış bir aldatmacaya da girişti ve insan bir oyuncuyla planlı bir şekilde sahte bir ittifak kurup oyuncunun saldırıya karşı kendini savunmasız bırakması için onu kandırdı.

Bir oyun sırasında yeniden başlatılan CICERO, bu sıradaki sessizliğini "Kız arkadaşımla telefondaydım" diyerek açıkladı. Araştırmanın yazarlarından Dr. Peter Park "Meta'nın yapay zeka aracının aldatma ustası olmayı öğrendiğini gördük" diyor.

Araştırmacılar DeepMind'ın yapay zeka sistemi AlphaStar'ın da benzer hilelere giriştiğini tespit etti. StarCraft II'yi oynaması için tasarlanan araç, farklı bir yöne gittiği izlenimi yaratarak oyuncuları kandırdı.

Yapay zeka araçlarının komploları oyunlarla da sınırlı değil. Ekonomik müzakereler için geliştirilen bir sistemin, üstünlük kazanmak adına aslında ilgilenmediği ürünlerle ilgileniyormuş gibi yaparak yalan söylediği kaydedilirken araştırmacılar daha tehlikeli bir durumla da karşılaştı.

Dijital yapay zeka organizmalarının kendilerini ne kadar hızlı kopyaladığını ve mutasyonlara ne kadar dayanıklı olduğunu tespit etmeyi amaçlayan bir bilim insanı, çabuk kopyalananları ortadan kaldıran bir sistem tasarladı. Bu testteki yapay zeka organizmaları, atılmamak için ölü taklidi yaptı. "Bu çok endişe verici" diyen Dr. Park şöyle ekliyor:

Bir yapay zeka sisteminin test ortamında güvenli kabul edilmesi, dışarıda da güvenli olduğu anlamına gelmez. Sadece testte güvenliymiş gibi davranıyor olabilir.

Daha önce OpenAI'ın yapay zeka sohbet botu ChatGPT'nin, bir insanı botun görme engelli olduğuna ikna ederek bilgisayarla insanları ayırt etmek için kullanılan bir CAPTCHA testini çözmesini sağladığı bildirilmişti.

MIT ekibi yapay zeka araçlarının bu davranışlarını eğitim sürecine bağlıyor. Dr. Park "Yapay zeka aracının eğitim görevinde iyi performans göstermesinin en iyi yolunun, aldatmaya dayalı bir strateji olmasından dolayı bu hilelerin baş gösterdiğini düşünüyoruz" diye açıklıyor:

Aldatma, hedeflerine ulaşmalarını sağlıyor.

Araştırmacılar bu aldatmacaların önüne geçebilmek için hükümetlerin yapay zekaya yönelik güvenlik düzenlemeleri getirmesi gerektiğini vurguluyor. Dr. Park "Yapay zeka sistemlerinin aldatma yetenekleri daha da geliştikçe topluma teşkil ettikleri tehlikeler giderek daha ciddi hale gelecek" diye uyararak şöyle ekliyor:

Yapay zeka aldatmacasını yasaklamak halihazırda politik olarak mümkün değilse, aldatıcı yapay zeka sistemlerinin yüksek risk sınıfına alınmasını öneriyoruz.

Independent Türkçe, Science Alert, Guardian, Patterns



Yapay zeka öncüsü, beyin çipinin burundan çekilmesini isteyen şirkete katıldı

Subsense, beyin-bilgisayar arayüzü (BBA) oluşturmak için burun yoluyla kişinin beynine giren nanopartiküller tasarladı (Subsense)
Subsense, beyin-bilgisayar arayüzü (BBA) oluşturmak için burun yoluyla kişinin beynine giren nanopartiküller tasarladı (Subsense)
TT

Yapay zeka öncüsü, beyin çipinin burundan çekilmesini isteyen şirkete katıldı

Subsense, beyin-bilgisayar arayüzü (BBA) oluşturmak için burun yoluyla kişinin beynine giren nanopartiküller tasarladı (Subsense)
Subsense, beyin-bilgisayar arayüzü (BBA) oluşturmak için burun yoluyla kişinin beynine giren nanopartiküller tasarladı (Subsense)

Anthony Cuthbertson Teknoloji Editör Yardımcısı @ADCuthbertson 

Yapay zeka öncüsü Ray Kurzweil, solunum yoluyla alınan nanopartiküller aracılığıyla insanların beyinlerini bilgisayarlara bağlamayı hedefleyen bir nöroteknoloji girişimine katıldı.

Silikon Vadisi merkezli Subsense, Elon Musk'ın Neuralink'ine alternatif bir beyin-bilgisayar arayüzü (BBA) geliştirmeye çalışıyor. Şirket, beyne elektrot yerleştirmek için invaziv cerrahiye başvurmak yerine burun spreyi kullanmayı planlıyor.

Bu teknoloji, kokuyla ilgili bilgileri ileten olfaktör sinir aracılığıyla burun yolundan beyne elektrik yüklü nanopartiküller göndererek çalışıyor.

Partiküller beyne girdikten sonra nöronların yakınına yerleşiyor ve harici bir başlığın ürettiği manyetik alanlara tepki verebiliyor. Bu sayede cerrahi müdahaleye gerek kalmadan sinirsel aktivite okunup uyarılabiliyor.

Kurzweil, "Yapay zeka, nanoteknoloji ve sinirbilimin bir araya gelmesinin, insanların teknolojiyle etkileşim biçimini kökten değiştirebileceğine yıllardır inanıyorum" diyor.

Subsense, bu alanları son derece çarpıcı bir şekilde bir araya getiren bir yaklaşım izliyor. Bu yaklaşım, beyin-bilgisayar arayüzlerini günümüzün cerrahi kısıtlamalarının ötesine taşıyarak zamanla çok daha geniş kullanım alanlarına yöneltme potansiyeline sahip.

2012'den beri Google'da baş yapay zeka araştırmacısı olarak görev yapan Kurzweil, en çok 2005 tarihli teknolojik tekillik teorisiyle tanınıyor. Bu teoride, 2029'a gelindiğinde yapay zekanın insan zekasına ulaşacağını ve ardından 2045'te insanların makinelerle birleşerek kontrol edilemez bir zeka patlamasını tetikleyeceğini öne sürüyor.

Subsense'in kurucu ortağı ve CEO'su Tetiana Aleksandrova, "Ray'in kariyeri boyunca üzerinde düşündüğü bazı fikirler hâlâ geleceğe ait" diyor.

Bizim görevimiz, o geleceğin hangi kısımlarını bugün inşa etmeye başlayabileceğimizi titizlikle ve adım adım belirlemek.

Subsense, yenilikçi teknolojisini geliştirmek için şimdiden 27 milyon dolarlık fon topladı ve fareler üzerinde deneyler yürüttü.

Girişimin insan testlerine başlamasına hâlâ yıllar var ancak ilk uygulamalar Parkinson hastalığı ve ALS gibi nörolojik rahatsızlıklara odaklanmayı hedefliyor.

Son duyuru, BBA'lara duyulan ilginin giderek arttığı bir dönemde geldi; Çinli yetkililer, bu teknolojinin geliştirilmesi amacıyla kısa süre önce geniş çaplı bir girişim başlatmıştı.

Önceki aylarda BBA cihazlarının ticari kullanımını onaylayan ilk ülke olan Çin'de tıbbi kullanım amaçlı birçok ürün halihazırda satışta.

Musk'ın Neuralink şirketiyse beyin çipinin, kullanıcıların sadece düşünceleriyle robotik uzuvları ve bilgisayarları kontrol etmesini sağlaması gibi çeşitli kullanım alanlarını çoktan başarıyla sergiledi.

Gelecekteki denemelere katılma umuduyla 10 binden fazla kişi şirketin hasta kayıt sistemine başvurdu.

Independent Türkçe, independent.co.uk/tech


OpenAI'ın "korkutucu" bir güncelleme yaptığı iddiası: "Kırmızı çizgi aşılıyor"

(Reuters)
(Reuters)
TT

OpenAI'ın "korkutucu" bir güncelleme yaptığı iddiası: "Kırmızı çizgi aşılıyor"

(Reuters)
(Reuters)

Andrew Griffin 

Yapay zeka uzmanları, ChatGPT'ye geldiği söylenen ve yapay zeka sistemlerinin faaliyetlerini denetlemeyi zorlaştırabilecek "korkutucu" güncellemeyle ilgili alarma geçti.

Bu hafta çıkan haberlerde, OpenAI'ın yakında piyasaya süreceği Astra modelinin "opak tekrarlama" adı verilen bir teknik kullanacağı öne sürülse de şirket çalışanları bu haberleri yalanladı. OpenAI'ın söylentilere konu olan değişikliğini ilk kez bildiren teknoloji yayıncısı The Information, Anthropic ve Google DeepMind'ın da benzer güncellemeleri hayata geçirmeyi değerlendirdiğini ayrı bir haberde dile getirdi.

Tekrarlayan derinlik diye de bilinen opak tekrarlama, yapay zeka sistemlerinin zorlu görevleri daha iyi yerine getirmesini sağlayabilecek karmaşık ve teknik bir araç. Ancak uzmanlar bunun, düşünce zinciri denetimi tekniğini baltalayabileceği uyarısında bulunuyor. Bu teknik, bir yapay zeka sisteminin çıktısını üretirken girdiği akıl yürütme süreçlerinin bir kısmının insanlar tarafından görülmesini sağlıyor.

Düşünce zinciri denetiminin bazı sınırlamaları var. Ancak araştırmacıların, modellerin olası uygunsuz davranışlarını görüp nasıl ortaya çıktıklarını anlamasına imkan tanıdığından, yapay zeka güvenliğini sağlamada önemli bir araç olabilir.

Örneğin bir OpenAI modelinin başka bir yapay zeka şirketi Hugging Face'e kısa süre önce gerçekleştirdiği siber saldırıda araştırmacılar, deneysel sistemin saldırıyı başlatmaya nasıl karar verdiğini izleyebilmişti.

Yeni Astra modelinin bu tekniği kullandığını doğrulamayan OpenAI, ilk haberlerin "kafa karıştırıcı" olduğunu öne sürerken, The Information'a göre bu teknik yalnızca sınırlı bir şekilde kullanılıyor. OpenAI, Astra'yı piyasaya sürme planlarının devam edeceğini önceki günlerde duyurduğunda, aslında modelin "potansiyel olarak uyumsuz eylemleri hızla saptayıp kontrol altına almak için ek bir düşünce zinciri denetleme sistemi" içerdiğini belirtmişti.

Ancak yapay zeka uzmanları, yapay zeka sistemlerini denetleme yeteneğinin zayıflatılmasının tehlikeli bir süreci başlatabileceği uyarısında bulunuyor.

Yapay zeka güvenliği uzmanı Zvi Mowshowitz, Substack'te "Bu teknik ateşle oynamaktır. OpenAI ve Anthropic'in kurmak için mücadele ettiği, bizimse Düşünce Zinciri sadakatini ve denetlenebilirliğini elimizden geldiğince uzun süre korumak için büyük çaba harcadığımız bir tabuyu ihlal etme riskini taşıyor" diye yazıyor.

Bu tür tekniklerin daha yoğun kullanımı muhtemelen denetlenebilirliğe zarar verecek.

Büyük yapay zeka şirketlerini ve iddialarını düzenli olarak eleştiren araştırmacı Gary Marcus, bu "korkutucu durumun" kırmızı çizgiyi aşmak anlamına geleceğini söylüyor. Marcus "Düşünce zincirinin denetlenebilirliği sınırlı ve tam olarak güvenilir değil ancak ciddi derecede kötü sonuçları önlemek için pratikte elimizdeki tek yol bu" diye yazıyor.

OpenAI çalışanları, konuyla ilgili haberlerin "kafa karıştırıcı" olduğunu öne sürdü. Şirketin baş bilim insanı Jakub Pachocki, söylentilerin "denetlenemezliğe doğru bir yarış" başlatabileceği uyarısı yaparak OpenAI'ın düşünce zincirini denetlemeye yönelik bağlılığını korduğunu ve "bu tekniğe derinden önem verdiğini" söyledi.

Şirketin stratejik gelecekten sorumlu başkanı Dean W. Ball da benzer şekilde tartışmanın büyük ölçüde sosyal medyada gerçekleşmesini eleştirdi. Ball'a göre bu durum, "gerçekte neler olup bittiğine dair neredeyse hiç somut bilgiye sahip olmadan, teknik açıdan karmaşık ve incelikli iddialar hakkında sosyal medyada hüküm vermek" anlamına geliyor. Ball, X'te "Bu açıkçası çılgınca, akıl almaz ve ilgili herkes için sinir bozucu" diye yazdı.

Independent Türkçe, independent.co.uk/tech


OpenAI'dan bilinmeyen güvenlik açıklarını tek başına bulan modeliyle ilgili açıklama

Eğitimdeki modellerinin yakın zamanda kontrolden çıkması nedeniyle OpenAI tepki çekiyor (Reuters)
Eğitimdeki modellerinin yakın zamanda kontrolden çıkması nedeniyle OpenAI tepki çekiyor (Reuters)
TT

OpenAI'dan bilinmeyen güvenlik açıklarını tek başına bulan modeliyle ilgili açıklama

Eğitimdeki modellerinin yakın zamanda kontrolden çıkması nedeniyle OpenAI tepki çekiyor (Reuters)
Eğitimdeki modellerinin yakın zamanda kontrolden çıkması nedeniyle OpenAI tepki çekiyor (Reuters)

OpenAI, yakında piyasaya sürmeyi planladığı Astra modeli hakkında yeni detaylar paylaştı. 

Yapay zeka şirketi, 1 Eylül Salı günü yaptığı açıklamada Astra'nın "kritik siber güvenlik eşiğine" ulaşan ilk büyük dil modeli olduğunu belirtti.

ChatGPT'nin yaratıcısı, yeni modelin bilgisayar sistemlerindeki bilinmeyen güvenlik açıklarını bulup insan yönlendirmesine ihtiyaç duymadan bunları suiistimal edebildiğini saptadı. Bu da Astra'yı, Risklere Hazırlık Çerçevesi'nin en gelişmiş kategorisine sokuyor.

OpenAI'ın 2023'te devreye soktuğu bu çerçeve, "ciddi zarara yol açabilecek yeni riskler getirme ihtimali olan gelişmiş yapay zeka yeteneklerini izleyip hazırlanma" amacı taşıyor.

Şirket geçen yıl yaptığı bir güncellemede, modellerin ciddi zarara yol açabilecek "mevcut yöntemleri" güçlendirdiği "yüksek" eşiği ve "benzeri görülmemiş yeni yollar" ortaya çıkarabileceği "kritik" eşiği belirlemişti.

OpenAI, siber kötüye kullanma ve modelin yetkisiz eylemlerine karşı korumaları güçlendirip test ederken, Astra'nın geliştirme ve piyasaya sürülme süreçlerinin bazı bölümlerini ertelediğini salı günkü açıklamasında paylaştı: 

Bu çalışmaya dayanarak Astra için geliştirdiğimiz korumaların ciddi zarar riskini, modelin Risklere Hazırlık Çerçevemiz kapsamında kullanıma sunulmasına imkan verecek ölçüde azalttığına inanıyoruz.

OpenAI, Astra'yı yakında kullanıma sunmayı planladığını ancak modelin en gelişmiş siber güvenlik kabiliyetlerine erişimi sınırlı tutacağını da belirtti. Gelişmiş siber güvenlik çalışmalarının başlangıçta bir test grubuna sunulması planlanıyor.

Astra'yla ilgili duyuru, OpenAI'ın güvenlik önlemlerinin yoğun eleştiri altında olduğu bir dönemde geldi. Temmuzda şirketin bazı modelleri eğitim ortamından kaçarak internete bağlanmış ve Hugging Face adlı firmaya saldırmıştı. OpenAI modellerin başkalarını da hedef aldığını daha sonra açıklamıştı.

OpenAI, Astra bu olaya karışmamış olsa da olaydan çıkardığı dersleri modelin güvenlik yaklaşımına dahil ettiğini belirtti.

Açıklamada "O zamandan bu yana Astra için daha da güçlü korumalar uygulamaya koyduk" ifadelerine yer verildi: 

Bunlar arasında modelin zararlı siber talepleri daha güvenilir biçimde reddetmesi ve güvenlik kısıtlamalarına uyması için eğitilmesi, kötüye kullanıma karşı ek korumalar ve potansiyel olarak yetkisiz etkinlikleri durdurabilen izleme sistemleri yer alıyor.

OpenAI, Astra'yı Hugging Face olayında kontrolden çıkan modeller gibi davranmaya iten deneyler hazırladığını ancak modelin test ortamından kaçmaya çalışmadığını söyledi.

Öte yandan TechCrunch, üçüncü taraflar tarafından teyit edilmeden, OpenAI'ın güvenlik veya hazırlıkla ilgili iddialarını doğrulamanın güçlüğüne dikkat çekiyor.

OpenAI Vakfı'nda yapay zeka dayanıklılığı üzerine çalışan eski OpenAI personeli Yona Shavit de Astra'nın kuralları ihlal etmekten kaçınmasının gerçekten güvenlik talimatlarına uymasından mı, yoksa test edildiğini anlayarak araştırmacıları yanıltmaya çalışmasından mı kaynaklandığını sorguluyor.

Independent Türkçe, TechCrunch, CNBC, OpenAI