Amerika

Beyaz Saray’da ‘DeepSeek ABD modellerinden faydalandı’ iddiası

Yayınlanma

Beyaz Saray’ın danışmanları bu hafta, Çin’in DeepSeek’inin ABD’li rakiplerinin “damıtma” adı verilen ilerlemelerini arka plana attığı iddia edilen bir yöntemden faydalanmış olabileceği yönündeki “endişelerini” dile getirdi.

Silikon Vadisi’ndeki yönetici ve yatırımcı kaynaklara göre, bir yapay zeka sisteminin başka bir yapay zeka sisteminden öğrenmesini içeren bu tekniği durdurmak zor olabilir.

DeepSeek bu ay, OpenAI gibi ABD’li devlerin yeteneklerine rakip olduğu görülen, ancak çok daha düşük maliyetli yeni bir yapay zeka modeliyle teknoloji sektörünü sarstı. Ve Çin merkezli şirket kodu ücretsiz olarak dağıttı.

ABD’li bazı teknoloji uzmanları DeepSeek’in modelinin bazı kazanımları elde etmek için ABD modellerinden öğrenmiş olabileceğini söylüyor. Damıtma tekniği, daha eski, daha köklü ve güçlü bir yapay zeka modelinin daha yeni bir modelden gelen yanıtların kalitesini değerlendirmesini ve eski modelin öğrendiklerini etkili bir şekilde aktarmasını içerir.

Bu da yeni modelin, ilk modelin oluşturulmasında harcanan büyük zaman ve hesaplama gücü yatırımlarının faydalarından, ilgili maliyetler olmadan yararlanabileceği anlamına geliyor.

Çoğu akademik araştırmacının daha önce bu kelimeyi kullanma şeklinden farklı olan bu damıtma biçimi, YZ alanında kullanılan yaygın bir teknik. Bununla birlikte, OpenAI dahil olmak üzere son yıllarda ABD teknoloji şirketleri tarafından ortaya konan bazı önemli modellerin hizmet şartlarının ihlali olarak yorumlanıyor.

Reuters’e konuşan bir sözcü, ChatGPT üreticisinin Çin’de ABD YZ modellerini damıtma yoluyla çoğaltmak için aktif olarak çalışan gruplar olduğunu bildiğini ve DeepSeek’in modellerini uygunsuz bir şekilde damıtmış olup olmadığını incelediğini söyledi.

Hizmet şartlarının yasakladığı durumlarda bu tekniği kullanmayan San Francisco merkezli Databricks’in yapay zeka başkan yardımcısı Naveen Rao, rakiplerden öğrenmenin yapay zeka sektöründe “olağan bir durum” olduğunu söyledi. Rao bu durumu otomobil üreticilerinin birbirlerinin motorlarını satın alıp incelemesine benzetti.

“Tamamen adil olmak gerekirse, bu her senaryoda olur. Rekabet gerçek bir şey ve çıkarılabilir bir bilgi olduğunda, onu çıkaracak ve kazanmaya çalışacaksınız,” dedi ve ekledi: “Hepimiz iyi vatandaşlar olmaya çalışıyoruz ama aynı zamanda rekabet de ediyoruz.”

Başkan Donald Trump’ın yapay zeka teknolojisinin gelecekteki ihracat kontrollerini denetleyecek olan Ticaret Bakanı adayı Howard Lutnick, çarşamba günü ABD Senatosu’nda yapılan bir onay duruşmasında DeepSeek’in ABD yapay zeka teknolojisini kötüye kullandığının ortaya çıktığını öne sürdü ve kısıtlamalar getirme sözü verdi.

“DeepSeek’in her şeyin kontrol altında yapıldığına inanmıyorum. Bu saçmalık,” dedi Lutnick. “Kısıtlamaların peşinde koşarken ve bizi liderlikte tutmak için bu kısıtlamaları uygularken titiz olacağım” diye ekledi.

Beyaz Saray’ın yapay zeka ve kripto çarı David Sacks da salı günü Fox News’e verdiği bir röportajda DeepSeek’in damıtılmasıyla ilgili endişelerini dile getirdi.

DeepSeek iddialarla ilgili yorum talebine hemen yanıt vermedi.

OpenAI, ABD teknolojisini korumak için ABD hükümetiyle birlikte çalışacağını ekledi, ancak nasıl olduğunu detaylandırmadı.

Şirketten yapılan açıklamada, “Yapay zekanın önde gelen kurucusu olarak, fikri mülkiyet haklarımızı korumak için, piyasaya sürülen modellere hangi sınır yeteneklerinin dahil edileceğine dair dikkatli bir süreç de dahil olmak üzere karşı önlemler alıyoruz” denildi.

Çin’in teknoloji sektörünü geliştirmek için ABD ürünlerini kullanması konusunda Washington’da yaşanan son endişeler, ABD’nin Çin’e hangi çiplerin ve üretim araçlarının gönderilebileceğine dair kısıtlamalar getirdiği ve bazı açık teknolojiler üzerindeki çalışmaları kısıtlamayı incelediği yarı iletken endüstrisiyle ilgili önceki endişelere benziyor.

Teknoloji uzmanları damıtmayı engellemenin göründüğünden daha zor olabileceğini söyledi.

DeepSeek’in yeniliklerinden biri, daha büyük, daha yetenekli bir modelden alınan nispeten az sayıda veri örneğinin – bir milyondan az – daha küçük bir modelin yeteneklerini önemli ölçüde geliştirebileceğini göstermesiydi.

ChatGPT gibi popüler ürünlerin yüz milyonlarca kullanıcısı olduğunda, bu kadar küçük miktarlardaki trafiği tespit etmek zor olabilir – ve Meta Platforms’un Llama ve Fransız startup Mistral’ın teklifleri gibi bazı modeller ücretsiz olarak indirilebilir ve özel veri merkezlerinde kullanılabilir, yani hizmet şartlarının ihlallerini tespit etmek zor olabilir.

“Mistral ve Llama gibi açık kaynaklı modellere sahip olduğunuzda model damıtmayı durdurmak imkansız. Bu modellere herkes ulaşabilir. OpenAI’nin modelini de müşteriler aracılığıyla bir yerlerde bulabilirler,” diyor Thomvest Ventures’ın genel müdürü Umesh Padval.

DeepSeek bir makalede bu ay yayınladığı modellerin bazı damıtılmış versiyonları için Llama kullandığını açıkladı, ancak sürecin daha önceki aşamalarında Meta’nın modelini kullanıp kullanmadığına değinmedi. Meta sözcüsü, şirketin DeepSeek’in hizmet şartlarını ihlal ettiğine inanıp inanmadığını söylemeyi reddetti.

Çok Okunanlar

Exit mobile version