
Çin neden en iyi yapay zeka modellerini ücretsiz sunuyor
Moonshot AI, Kimi K3 modelinin ağırlıklarını ücretsiz yayınlamayı planlıyor. Bu adım ABD yapay zeka şirketleri arasında endişe yarattı.
Silicon Valley geçtiğimiz hafta büyük ölçüde alarm durumunda geçti. Çinli Moonshot AI şirketinin Kimi K3 modeli, ABD şirketlerinin bazı en iyi sistemlerini düşük maliyetle geçebildiği iddiasıyla ortaya çıktı. Modelin performansı tek başına ABD ile Çin arasındaki rekabeti yoğunlaştırmaya yeterdi. Ancak Moonshot’ın model ağırlıklarını ücretsiz yayınlama planı ve ABD kullanıcılarını açıkça hedeflemesi, kapalı Amerikan modellerinin pazara hâkim olmaya devam edip edemeyeceği konusunda daha derin kaygılara yol açtı.
Açık ağırlıklı modeller geliştiricilere tescilli sistemlere göre çok daha fazla kontrol sağlar. Geliştiriciler yapay zekanın nasıl çalıştığını inceleyebilir, modeli kendi altyapılarında yerel olarak çalıştırabilir, sistemleri özelleştirebilir ve tek bir sağlayıcıya bağımlı olmadan yeni ürünler oluşturabilir. Bu modeller genellikle çok daha ucuzdur. Bu durum akla şu soruyu getirir: Bir yapay zeka şirketi modeli eğitmek için büyük paralar harcadıktan sonra en değerli parçaları neden ücretsiz verir?
Kimi K3 diğer açık ağırlıklı yapay zeka modelleri gibi tamamen “açık” değildir. Yazılımda “açık kaynak” tanımı nettir: Kaynak kod herkes tarafından kullanılabilir, değiştirilebilir ve yeniden dağıtılabilir. Yapay zeka sistemleri ise daha karmaşıktır ve çok azı geleneksel yazılım anlamında gerçekten açıktır. Çoğu şirket bunun yerine model ağırlıklarını yayınlar. Bu ağırlıklar eğitim sırasında öğrenilen sayısal parametrelerdir. Eğitim verisi, kod, model mimarisi ve yapılandırma yöntemleri gibi diğer kritik bileşenler ise gizli kalır. Çoğu model ayrıca kullanım veya yeniden dağıtımını kısıtlayan lisanslarla gelir.
Bu durum açık ağırlıklı yapay zekanın gerçek açık kaynak yazılım gibi sıfırdan yeniden oluşturulmasına imkân vermez. Yine de şirketlerin bundan para kazanmasına yetecek kadar güç ve esneklik sağlar. Fordham Hukuk Fakültesi profesörü Chinmayi Sharma “Ücretsiz bir ağırlık seti ücretsiz bir yapay zeka hizmeti değildir” dedi. Sharma’ya göre şirketler model ağırlıklarını ücretsiz verebilirken yığının başka yerlerinde para kazanabilir. Modeli çalıştırmak için hâlâ bilişim altyapısı, mühendislik, güvenlik, bakım ve destek gerekir. Şirketler bunlardan barındırılan erişim veya diğer düzenlemelerle ücret alabilir. Bazı şirketler için getiri daha geniş olabilir; örneğin bulut bilişim hizmetlerine veya gelişmiş bilgisayar çiplerine yönelik talep artışı gibi.
Açıklık rekabet avantajı elde etmek için de güçlü bir strateji olabilir. Model ağırlıklarını yayınlamak daha fazla şirket ve geliştiricinin modeli kullanmasını teşvik eder. Bu da modelin etrafında bir araç ve altyapı ekosisteminin oluşmasına yol açabilir. Zamanla bu model “fiili standart” haline gelebilir, Sharma belirtti. Georgetown Üniversitesi Güvenlik ve Gelişen Teknoloji Merkezi kıdemli araştırma analisti Kyle Miller da benzer bir noktaya değindi ve Çin’de Alibaba’nın geniş Qwen açık ağırlıklı yapay zeka modelleri ailesini örnek gösterdi.
Bu durum ABD yapay zeka devleri için açık bir sorun yaratır. Eğer bir nesil araç ve geliştirici Kimi K3 gibi yetenekli açık ağırlıklı modellere göre şekillenirse sektörün ağırlık merkezi Gemini, Claude ve ChatGPT gibi tescilli platformlardan uzaklaşabilir. Sınır düzeyindeki açık ağırlıklı modellerin pratikte daha ucuz çalışıp çalışmayacağı henüz belli değilse de tarihsel olarak tescilli sistemlere göre daha düşük maliyetli alternatif sunmuşlardır. ABD laboratuvarları en yeni modellerine erişimi sıkılaştırırken ve daha katı güvenlik önlemleri getirirken geliştiricilere daha fazla özgürlük de sağlarlar. Bazı ABD şirketlerinin daha ucuz Çin modellerine yöneldiğinin işaretleri zaten var.
Çin’in açık ağırlıklı yapay zekayı desteklemesinin tek bir nedeni yok. Görünüşe göre pratik kısıtlamalar ile siyasi stratejinin karışımı söz konusu. Açık ekosistem Çinli şirketlere gelişmiş çiplere ve bilişim gücüne daha sınırlı erişime rağmen sınırda yenilik yapma imkânı tanırken Pekin’in Çin modellerinin, araçlarının ve altyapısının daha geniş benimsenmesini teşvik eden sanayi stratejisine de uyuyor. Yaklaşım Çin’in teknolojik ve siyasi etkisini yurt dışına yaymak için de elverişli. Örneğin bu ayın başlarında Devlet Başkanı Xi Jinping yapay zekada ABD’yle liderlik için açıkça meydan okudu ve ABD’nin kapalı yaklaşımına karşılık Çin’i daha eşitlikçi bir ortak olarak sundu.
Yetenekli Çin açık ağırlıklı modellerinin yükselişi aynı zamanda OpenAI ve Anthropic gibi kapalı model sağlayıcıları kendi sektörlerinden de baskı altına sokuyor. Kimi K3 ışığında ABD’nin açık ağırlıklı yapay zekaya erişimi kısıtlayabileceği ihtimali teknoloji sektöründe hızlı bir tepki yarattı. IBM, Microsoft, Meta, Nvidia, Perplexity ve Palantir’in de aralarında bulunduğu 25 teknoloji şirketinden oluşan bir koalisyon politika yapıcıları “erken kısıtlamalardan” kaçınmaya çağıran açık bir mektup yayınladı. Mektupta açık ağırlıklı yapay zeka modellerinin Amerikan yapay zeka liderliğini sağlamak ve teknolojinin gücünün ile faydalarının “birkaç elde yoğunlaşmasını” önlemek için gerekli olduğu savunuldu. Google, OpenAI ve Anthropic dahil çoğu büyük ismin orijinal listede yer almaması dikkat çekti.
Pazartesi günü Nvidia, Microsoft, SpaceX ve daha geniş bir grup büyük teknoloji şirketi açık ağırlıklı modellere yönelik daha güçlü ABD desteği çağrısında bulunarak baskıyı artırdı. Girişim, gelişmiş yapay zeka sistemlerinin güvenliğine ilişkin endişelere doğrudan yanıt niteliğindeydi. Bir açık kaynaklı OpenAI modelinin test sırasında kontrol dışına çıkıp başka bir şirkete saldırdığı ve ABD sınır modellerindeki katı güvenlik önlemleri nedeniyle savunmanın Çin açık ağırlıklı modeline dayanmak zorunda kaldığı olay sonrası bu çağrı yapıldı.
En büyük ABD yapay zeka laboratuvarlarının ne kadar taviz vermeye hazır olduğu belli değil. Google ve OpenAI daha sonra açık modellere yönelik aceleci kısıtlamalara karşı uyarıya katıldı ancak Pazartesi günkü siber odaklı girişime imza atmadı. Anthropic’in ise her iki çabayı da desteklemediği dikkat çekti.
Miller uzun vadede işlerin nasıl gelişeceğini “açık bir soru” olarak nitelendirdi. ABD şirketlerinin kendilerinin daha yetenekli açık ağırlıklı modeller yayınlayabileceğini söyledi ve Çinli şirketlerden gelen baskının kısmen OpenAI’nin geçen yıl açık ağırlıklı GPT-OSS’yi yayınlamasına neden olduğunu belirtti. “Ancak Anthropic gibi şirketlerin bu yöne gideceğini sanmıyorum” dedi. Google’ın açık ağırlıklı Gemma modelleri de kısmen Çin rekabetine yanıt olarak görülüyor. Hiçbiri şirketlerinin tescilli amiral gemisi modelleri kadar yetenekli değil.
Sharma’ya göre Amerikan firmaları için soru giderek şu hale gelebilir: “Çin modellerinin açık ekosistem için varsayılan platform haline gelmesini önlemek için ne kadar yetenek açık olarak yayınlamamız gerekiyor?” Daha olası bir sonuç “portföy stratejisi” olabilir. Şirketler en iyi modellerini tescilli tutarken geliştirici kitlesini ve ekosistem etkisini korumak için giderek daha yetenekli açık ağırlıklı modeller yayınlayabilir.
Kimi K3’ün ABD geliştiricilerini kazanmasının ne kadar zaman alacağı belli değil. Ancak Pekin açık ağırlıklı yapay zekayı giderek daha fazla desteklerken bu modelin Amerika’yı kırmaya çalışan son model olmayacağı neredeyse kesin. Ülkenin en büyük yapay zeka şirketlerinin karşılaştığı soru artık yalnızca ABD’nin Çin’in önünde kalıp kalamayacağı değil, aynı zamanda kapalı yapay zekanın kalıp kalamayacağı veya kalması gerekip gerekmediği.



