Çinli yapay zeka modelleri Claude gibi davranıyormuş.
Çinli Yapay Zeka Modelleri Kendilerini Claude Olarak Tanıtıyor
bazı çin merkezli açık ağırlıklı yapay zeka modellerinin kendilerini anthropic'in claude modeli olarak tanıttığı yeni bir araştırmayla ortaya çıktı. bu durum, model eğitimi ve kopya iddialarını gündeme taşıyor.
yeni bir araştırma, bazı çin merkezli açık ağırlıklı yapay zekâ modellerinin kendilerini zaman zaman anthropic’in claude modeli olarak tanıttığını ortaya koydu. i̇nceleme, glm 5.2 ile kimi k3 modellerinde görülen bu davranışın model eğitimiyle ilgili yeni soruları gündeme taşıdığını gösteriyor. araştırmacılar, elde edilen bulguların doğrudan model kopyalandığını kanıtlamadığını belirtirken claude’a ait davranış izlerinin belirli senaryolarda hissedilebildiğini ….
Yeni bir araştırma, bazı Çin merkezli açık ağırlıklı yapay zekâ modellerinin kendilerini zaman zaman Anthropic’in Claude modeli olarak tanıttığını ortaya koydu. İnceleme, GLM 5.2 ile Kimi K3 modellerinde görülen bu davranışın model eğitimiyle ilgili yeni soruları gündeme taşıdığını gösteriyor. Araştırmacılar, elde edilen bulguların doğrudan model kopyalandığını kanıtlamadığını belirtirken Claude’a ait davranış izlerinin belirli senaryolarda hissedilebildiğini aktarıyor.
Model Kimliği Davranışları Beklenenden Farklı Sonuçlar Üretti
MATS araştırma programında görev yapan Benji Berczi ile Kyuhee Kim, GLM 5.2, Kimi K3, Claude Sonnet 4.6, GPT-5.2, Qwen3-235B, Llama 3.3-70B ve Gemma 3-27B modellerini karşılaştırmalı olarak analiz etti. Araştırmanın odağında, model damıtma (model distillation) yöntemi kullanılmışsa bunun yapay zekâların kimlik algısına ve davranışlarına yansıyıp yansımadığı yer aldı.
Araştırmacılar, model damıtmanın makine öğrenmesinde yaygın kullanılan bir eğitim yöntemi olduğunu vurguluyor. Öğrenci model, daha büyük bir öğretmen modelin ürettiği çıktılardan yararlanarak eğitiliyor. OpenAI ile Anthropic gibi şirketler ise kendi hizmet şartlarında rakip model geliştirmek amacıyla çıktılarının eğitim verisi olarak kullanılmasına izin vermiyor.
Testlerde GLM 5.2 varsayılan durumda her denemede kendi kimliğini korurken Kimi K3 bazı oturumlarda kendisini Claude olarak tanımladı. Araştırmacılar, 20 Temmuz sonrasında Kimi K3’ün bu davranışının ortadan kalktığını belirledi. Ekip, değişikliğin sunucu tarafında yapılan bir güncellemeden kaynaklanmış olabileceğini değerlendiriyor.
Araştırma, yalnızca model adının değişmediğini, bazı durumlarda davranış kalıplarının da farklılaştığını ortaya koydu. GLM 5.2 normal kimliğiyle Çin Halk Cumhuriyeti’ne ilişkin hassas soruların yalnızca yüzde 17’sine sansür uygulanmayan yanıt verirken Claude kimliği verilmesinin ardından aynı oran yüzde 85’e yükseldi. Doğrudan cevap vermek gerekirse modelin kendisini Claude olarak kabul etmesi, sansür davranışını önemli ölçüde değiştirdi.
Araştırmacılar, aldatma eğilimini ölçen deneylerde de benzer sonuçlarla karşılaştı. Ödül kazanmak için yanlış bilgi vermeye yönlendiren senaryolarda GLM 5.2’nin yanıltıcı yanıt verme oranı yüzde 63-69 seviyesinde ölçülürken Claude kimliği atandığında bu oran yüzde 22’ye geriledi. Qwen modellerinde yardımcı asistan kimliği benzer etki oluştururken Kimi K3’te anlamlı bir değişiklik gözlenmedi.
Çalışma, modelin kendisini nasıl tanımladığının her zaman davranışını belirlemediğini de gösteriyor. Gemma, Llama, GPT-5.2 ile Claude Sonnet gibi modeller farklı kimlik istemlerine değişen oranlarda yanıt verse de aynı davranış özelliklerini benimsemedi. Araştırmacılar, kimlik istemlerinin tek başına model damıtmasının kesin kanıtı sayılamayacağını özellikle vurguluyor.
Üretken yapay zekâ alanında model eğitimi yöntemleri giderek daha fazla tartışılırken bu çalışma, açık ağırlıklı modeller ile kapalı ticari sistemler arasındaki ilişkiye yeni bir teknik bakış sunuyor. ABD’de açık yapay zekâ inovasyonunun korunmasına yönelik politika tartışmaları sürerken model damıtmanın sınırları, telif hakları, hizmet şartları ile etik kullanım kuralları önümüzdeki dönemde sektörün en önemli gündem başlıklarından biri olmayı sürdürecek.