Beş yapay zekâ asistanı mobilyada aynı üç markayı öneriyor, bu uzlaşma ne anlama geliyor?
Kaynak:Perihan Önal
Beş yapay zekâ asistanı mobilyada aynı üç markayı öneriyor, bu uzlaşma ne anlama geliyor?
“Hangi mobilya markasını almalıyım?” sorusunu ChatGPT, Gemini, Claude, Grok ve Perplexity'ye ayrı ayrı sorduğunuzda beş farklı liste beklersiniz. Ölçüm bunun tersini söylüyor. Herm.io'nun 746 yanıt üzerinde yaptığı çalışmada İstikbal, Bellona ve Doğtaş yanıtların yaklaşık yarısında ve beş asistanın tamamında göründü. Hiçbir model listenin başındaki ismi değiştirmedi.
Uzlaşma yalnızca ilk sıralarda değil, rafın genişliğinde de var. Çalışmada 352 marka izlendi ve bunların yalnızca 28'i sıralamaya girecek kadar sık anıldı. Doğtaş ile onu izleyen Kelebek arasında 23,5 puanlık bir boşluk açıldı. Yani asistanlar sadece aynı isimleri söylemiyor, aynı yerde de susuyor.
Üç ismin arası çok yakın, sıralamayı ayıran şey küçük bir ayrıntı
İlk üçü birbirinden ayıran fark 6,7 puan. AI Görünürlük Skorunda İstikbal 96,78, Bellona 94,36 ve Doğtaş 90,12 aldı. İlginç olan şu: en sık anılan marka aslında Bellona, yanıtların yüzde 50,5'inde adı geçiyor. İstikbal'i bir adım öne taşıyan şey anılma sıklığı değil, yanıt içinde genellikle daha erken geçmesi. Bir asistan üç marka sayıyorsa okurun aklında kalan isim çoğu zaman ilk söylenen oluyor.
Sıra | Marka | AI Görünürlük Skoru |
1 | İstikbal | 96,78 |
2 | Bellona | 94,36 |
3 | Doğtaş | 90,12 |
4 | Kelebek | 66,62 |
5 | IKEA | 58,73 |
6 | Gündoğdu | 56,24 |
7 | Vivense | 55,87 |
8 | Enza | 55,62 |
9 | Koçtaş | 55,22 |
10 | Trendyol | 54,64 |
Tabloda Vivense, Koçtaş ve Trendyol gibi satış noktalarının üretici markalarla yan yana durması şaşırtıcı gelebilir. Bunun nedeni, asistanların önüne koyduğu rafın da böyle karışık olması: alışverişçi öneri istediğinde karşısına hem üretici hem pazaryeri çıkıyor.
Asistanlar ilk sıralarda değil, listenin uzunluğunda ayrışıyor
Modeller arasındaki gerçek fark hangi markayı başa koyduklarında değil, kaç isim saydıklarında ortaya çıkıyor. Grok yanıt başına yaklaşık on, Perplexity yaklaşık dokuz marka adı verdi. Claude ve ChatGPT tarafında test edilen modeller çok daha seçici davrandı ve yaklaşık dört isimle yetindi.
Bunun okur için pratik sonucu şu: büyük üçlünün dışındaki bir markanın adının geçip geçmemesi, büyük ölçüde soruyu hangi asistana sorduğunuza bağlı. Gündoğdu, Enza veya Modalife gibi isimler geniş yanıt veren modellerde görünür hale geliyor, kısa yanıt veren modellerde çoğu zaman hiç çıkmıyor. Tek bir asistanla yapılan bir araştırma bu yüzden rafın tamamını göstermiyor.
Beş modelin hemfikir olması neyi kanıtlar
Uzlaşma sezgisel olarak güçlü bir onay gibi görünür. Beş ayrı sistem aynı ismi söylüyorsa, birbirinden bağımsız beş görüşün birleştiği hissedilir. Ölçüm bu okumayı desteklemiyor. Yanıtların yüzde 98,4'ü internet aramasına dayanıyor, yani modeller büyük ölçüde aynı kamuya açık kaynak havuzundan besleniyor. Aynı havuzdan beslenen beş sistemin aynı sonuca varması beş bağımsız doğrulama değil, tek bir bilgi tabanının beş kez okunmasıdır.
Bu yüzden yapay zekada en çok önerilen mobilya markaları ölçümü bir bulunabilirlik haritası olarak okunmalı. Yüksek bir skor, o marka hakkında çok sayıda güncel ve erişilebilir bilgi bulunduğunu gösterir. Ürünün dayanıklılığı, fiyat performansı veya satış sonrası hizmeti hakkında hiçbir şey söylemez. Herm.io da raporunda bu ayrımı açıkça koruyor: ölçülen şey markanın ne kadar kolay bulunduğu, ne kadar iyi olduğu değil.
Ölçümün sınırlarını da not etmek gerekiyor. Her asistanın belirli bir sürümü kullanıldı ve sabit 30 soruluk bir set soruldu, her soru her modele beşer kez yöneltildi. Farklı bir soru seti veya modellerin daha büyük sürümleri sıralamayı bire bir aynı üretmeyebilir. Çalışma çeyreklik olarak tekrarlanacağı için bu tablo sabit bir fotoğraf değil.
Soruya “Türk markası” demeyi bıraktığınızda liste değişiyor mu
Menşe kısıtı kaldırıldığında bile raf büyük ölçüde yerli kaldı. Köken belirtmeyen sorularda yanıtların yüzde 88,4'ü bir Türk markasının, yüzde 34,8'i bir yabancı markanın adını verdi. Eşiği geçebilen yabancı marka sayısı ikide kaldı: IKEA ve Roche Bobois. IKEA genel kesitte beşinci sırada duruyor. Yani asistanların üzerinde uzlaştığı isimler, sorunun kurulma biçimine karşı görece dayanıklı.
Bu tabloyu alışveriş kararında nasıl kullanmalı
Uzlaşma bir kısa yol sunuyor, ama yanlış okunmaya da açık. Listeyi kararın kendisi değil, aramanın başlangıcı olarak kullanmak daha sağlıklı.
- Tek asistana bakmayın. Kısa yanıt veren bir modelde çıkmayan marka kötü marka değil, az görünen markadır.
- Liste yerine gerekçe isteyin. Asistana neye göre önerdiğini sorduğunuzda, yanıtın ne kadarının gerçek karşılaştırmaya dayandığı ortaya çıkar.
- İhtiyacınızı daraltarak sorun. Genel bir mobilya sorusu ile küçük bir daire için yatak odası takımı sorusu farklı isimler getirir.
- İlk üçün dışına bakın. İzlenen 352 markanın 324'ü sıralamaya girecek sıklıkta anılmadı, aradığınız ürünü yapan üretici bu grupta olabilir.
- Adı geçen markanın fiyat ve özellik bilgisini markanın kendi sitesinden ve satıcıdan doğrulayın.
Mobilyada asistanların aynı ağızdan konuşması okura kolaylıktan çok bir uyarı veriyor. Beş sistemin aynı üç ismi söylemesi seçeneklerin üçe indiği anlamına gelmiyor, yalnızca dijital olarak en görünür üç ismin bunlar olduğunu gösteriyor. Yapay zekâya sormak arama süresini kısaltır, kararın sorumluluğunu üstlenmez.