Birleşik Krallık merkezli fintech şirketi Saturn‘ın araştırmasına göre; ana akım yapay zeka modelleri, kişisel finans sorularının %57’sine yanlış cevap veriyor. Zorluk seviyesi arttıkça hata oranı %88e kadar tırmanıyor.
Son dönemde kullanıcıların para ile ilgili sorularda chatbotlara güveni hızla artıyor.
Zor Sorular, Çoğu Modeli Çökertecek Kadar Güçlü Çıktı!
Araştırmada aralarında ChatGPT, Gemini, Claude ve Copilot‘ın da olduğu 18 ücretsiz ve ücretli modelden 121 soru için yanıt alındı. Her bir soru en fazla 5 kez tekrarlandı ve toplamda 10.000’in üzerinde cevap elde edildi.
Bir yanıtta maddi bir hata, önemli bir eksiklik ya da gerekli uyarının atlanması ‘hata’ olarak değerlendirildi.
Ücretsiz modeller, %63 hata oranı ile en başarısız olanlar. Ücretli modellerde bu oran %49a düşüyor. Ancak en zor sorularda, ücretsiz modellerin hata oranı %93 seviyesine ulaşıyor.
Sponsorlu
Sponsorlu
Akıl yürütme modunda öne çıkan Claude Opus 5 bile cevapların %39unda hata yapıyor. Hataların başında yanlış hesaplamalar, gözden kaçan vergi değişiklikleri ve aslında olmayan kurallara atıf bulunuyor.
Bazı emeklilik vergisi yanıtları, birikim sahiplerine 17.500 sterlinlik bir Birleşik Krallık Vergi Dairesi cezası riski doğurabilirdi.
Saturn CEO‘su Amal Jolly şöyle konuştu: ’Milyonlarca insan para ile ilgili tavsiyelerde AI modellerine güveniyor ama aldıkları yanlış cevaplar ceplerinden para gitmesine neden olabiliyor dedi.
Bizi Xte takip edin ve güncel gelişmeleri anında yakalayın
Chatbotlara Güven Artmaya Devam Ediyor!
Öte yandan kullanım, hem farklı piyasalara hem de yaş gruplarına yayılıyor. EYnin küresel kapsamlı anketinde 18.000 kişinin %49u, tasarruf ve yatırım kararlarında AI araçlarından yararlandığını belirtiyor.
Birleşik Krallık‘ın finansal düzenleyicisi geçen ağustosta, az deneyimli yatırımcıların beşte dördünün yatırım için AI araçlarını kullandığını açıkladı. Katılımcıların %56’sı, bu araçlara televizyon ve radyodan (%47) daha çok güvendiklerini bildirdi.
Aynı araştırmaya göre katılımcıların %44ü, AI tarafından üretilen finansal bilginin yasal olarak düzenlendiğini sanıyor.
PensionBee‘nin anketine katılan bin ABD’li yetişkinin neredeyse %60‘ı, parasal tavsiyeleri bağımsızca doğrulamadan uygulamaya hazır olduğunu söyledi. Yaklaşık dört kişiden biri ise, bir chatbot’tan finansal durumda yanlış bilgi aldığını ifade etti.
Jolly, AI tabanlı finansal danışmanlığın yasal koruma kapsamında olmadığını, tüketicilerin insan danışmanlarda olduğu gibi bir hakka sahip olmadıklarını belirtiyor. FCAnın hızlıca harekete geçmesi gerektiğini vurguluyor.

