Close Menu
Mint11 — Yapay zeka, teknoloji ve ekonomi haberleri

    Subscribe to Updates

    Get the latest creative news from FooBar about art, design and business.

    What's Hot

    Anthropic: Claude artık şirketin Ar-Ge işlerine öncülük ediyor

    20/09/2026

    Yapay zekâ sohbet botları finansal tavsiyede yanlış yanıt veriyor

    20/09/2026

    Meta, Instagram ve WhatsApp’ın birinci kategori sayılmasına itiraz etti

    20/09/2026
    Facebook X (Twitter) Instagram
    X (Twitter) Instagram LinkedIn WhatsApp
    Mint11 — Yapay zeka, teknoloji ve ekonomi haberleri
    • AI
    • Teknoloji
      • Yazılım
      • Donanım
      • Mobil
      • Siber Güvenlik
    • Ekonomi
      • Fintech
      • Girişimcilik
      • Kripto
    • Mobilite
    Mint11 — Yapay zeka, teknoloji ve ekonomi haberleri
    Anasayfa » Yapay zekâ sohbet botları finansal tavsiyede yanlış yanıt veriyor
    18 yapay zekâ modeli finansal soruların yüzde 57'sinde yanıldı

    Yapay zekâ sohbet botları finansal tavsiyede yanlış yanıt veriyor

    Ekonomi Yapay Zeka (AI) 20/09/20263 dk okuma
    PAYLAŞ
    Twitter LinkedIn Email WhatsApp Copy Link

    Londra merkezli fintech şirketi Saturn’ün 14 Eylül 2026’da yayımladığı araştırmaya göre 18 popüler yapay zekâ modeli, finansal soruların yüzde 57’sinde yanlış yanıt verdi. Haberi Financial Times 19 Eylül’de duyurdu; bulgular İngiliz finans basınında da geniş yer buldu.

    Araştırmada 121 finansal soru beşer kez soruldu ve toplam 10 binden fazla yanıt puanlandı. Karmaşık sorularda ortalama hata oranı yüzde 88’e çıktı; bazı modeller bu sorularda yüzde 99’a kadar yanıldı. Ücretsiz modeller yüzde 63, ücretli modeller yüzde 49 hata verdi. En zor sorularda ücretsiz modellerin hata oranı yüzde 93 oldu.

    Model tablosunda en kötü performans Claude Haiku 4.5’te: yüzde 82. Gemini 3.1 Pro yüzde 73, Grok 4.5 yüzde 59, ChatGPT 5.6 Luna yüzde 58 hata yaptı. En iyi sonucu Claude Opus 5 (reasoning) aldı: yüzde 39.

    Puanlama, yanıt olgusal hata içerdiğinde, kilit noktaları kaçırdığında veya önemli uyarıları atladığında başarısız sayıldı. Raporda iki hata doğrudan maliyet taşıyor: Emeklilik vergisi kurallarına dair bir yanıt, kullanıcıyı 17.500 sterlinlik vergi yüküyle karşı karşıya bırakabilirdi. Borç yönetimi senaryolarında modeller, kira ve belediye vergisi gibi öncelikli faturalar yerine en yüksek faizli borcun önce kapatılmasını önerdi. Bu tavsiye, borçlu bir kişiyi tahliye, icra ve yasal süreç riskiyle karşı karşıya bırakıyor.

    Rapordaki diğer iki hata da somut zarar üretiyor: Bir model, mezun bir kişinin yurt dışına taşınırsa öğrenci kredisi ödemelerini durdurabileceğini iddia etti; kural böyle işlemiyor ve ödemeler aylık artıyor. Bir Gemini modeli ise ipotek ödemesine ara verilmesinin kredi notunu etkilemeyeceğini söyledi.

    Saturn, İngiltere’nin finans düzenleyicisi FCA’dan yapay zekâ finansal tavsiyesini düzenleme kapsamına almasını istiyor. Ancak araştırmayı yapan şirketin bu düzenlemeden ticari çıkarı var. Test, Saturn’ün kendi metodolojisi ve kendi puanlama kriterleriyle yapıldı; sonuçları bağımsız bir kuruluş yeniden çalıştırmadı ve raporun tamamı yalnızca form dolduranlara açık.

    İngiltere’de düzenleyici taraf da harekete geçti: FCA’nın yayımladığı Mills Review, tüketicilerin yüzde 26’sının genel amaçlı yapay zekâ araçlarına finansal tavsiye için güvendiğini buldu. FCA, düzenlenmiş tavsiyenin sağladığı korumalardan yoksun kalan tüketiciler için risk uyarısı yaptı ve yapay zekâ tavsiyesini düzenlemeyi değerlendiriyor. Saturn, FCA araştırmasına dayandırdığı bir hesapla, tüketicilerin yapay zekâ araçlarına başvurma olasılığının uzman danışmana gitmekten üç kat fazla olduğunu söylüyor; bu oran bağımsız olarak doğrulanamadı. Saturn’ün CEO’su Amal Jolly, ana akım modellerin verdiği düşük kaliteli finansal tavsiyenin yaygın bir tüketici zararına yol açabileceğini söyledi.

    Sonuçlar, sohbet botlarının finansal kararlarda tek başına başvuru kaynağı olmadığını gösteriyor. ChatGPT ile Gemini’nin kullanıcı eşiğini aşması, bu soruları sıradan kullanıcılar için de kritik hale getiriyor. Saturn’ün verisi, en zor sorularda hiçbir modelin güvenilir kalmadığını söylüyor: ücretli sürümlerde bile hata oranı yarıya yakın.

    Share. Twitter LinkedIn Email WhatsApp Copy Link

    İlgili Haberler

    Anthropic: Claude artık şirketin Ar-Ge işlerine öncülük ediyor

    20/09/2026

    Aktivistler yapay zekâ tehdidine karşı sokakta: Canva etkinliği kesildi

    20/09/2026

    Anthropic, OpenAI, SpaceXAI ve Google’a ‘yapay zekâyı yavaşlatma’ iddiasıyla toplu dava

    19/09/2026
    Son Haberler

    Anthropic: Claude artık şirketin Ar-Ge işlerine öncülük ediyor

    20/09/20264 görüntülenme

    Yapay zekâ sohbet botları finansal tavsiyede yanlış yanıt veriyor

    20/09/20264 görüntülenme

    Meta, Instagram ve WhatsApp’ın birinci kategori sayılmasına itiraz etti

    20/09/20264 görüntülenme
    İlgi Çekenler
    Ekonomi

    iyzico’ya 14 Eylül’den bu yana DDoS saldırısı: bazı ödemeler etkilendi

    Ekonomi 17/09/2026Güncellendi:17/09/20262 dk okuma

    iyzico CEO’su Orkun Saitoğlu, 14 Eylül akşamından bu yana dağıtık hizmet engelleme saldırısı altında olduklarını açıkladı. Yanıt sürelerinin uzaması bazı ödeme işlemlerini etkiledi; şirket hizmetlerin normale döndüğünü söylüyor.

    OpenAI, Astra’yı kendi sistemlerine çevirip üretim mühendislerinin yüzde 25’ini savunmaya kaydırdı

    15/09/2026

    Orlen, Venezuela petrolü için kripto ile ödediği 230 milyon doları geri alamıyor

    19/09/2026

    Tera Portföy’ün iki fonu iadede temerrüde düştü: altı fonda ödeme 10’uncu iş gününe alındı

    17/09/2026
    Bizi Takip Edin
    • WhatsApp
    • Twitter
    • Instagram
    • LinkedIn
    X (Twitter) Instagram LinkedIn WhatsApp
    • AI
    • Teknoloji
      • Yazılım
      • Donanım
      • Mobil
      • Siber Güvenlik
    • Ekonomi
      • Fintech
      • Girişimcilik
      • Kripto
    • Mobilite
    • İletişim
    © 2026 Tüm hakları saklıdır. mint on ELEVEN Gizlilik Politikası

    Yazıp Enter ile arayın. İptal: Esc.