"Saturn" texnologiya şirkəti ən geniş yayılmış süni intellekt modellərinin ("ChatGPT", "Claude", "Copilot", "Grok", "Gemini" və digərləri) maliyyə tapşırıqlarının öhdəsindən necə gəldiyini təhlil edib.
Oxu.Az xəbər verir ki, tədqiqatın nəticələrini "Financial Times" nəşri dərc edib.
Modellər ortaçətinlikli suallara cavab verərkən 57% hallarda, daha mürəkkəb suallarda isə 99% hallarda səhvə yol veriblər.
Tədqiqatçılar süni intellekt modellərini maliyyə ilə bağlı 100-dən çox sualdan ibarət siyahı üzrə sınaqdan keçiriblər. Suallar beş dəfəyə qədər təkrar oluna bilərdi. Mütəxəssislər qeyd edirlər ki, süni intellekt hesablamalarda səhvlərə yol verib, məsələn, vergi qanunvericiliyində gözlənilən dəyişiklikləri nəzərə almayıb və ya mövcud olmayan normalar uydurublar. Çatbotlar ən yaxşı nəticəni büdcənin tərtib edilməsində göstəriblər.
"Milyonlarla insan maliyyə məsələlərində süni intellekt modellərinə etibar edir, lakin onlar pullarını itirmələrinə səbəb ola biləcək yanlış cavablar alırlar", - deyə "Saturn" şirkətinin icraçı direktoru Amal Coli bildirib.
Mütəxəssislər qeyd edirlər ki, tədqiqatın nəticələrinə görə, ən yaxşı göstərici "düşüncə" rejimində işləyən "Claude Opus 5" modeli olub.