ChatGPT, Gemini și Grok greșesc 40% din problemele simple de matematică

chatbot AI matematică
Foto: stevepb / Pixabay

Potrivit tech euronews, Chatbot-urile cu inteligență artificială ChatGPT, Gemini și Grok greșesc aproximativ 40% din problemele simple de matematică din viața de zi cu zi, conform unui nou studiu publicat miercuri, 18 decembrie. Cercetătorii au testat acuratețea a cinci modele AI folosind 500 de probleme matematice uzuale.

Rezultatele surprinzătoare arată că există o șansă de 40% ca un chatbot AI să ofere un răspuns greșit la calcule matematice de bază, potrivit Tech Euronews.

Testul pe 500 de probleme matematice cotidiene

Studiul a evaluat performanțele ChatGPT-ului de la OpenAI, Gemini de la Google, Grok de la xAI, precum și alte două modele AI majore. Cercetătorii au folosit probleme de matematică pe care le întâlnești în situații reale.

Un studiu arată că ChatGPT și Gemini greșesc 80% din diagnosticele medicale
RecomandariUn studiu arată că ChatGPT și Gemini greșesc 80% din diagnosticele medicale

„Rezultatele demonstrează că modelele actuale de AI au încă deficiențe semnificative în rezolvarea problemelor matematice de bază”, a explicat unul dintre autorii studiului.

Implicații pentru utilizatorii din România

Pentru utilizatorii români care se bazează din ce în ce mai mult pe chatbot-uri pentru calculele rapide, aceste rezultate ridică semne de întrebare importante. Rata de eroare de 40% înseamnă că din 10 probleme de matematică, 4 vor fi rezolvate incorect.

Problemele testate includeau calcularea procentajelor pentru reduceri în magazine, împărțirea cheltuielilor între prieteni sau calcularea dobânzilor simple la credite.

Studiu alarmant – 50% din sfaturile medicale de la ChatGPT si Grok sunt eronate
RecomandariStudiu alarmant – 50% din sfaturile medicale de la ChatGPT si Grok sunt eronate

Diferențe între platformele AI

Deși toate modelele au prezentat dificultăți similare, studiul a identificat anumite variații în performanță. Unele chatbot-uri s-au descurcat mai bine la anumite tipuri de probleme, în timp ce altele au excelat în domenii diferite.

Cercetătorii subliniază că aceste deficiențe sunt surprinzătoare, având în vedere că matematica de bază ar trebui să fie una dintre punctele forte ale inteligenței artificiale.

Contextul dezvoltării AI în matematică

Inițial, sistemele de inteligență artificială erau considerate extrem de fiabile pentru calculele matematice, fiind văzute ca superioare oamenilor în acest domeniu. Însă testele practice arată o realitate diferită.

Walmart dă lovitura: Inteligența Artificială Gemini intră în luptă cu ChatGPT pentru supremația cumpărăturilor
RecomandariWalmart dă lovitura: Inteligența Artificială Gemini intră în luptă cu ChatGPT pentru supremația cumpărăturilor

Industria AI investește miliarde de dolari în dezvoltarea acestor tehnologii, iar companiile precum OpenAI, Google și xAI promit constant îmbunătățiri ale capacităților matematice ale chatbot-urilor lor.

Recomandări pentru utilizatori

Specialiștii recomandă verificarea răspunsurilor oferite de chatbot-uri pentru problemele matematice importante. Pentru calcule financiare, fiscale sau tehnice, consultarea unei surse suplimentare rămâne esențială.

Această situație evidențiază importanța unei abordări critice în utilizarea inteligenței artificiale, mai ales când rezultatele pot avea impact asupra deciziilor financiare personale.