Potrivit tech euronews, Chatbot-urile cu inteligență artificială ChatGPT, Gemini și Grok greșesc aproximativ 40% din problemele simple de matematică din viața de zi cu zi, conform unui nou studiu publicat miercuri, 18 decembrie. Cercetătorii au testat acuratețea a cinci modele AI folosind 500 de probleme matematice uzuale.
Rezultatele surprinzătoare arată că există o șansă de 40% ca un chatbot AI să ofere un răspuns greșit la calcule matematice de bază, potrivit Tech Euronews.
Testul pe 500 de probleme matematice cotidiene
Studiul a evaluat performanțele ChatGPT-ului de la OpenAI, Gemini de la Google, Grok de la xAI, precum și alte două modele AI majore. Cercetătorii au folosit probleme de matematică pe care le întâlnești în situații reale.
„Rezultatele demonstrează că modelele actuale de AI au încă deficiențe semnificative în rezolvarea problemelor matematice de bază”, a explicat unul dintre autorii studiului.
Implicații pentru utilizatorii din România
Pentru utilizatorii români care se bazează din ce în ce mai mult pe chatbot-uri pentru calculele rapide, aceste rezultate ridică semne de întrebare importante. Rata de eroare de 40% înseamnă că din 10 probleme de matematică, 4 vor fi rezolvate incorect.
Problemele testate includeau calcularea procentajelor pentru reduceri în magazine, împărțirea cheltuielilor între prieteni sau calcularea dobânzilor simple la credite.
Diferențe între platformele AI
Deși toate modelele au prezentat dificultăți similare, studiul a identificat anumite variații în performanță. Unele chatbot-uri s-au descurcat mai bine la anumite tipuri de probleme, în timp ce altele au excelat în domenii diferite.
Cercetătorii subliniază că aceste deficiențe sunt surprinzătoare, având în vedere că matematica de bază ar trebui să fie una dintre punctele forte ale inteligenței artificiale.
Contextul dezvoltării AI în matematică
Inițial, sistemele de inteligență artificială erau considerate extrem de fiabile pentru calculele matematice, fiind văzute ca superioare oamenilor în acest domeniu. Însă testele practice arată o realitate diferită.
Industria AI investește miliarde de dolari în dezvoltarea acestor tehnologii, iar companiile precum OpenAI, Google și xAI promit constant îmbunătățiri ale capacităților matematice ale chatbot-urilor lor.
Recomandări pentru utilizatori
Specialiștii recomandă verificarea răspunsurilor oferite de chatbot-uri pentru problemele matematice importante. Pentru calcule financiare, fiscale sau tehnice, consultarea unei surse suplimentare rămâne esențială.
Această situație evidențiază importanța unei abordări critice în utilizarea inteligenței artificiale, mai ales când rezultatele pot avea impact asupra deciziilor financiare personale.









