Моделі штучного інтелекту від OpenAI, Google та Anthropic показали результати, що перевищили найвищі бали людей на складному вступному іспиті до Токійського університету, зокрема в науковому напрямку.
Про це пише Asia Business Daily.
Штучний інтелект продовжує демонструвати стрімке зростання в академічних завданнях. За даними японських медіа, моделі OpenAI та Google набрали результати, вищі за найкращих абітурієнтів, на найскладнішому розділі вступного іспиту до Університету Токіо.
Дослідження проводили стартап у сфері штучного інтелекту та освітня компанія, які протестували сучасні моделі, зокрема GPT, Gemini та Claude. Вони були оцінені викладачами за реальними екзаменаційними завданнями.
У науковому блоці OpenAI набрав 503 бали зі 550 можливих, а Google — 496 балів, тоді як найкращий результат серед людей склав 453 бали. Деякі моделі також продемонстрували ідеальні результати з математики та окремих природничих дисциплін.
Особливо сильними штучний інтелект виявився в природничих науках та інженерії. Водночас результати в гуманітарних предметах були нерівномірними: моделі краще справлялися з фізикою та хімією, але мали труднощі з історією та японською мовою.
Дослідники зазначають, що якість відповідей штучного інтелекту суттєво покращилася порівняно з попереднім роком. Водночас експерти підкреслюють, що різні моделі мають власні сильні сторони залежно від навчальних даних та архітектури.


