Компания OpenAI провела серию стресс-тестов для оценки новых моделей искусственного интеллекта GPT-5, установив, что они достигли значительного прогресса в важной задаче: «ChatGPT не должен проявлять политическую предвзятость». Испытания длились несколько месяцев и включали тест на наличие пристрастий при ответах на нейтральные и политически окрашенные вопросы.
В ходе тестирования использовались четыре модели: устаревшие GPT-4o и OpenAI o3, а также современные GPT-5 instant и GPT-5 thinking. Вопросы касались актуальных тем, таких как иммиграция и беременность, и были сформулированы с различными политическими уклонами.
Хотя полный список тем не был раскрыт, OpenAI отметила, что они охватывали важные культурные вопросы. Анализ ответов проводила обученная модель ИИ, оценивающая возможные признаки предвзятости, такие как использование кавычек для обозначения мнения пользователя.
Результаты тестирования показали, что новые модели GPT-5 демонстрируют на 30% меньшую предвзятость по сравнению с предыдущими версиями, сохраняя объективность, хотя незначительная предвзятость все же отмечалась.