#2-2

Кризис бенчмарков: почему впечатляющие результаты ИИ в тестах вводят в заблуждение

В 2025 году индустрия искусственного интеллекта столкнулась с системным кризисом доверия к собственным методам оценки. Исследования показывают, что существующие бенчмарки зачастую не в состоянии предсказать их реальную полезность и надежность, создавая опасный разрыв между лабораторными показателями и практическим применением. Масштаб проблемы демонстрирует исследование ученых из Института безопасности ИИ при правительстве Великобритании, Оксфорда, Стэнфорда и Калифорнийского университета в Беркли. Они изучили […]

Исследование выявило деградацию языковых моделей после обучения на контенте из социальных сетей

В 2025 году индустрия искусственного интеллекта столкнулась с тревожным феноменом: передовые модели начали демонстрировать признаки интеллектуальной деградации, теряя способность к логическому мышлению и рассуждению после обучения на низкокачественном контенте из социальных сетей. Научные сотрудники Google DeepMind предупреждают,  что это явление, получившее название «цифрового самопоедания» или «model collapse», ставит под угрозу дальнейшее развитие технологий искусственного интеллекта и заставляет разработчиков искать срочные […]