Дэвид Робинсон, проработавший в OpenAI три с половиной года и участвовавший в подготовке отчетов по безопасности крупных продуктов компании, объявил об уходе. Он заявил, что корпоративная культура OpenAI изменилась и перестала уделять достаточно внимания рискам, связанным с развитием искусственного интеллекта, сообщает TechCrunch.
По мнению Робинсона, проблема заключается в подходе: «сначала запустить, потом исправить». OpenAI активно выпускает новые системы, а возникающие проблемы выявляет уже в процессе их использования и затем усиливает защиту. Бывший сотрудник считает, что такая стратегия становится все более рискованной по мере того, как ИИ получает новые возможности.
Робинсон предлагает относиться к разработке передового ИИ так же серьезно, как к авиации или атомной энергетике — с несколькими уровнями защиты и заранее продуманными сценариями на случай ошибок. По его словам, компании не должны рассчитывать, что опасные последствия всегда удастся исправить после запуска системы.
В OpenAI с такой оценкой не согласились. Представитель компании заявил, что разработчик следит за тем, чтобы возможности моделей не опережали способность компании безопасно ими управлять. OpenAI также усиливает тестирование и мониторинг поведения моделей.
Напомним, в конце сентября OpenAI отменила выпуск модели GPT-6.1 Astra. Она предназначена для решения более сложных задач без участия человека. Исследователи выразили обеспокоенность по поводу безопасности новой модели после проведения внутреннего тестирования.
