Исследования
OpenAI опубликовала первые гайдлайны по безопасности для тренировки фронтир-моделей
OpenAI опубликовала черновик гайдлайнов по безопасности, которые компания планирует применять при обучении фронтирных моделей. Это ответ на растущие риски, связанные с появлением всё более мощных систем.
Документ охватывает три ключевых направления: технические средства защиты (technical safeguards), операционные практики (operational practices) и процедуры расследования инцидентов рассогласования (investigating misalignment incidents).
Хотя это лишь ранняя версия, сам факт публикации таких принципов — важный шаг к прозрачности и стандартизации safety-процедур в индустрии. Другие лаборатории могут взять их за основу для собственных регламентов.
Источник: openai.com