Исследователи определили ключевые компоненты в больших языковых моделях (LLM), которые играют решающую роль в обеспечении того, чтобы эти системы искусственного интеллекта обеспечивали безопасные ответы на запросы пользователей. Исследователи использовали эти данные для разработки и демонстрации методов обучения ИИ, которые повышают безопасность LLM при минимизации «налога на выравнивание», что означает, что ИИ становится более безопасным без существенного влияния на производительность.
Новости от techxplore

