Модель обучила более сильную модель
-
topic:wrote-ago global:last-edited-by

Коротко: Anthropic заявила, что Sonnet 5 помогла дообучить более способный ранний чекпойнт Opus 4.8 до близких показателей безопасности.
Sonnet 5 дообучила раннюю версию более сильной Opus 4.8
Anthropic сообщила о первом эксперименте, в котором Sonnet 5 провела post-training раннего чекпойнта более способной Opus 4.8. По данным компании, после этого модель приблизилась по показателям безопасности к промышленной версии Opus 4.8, прошедшей полный цикл alignment-обучения.
Эксперимент указывает на возможность использовать одни модели для настройки безопасности более сильных систем. Однако публикация не раскрывает конкретные метрики и методику, а один тест ещё не доказывает, что подход будет надёжно работать с будущими моделями.
Почему это важно
Результат указывает на возможный путь масштабировать настройку безопасности более сильных моделей с помощью самих ИИ-систем.
Первоисточник
Дата публикации источника: 2026-08-28T17:13:37.000Z