Калибровка модели (Model Calibration)

Калибровка описывает, насколько уверенность модели соответствует её реальной точности. Хорошо откалиброванная модель, говорящая «уверен на 80%», права примерно в 80% случаев; плохо откалиброванная — уверенно ошибается или без нужды колеблется. Это становится важно, как только вы используете уверенность модели для решений — автоодобряете ответы с высокой уверенностью, направляете низкоуверенные человеку или ставите порог классификатору. Если уверенность не откалибрована, эти пороги бессмысленны. Исследования показали, что выравнивающее обучение способно ухудшить калибровку базовой модели, так что гладкий, уверенный тон — не доказательство правоты. Для разработчиков: не принимайте уверенный вид модели за её фактическую уверенность. Практическая заметка: если вы полагаетесь на уверенность, измерьте калибровку на собственных размеченных примерах — сгруппируйте предсказания по заявленной или подразумеваемой уверенности и проверьте реальную долю попаданий в каждой группе. Где возможно, выводите уверенность из вероятностей токенов (logprobs), а не из самоотчёта модели «уверен на 90%», который часто ненадёжен.

Похожие термины

Ещё термины: Основы ИИ