Рома Филев против FOMO
Переслано от канала
27 5 771
Ключевое различие: рандомизированный эксперимент выявляет эффект воздействия за счёт дизайна. LLM-суррогат выявляет его только за счёт допущений.
Мы формализовали эти допущения через теорию суррогатных конечных точек и проверили их на примерно 3 600 реальных A/B-экспериментах из Upworthy Research Archive. Сырые предсказания LLM восстановили лишь 39% истинного эффекта от воздействий на людей. Калибровка этих предсказаний на исторических данных сократила разрыв, но только при двух условиях, которые невозможно проверить для воздействий, которые вы ещё никогда не тестировали.