Локализованный выигрыш и ловушка равномерного деления бюджета: что показывает HARNESSEVO о самоэволюции LLM-агентов
Исследователи разложили обвязку LLM-агента на четыре слота и обнаружили, что почти вся польза от оптимизации сосредоточена в слоте рефлексии, а равномерное распределение вычислительного бюджета между слотами ведёт к нулевому прогрессу. На ALFWorld концентрация ресурсов...
Открыть материал →









