AI-агенты против инференса: новый бенчмарк InferenceBench показал предел «заученных» решений

Исследователи представили бенчмарк InferenceBench, в котором AI-агенты должны оптимизировать скорость LLM-инференса на одном H100 за два часа. Результаты показали, что агенты превосходят наивный baseline, но уступают простому перебору гиперпараметров — узкое место не в...

Открыть материал →