Тема COMRAD404

inference

2 материалов

AI-агенты против инференса: новый бенчмарк InferenceBench показал предел «заученных» решений

Исследователи представили бенчмарк InferenceBench, в котором AI-агенты должны оптимизировать скорость LLM-инференса на одном H100 за два часа. Результаты показали, что...