inference-bench

Tag

Cards List
#inference-bench

InferenceBench: A Benchmark for Open-Ended LLM Inference Optimization by AI Agents

arXiv cs.AI · 17h ago Cached

InferenceBench is a benchmark that evaluates AI agents on optimizing LLM inference speed using an H100 GPU across multiple bottleneck scenarios. Results show agents improve over naive baselines but frequently converge on single frameworks and underperform simple hyperparameter searches, indicating a need for better exploration strategies.

0 favorites 0 likes
← Back to home

Submit Feedback