instruction-followingLLM evaluationIFEvalInstruction-Following Evaluation for Large Language ModelsA reference guide to instruction-following evaluation for large language models, covering verifiable benchmarks, metrics, annotation, reproducibilityOctober 2, 202622 min read