CodeEditorBench: Evaluating Code Editing Capability of Large Language Models
Jiawei Guo, Ziming Li, Xueling Liu +13 authors
CodeEditorBench evaluates Large Language Models in real-world code editing tasks, demonstrating that closed-source models perform better across various scenarios and problems.