1 briefs tagged #recursive self-improvement.
The arXiv benchmark evaluates whether LLM agents can rewrite training algorithms across frozen repositories.