#reinforcement learning
7 briefs tagged #reinforcement learning.
Research
Researchers target reliability gaps in search agents
New papers propose evidence grounding, memory, training data and workflow methods for LLM agents.
arXiv cs.AI+1 outlet·5d ago
Research
New papers scrutinize LLM agent tool-use evaluation
Several arXiv papers propose benchmarks and auditing methods for tool-calling agents.
arXiv cs.CL+1 outlet·6d ago
Research
RoMeRL targets memory failures in self-evolving agents
The method uses fixed-dimensional utility states to reduce feedback dispersion and misleading memory rewards.
arXiv cs.CL+1 outlet·6d ago
Research
Researchers target more reliable LLM agents
New papers propose training, workflow and reward methods for tool-using AI agents.
HF Daily Papers+1 outlet·Aug 10
Research
Researchers target credit assignment for search agents
RICE-PO and ABSeeker propose finer-grained training signals for retrieval and long-horizon search agents.
arXiv cs.CL+1 outlet·Aug 7
Research
New papers target cheaper training for LLM agents
State2State, EnvACE and OASE explore alternatives to expert data, executable environments and static baselines.
arXiv cs.CL+1 outlet·Aug 6
Research
Researchers target credit assignment for search agents
New papers propose denser training signals for multi-step search, retrieval and reasoning agents.
arXiv cs.AI+1 outlet·Aug 6