AAI News Hub
InvestigaciónWed, August 5, 2026·Aug 52 sources corroborating

Investigadores proponen RST para tareas de agentes en terminal

Recursive Synthetic Terminal Tasks generó 37.484 tareas verificadas a partir de tareas semilla.

Por qué importa

El trabajo aborda un cuello de botella en el entrenamiento de agentes en terminal: producir tareas coherentes de largo horizonte con instrucciones, entornos, soluciones y verificadores alineados. Si es reproducible, la síntesis recursiva verificada podría reducir el costo de crear conjuntos de entrenamiento para agentes y suites de evaluación más difíciles.

Puntos clave

  • 1.RST generó 37.484 tareas sintetizadas para agentes en terminal.
  • 2.El costo reportado fue de aproximadamente 0,05 dólares por tarea.
  • 3.El pass@4 de DeepSeek-V4-Pro cayó del 90% al 2,5% a lo largo de las rondas.

Un paper destacado por HF Daily Papers presenta Recursive Synthetic Terminal Tasks, un marco para generar tareas de entrenamiento de largo horizonte para agentes en terminal. A partir de tareas semilla verificadas, RST amplía las soluciones de referencia, realinea verificadores e instrucciones, valida las tareas en sandboxes nuevos y reutiliza las tareas aceptadas en rondas posteriores. En 15 rondas recursivas, produjo 37.484 tareas sintetizadas a un costo aproximado de 0,05 dólares por tarea, con una dificultad que aumentó ronda tras ronda.

Pruébalo hoy

Lee el paper antes de construir benchmarks para agentes en terminal o pipelines de entrenamiento sintético.

Fuentes y cobertura original

Este resumen sintetiza y enlaza la cobertura de los medios siguientes.

¿Te gustó este resumen? Recibe el próximo en tu correo.

Más en Investigación