Pesquisadores testam harnesses para agentes incorporados
Thea e SHAPER aplicam a robôs e IA incorporada ideias de infraestrutura usadas em agentes de programação.
Por que importa
O trabalho desloca o foco dos pesos do modelo, isoladamente, para o sistema de execução ao redor da IA incorporada. Ele sugere que avanços em agentes robóticos podem depender de melhores representações de estado, interfaces de ação, ciclos de avaliação e habilidades reutilizáveis.
Pontos-chave
- 1.Thea encapsula capacidades robóticas como ferramentas acionáveis.
- 2.SHAPER evolui habilidades e código de harness sem atualizar os parâmetros do modelo.
- 3.Os dois artigos tratam o design do harness como central para o desempenho de agentes incorporados.
Dois novos artigos investigam se o modelo de harness usado por agentes de programação pode melhorar agentes incorporados. Um apresenta Thea, um harness para agentes robóticos que encapsula capacidades como ferramentas acionáveis e acrescenta um grafo de cena persistente, além de um mecanismo de avaliação de ações para fechar o ciclo em ambientes físicos. O outro apresenta SHAPER, um framework de adaptação sem treinamento que mantém os parâmetros do modelo congelados enquanto evolui habilidades reutilizáveis e um harness de contexto-código por meio de rollouts no ambiente-alvo, avaliado no VLABench e no ESI-Bench.
⚡ Experimente hoje
Antes de ajustar um agente incorporado com fine-tuning, avalie se suas ferramentas, sua representação de contexto e seu ciclo de avaliação de ações podem ser melhorados sem atualizar parâmetros.
Fontes e reportagens originais
Este resumo sintetiza e linka a cobertura dos veículos abaixo.
- arXiv cs.AITowards the Harness of Embodied AgentsAug 13, 12:00 PM↗
- arXiv cs.LGTowards the Harness of Embodied AgentsAug 13, 12:00 PM↗
- arXiv cs.CLSelf-Evolving Embodied Agents via Skill-Harness EvolutionAug 13, 12:00 PM↗
- HF Daily PapersSelf-Evolving Embodied Agents via Skill-Harness EvolutionAug 11, 4:00 AM↗
Gostou deste resumo? Receba o próximo no seu e-mail.
Mais em Pesquisa
Estudo mostra que contexto de auditoria e correção torna verificadores baseados em LLMs mais lenientes
O artigo no arXiv relata menos falsos alarmes após episódios anteriores de auditoria e correção no contexto do modelo.
AlphaEvolve ajuda a reduzir o limite da multiplicação de matrizes
Uma nova nota no arXiv relata um limite superior melhorado para o expoente da multiplicação de matrizes.
InternLM propõe a arquitetura de modelo Mobius
O artigo no arXiv separa memória e raciocínio para melhorar a compressão e a eficiência na inferência.