AAI News Hub
ModelosTue, August 11, 2026·Aug 112 sources corroborating

Cactus lanza Needle 2 para dispositivos edge

El LLM agéntico de 14 MB apunta al uso de herramientas y la extracción estructurada en teléfonos, wearables y robots.

Por qué importa

Needle 2 refleja el trabajo continuo para ejecutar agentes de IA en hardware edge con recursos limitados, en lugar de depender solo de PCs, Macs o sistemas en la nube. Si sus afirmaciones de benchmark se sostienen, modelos muy pequeños podrían hacer más práctico el uso de herramientas y el control de dispositivos en una amplia gama de dispositivos conectados de bajo costo.

Puntos clave

  • 1.Needle 2 es un binario de 14 MB que usa 28 MB de RAM por sesión.
  • 2.Cactus reporta una decodificación de 500 tokens/s en Raspberry Pi 5.
  • 3.El modelo está orientado a invocar herramientas, usar dispositivos y realizar extracción estructurada.

Cactus lanzó Needle 2, un LLM agéntico de 14 MB diseñado para invocar herramientas, usar dispositivos y realizar extracción estructurada en teléfonos, wearables, dispositivos de hogar inteligente, robots pequeños y microcontroladores. La compañía afirma que el modelo es un único binario de 14 MB con 45 millones de parámetros con compresión de 2 bits y que puede ejecutar una sesión completa en 28 MB de RAM. Reporta velocidades de decodificación de 500 tokens por segundo en una Raspberry Pi 5, de 400 a 1.500 tokens por segundo en Meta Quest 3S y Apple Vision Pro, y de 300 a 700 tokens por segundo en teléfonos Samsung A-Series de menos de 200 dólares.

Pruébalo hoy

Evalúa Needle 2 en tu hardware edge objetivo antes de comprometerte con modelos móviles o en la nube más grandes para flujos de trabajo de invocación de herramientas.

Fuentes y cobertura original

Este resumen sintetiza y enlaza la cobertura de los medios siguientes.

¿Te gustó este resumen? Recibe el próximo en tu correo.

Más en Modelos