Microsoft Research presentó Orchard, un marco de código abierto para modelos de inteligencia artificial basados en agentes. Este marco está construido sobre Orchard Env, un servicio de entorno para el entrenamiento y evaluación de agentes utilizados en tareas de ingeniería de software, navegación web y asistentes personales. El marco puede ser utilizado en diferentes áreas de tareas y sistemas de agentes, lo que permite a los investigadores reutilizar entornos, pipelines de datos y procesos de evaluación.

Ejemplos del marco como Orchard-SWE, Orchard-GUI y Orchard-Claw demostraron que los modelos pequeños de código abierto pueden obtener resultados efectivos en tareas complejas del mundo real. Por ejemplo, Orchard-SWE alcanzó un 69.7% de éxito en el benchmark SWE-bench Verified, acercándose a los sistemas pioneros que utilizan modelos más grandes. Orchard-GUI también obtuvo resultados efectivos en tareas de navegación web, mientras que Orchard-Claw tuvo éxito en tareas de asistentes personales.

El marco Orchard reduce el costo de la investigación en inteligencia artificial basada en agentes, permitiendo a los investigadores trabajar sin depender de infraestructuras especializadas.