Anthropic anunció que ha desarrollado un modelo que aumenta significativamente el límite inferior de las soluciones válidas para la hipótesis de Riemann. Este modelo logró este resultado después de probar 650 ideas diferentes coordinadas por 60 subagentes, utilizando 31 millones de horas de procesamiento.
El modelo se basa en ideas matemáticas críticas desarrolladas por dos subagentes principales, con contribuciones de 13 subagentes adicionales. Aunque 30 subagentes no pudieron generar nuevas ideas, 13 subagentes validaron los resultados y dos subagentes finales redactaron un artículo que respalda los hallazgos. Este descubrimiento fue validado por matemáticos dentro de Anthropic y formalizado con Lean, un asistente de prueba de código abierto.
En los últimos años, los avances matemáticos realizados por grandes modelos de lenguaje (LLM) han generado tanto entusiasmo como preocupación en este campo. Algunos matemáticos temen que la IA pueda socavar valores críticos como la atribución de pruebas matemáticas a autores específicos. Sin embargo, aún no hay consenso sobre este tema.
