Les agents peuvent produire des erreurs et ne peuvent pas juger de la validité scientifique de leur propre production, nécessitant une supervision humaine rigoureuse.
OpenAI révèle comment ses agents de codage, tels que Codex et Claude Code, transforment le développement logiciel scientifique en réduisant drastiquement les temps d'exécution. Cependant, l'expertise humaine reste indispensable pour garantir la validité scientifique et la pérennité des outils.