Pour contrer la confiance des agents dans des codes erronés, les humains doivent construire des tests d'acceptation précis et des vérifications de parité.
OpenAI révèle comment ses agents de codage, tels que Codex et Claude Code, transforment le développement logiciel scientifique en réduisant drastiquement les temps d'exécution. Cependant, l'expertise humaine reste indispensable pour garantir la validité scientifique et la pérennité des outils.