Research·Global

Epoch and METR Launch MirrorCode Benchmark to Test AI Model Coding

Global AI Watch · Editorial Team··5 min read
Epoch and METR Launch MirrorCode Benchmark to Test AI Model Coding
Point de vue éditorial

MirrorCode marks a pivotal movement from simple code tasks to complex software autonomy, reshaping AI's role in programming.

Points clés

  • 1MirrorCode fait progresser la capacité de l'IA, passant de 30 % l'année dernière sur des tâches simples à des réimplémentations de programmes complexes.
  • 2L'Opus 4.7 accomplit des tâches de manière significativement plus rapide que les estimations humaines, modifiant ainsi la dynamique des coûts de développement.
  • 3Il n'y a pas de changement de souveraineté ; cela dépend de l'adaptabilité des logiciels, et non des ressources nationales, limitant ainsi l'impact géopolitique.

MirrorCode fait progresser la capacité de l'IA, passant de 30 % l'année dernière sur des tâches simples à des réimplémentations de programmes complexes. L'Opus 4.7 accomplit des tâches de manière significativement plus rapide que les estimations humaines, modifiant ainsi la dynamique des coûts de développement. Il n'y a pas de changement de souveraineté ; cela dépend de l'adaptabilité des logiciels, et non des ressources nationales, limitant ainsi l'impact géopolitique.

Free Daily Briefing

Top AI intelligence stories delivered each morning.

Subscribe Free →

Explore Trackers