Supabase lance Evals : un benchmark open source qui évalue Claude Code, Codex et OpenCode sur des tâches réelles
7/10Le 1er août 2026, Supabase a annoncé le lancement de Evals, un benchmark open source conçu pour mesurer et comparer les performances de Claude Code, Codex et OpenCode dans l'exécution de tâches concrètes liées à Supabase. Cet outil vise à standardiser les évaluations des intelligences artificielles pour accroître la transparence de leurs capacités.
