Quel LLM produit la meilleure CAO ? Douze modèles sur un même banc d’essai de pièces 3D paramétriques, notés sur la fidélité, l’étanchéité et le coût.
Sur le banc d’essai de pièces paramétriques publié par OwlCAD, GPT-5.6 Sol Pro arrive en tête, avec une fidélité moyenne de 4,3 sur 5 et 99 % de ses générations produisant un solide étanche. Grok 4.5 et Gemini 3.6 Flash suivent, et Gemini 3.6 Flash y parvient pour environ un quart du coût par génération. Le classement est un score composite pondéré de fidélité, d’étanchéité, de vérifications géométriques, de coût et de vitesse, sur 12 exécutions du banc d’essai.
Commencez par les chiffres absolus. Le score composite ne fait que classer les modèles entre eux.
La fidélité de la pièce à la demande, notée par un évaluateur à l’aveugle : 5 signifie les bonnes fonctions, positions et proportions, prête à imprimer. Le chiffre qui compte le plus.
La part des générations qui ont construit un solide étanche et non vide dans le noyau de CAO. Un modèle qui produit une sortie valide mais aucun solide ne marque rien ici.
La part des prompts dont toutes les attentes automatiques ont été satisfaites, par exemple des trous réellement percés plutôt que simulés, ou un générateur normalisé utilisé quand il en existe un.
Coût fournisseur moyen en dollars américains et temps réel moyen, tous deux mesurés via OpenRouter : comparables d’un modèle à l’autre, mais pas identiques au coût d’une voie directe.
Un mélange pondéré de fidélité 45 %, étanchéité 30 %, vérifications 10 %, coût 10 % et vitesse 5 %, chacun normalisé sur les modèles du tableau. Il classe ce groupe ; ce n’est pas une note absolue.
Publié le 31 août 2026 · 12 exécutions · 752 générations
Modèles d’IA classés sur le banc d’essai de CAO paramétrique d’OwlCAD
Ouvrez de vraies pièces des modèles que Pro fait tourner, dans l’éditeur et sans compte.
Chaque modèle reçoit la même série de prompts de pièces — équerres, engrenages, boîtiers, mécanismes imprimés d’un seul tenant, transitions et formes de révolution — avec le même prompt système qu’OwlCAD utilise en production. Chaque réponse est validée, construite en solide par le noyau de CAO Manifold, vérifiée par rapport aux attentes géométriques du prompt, puis notée de 1 à 5 en fidélité par un modèle évaluateur à qui l’on ne dit pas quel modèle l’a produite.
C’est déclaré plutôt que caché. L’évaluateur, Claude Opus 4.8, ne voit jamais quel modèle a produit un arbre, et les notes qu’il a données à ses propres générations sont comptées dans les chiffres. Le tableau indique combien de ses notes étaient des auto-évaluations, pour que vous puissiez les écarter si vous préférez.
Pro fait tourner Gemini 3.6 Flash, Gemini 3.5 Flash, Claude Opus 4.8 et GPT-5.6 Sol sur vos crédits mensuels. Tous les autres modèles du tableau, y compris GPT-5.6 Sol Pro et Grok 4.5, fonctionnent avec votre propre clé de fournisseur et ne consomment aucun crédit.
Pour mesurer tous les modèles avec un même transport et une même grille tarifaire. En production, OwlCAD accède directement à certains modèles, donc le coût et le temps réels peuvent différer de ces chiffres ; la fidélité et l’étanchéité ne dépendent pas de la voie d’accès.