Meilleur modèle d’IA pour la CAO — banc d’essai LLM

Quel LLM produit la meilleure CAO ? Douze modèles sur un même banc d’essai de pièces 3D paramétriques, notés sur la fidélité, l’étanchéité et le coût.

Quel modèle d’IA est le meilleur pour la CAO ?

Quel est le meilleur modèle d’IA pour générer de la CAO ?

Sur le banc d’essai de pièces paramétriques publié par OwlCAD, GPT-5.6 Sol Pro arrive en tête, avec une fidélité moyenne de 4,3 sur 5 et 99 % de ses générations produisant un solide étanche. Grok 4.5 et Gemini 3.6 Flash suivent, et Gemini 3.6 Flash y parvient pour environ un quart du coût par génération. Le classement est un score composite pondéré de fidélité, d’étanchéité, de vérifications géométriques, de coût et de vitesse, sur 12 exécutions du banc d’essai.

Ce que mesure chaque chiffre

Commencez par les chiffres absolus. Le score composite ne fait que classer les modèles entre eux.

Fidélité, sur 5

La fidélité de la pièce à la demande, notée par un évaluateur à l’aveugle : 5 signifie les bonnes fonctions, positions et proportions, prête à imprimer. Le chiffre qui compte le plus.

Solides étanches

La part des générations qui ont construit un solide étanche et non vide dans le noyau de CAO. Un modèle qui produit une sortie valide mais aucun solide ne marque rien ici.

Vérifications géométriques

La part des prompts dont toutes les attentes automatiques ont été satisfaites, par exemple des trous réellement percés plutôt que simulés, ou un générateur normalisé utilisé quand il en existe un.

Coût et temps par génération

Coût fournisseur moyen en dollars américains et temps réel moyen, tous deux mesurés via OpenRouter : comparables d’un modèle à l’autre, mais pas identiques au coût d’une voie directe.

Score composite

Un mélange pondéré de fidélité 45 %, étanchéité 30 %, vérifications 10 %, coût 10 % et vitesse 5 %, chacun normalisé sur les modèles du tableau. Il classe ce groupe ; ce n’est pas une note absolue.

Le classement

Publié le 31 août 2026 · 12 exécutions · 752 générations

Modèles d’IA classés sur le banc d’essai de CAO paramétrique d’OwlCAD

1. GPT-5.6 Sol Pro

  • Fidélité /5: 4,3
  • Étanche: 99 %
  • Vérifications: 95 %
  • Coût / génération: 0,082 $US

2. Grok 4.5

  • Fidélité /5: 4,2
  • Étanche: 95 %
  • Vérifications: 100 %
  • Coût / génération: 0,025 $US

3. Gemini 3.6 Flash

  • Fidélité /5: 4,2
  • Étanche: 98 %
  • Vérifications: 91 %
  • Coût / génération: 0,020 $US

4. Gemini 3.5 Flash

  • Fidélité /5: 4,1
  • Étanche: 100 %
  • Vérifications: 96 %
  • Coût / génération: 0,048 $US

5. Claude Opus 5

  • Fidélité /5: 4,2
  • Étanche: 100 %
  • Vérifications: 95 %
  • Coût / génération: 0,126 $US

6. Kimi K3

  • Fidélité /5: 4,2
  • Étanche: 69 %
  • Vérifications: 100 %
  • Coût / génération: 0,036 $US

7. Claude Sonnet 5

  • Fidélité /5: 4,0
  • Étanche: 100 %
  • Vérifications: 100 %
  • Coût / génération: 0,028 $US

8. GPT-5.6 Terra Pro

  • Fidélité /5: 4,0
  • Étanche: 100 %
  • Vérifications: 100 %
  • Coût / génération: 0,061 $US

9. Claude Opus 4.8

  • Fidélité /5: 4,0
  • Étanche: 100 %
  • Vérifications: 98 %
  • Coût / génération: 0,063 $US

10. DeepSeek V4 Pro

  • Fidélité /5: 4,0
  • Étanche: 83 %
  • Vérifications: 100 %
  • Coût / génération: 0,008 $US

11. Qwen3.7 Max

  • Fidélité /5: 4,0
  • Étanche: 72 %
  • Vérifications: 95 %
  • Coût / génération: 0,014 $US

12. GLM-5.2

  • Fidélité /5: 3,9
  • Étanche: 58 %
  • Vérifications: 100 %
  • Coût / génération: 0,004 $US

Voyez ce que ces modèles ont réellement construit

Ouvrez de vraies pièces des modèles que Pro fait tourner, dans l’éditeur et sans compte.

Frequently asked questions

Comment le banc d’essai est-il mené ?

Chaque modèle reçoit la même série de prompts de pièces — équerres, engrenages, boîtiers, mécanismes imprimés d’un seul tenant, transitions et formes de révolution — avec le même prompt système qu’OwlCAD utilise en production. Chaque réponse est validée, construite en solide par le noyau de CAO Manifold, vérifiée par rapport aux attentes géométriques du prompt, puis notée de 1 à 5 en fidélité par un modèle évaluateur à qui l’on ne dit pas quel modèle l’a produite.

L’évaluateur fait aussi partie des modèles. Est-ce équitable ?

C’est déclaré plutôt que caché. L’évaluateur, Claude Opus 4.8, ne voit jamais quel modèle a produit un arbre, et les notes qu’il a données à ses propres générations sont comptées dans les chiffres. Le tableau indique combien de ses notes étaient des auto-évaluations, pour que vous puissiez les écarter si vous préférez.

Lesquels de ces modèles puis-je utiliser dans OwlCAD ?

Pro fait tourner Gemini 3.6 Flash, Gemini 3.5 Flash, Claude Opus 4.8 et GPT-5.6 Sol sur vos crédits mensuels. Tous les autres modèles du tableau, y compris GPT-5.6 Sol Pro et Grok 4.5, fonctionnent avec votre propre clé de fournisseur et ne consomment aucun crédit.

Pourquoi le coût et la vitesse sont-ils mesurés via OpenRouter ?

Pour mesurer tous les modèles avec un même transport et une même grille tarifaire. En production, OwlCAD accède directement à certains modèles, donc le coût et le temps réels peuvent différer de ces chiffres ; la fidélité et l’étanchéité ne dépendent pas de la voie d’accès.

OwlCAD · Fonctionnalités · Tarifs · Galerie · Pour les écoles · Agents IA · Serveur MCP · Éditeur STL · Visionneuse STL · Éditeur 3MF · Visionneuse 3MF · Éditeur OBJ · Éditeur DXF · Visionneuse STEP · Visionneuse OBJ · Visionneuse GLB · Générateur 3D par IA · Personnaliseur de modèles · Galerie de configurateurs · Tout comparer · vs TinkerCAD · vs Onshape · vs Fusion 360 · vs FreeCAD · vs SelfCAD · face à OpenSCAD · Toutes les ressources · Prise en main · Tutoriels vidéo · Centre d'aide · Offrez-moi un café ☕ · Contact · Ouvrir l'éditeur · Crédits · Confidentialité · Conditions