Bestes KI-Modell für CAD — LLM-Benchmark für 3D-Teile

Welches LLM baut das beste CAD? Zwölf Modelle in einem Benchmark für parametrische 3D-Teile, bewertet nach Treue, wasserdichten Körpern, Prüfungen und Kosten.

Welches KI-Modell ist am besten für CAD?

Welches KI-Modell ist am besten für die CAD-Erstellung?

Im veröffentlichten Benchmark für parametrische Teile von OwlCAD liegt GPT-5.6 Sol Pro vorn, mit durchschnittlich 4,3 von 5 Punkten bei der Treue und 99 % seiner Generierungen, die einen wasserdichten Körper ergeben. Danach folgen Grok 4.5 und Gemini 3.6 Flash, wobei Gemini 3.6 Flash das für etwa ein Viertel der Kosten pro Generierung schafft. Die Rangfolge ist ein gewichteter Gesamtwert aus Treue, Wasserdichtheit, Geometrieprüfungen, Kosten und Geschwindigkeit über 12 Benchmark-Läufe.

Was jede Zahl misst

Beginne mit den absoluten Zahlen. Der Gesamtwert ordnet die Modelle nur untereinander.

Treue, von 5

Wie genau das Teil der Anfrage entspricht, bewertet von einem blinden Bewerter: 5 heißt richtige Merkmale, Position und Proportionen, druckfertig. Die wichtigste Zahl.

Wasserdichte Körper

Der Anteil der Generierungen, die im CAD-Kernel einen nicht leeren, wasserdichten Körper ergeben haben. Ein Modell, das gültige Ausgaben, aber keinen Körper liefert, bekommt hier nichts.

Geometrieprüfungen

Der Anteil der Prompts, deren automatische Erwartungen alle erfüllt wurden, etwa dass Löcher wirklich geschnitten und nicht vorgetäuscht sind oder dass ein Normgenerator genutzt wurde, wo es einen gibt.

Kosten und Zeit pro Generierung

Durchschnittliche Anbieterkosten in US-Dollar und durchschnittliche Laufzeit, beides über OpenRouter gemessen: zwischen Modellen vergleichbar, aber nicht identisch mit den Kosten eines direkten Wegs.

Gesamtwert

Eine gewichtete Mischung aus Treue 45 %, Wasserdichtheit 30 %, Prüfungen 10 %, Kosten 10 % und Geschwindigkeit 5 %, jeweils über die Modelle der Tabelle normiert. Er ordnet dieses Feld; eine absolute Note ist er nicht.

Die Rangliste

Veröffentlicht am 31. August 2026 · 12 Benchmark-Läufe · 752 Generierungen

KI-Modelle im parametrischen CAD-Benchmark von OwlCAD

1. GPT-5.6 Sol Pro

  • Treue /5: 4,3
  • Wasserdicht: 99 %
  • Prüfungen: 95 %
  • Kosten / Generierung: 0,082 $

2. Grok 4.5

  • Treue /5: 4,2
  • Wasserdicht: 95 %
  • Prüfungen: 100 %
  • Kosten / Generierung: 0,025 $

3. Gemini 3.6 Flash

  • Treue /5: 4,2
  • Wasserdicht: 98 %
  • Prüfungen: 91 %
  • Kosten / Generierung: 0,020 $

4. Gemini 3.5 Flash

  • Treue /5: 4,1
  • Wasserdicht: 100 %
  • Prüfungen: 96 %
  • Kosten / Generierung: 0,048 $

5. Claude Opus 5

  • Treue /5: 4,2
  • Wasserdicht: 100 %
  • Prüfungen: 95 %
  • Kosten / Generierung: 0,126 $

6. Kimi K3

  • Treue /5: 4,2
  • Wasserdicht: 69 %
  • Prüfungen: 100 %
  • Kosten / Generierung: 0,036 $

7. Claude Sonnet 5

  • Treue /5: 4,0
  • Wasserdicht: 100 %
  • Prüfungen: 100 %
  • Kosten / Generierung: 0,028 $

8. GPT-5.6 Terra Pro

  • Treue /5: 4,0
  • Wasserdicht: 100 %
  • Prüfungen: 100 %
  • Kosten / Generierung: 0,061 $

9. Claude Opus 4.8

  • Treue /5: 4,0
  • Wasserdicht: 100 %
  • Prüfungen: 98 %
  • Kosten / Generierung: 0,063 $

10. DeepSeek V4 Pro

  • Treue /5: 4,0
  • Wasserdicht: 83 %
  • Prüfungen: 100 %
  • Kosten / Generierung: 0,008 $

11. Qwen3.7 Max

  • Treue /5: 4,0
  • Wasserdicht: 72 %
  • Prüfungen: 95 %
  • Kosten / Generierung: 0,014 $

12. GLM-5.2

  • Treue /5: 3,9
  • Wasserdicht: 58 %
  • Prüfungen: 100 %
  • Kosten / Generierung: 0,004 $

Sieh dir an, was diese Modelle wirklich gebaut haben

Öffne echte Teile der Modelle, die Pro nutzt, im Editor und ohne Konto.

Frequently asked questions

Wie läuft der Benchmark ab?

Jedes Modell erhält dieselben Teile-Prompts – Halterungen, Zahnräder, Gehäuse, am Stück gedruckte Mechanismen, Übergänge und Drehkörper – mit demselben Systemprompt, den OwlCAD in Produktion nutzt. Jede Antwort wird validiert, vom Manifold-CAD-Kernel zu einem Körper gebaut, gegen die geometrischen Erwartungen des Prompts geprüft und von einem Bewertungsmodell, das nicht erfährt, welches Modell sie erzeugt hat, mit 1 bis 5 Punkten für die Treue bewertet.

Der Bewerter ist selbst eines der Modelle. Ist das fair?

Das wird offengelegt statt verschwiegen. Der Bewerter, Claude Opus 4.8, sieht nie, welches Modell einen Baum erzeugt hat, und die Noten für seine eigenen Generierungen fließen in die Zahlen ein. Die Tabelle zeigt, wie viele seiner Noten Selbstbewertungen waren, damit du sie abziehen kannst, wenn du möchtest.

Welche dieser Modelle kann ich in OwlCAD nutzen?

Pro nutzt Gemini 3.6 Flash, Gemini 3.5 Flash, Claude Opus 4.8 und GPT-5.6 Sol mit deinen monatlichen Credits. Alle anderen Modelle in der Tabelle, darunter GPT-5.6 Sol Pro und Grok 4.5, laufen mit deinem eigenen Anbieter-Schlüssel und verbrauchen keine Credits.

Warum werden Kosten und Geschwindigkeit über OpenRouter gemessen?

Damit alle Modelle über denselben Transport und dieselbe Preisliste gemessen werden. OwlCAD erreicht manche Modelle in Produktion direkt, daher können echte Kosten und Zeiten von diesen Zahlen abweichen; Treue und Wasserdichtheit hängen nicht vom Weg ab.

OwlCAD · Funktionen · Preise · Galerie · Für Schulen · KI-Agenten · MCP-Server · STL-Editor · STL-Betrachter · 3MF-Editor · 3MF-Betrachter · OBJ-Editor · DXF-Editor · STEP-Viewer · OBJ-Viewer · GLB-Viewer · KI-3D-Generator · Modell-Konfigurator · Konfiguratoren-Galerie · Alle vergleichen · vs. TinkerCAD · vs. Onshape · vs. Fusion 360 · vs. FreeCAD · vs. SelfCAD · vs. OpenSCAD · Alle Ressourcen · Erste Schritte · Video-Tutorials · Hilfe-Center · Spendier mir einen Kaffee ☕ · Kontakt · Editor öffnen · Credits · Datenschutz · AGB