Mejor modelo de IA para CAD — Prueba de LLM

¿Qué LLM hace el mejor CAD? Doce modelos en una misma prueba de piezas 3D paramétricas, puntuados en fidelidad, sólidos estancos, comprobaciones y coste.

¿Qué modelo de IA es mejor para CAD?

¿Cuál es el mejor modelo de IA para generar CAD?

En la prueba de piezas paramétricas publicada por OwlCAD, GPT-5.6 Sol Pro queda primero, con una fidelidad media de 4,3 sobre 5 y un 99 % de sus generaciones produciendo un sólido estanco. Le siguen Grok 4.5 y Gemini 3.6 Flash, y Gemini 3.6 Flash lo consigue con aproximadamente una cuarta parte del coste por generación. La clasificación es una combinación ponderada de fidelidad, estanqueidad, comprobaciones geométricas, coste y velocidad, a lo largo de 12 ejecuciones de la prueba.

Qué mide cada cifra

Empieza por las cifras absolutas. La puntuación combinada solo ordena los modelos entre sí.

Fidelidad, sobre 5

Lo fielmente que la pieza responde a la petición, según un evaluador ciego: 5 significa las características, la posición y las proporciones correctas, lista para imprimir. La cifra que más importa.

Sólidos estancos

La proporción de generaciones que construyeron un sólido estanco y no vacío en el núcleo CAD. Un modelo que escribe una salida válida pero sin sólido no suma aquí.

Comprobaciones geométricas

La proporción de prompts cuyas expectativas automáticas se cumplieron todas; por ejemplo, que los agujeros estén realmente cortados y no simulados, o que se usara un generador estándar cuando existe.

Coste y tiempo por generación

Coste medio del proveedor en dólares y tiempo medio real, ambos medidos a través de OpenRouter: comparables entre modelos, pero no idénticos a lo que cuesta una ruta directa.

Puntuación combinada

Una mezcla ponderada de fidelidad 45 %, estanqueidad 30 %, comprobaciones 10 %, coste 10 % y velocidad 5 %, cada una normalizada entre los modelos de la tabla. Ordena este grupo; no es una nota absoluta.

La clasificación

Publicado el 31 de agosto de 2026 · 12 ejecuciones · 752 generaciones

Modelos de IA clasificados en la prueba de CAD paramétrico de OwlCAD

1. GPT-5.6 Sol Pro

  • Fidelidad /5: 4,3
  • Estanco: 99 %
  • Comprobaciones: 95 %
  • Coste / generación: 0,082 US$

2. Grok 4.5

  • Fidelidad /5: 4,2
  • Estanco: 95 %
  • Comprobaciones: 100 %
  • Coste / generación: 0,025 US$

3. Gemini 3.6 Flash

  • Fidelidad /5: 4,2
  • Estanco: 98 %
  • Comprobaciones: 91 %
  • Coste / generación: 0,020 US$

4. Gemini 3.5 Flash

  • Fidelidad /5: 4,1
  • Estanco: 100 %
  • Comprobaciones: 96 %
  • Coste / generación: 0,048 US$

5. Claude Opus 5

  • Fidelidad /5: 4,2
  • Estanco: 100 %
  • Comprobaciones: 95 %
  • Coste / generación: 0,126 US$

6. Kimi K3

  • Fidelidad /5: 4,2
  • Estanco: 69 %
  • Comprobaciones: 100 %
  • Coste / generación: 0,036 US$

7. Claude Sonnet 5

  • Fidelidad /5: 4,0
  • Estanco: 100 %
  • Comprobaciones: 100 %
  • Coste / generación: 0,028 US$

8. GPT-5.6 Terra Pro

  • Fidelidad /5: 4,0
  • Estanco: 100 %
  • Comprobaciones: 100 %
  • Coste / generación: 0,061 US$

9. Claude Opus 4.8

  • Fidelidad /5: 4,0
  • Estanco: 100 %
  • Comprobaciones: 98 %
  • Coste / generación: 0,063 US$

10. DeepSeek V4 Pro

  • Fidelidad /5: 4,0
  • Estanco: 83 %
  • Comprobaciones: 100 %
  • Coste / generación: 0,008 US$

11. Qwen3.7 Max

  • Fidelidad /5: 4,0
  • Estanco: 72 %
  • Comprobaciones: 95 %
  • Coste / generación: 0,014 US$

12. GLM-5.2

  • Fidelidad /5: 3,9
  • Estanco: 58 %
  • Comprobaciones: 100 %
  • Coste / generación: 0,004 US$

Mira lo que estos modelos construyeron de verdad

Abre piezas reales de los modelos que ejecuta Pro, en el editor y sin cuenta.

Frequently asked questions

¿Cómo se realiza la prueba?

Cada modelo recibe el mismo conjunto de prompts de piezas —soportes, engranajes, carcasas, mecanismos impresos en una pieza, transiciones y formas de revolución— con el mismo prompt de sistema que OwlCAD usa en producción. Cada respuesta se valida, el núcleo CAD Manifold la construye como sólido, se comprueba frente a las expectativas geométricas del prompt y un modelo evaluador, al que no se le dice qué modelo la produjo, la puntúa de 1 a 5 en fidelidad.

El evaluador también es uno de los modelos. ¿Es justo?

Se declara en lugar de ocultarse. El evaluador, Claude Opus 4.8, nunca ve qué modelo produjo un árbol, y las notas que dio a sus propias generaciones cuentan en las cifras. La tabla indica cuántas de sus notas fueron autoevaluadas, para que puedas descontarlas si lo prefieres.

¿Cuáles de estos modelos puedo usar en OwlCAD?

Pro ejecuta Gemini 3.6 Flash, Gemini 3.5 Flash, Claude Opus 4.8 y GPT-5.6 Sol con tus créditos mensuales. Todos los demás modelos de la tabla, incluidos GPT-5.6 Sol Pro y Grok 4.5, funcionan con tu propia clave de proveedor y no gastan créditos.

¿Por qué se miden el coste y la velocidad a través de OpenRouter?

Para medir todos los modelos con un mismo transporte y una misma lista de precios. En producción OwlCAD llega a algunos modelos directamente, así que el coste y el tiempo reales pueden diferir de estas cifras; la fidelidad y la estanqueidad no dependen de la ruta.

OwlCAD · Características · Precios · Galería · Para centros · Agentes de IA · Servidor MCP · Editor STL · Visor STL · Editor 3MF · Visor 3MF · Editor OBJ · Editor DXF · Visor STEP · Visor OBJ · Visor GLB · Generador 3D con IA · Personalizador de modelos · Galería de personalizadores · Comparar todo · vs TinkerCAD · vs Onshape · vs Fusion 360 · vs FreeCAD · vs SelfCAD · frente a OpenSCAD · Todos los recursos · Primeros pasos · Videotutoriales · Centro de ayuda · Invítame a un café ☕ · Contacto · Abrir editor · Créditos · Privacidad · Términos