ViaMind Radar

IA · Verificado por ViaMind

DeepSeek V4 Pro 0813 vs GPT-5.6 Sol: costo y precisión en DeepSWE

Together AI comparó ambos modelos en 904 ejecuciones de DeepSWE. GPT-5.6 Sol lidera pass@1 por 10 puntos, pero cuesta 35 veces más; DeepSeek V4 Pro gana en pass@4 y una cascada Pro-first alcanza 83,0%.

· Publicado

Fuente: Together AI · Ver original ↗

Ilustracion contextual ViaMind · no es fotografia del hecho

Lo reportado

Resultados del benchmark

Según Together AI, en 904 ejecuciones de DeepSWE, GPT-5.6 Sol supera a DeepSeek V4 Pro 0813 en pass@1 por 10 puntos, pero a un costo 35 veces mayor. DeepSeek V4 Pro gana en pass@4, y una cascada que prioriza Pro alcanza 83,0%.

Implicaciones de costo y enrutamiento

La diferencia de costo sugiere que usar DeepSeek V4 Pro como primera opción y recurrir a GPT-5.6 Sol solo cuando sea necesario puede optimizar el gasto sin sacrificar demasiada precisión. Together AI destaca la cascada Pro-first como estrategia eficiente.

Estado de evidencia: Las afirmaciones materiales incluidas fueron contrastadas con la evidencia enlazada.

Qué seguir

Observar si otros benchmarks independientes confirman la relación costo-precisión y si surgen implementaciones de cascada Pro-first en producción.

Compartir esta historia

LinkedIn WhatsApp

RECIBE VIAMIND RADAR

Lo que importa,
directo en tu correo.

Un resumen diario con una historia clave de cada sección.

Fuentes

← Volver al inicio