DeepSeek presenta V4-Flash-Vision-Exp, una versión experimental que procesa texto e imágenes de forma simultánea. Este modelo supera a su base V4-Flash y se acerca a Claude Opus 4.8 en pruebas de agentes, marcando un avance en IA visual. Para profesionales del 3D, la accesibilidad a herramientas multimodales abre puertas a nuevas formas de integrar referencias visuales en el trabajo diario, aunque su impacto en renderizado o modelado aún es limitado.
Harness 0.1.1 y tokenización de imágenes a 384 tokens 🚀
La API de DeepSeek incorpora la herramienta Harness 0.1.1, diseñada para optimizar tareas de agente con entrada visual. Las imágenes se tokenizan a 384 tokens cada una, manteniendo el precio base de la plataforma. Esta eficiencia en tokenización reduce costos de procesamiento, facilitando la experimentación con análisis de imágenes en pipelines creativos. Aunque no sustituye motores de render, la capacidad de entender contextos visuales complejos permite automatizar tareas de clasificación o referencia en etapas previas del flujo.
El futuro llegó, pero el render sigue esperando 🎨
DeepSeek acelera la competencia en IA visual, pero los modeladores 3D pueden respirar tranquilos: su software de renderizado no será reemplazado por una IA que solo mira imágenes. Mientras tanto, la integración de análisis visual en pipelines creativos se vuelve más accesible, y ya hay quien la usa para criticar tus renders antes de que los subas a la nube. Eso sí, la IA aún no sabe por qué tu malla tiene más agujeros que un queso suizo.