DeepSeek lanza un modelo de IA experimental
El laboratorio de Inteligencia Artificial (IA) DeepSeek ha publicado un modelo multimodal experimental que, en la tabla compartida por la propia compañía, supera a Opus 4.8 de Anthropic en tres de once pruebas (‘benchmarks’).
El modelo es DeepSeek-V4-Flash-VisionExp y añade capacidad de visión al modelo previo V4-Flash, lo que le permite interpretar imágenes y capturas de pantalla, y con ello amplía sus posibilidades de uso.
“Este modelo multimodal experimental iguala a DeepSeek-V4-Flash en capacidades de texto, incluyendo agentes, razonamiento y conocimiento del mundo” , afirma DeepSeek en su anuncio en X (antes Twitter), donde sostiene que es un gran salto sobre V4- Flash que acerca su rendimiento como agente multimodal al mencionado de Anthropic.
En lo que respecta al rendimiento, el laboratorio de IA afirma que, de las once pruebas, DeepSeek supera a Opus 4.8 en tres (DeepSWE, Agents’ Last Exam y ZeroBench), mientras que en el resto se queda detrás, con una diferencia de doce puntos en el ‘benchmark’ de tareas complejas de repositorios (NL2Repo).
Comparado con la versión V4-Flash de solo texto, el modelo experimental lo supera en seis de las siete evaluaciones de texto, aunque cabe recordar que ese modelo no es capaz de ver imágenes.