🌐Modelos multimodales
LLM especializado en imágenes y videos
Salamandra-VL-7B-2512
Versión más reciente de la familia de modelos multimodales Salamandra. Combina el codificador visual SigLIP 2 Giant con Salamandra 7B ajustado para seguir instrucciones, con especial atención a las lenguas europeas, y mejora la comprensión visual detallada y el conteo mediante datos PixMo.
LLM especializado en imágenes y videos
salamandra-7b-vision
Modelo salamandra-7b adaptado para el procesamiento de imágenes y videos.
Traducción de voz a texto
SalamandraTAV-7b
Modelo de lenguaje multimodal especializado en voz y traducción, afinado a partir de salamandraTA-7b-instruct, Admite seis lenguas ibéricas además del inglés y puede realizar reconocimiento automático del habla, traducción de texto, traducción de voz a texto e identificación de la lengua hablada.
Modelo multimodal (voz y texto)
speech-salamandra-es-en
Modelo multimodal de voz y texto en español e inglés, basado en Salamandra-7B-Instruct e integrado con el codificador de voz de SeamlessM4T v2. Puede recibir instrucciones de texto y audio para realizar reconocimiento automático del habla y responder preguntas sobre contenidos hablados.
Modelo multimodal y muiltilingüe instruido
Latxa-Qwen3.5-2B
Modelo multimodal y multilingüe instruido, basado en Qwen3-VL-2B-Instruct, capaz de comprender y generar texto, procesar imágenes y seguir instrucciones. Ha sido adaptado para mejorar su rendimiento en euskera y, en su variante multilingüe, también en gallego y catalán.
Modelo multimodal y muiltilingüe instruido
Latxa-Qwen3.5-4B
Modelo multimodal y multilingüe instruido, basado en Qwen3.5-4B, capaz de comprender y generar texto, procesar imágenes y seguir instrucciones. Ha sido adaptado para mejorar su rendimiento en euskera, gallego y catalán.
Modelo multimodal y muiltilingüe instruido
Latxa Qwen-3 VL 2B
Modelo multimodal y multilingüe instruido, basado en Qwen3-VL-2B-Instruct, capaz de comprender y generar texto, procesar imágenes y seguir instrucciones. Ha sido adaptado para mejorar su rendimiento en euskera y, en su variante multilingüe, también en gallego y catalán.
Modelo multimodal y muiltilingüe instruido
Latxa Qwen-3 VL 4B
Modelo multimodal y multilingüe instruido, basado en Qwen3-VL-4B-Instruct, capaz de comprender y generar texto, procesar imágenes y seguir instrucciones. Ha sido adaptado para mejorar su rendimiento en euskera y, en su variante multilingüe, también en gallego y catalán.
Modelo multimodal y muiltilingüe instruido
Latxa-Qwen3-VL-8B-Instruct
Modelo multimodal y multilingüe instruido, basado en Qwen3-VL-8B-Instruct, capaz de comprender y generar texto, procesar imágenes y seguir instrucciones. Ha sido adaptado para mejorar su rendimiento en euskera y, en su variante multilingüe, también en gallego y catalán.
Modelo multimodal y muiltilingüe instruido
Latxa-Qwen3-VL-32B-Instruct
Modelo multimodal y multilingüe instruido, basado en Qwen3-VL-32B-Instruct, capaz de comprender y generar texto, procesar imágenes y seguir instrucciones. Ha sido adaptado para mejorar su rendimiento en euskera y, en su variante multilingüe, también en gallego y catalán.
Última actualización
