Las mejores IA de código abierto bajo demanda en una nube soberana
Descubre las mejores alternativas de código abierto a ChatGPT, Gemini, Midjourney o Claude para tratar datos sensibles en pleno cumplimiento del derecho europeo.
Grandes modelos de lenguaje (LLM)
Las mejores alternativas de código abierto a ChatGPT, Gemini y Microsoft Copilot para interactuar, analizar y generar contenido con la IA.
Qwen/Qwen3.5-122B-A10B-FP8
El más potente
Beta
- ●
Diseñado para tareas complejas que requieren una gran ventana de contexto y mayor precisión en el razonamiento lógico.
- ●
Arquitectura optimizada para una inferencia más rápida y un consumo energético reducido, que libera notables recursos de cálculo.
- ●
Entrenado con millones de agentes y tareas cada vez más complejas para garantizar una sólida adaptabilidad al mundo real.
Modalidad
Image-Text to Text
Tokens de entrada máx.
200 000
Idiomas
Más de 100 idiomas
Llamada de funciones
Sí
Categoría del modelo
chat_large
- ●
Diseñado para tareas complejas que requieren una gran ventana de contexto y mayor precisión en el razonamiento lógico.
- ●
Arquitectura optimizada para una inferencia más rápida y un consumo energético reducido, que libera notables recursos de cálculo.
- ●
Entrenado con millones de agentes y tareas cada vez más complejas para garantizar una sólida adaptabilidad al mundo real.
Modalidad
Image-Text to Text
Tokens de entrada máx.
200 000
Idiomas
Más de 100 idiomas
Llamada de funciones
Sí
Categoría del modelo
chat_large
Apertus-70B-Instruct-2509
El más ético
Beta
- ●
Ideal para servicios multilingües, administraciones y equipos de I+D que buscan un modelo fiable y adaptable
- ●
Datos y métodos documentados para una transparencia sin precedentes
- ●
Conforme con la AI Act y respetuoso con la privacidad y la propiedad intelectual
- ●
Una versión 70B con un rendimiento comparable al de los actuales líderes del mercado
Modalidad
Text to Text
Tokens de entrada máx.
65 536
Idiomas
Más de 100 idiomas
Llamada de funciones
No
Categoría del modelo
chat_medium
- ●
Ideal para servicios multilingües, administraciones y equipos de I+D que buscan un modelo fiable y adaptable
- ●
Datos y métodos documentados para una transparencia sin precedentes
- ●
Conforme con la AI Act y respetuoso con la privacidad y la propiedad intelectual
- ●
Una versión 70B con un rendimiento comparable al de los actuales líderes del mercado
Modalidad
Text to Text
Tokens de entrada máx.
65 536
Idiomas
Más de 100 idiomas
Llamada de funciones
No
Categoría del modelo
chat_medium
google/gemma-4-31B-it
El equilibrio perfecto
Beta
- ●
El compromiso ideal entre reactividad y potencia, diseñado para destacar en el razonamiento lógico, el análisis profundo de la documentación y la generación de código fiable.
- ●
Aprovecha una arquitectura de vanguardia para ofrecer una comprensión profunda de contextos avanzados e instrucciones complejas.
- ●
Ideal para agentes conversacionales avanzados y flujos de trabajo empresariales que requieren gran versatilidad sin sacrificar la velocidad de ejecución.
Modalidad
Text-to-Text (optimizado para instrucción)
Tokens de entrada máx.
100 000
Idiomas
Más de 140 idiomas
Llamada de funciones
Sí (nativo y optimizado)
Categoría del modelo
chat_medium
- ●
El compromiso ideal entre reactividad y potencia, diseñado para destacar en el razonamiento lógico, el análisis profundo de la documentación y la generación de código fiable.
- ●
Aprovecha una arquitectura de vanguardia para ofrecer una comprensión profunda de contextos avanzados e instrucciones complejas.
- ●
Ideal para agentes conversacionales avanzados y flujos de trabajo empresariales que requieren gran versatilidad sin sacrificar la velocidad de ejecución.
Modalidad
Text-to-Text (optimizado para instrucción)
Tokens de entrada máx.
100 000
Idiomas
Más de 140 idiomas
Llamada de funciones
Sí (nativo y optimizado)
Categoría del modelo
chat_medium
moonshotai/Kimi-K2.6
El más potente para el vibe coding
Beta
- ●
Multimodal nativo: convierte texto, imágenes o maquetas en código totalmente funcional.
- ●
Concebido para el desarrollo a gran escala: integra una ventana de contexto ampliada hasta 256k tokens para gestionar proyectos complejos
- ●
Optimizado para el vibe coding: una experiencia rápida, fluida y creativa, pensada para desarrolladores y diseñadores de productos
- ●
Compatible con los flujos de trabajo agénticos: automatiza el análisis, la generación de código y su ejecución de principio a fin
Modalidad
Image-Text to Text
Tokens de entrada máx.
256 000
Idiomas
Multilingüe
Llamada de funciones
Sí
Categoría del modelo
code
- ●
Multimodal nativo: convierte texto, imágenes o maquetas en código totalmente funcional.
- ●
Concebido para el desarrollo a gran escala: integra una ventana de contexto ampliada hasta 256k tokens para gestionar proyectos complejos
- ●
Optimizado para el vibe coding: una experiencia rápida, fluida y creativa, pensada para desarrolladores y diseñadores de productos
- ●
Compatible con los flujos de trabajo agénticos: automatiza el análisis, la generación de código y su ejecución de principio a fin
Modalidad
Image-Text to Text
Tokens de entrada máx.
256 000
Idiomas
Multilingüe
Llamada de funciones
Sí
Categoría del modelo
code
mistralai/Ministral-3-14B-Instruct-2512
El más versátil
Beta
- ●
Optimizado para una implementación rápida y económica, ideal para agentes conversacionales, el análisis de documentos y las tareas especializadas.
- ●
Ofrece un rendimiento comparable al de Mistral Small 3.2 24B con un mínimo de recursos.
- ●
Capaz de analizar imágenes y proporcionar información basada en el contenido visual, además del texto.
Modalidad
Image-Text to Text
Tokens de entrada máx.
100 000
Idiomas
EN, ES, FR, DE, IT...
Llamada de funciones
Sí
Categoría del modelo
chat_small
- ●
Optimizado para una implementación rápida y económica, ideal para agentes conversacionales, el análisis de documentos y las tareas especializadas.
- ●
Ofrece un rendimiento comparable al de Mistral Small 3.2 24B con un mínimo de recursos.
- ●
Capaz de analizar imágenes y proporcionar información basada en el contenido visual, además del texto.
Modalidad
Image-Text to Text
Tokens de entrada máx.
100 000
Idiomas
EN, ES, FR, DE, IT...
Llamada de funciones
Sí
Categoría del modelo
chat_small
Modelos de reclasificación
Las mejores alternativas de código abierto compatibles para optimizar la relevancia de tus resultados de búsqueda. Optimiza la clasificación de tus documentos, mejora la precisión de tus sistemas RAG y garantiza una recuperación de la información más inteligente y contextual.
BAAI/bge-reranker-v2-m3
El más versátil
- ●
Modelo multilingüe avanzado capaz de procesar simultáneamente consultas breves, párrafos y documentos largos de hasta 8192 tokens
- ●
Combina el análisis léxico (palabras clave) y el semántico (significado) para una precisión de clasificación sin igual en corpus complejos
- ●
La solución ideal para los motores de búsqueda empresariales y las aplicaciones RAG que requieren una comprensión profunda del contexto
Modalidad
Text to Text
Tokens de entrada máx.
8192
Idiomas
Más de 100 idiomas
Llamada de funciones
No
Tipo
Posición
- ●
Modelo multilingüe avanzado capaz de procesar simultáneamente consultas breves, párrafos y documentos largos de hasta 8192 tokens
- ●
Combina el análisis léxico (palabras clave) y el semántico (significado) para una precisión de clasificación sin igual en corpus complejos
- ●
La solución ideal para los motores de búsqueda empresariales y las aplicaciones RAG que requieren una comprensión profunda del contexto
Modalidad
Text to Text
Tokens de entrada máx.
8192
Idiomas
Más de 100 idiomas
Llamada de funciones
No
Tipo
Posición
Qwen/Qwen3-Reranker-0.6B
El más eficaz
- ●
Arquitectura ultraligera (0,6 mil millones de parámetros) diseñada para una inferencia de latencia muy baja y un consumo energético mínimo
- ●
Mantiene una elevada precisión de relevancia incluso con una ventana de contexto ampliada hasta 32768 tokens
- ●
Ideal para flujos de datos en tiempo real, agentes autónomos e implementaciones a gran escala
Modalidad
Text to Text
Tokens de entrada máx.
32768
Idiomas
Más de 100 idiomas
Llamada de funciones
No
Tipo
Posición
- ●
Arquitectura ultraligera (0,6 mil millones de parámetros) diseñada para una inferencia de latencia muy baja y un consumo energético mínimo
- ●
Mantiene una elevada precisión de relevancia incluso con una ventana de contexto ampliada hasta 32768 tokens
- ●
Ideal para flujos de datos en tiempo real, agentes autónomos e implementaciones a gran escala
Modalidad
Text to Text
Tokens de entrada máx.
32768
Idiomas
Más de 100 idiomas
Llamada de funciones
No
Tipo
Posición
Modelos de embedding
Los mejores modelos de embedding de código abierto para transformar tus datos en vectores inteligentes. Mejora la precisión de tus búsquedas, personaliza tus recomendaciones, simplifica el análisis de datos, explora las conexiones semánticas y clasifica el texto fácilmente.
Bge Multilingual Gemma2
El de mayor calidad
- ●
El modelo de embedding de código abierto más potente del mercado
- ●
La referencia para las tareas de búsqueda semántica y generación aumentada por recuperación (RAG)
- ●
Ideal para un uso avanzado de los vectores de embedding en diversos casos de uso
- ●
Rendimiento excepcional, independientemente del idioma del texto (más de 100 idiomas)
Tokens de entrada máx.
8192
Parámetros
9.2 B
Dimensiones
3584
Idiomas
EN, ES, FR, DE, IT...
Tipo
Texto
- ●
El modelo de embedding de código abierto más potente del mercado
- ●
La referencia para las tareas de búsqueda semántica y generación aumentada por recuperación (RAG)
- ●
Ideal para un uso avanzado de los vectores de embedding en diversos casos de uso
- ●
Rendimiento excepcional, independientemente del idioma del texto (más de 100 idiomas)
Tokens de entrada máx.
8192
Parámetros
9.2 B
Dimensiones
3584
Idiomas
EN, ES, FR, DE, IT...
Tipo
Texto
All MiniLM L12 v2
La mejor relación calidad-precio
- ●
Este modelo es el resultado de un trabajo conjunto basado en un modelo publicado por Microsoft
- ●
Excelente relación calidad-precio, ideal para la creación de prototipos y para tareas sencillas con recursos limitados
- ●
Rendimiento interesante para tareas relativamente sencillas, independientemente del idioma del texto
- ●
Extrema velocidad para la indexación de enormes bases de datos o para el procesamiento en tiempo real
- ●
Alta eficiencia energética para reducir el impacto ambiental
Tokens de entrada máx.
512
Parámetros
33 M
Dimensiones
384
Idiomas
EN, ES, FR, DE, IT...
Tipo
Texto
- ●
Este modelo es el resultado de un trabajo conjunto basado en un modelo publicado por Microsoft
- ●
Excelente relación calidad-precio, ideal para la creación de prototipos y para tareas sencillas con recursos limitados
- ●
Rendimiento interesante para tareas relativamente sencillas, independientemente del idioma del texto
- ●
Extrema velocidad para la indexación de enormes bases de datos o para el procesamiento en tiempo real
- ●
Alta eficiencia energética para reducir el impacto ambiental
Tokens de entrada máx.
512
Parámetros
33 M
Dimensiones
384
Idiomas
EN, ES, FR, DE, IT...
Tipo
Texto
Reconocimiento de voz
Las mejores IA de código abierto para transcribir archivos de audio a texto o crear voces humanas realistas.
Whisper V3
Para transcripciones complejas
- ●
Modelo entrenado con más de 1 millón de horas de datos
- ●
Reducción de los errores de transcripción de hasta el 20% respecto a Whisper V2
- ●
Mejor gestión de los acentos, el ruido de fondo y los discursos complejos (por ejemplo, llamadas o videoconferencias)
- ●
Soporte multilingüe mejorado y traducción de transcripciones a idiomas distintos del inglés
Tamaño máximo de un archivo
25 MB
Formatos compatibles
mp3, mp4, aac, wav, flac, ogg, opus, wma, m4a
- ●
Modelo entrenado con más de 1 millón de horas de datos
- ●
Reducción de los errores de transcripción de hasta el 20% respecto a Whisper V2
- ●
Mejor gestión de los acentos, el ruido de fondo y los discursos complejos (por ejemplo, llamadas o videoconferencias)
- ●
Soporte multilingüe mejorado y traducción de transcripciones a idiomas distintos del inglés
Tamaño máximo de un archivo
25 MB
Formatos compatibles
mp3, mp4, aac, wav, flac, ogg, opus, wma, m4a
Creación y procesamiento de imágenes
Las mejores alternativas de código abierto a Midjourney, Microsoft Copilot Designer o Gemini para crear, combinar o interpretar imágenes.
Photomaker V2
Ideal para crear imágenes
- ●
La mejor combinación de calidad y velocidad en la creación de imágenes mediante IA generativa
- ●
Creación rápida de imágenes fotorrealistas en 1, 2, 4 u 8 pasos a partir de un prompt
- ●
Funciona por destilación, lo que aumenta la eficiencia energética garantizando una calidad excelente
- ●
Optimizado para el inglés, con conocimientos limitados de los demás idiomas (FR, DE, ES, IT…)
Tokens de entrada máx.
77
Imagen de salida máx.
5
Idiomas
EN
Resolución máxima
1024x1024, 1792x1024, 1024x1792
- ●
La mejor combinación de calidad y velocidad en la creación de imágenes mediante IA generativa
- ●
Creación rápida de imágenes fotorrealistas en 1, 2, 4 u 8 pasos a partir de un prompt
- ●
Funciona por destilación, lo que aumenta la eficiencia energética garantizando una calidad excelente
- ●
Optimizado para el inglés, con conocimientos limitados de los demás idiomas (FR, DE, ES, IT…)
Tokens de entrada máx.
77
Imagen de salida máx.
5
Idiomas
EN
Resolución máxima
1024x1024, 1792x1024, 1024x1792
Flux schnell
Ideal para editar y combinar retratos de personas
- ●
Creación de fotos en varios estilos a partir de una o varias fotos de perfil
- ●
Potente y flexible: recontextualización, coloración, cambio de edad y género, mezcla de identidades...
Tokens de entrada máx.
77
Imagen de entrada máx.
6
Imagen de salida máx.
5
Idiomas
EN
Resolución máxima
1024x1024, 1792x1024, 1024x1792
- ●
Creación de fotos en varios estilos a partir de una o varias fotos de perfil
- ●
Potente y flexible: recontextualización, coloración, cambio de edad y género, mezcla de identidades...
Tokens de entrada máx.
77
Imagen de entrada máx.
6
Imagen de salida máx.
5
Idiomas
EN
Resolución máxima
1024x1024, 1792x1024, 1024x1792
