1. Qwen3.8-27B de Qwen

image-text-to-text · transformers · Me gusta: 11143 · Descargas: 665513 · Ver en Hugging Face →

Etiquetas: transformers, safetensors, qwen3_5, image-text-to-text, conversational, license:apache-2.0, eval-results

Qué es. Qwen3.8-27B es un modelo multimodal conversacional de Qwen que maneja tareas de image-text-to-text, aceptando tanto imágenes como texto como entradas para producir salidas de texto.

Por qué está en tendencia. Está en tendencia esta semana debido a señales de interacción muy altas en sus metadatos, incluidas más de 665,000 descargas, más de 11,000 me gusta y una puntuación de tendencia de 10,560.

Quién debería usarlo. Es muy adecuado para desarrolladores y equipos que crean aplicaciones conversacionales y multimodales que necesitan comprensión de imágenes y texto, con implementación en Azure y compatibilidad con endpoints disponible.

2. Qwen3.8-27B-GGUF de unsloth

Modelo · Me gusta: 1824 · Descargas: 3561466 · Ver en Hugging Face →

Etiquetas: gguf, qwen3_5, unsloth, base_model:Qwen/Qwen3.8-27B, base_model:quantized:Qwen/Qwen3.8-27B, license:apache-2.0

Qué es. unsloth/Qwen3.8-27B-GGUF es un modelo de lenguaje grande conversacional basado en texto, publicado por unsloth como una versión cuantizada en GGUF con imatrix del modelo base Qwen/Qwen3.8-27B.

Por qué está en tendencia. Es destacado esta semana por su alta puntuación de tendencia de 1724, junto con aproximadamente 3.56 millones de descargas y 1,824 me gusta, lo que refleja una fuerte adopción de este empaquetado cuantizado listo para ejecutar.

Quién debería usarlo. Está dirigido a desarrolladores y entusiastas que quieren ejecutar el modelo de chat Qwen3.8-27B con herramientas compatibles con GGUF y con endpoints, bajo la licencia permisiva Apache-2.0.

3. Qwen3.8-2.4T-A95B de Qwen

text-generation · transformers · Me gusta: 1066 · Descargas: 11212 · Ver en Hugging Face →

Etiquetas: transformers, safetensors, qwen3_5_moe_text, text-generation, conversational, license:other, eval-results

Qué es. Qwen/Qwen3.8-2.4T-A95B es un modelo grande de generación de texto de Qwen (publicado en formato safetensors con una arquitectura qwen3_5_moe_text) creado para tareas de generación de lenguaje conversacional.

Por qué está en tendencia. Está en tendencia esta semana con una alta señal de interacción en sus metadatos — 1,066 me gusta, más de 11,000 descargas y una puntuación de tendencia de 1,019 — junto con las etiquetas eval-results y endpoints_compatible, que sugieren evaluaciones publicadas y disponibilidad para servir el modelo.

Quién debería usarlo. Es adecuado para desarrolladores e investigadores que crean aplicaciones conversacionales de generación de texto y que quieren un modelo de la familia Qwen con resultados de evaluación informados, compatible con la biblioteca transformers y con los endpoints de inferencia.

4. MiniMax-Music3 de MiniMaxAI

text-to-audio · diffusers · Me gusta: 962 · Descargas: 11745 · Ver en Hugging Face →

Etiquetas: diffusers, safetensors, minimax_music3, music-generation, text-to-music, pytorch, sglang-omni, text-to-audio

Qué es. MiniMax-Music3 es un modelo de text-to-audio de MiniMaxAI que genera música a partir de prompts de texto, construido sobre la pila Diffusers/PyTorch.

Por qué está en tendencia. Está en tendencia esta semana con 962 me gusta, alrededor de 11.7K descargas y una alta puntuación de tendencia de 933, lo que indica un fuerte interés reciente de la comunidad en sus capacidades de text-to-music.

Quién debería usarlo. Creadores de música, diseñadores de sonido y desarrolladores que crean aplicaciones de generación de text-to-music dentro del ecosistema Diffusers y PyTorch.

5. LTX-2.5 de Lightricks

image-to-video · diffusion-single-file · Me gusta: 1224 · Descargas: 503632 · Ver en Hugging Face →

Etiquetas: diffusion-single-file, image-to-video, text-to-video, video-to-video, image-text-to-video, audio-to-video

Qué es. LTX-2.5 es un modelo de IA de Lightricks para generación de image-to-video que también admite tareas de generación text-to-video, video-to-video y relacionadas con audio en nueve idiomas.

Por qué está en tendencia. Esta semana está ganando una tracción notable, reflejada en una puntuación de tendencia de 771, más de 503,600 descargas y 1,224 me gusta en el Hugging Face Hub.

Quién debería usarlo. Creadores de video y audio, desarrolladores y usuarios de ComfyUI que buscan un único modelo que cubra la síntesis de video y audio impulsada por imagen, texto y audio.

6. DeepSeek-V4-Pro-0813 de deepseek-ai

text-generation · transformers · Me gusta: 602 · Descargas: 30985 · Ver en Hugging Face →

Etiquetas: transformers, safetensors, deepseek_v4, text-generation, conversational, arxiv:2606.19348, license:mit

Qué es. DeepSeek-V4-Pro-0813 es un modelo conversacional de generación de texto de deepseek-ai construido sobre la biblioteca transformers para producir salidas en lenguaje natural.

Por qué está en tendencia. Está llamando la atención esta semana con una puntuación de tendencia de 553, más de 30,000 descargas y más de 600 me gusta en el Hugging Face Hub.

Quién debería usarlo. Está dirigido a desarrolladores e investigadores que crean asistentes conversacionales, chatbots y otras aplicaciones de generación de texto.

7. Qwen3.8-27B-FP8 de Qwen

image-text-to-text · transformers · Me gusta: 564 · Descargas: 741011 · Ver en Hugging Face →

Etiquetas: transformers, safetensors, qwen3_5, image-text-to-text, conversational, base_model:Qwen/Qwen3.8-27B

Qué es. Qwen/Qwen3.8-27B-FP8 es un modelo base multimodal de 27 mil millones de parámetros, con licencia Apache 2.0, cuantizado en FP8, para tareas de image-text-to-text y de generación conversacional, derivado del modelo base Qwen/Qwen3.8-27B.

Por qué está en tendencia. Este modelo está en tendencia esta semana debido a su fuerte tracción en la comunidad, evidenciada por su puntuación de tendencia de 533, más de 740,000 descargas y 564 me gusta, como variante cuantizada en FP8 del popular modelo base multimodal Qwen3 27B.

Quién debería usarlo. Este modelo es adecuado para desarrolladores de IA, investigadores y profesionales que buscan un modelo multimodal de licencia abierta, cuantizado en FP8, para tareas de image-text-to-text y conversacionales, compatible con endpoints de implementación estándar.

8. Muse-Glimmer-30B de meta-models

image-text-to-text · transformers · Me gusta: 1682 · Descargas: 384097 · Ver en Hugging Face →

Etiquetas: transformers, safetensors, muse_glimmer, image-text-to-text, conversational, arxiv:2504.13181, arxiv:2602.06036

Qué es. Muse-Glimmer-30B es un modelo de lenguaje multimodal de 30 mil millones de parámetros de la organización meta-models, diseñado para tareas de image-text-to-text en un entorno conversacional.

Por qué está en tendencia. Está llamando la atención esta semana con una alta puntuación de tendencia de 506, 1,682 me gusta y 384,097 descargas, junto con eval-results publicados y enlaces a artículos recientes de arXiv.

Quién debería usarlo. Está dirigido a desarrolladores e investigadores que crean aplicaciones conversacionales multimodales como respuesta a preguntas visuales, chat basado en imágenes y asistentes de visión-lenguaje.

9. MiniMax-H3 de MiniMaxAI

image-text-to-video · minimax-h3 · Me gusta: 4145 · Descargas: 2855539 · Ver en Hugging Face →

Etiquetas: minimax-h3, diffusers, safetensors, text-to-video, image-to-video, image-text-to-video, video-to-video

Qué es. MiniMax-H3 es un modelo multimodal diseñado para generar contenido de audio y video sincronizados a partir de entradas que incluyen texto, imágenes y video, y admite una amplia gama de tareas de generación entre modalidades.

Por qué está en tendencia. Está en fuerte tendencia esta semana, como lo evidencian sus 4145 me gusta, más de 2.8 millones de descargas y su puntuación de tendencia de 487, lo que refleja un alto interés de la comunidad en sus capacidades de generación multimodal.

Quién debería usarlo. Está pensado para creadores de contenido, desarrolladores de IA e investigadores que crean aplicaciones que requieren generar audio y video sincronizados a partir de prompts de texto, imagen o video.

10. Qwen3.8-27B-Uncensored-FP8 de orcarouter

image-text-to-text · transformers · Me gusta: 532 · Descargas: 45465 · Ver en Hugging Face →

Etiquetas: transformers, safetensors, qwen3_5, image-text-to-text, abliterated, qwen3.8, uncensored, ai-red-team, red-teaming

Qué es. Qwen3.8-27B-Uncensored-FP8 es un modelo multimodal cuantizado (FP8) derivado de Qwen3.8-27B que realiza tareas de image-text-to-text, incluidos el razonamiento conversacional y la llamada de funciones (function calling).

Por qué está en tendencia. Ha atraído una interacción notable esta semana con una puntuación de tendencia de 469, más de 45,000 descargas y 532 me gusta, probablemente impulsada por el interés en su variante sin censura, abliterated y orientada al red-teaming.

Quién debería usarlo. Red-teamers de IA, investigadores de seguridad y desarrolladores que exploran capacidades multimodales cuantizadas sin censura para aplicaciones en inglés y chino.