1. MiniMax-H3 by MiniMaxAI

image-text-to-video · diffusers · Likes: 3574 · Downloads: 59368 · Hugging Face에서 보기 →

Tags: diffusers, safetensors, text-to-video, image-to-video, image-text-to-video, video-to-video, text-to-audio-video

이 모델이란. MiniMax-H3는 diffusers 라이브러리의 멀티모달 모델로, 주요 파이프라인은 image-text-to-video이며 태그에는 텍스트, 이미지, 비디오, 오디오, 레퍼런스 입력으로부터 동기화된 오디오-비디오 생성 기능도 포함되어 있습니다.

왜 트렌딩인가. 이번 주 트렌딩 점수 1346으로 트렌딩 중이며, 3,574개의 좋아요와 59,000회 이상의 다운로드라는 강력한 커뮤니티 참여에 힘입고 있습니다.

사용 대상. 텍스트, 이미지, 비디오, 오디오, 레퍼런스 입력 등 다양한 조합으로부터 동기화된 오디오-비디오 출력을 생성해야 하는 멀티모달 생성 파이프라인을 구축하는 개발자와 연구자를 위한 모델입니다.

2. Muse-Glimmer-30B by meta-models

image-text-to-text · transformers · Likes: 1097 · Downloads: 0 · Hugging Face에서 보기 →

Tags: transformers, safetensors, muse_glimmer, image-text-to-text, conversational, arxiv:2504.13181, arxiv:2602.06036

이 모델이란. Muse-Glimmer-30B는 meta-models에서 공개한 300억 파라미터의 멀티모달 모델로, image-text-to-text 생성과 대화형 작업을 위해 설계되었습니다.

왜 트렌딩인가. 1,000개 이상의 좋아요와 높은 트렌딩 점수, 그리고 Apache 2.0 오픈 라이선스와 image-text-to-text 작업을 위한 관련 연구 논문들이 링크되어 있어, 이번 주 강력한 커뮤니티 관심을 받고 있어 트렌딩 중입니다.

사용 대상. 이미지와 텍스트 입력을 함께 처리하는 멀티모달 대화형 애플리케이션을 구축하는 개발자와 연구자를 주요 대상으로 합니다.

3. DeepSeek-V4-Flash-0731 by deepseek-ai

text-generation · transformers · Likes: 3150 · Downloads: 1048685 · Hugging Face에서 보기 →

Tags: transformers, safetensors, deepseek_v4, text-generation, conversational, arxiv:2606.19348, license:mit

이 모델이란. DeepSeek-V4-Flash-0731은 대화형 모달리티의 text-generation 모델로, transformers 라이브러리를 기반으로 구축되었으며 fp8 및 8-bit 양자화 포맷으로 제공됩니다.

왜 트렌딩인가. 다운로드 횟수가 100만을 돌파했으며, 3,150개의 좋아요와 트렌딩 점수 668을 기록하여, 이번 주 커뮤니티의 강력하고 빠른 채택을 보여줍니다.

사용 대상. 특히 Azure 엔드포인트에서의 배포에 초점을 맞춘, 대화형 애플리케이션을 위한 배포 가능한 양자화 text-generation 모델을 찾는 개발자와 팀이 고려해볼 만한 모델입니다.

4. MiniMax-H3-Turbo-Lora by larryvrh

text-to-video · Likes: 651 · Downloads: 0 · Hugging Face에서 보기 →

Tags: text-to-video, text-to-audio, audio-video, lora, minimax-h3, comfyui, base_model:Comfy-Org/MiniMax-H3

이 모델이란. MiniMax-H3 모델용 LoRA 어댑터로, ComfyUI를 통해 text-to-video 생성과 관련 오디오-비디오 기능을 수행합니다.

왜 트렌딩인가. 다운로드 수는 0회이지만 651개의 좋아요와 트렌딩 점수 612라는 높은 수치를 기록하며, 이번 주 강력한 커뮤니티 참여를 이끌어낸 점이 주목할 만합니다.

사용 대상. text-to-video 및 text-to-audio 워크플로우를 위해 MiniMax-H3 기반 LoRA를 사용하고자 하는 ComfyUI 환경의 크리에이터와 개발자를 대상으로 합니다.

5. MiniMax-H3 by Comfy-Org

Model · diffusion-single-file · Likes: 1212 · Downloads: 6798796 · Hugging Face에서 보기 →

Tags: diffusion-single-file, comfyui, base_model:MiniMaxAI/MiniMax-H3, base_model:finetune:MiniMaxAI/MiniMax-H3

이 모델이란. MiniMax-H3는 ComfyUI 인터페이스에서 이미지 생성 작업을 수행하기 위해 Comfy-Org가 개발한 단일 파일 diffusion 모델입니다.

왜 트렌딩인가. 현재 Hugging Face 트렌딩 점수 535를 기록하고 있으며, 670만 회 이상의 다운로드와 1,200개 이상의 커뮤니티 좋아요를 바탕으로 최근 사용자 채택이 활발합니다.

사용 대상. 복잡한 설정 없이 휴대 가능하고 간편하게 사용할 수 있는 diffusion 모델로 이미지 생성 워크플로우를 실행하고자 하는 ComfyUI 사용자에게 적합합니다.

6. Kimi-K3 by moonshotai

image-text-to-text · transformers · Likes: 10526 · Downloads: 1565484 · Hugging Face에서 보기 →

Tags: transformers, safetensors, kimi_k3, feature-extraction, compressed-tensors, conversational, image-text-to-text

이 모델이란. Kimi-K3는 moonshotai가 개발한 멀티모달 image-text-to-text 모델로, 이미지와 텍스트 입력을 모두 받아 텍스트 출력을 생성합니다.

왜 트렌딩인가. 156만 회 이상의 다운로드, 10,500개 이상의 좋아요, 트렌딩 점수 385를 기록하며 Hugging Face 사용자 참여도가 높아, 이번 주 트렌딩 중입니다.

사용 대상. 대화형 및 시각 콘텐츠 분석 사용 사례를 포함하여 이미지와 텍스트 입력을 결합한 멀티모달 텍스트 생성 애플리케이션을 구축하는 개발자가 사용해야 할 모델입니다.

7. LFM2.5-2.6B by LiquidAI

text-generation · transformers · Likes: 550 · Downloads: 93668 · Hugging Face에서 보기 →

Tags: transformers, safetensors, lfm2, text-generation, liquid, lfm2.5, edge, conversational, ar, zh, en, fr, de, hi, id

이 모델이란. LFM2.5-2.6B는 LiquidAI의 26억 파라미터 text-generation 모델로, LFM2.5-2.6B-Base에서 미세 조정되어 다국어 대화형 사용을 위해 제작되었습니다.

왜 트렌딩인가. 트렌딩 점수 373, 좋아요 550, 다운로드 93,000회 이상을 기록하며, 엣지 중심의 다국어 설계에 대한 강한 관심을 반영하여 이번 주 주목받고 있습니다.

사용 대상. 특히 엣지 배포 시나리오를 대상으로 하는 다국어 대화형 AI 애플리케이션을 구축하는 개발자와 연구자.

8. Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF by DavidAU

image-text-to-text · Likes: 1898 · Downloads: 2521093 · Hugging Face에서 보기 →

Tags: gguf, unsloth, fine tune, heretic, uncensored, abliterated, ara, MTP GGUF Quants, Regular GGUF Quants, qwen3.6

이 모델이란. Qwen3.6 기반의 GGUF 양자화 270억 파라미터 미세 조정 언어 모델로, image-text-to-text 대화, 추론, 창작 글쓰기, 코딩 작업을 위해 구성되었습니다.

왜 트렌딩인가. 250만 회 이상의 다운로드와 거의 1,900개의 좋아요, 높은 트렌딩 점수를 기록하며, Qwen3.6 베이스 모델에 대한 다단계 비검열 미세 조정 모델에 대한 커뮤니티의 강한 관심을 반영합니다.

사용 대상. 추론 및 image-text 이해 기능을 갖춘 비제한형 다국어 대화 모델을 찾는 창작 작가, 롤플레이어, 개발자.

9. Minimax-h3-Turbo by lightx2v

image-to-video · diffusers · Likes: 341 · Downloads: 20376 · Hugging Face에서 보기 →

Tags: diffusers, t2v, i2v, r2v, image-to-video, en, zh, base_model:MiniMaxAI/MiniMax-H3

이 모델이란. Minimax-h3-Turbo는 Diffusers 기반 모델로 image-to-video 생성(추가로 text-to-video 및 reference-to-video 태그 포함)을 위해 태그되어 있으며, MiniMax-H3 베이스 모델의 파인튜닝 버전입니다.

왜 트렌딩인가. 트렌딩 점수 327, 좋아요 341, Hugging Face Hub에서 20,000회 이상의 다운로드를 기록하며, 이번 주 주목을 받고 있습니다.

사용 대상. MiniMax-H3 베이스에서 파생된 이미지 조건부 비디오 생성 모델이 필요한 Diffusers 라이브러리 사용자 개발자와 연구자.

10. Muse-Glimmer-30B-GGUF by unsloth

image-text-to-text · transformers · Likes: 305 · Downloads: 0 · Hugging Face에서 보기 →

Tags: transformers, gguf, unsloth, meta, image-text-to-text, arxiv:2504.13181, arxiv:2602.06036

이 모델이란. Meta의 Muse-Glimmer-30B 베이스 모델에서 파생된, 이미지와 텍스트를 받아 텍스트를 생성하는 GGUF 양자화 300억 비전-언어 모델로, Unsloth가 Apache-2.0 라이선스로 공개했습니다.

왜 트렌딩인가. 트렌딩 점수 301과 좋아요 305를 기록하며 Hugging Face 트렌딩 차트에서 상승 중이며, 300억 image-text-to-text 모델의 Unsloth GGUF 빌드에 대한 커뮤니티 관심이 주요 동인입니다.

사용 대상. 이미지와 텍스트를 입력받아 대화형 텍스트 응답을 생성하는 양자화된 로컬 배포형 멀티모달 모델을 실행하고자 하는 개발자와 개인 사용자.