1. MiniMaxAI による MiniMax-H3

画像・テキスト→動画 · diffusers · いいね: 3574 · ダウンロード: 59368 · Hugging Faceで表示 →

タグ: diffusers, safetensors, text-to-video, image-to-video, image-text-to-video, video-to-video, text-to-audio-video

概要. MiniMax-H3 は、diffusers ライブラリのマルチモーダルモデルです。主要なパイプラインは画像・テキスト→動画で、テキスト、画像、動画、音声、参照入力から同期された音声付き動画を生成するタグも含まれています。

トレンドの理由. トレンドスコア 1346 で今週トレンドに入っており、3,574 件のいいねと 59,000 を超えるダウンロードという強力なコミュニティの関心を背景にしています。

対象ユーザー. テキスト、画像、動画、音声、参照入力の組み合わせから同期された音声付き動画を出力する必要がある、マルチモーダル生成パイプラインを構築する開発者や研究者。

2. meta-models による Muse-Glimmer-30B

画像・テキスト→テキスト · transformers · いいね: 1097 · ダウンロード: 0 · Hugging Faceで表示 →

タグ: transformers, safetensors, muse_glimmer, image-text-to-text, conversational, arxiv:2504.13181, arxiv:2602.06036

概要. Muse-Glimmer-30B は、meta-models による 300 億パラメータのマルチモーダルモデルで、画像・テキスト→テキスト生成と会話タスク向けに設計されています。

トレンドの理由. 1,000 を超えるいいねと高いトレンドスコアで示される強力なコミュニティの関心に加え、Apache 2.0 ライセンスでの公開や、画像・テキスト→テキストタスクに関連する研究論文へのリンクがあることから、今週トレンド入りしています。

対象ユーザー. 画像とテキストを組み合わせた入力を処理するマルチモーダルな会話アプリケーションを構築する開発者や研究者が、このモデルの対象読者です。

3. deepseek-ai による DeepSeek-V4-Flash-0731

テキスト生成 · transformers · いいね: 3150 · ダウンロード: 1048685 · Hugging Faceで表示 →

タグ: transformers, safetensors, deepseek_v4, text-generation, conversational, arxiv:2606.19348, license:mit

概要. DeepSeek-V4-Flash-0731 は会話モードのテキスト生成モデルで、transformers ライブラリに基づき、fp8 および 8-bit 量子化形式で提供されています。

トレンドの理由. 100 万ダウンロードを突破し、3,150 件のいいねとトレンドスコア 668 を獲得しており、今週の強く急速なコミュニティ採用を示しています。

対象ユーザー. 会話アプリケーション向けにデプロイ可能な量子化テキスト生成モデルを探す開発者やチーム、特に Azure エンドポイントでの利用を検討している層が、このモデルを検討すべきです。

4. larryvrh による MiniMax-H3-Turbo-Lora

テキスト→動画 · いいね: 651 · ダウンロード: 0 · Hugging Faceで表示 →

タグ: text-to-video, text-to-audio, audio-video, lora, minimax-h3, comfyui, base_model:Comfy-Org/MiniMax-H3

概要. これは MiniMax-H3 モデル用の LoRA アダプタで、ComfyUI を介してテキスト→動画生成および関連する音声付き動画機能を実行します。

トレンドの理由. 記録されたダウンロードは 0 であるものの、651 件のいいねと 612 という高いトレンドスコアを獲得し、強力なコミュニティの関心を集めて今週注目されています。

対象ユーザー. ComfyUI で作業し、テキスト→動画やテキスト→音声のワークフローに MiniMax-H3 ベースの LoRA を利用したいクリエイターや開発者向けです。

5. Comfy-Org による MiniMax-H3

モデル · diffusion-single-file · いいね: 1212 · ダウンロード: 6798796 · Hugging Faceで表示 →

タグ: diffusion-single-file, comfyui, base_model:MiniMaxAI/MiniMax-H3, base_model:finetune:MiniMaxAI/MiniMax-H3

概要. MiniMax-H3 は Comfy-Org が開発した単一ファイルの拡散モデルで、ComfyUI インターフェースで画像生成タスクを行うために使用します。

トレンドの理由. 現在 Hugging Face のトレンドスコア 535、670 万を超えるダウンロード、1,200 件を超えるコミュニティのいいねを獲得しており、最近の強力なユーザー採用を反映しています。

対象ユーザー. 画像生成ワークフローを煩雑なセットアップなしで実行できる、ポータブルで導入負担の少ない拡散モデルを求める ComfyUI ユーザーに適しています。

6. moonshotai による Kimi-K3

画像・テキスト→テキスト · transformers · いいね: 10526 · ダウンロード: 1565484 · Hugging Faceで表示 →

タグ: transformers, safetensors, kimi_k3, feature-extraction, compressed-tensors, conversational, image-text-to-text

概要. Kimi-K3 は moonshotai が開発したマルチモーダルな画像・テキスト→テキストモデルで、画像とテキストの両方の入力を受け取りテキストを出力します。

トレンドの理由. Hugging Face でのユーザー関心が高く、156 万を超えるダウンロード、10,500 件を超えるいいね、トレンドスコア 385 を獲得しているため、今週トレンド入りしています。

対象ユーザー. 画像とテキストを組み合わせた入力を用いたマルチモーダルテキスト生成アプリケーションを構築する開発者、とくに会話や視覚コンテンツ分析のユースケースを含む場合、このモデルを使用すべきです。

7. LiquidAI による LFM2.5-2.6B

テキスト生成 · transformers · いいね: 550 · ダウンロード: 93668 · Hugging Faceで表示 →

タグ: transformers, safetensors, lfm2, text-generation, liquid, lfm2.5, edge, conversational, ar, zh, en, fr, de, hi, id

概要. LFM2.5-2.6B は LiquidAI の 2.6B パラメータのテキスト生成モデルで、多数の言語での会話用途向けに LFM2.5-2.6B-Base からファインチューニングされています。

トレンドの理由. 高いトレンドスコア 373、550 件のいいね、93,000 を超えるダウンロードで今週注目を集めており、エッジ向けの多言語設計に対する強い関心を反映しています。

対象ユーザー. 多言語会話 AI アプリケーションを構築する開発者や研究者、とくにエッジデプロイメントを想定している層向けです。

8. DavidAU による Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF

画像・テキスト→テキスト · いいね: 1898 · ダウンロード: 2521093 · Hugging Faceで表示 →

タグ: gguf, unsloth, fine tune, heretic, uncensored, abliterated, ara, MTP GGUF Quants, Regular GGUF Quants, qwen3.6

概要. Qwen3.6 をベースとした GGUF 量子化 27B パラメータのファインチューニング言語モデルで、画像・テキスト→テキストの会話、推論、創作、コーディングタスク向けに設定されています。

トレンドの理由. 250 万を超えるダウンロードと 1,900 件に迫るいいねを蓄積し、高いトレンドスコアを伴っています。これは Qwen3.6 ベースの多段階の検閲なしファインチューンに対する強いコミュニティの関心を反映しています。

対象ユーザー. 推論と画像・テキスト理解を備えた、制限のない多言語会話モデルを求めるクリエイティブな執筆者、ロールプレイヤー、開発者向けです。

9. lightx2v による Minimax-h3-Turbo

画像→動画 · diffusers · いいね: 341 · ダウンロード: 20376 · Hugging Faceで表示 →

タグ: diffusers, t2v, i2v, r2v, image-to-video, en, zh, base_model:MiniMaxAI/MiniMax-H3

概要. Minimax-h3-Turbo は Diffusers ベースのモデルで、画像→動画生成用にタグ付けされており(テキスト→動画や参照→動画のタグも追加)、MiniMax-H3 ベースモデルのファインチューンです。

トレンドの理由. トレンドスコア 327 で今週牽引力を伸ばしており、341 件のいいねと Hugging Face Hub での 20,000 を超えるダウンロードに支えられています。

対象ユーザー. Diffusers ライブラリを使用し、MiniMax-H3 ベースから派生した画像条件付き動画生成モデルを必要とする開発者や研究者向けです。

10. unsloth による Muse-Glimmer-30B-GGUF

画像・テキスト→テキスト · transformers · いいね: 305 · ダウンロード: 0 · Hugging Faceで表示 →

タグ: transformers, gguf, unsloth, meta, image-text-to-text, arxiv:2504.13181, arxiv:2602.06036

概要. Meta の Muse-Glimmer-30B ベースモデルから派生し、Unsloth が Apache-2.0 ライセンスで公開した、GGUF 量子化 30B ビジョン言語モデルです。画像とテキストからテキスト生成を行います。

トレンドの理由. 今週 Hugging Face のトレンドチャートを上昇しており、高いトレンドスコア 301 といいね 305 件を記録しています。これは 30B の画像・テキスト→テキストモデルに対する Unsloth の GGUF ビルドへのコミュニティの関心に後押しされています。

対象ユーザー. 画像とテキストを受け取り、会話形式のテキスト応答を生成する、量子化されたローカルデプロイ可能なマルチモーダルモデルを実行したい開発者やホビイスト向けです。