生成AIモデル、多すぎてどれが何かわからない?〜最新17本を大きさ・作り・用途で分けてみた

2026年9月28日

本ページは広告(アフィリエイトプログラム)を含みます。詳しくはプライバシーポリシーをご覧ください。

新しい生成AIのモデルが、毎日のように生まれています。中には聞いたことのない名前も多く、どれが自分に関係あるのか分からなくなります。最近出たモデルは、それぞれどんなものなのでしょうか?

2026年9月28日時点で調べた内容です。

スポンサーリンク

調べた生成AIモデルについて

モデルは、Hugging Face(AIモデルの配布サイト)から集めました。ローカルLLMで使うモデルは、ほとんどがここで公開されています。

対象は、2026年8月5日から9月21日までに公開された、文章を扱うモデル17本です。Hugging Face の人気一覧(トレンド)の上位60本と、9月13日時点の上位30本から、開発元が公開した本体だけを選びました。他の人が作り直した版(縮めた版・追加で学習させた版)は1本として数えず、そのダウンロード数だけを本体に足しています。

それぞれについて、次の項目を調べました。

  • 人気:Hugging Face が表示する、直近30日のダウンロード数。本体と GGUF(下で説明します)の合計
  • 大きさ:パラメータ数(モデルの中の数値の個数。1B=10億個)と、4ビットに縮めた形式(Q4_K_M)のファイルサイズ
  • 作り:全部を毎回使う「通常型」か、一部だけを使う「MoE」か
  • 得意なこと:開発元がモデルの説明ページ(モデルカード)に書いている内容
  • GGUF が出た日:本体の公開から、最初の GGUF が出るまでの日数

「得意なこと」は開発元の説明をまとめたもので、当ブログで確かめたものではありません。

GGUF って何?

GGUF(ジーガフ)は、生成AIのモデルを自分のPCで動かすためのファイル形式です。

開発元が公開するモデルの本体は、多くが safetensors という形式です。大きなモデルほどファイルが多く、今回の17本では1個から644個に分かれていました。中の数値も縮めていない元の精度のままなので、ファイルが大きく、主にサーバーの専用ソフトで使う前提になっています。

GGUF は、この本体を llama.cpp(自分のPCで生成AIを動かすための代表的な無料ソフト)で読み込めるように変換したものです。モデルの数値と設定を1つのファイルにまとめ、多くは4ビットなどに縮めて(量子化して)配られます。自分のPCで生成AIを動かすアプリの Ollama や LM Studio も、GGUF を読み込めます。

ファイル名にある「Q4_K_M」「Q8_0」といった記号は、縮め方の種類です。数字が小さいほどファイルは小さくなりますが、答えの質は少しずつ落ちます。この記事では、大きさと質のつり合いがよく、よく使われる Q4_K_M を基準にしました。

GGUF は、開発元ではなく有志の変換者が作って公開することが多くあります。今回の16本(最初から GGUF の Ternary-Bonsai-2-27B を除く)で、開発元が自分で GGUF を出していたのは3本(Xing4.0-29B-A4B、MiniCPM5-2B、ZDTaichu5.0-9B)でした。そのため、本体の公開から GGUF が出るまでの日数は、モデルによって違います。

スポンサーリンク

17本の一覧(人気順)

ダウンロードされた順に並べ、それぞれどんなモデルなのかを一覧にしました。

順モデル出した所公開日ダウンロード(30日)パラメータ数作り4ビット版のサイズ得意と説明されていること
1Qwen3.8-27BQwen(アリババ)08/053,881万27.8B通常型16.5GBコーディングやエージェントの複数手順作業が得意
2Qwen3.8-Flash-NextQwen(アリババ)08/24518万180.0BMoE(専門家512のうち10)111.3GB(UD-Q4_K_XL)長い文脈のエージェント処理を高速にする実験的な新設計
3Ternary-Bonsai-2-27BPrismML(新興)09/16356万——5.9GB(1.75ビット)小さくても27B級の考える力をよく保てる
4DeepSeek-V4.1-FlashDeepSeek09/10183万763.2BMoE(専門家384のうち6)444.7GB長い文脈でもメモリを節約し効率よく動くのが得意
5MiniCPM5-2BOpenBMB(清華大学系)09/0688万2.5B通常型1.6GB省リソース端末向けの軽量2Bで2B級最高水準の性能
6Nex-N2.5-miniNex AGI(新興)09/0817万35.1BMoE(専門家256のうち8)22.3GB実世界での長時間のエージェント作業が得意
7MiMo-V2.6-Distill-Qwen-9BXiaomi(シャオミ)09/2113万9.4B通常型5.8GBコーディングや道具を使うエージェント作業が得意
8Edge0-35B-A3B-previewEdge0(新興)09/088.0万34.7BMoE(専門家256のうち8)—スマホ並みの少メモリで35B級モデルが動く
9MiMo-V2.6-Pro-RLXiaomi(シャオミ)09/217.7万1,024.2BMoE(専門家384のうち8)528.9GB(MXFP4)強化学習を大規模に回し自己改善し続けるのが得意
10Hemmingway-1Altworld(新興)09/206.7万26.9B通常型17.4GB日常のメールやメッセージを人間らしい文章で書くのが得意
11Xing4.0-29B-A4BXingChen-AGI(新興)09/166.2万31.2BMoE(専門家64のうち4)19.0GB計画を立てて道具を使いこなすエージェント作業が得意
12MiMo-V2.6-Flash-RLXiaomi(シャオミ)09/215.1万310.8BMoE(専門家256のうち8)167.4GB(MXFP4)軽さと性能のバランスを取った強化学習モデル
13Nex-N2.5-ProNex AGI(新興)09/084.1万396.8BMoE(専門家512のうち10)250.8GB実世界での長時間のエージェント作業が得意
14ZDTaichu5.0-9BTaichuAI(中国の研究機関系)09/042.2万9.8B通常型5.6GB画像や動画を使った空間把握と道具操作が得意
15Nex-N2.5-MaxNex AGI(新興)09/071.3万1,600.8BMoE(専門家384のうち6)897.8GB(4ビットと8ビットの混合)実世界での長時間のエージェント作業が得意
16AliceAI-Foundation-80B-A3B-BaseYandex(ロシアの検索大手)09/127,74381.3BMoE(専門家512のうち10)48.3GBロシア語の事実知識問題が特に強い基盤モデル
17LensVLM-9BApple09/216,2079.4B通常型5.8GB圧縮した文書画像から必要な部分だけ展開して読み解ける

ダウンロード数は直近30日の数で、公開からの累計ではありません。公開から日が浅いモデルほど、少なく出ます。サイズは Q4_K_M を基本にし、Q4_K_M が配られていないものは、最も近い4ビット前後の形式を( )に書きました。UD-Q4_K_XL や MXFP4 は、Q4_K_M とは別の4ビット前後の縮め方です。Ternary-Bonsai-2-27B は、最初から1.75ビットという、4ビットの半分以下まで縮めた独自の形式の GGUF で配られています。「—」は GGUF が無いものです。

スポンサーリンク

自分のPCで動かせる大きさはどれ?

自分のPCで動かせるかは、まずファイルサイズで決まります。ファイルがグラフィックボードのメモリ(VRAM)か、PC本体のメモリに収まらないと動かないからです。実際には、会話の内容を覚えておく領域(KVキャッシュ)として、ファイルサイズより数GB多い空きが必要になります。なお、Mac やメモリを共有する作りのミニPCは、本体のメモリをグラフィック用にも使えるため、同じメモリ量の一般的なPCより大きなモデルを扱えます。

大きさ用途モデル4ビット版のサイズ
8GB以下小型・エージェントMiniCPM5-2B1.6GB
8GB以下画像も読める・エージェントZDTaichu5.0-9B5.6GB
8GB以下エージェント・プログラミングMiMo-V2.6-Distill-Qwen-9B5.8GB
8GB以下画像も読めるLensVLM-9B5.8GB
8GB以下推論・小型Ternary-Bonsai-2-27B5.9GB(1.75ビット)
8〜24GBプログラミング・エージェントQwen3.8-27B16.5GB
8〜24GB文章作成Hemmingway-117.4GB
8〜24GBエージェント・プログラミングXing4.0-29B-A4B19.0GB
8〜24GBエージェント・画像も読めるNex-N2.5-mini22.3GB
24〜100GB土台(Base)AliceAI-Foundation-80B-A3B-Base48.3GB
100GB超エージェント・画像も読めるQwen3.8-Flash-Next111.3GB(UD-Q4_K_XL)
100GB超エージェント・画像も読めるMiMo-V2.6-Flash-RL167.4GB(MXFP4)
100GB超エージェント・画像も読めるNex-N2.5-Pro250.8GB
100GB超エージェント・画像も読めるDeepSeek-V4.1-Flash444.7GB
100GB超エージェント・画像も読めるMiMo-V2.6-Pro-RL528.9GB(MXFP4)
100GB超エージェントNex-N2.5-Max897.8GB(4ビットと8ビットの混合)
GGUF なし小型Edge0-35B-A3B-preview—

17本のうち、VRAM 24GB 以内に収まるのは9本、100GB を超えるのは6本でした。DeepSeek-V4.1-Flash は4ビットに縮めても約445GB、Nex-N2.5-Max は約898GBあります。

スポンサーリンク

MoE とは何で、どれが MoE?

MoE(Mixture of Experts)は、モデルの中を多数の「専門家」に分け、1つの言葉を作るたびに一部の専門家だけを使う作りです。たとえば Xing4.0-29B-A4B では、64ある専門家(エキスパート)のうち、1回に使うのは4つだけです。全体は大きくても、1回に動かす量が少ないぶん、同じ大きさの通常型より速く答えを書けるのが特徴です。ただし、使わない専門家もメモリには置いておかなければなりません。必要なメモリの量は、あくまで全体の大きさで決まります。

17本のうち、MoE は10本でした。モデル名の「A3B」「A4B」は、1回に使う量(Active)がおよそ30億・40億という意味です。

それぞれのモデルは何が得意?

用途VRAM の目安モデル
エージェント8GB以下MiniCPM5-2B, ZDTaichu5.0-9B, MiMo-V2.6-Distill-Qwen-9B
エージェント8〜24GBQwen3.8-27B, Xing4.0-29B-A4B, Nex-N2.5-mini
エージェント100GB超Qwen3.8-Flash-Next, MiMo-V2.6-Flash-RL, Nex-N2.5-Pro, DeepSeek-V4.1-Flash, MiMo-V2.6-Pro-RL, Nex-N2.5-Max
プログラミング8GB以下MiMo-V2.6-Distill-Qwen-9B
プログラミング8〜24GBQwen3.8-27B, Xing4.0-29B-A4B
画像も読める8GB以下ZDTaichu5.0-9B, LensVLM-9B
画像も読める8〜24GBNex-N2.5-mini
画像も読める100GB超Qwen3.8-Flash-Next, MiMo-V2.6-Flash-RL, Nex-N2.5-Pro, DeepSeek-V4.1-Flash, MiMo-V2.6-Pro-RL
文章作成8〜24GBHemmingway-1
推論8GB以下Ternary-Bonsai-2-27B
小型8GB以下MiniCPM5-2B, Ternary-Bonsai-2-27B
小型GGUF なしEdge0-35B-A3B-preview
土台(Base)24〜100GBAliceAI-Foundation-80B-A3B-Base

複数の用途に当てはまるものは、それぞれの欄に入れています。用途は、モデルカードの説明全体から分けたもので、一覧の1文に入りきらなかった用途も含みます。「エージェント」は、AIが自分で判断しながら、検索やプログラムの実行といった道具を使って複数の手順をこなす使い方です。「土台(Base)」は、そのままではチャットの相手として使いにくいモデルで、ほかの開発者が追加で学習させる元として公開されています。

スポンサーリンク

どこが出したモデル?

17本を、出した所と、元にしたモデルで分けました。

出した所区分モデル元にしたモデル
Apple大手・研究機関LensVLM-9BQwen3.5-9B
DeepSeek大手・研究機関DeepSeek-V4.1-Flash—
OpenBMB(清華大学系)大手・研究機関MiniCPM5-2B—
Qwen(アリババ)大手・研究機関Qwen3.8-27B—
Qwen(アリババ)大手・研究機関Qwen3.8-Flash-Next—
Xiaomi(シャオミ)大手・研究機関MiMo-V2.6-Distill-Qwen-9BQwen3.5-9B
Xiaomi(シャオミ)大手・研究機関MiMo-V2.6-Flash-RL—
Xiaomi(シャオミ)大手・研究機関MiMo-V2.6-Pro-RL—
Yandex(ロシアの検索大手)大手・研究機関AliceAI-Foundation-80B-A3B-Base—
Altworld新興Hemmingway-1Qwen3.8-27B
Edge0新興Edge0-35B-A3B-previewQwen3.6-35B-A3B
Nex AGI新興Nex-N2.5-Max—
Nex AGI新興Nex-N2.5-ProNex-N2(同じ開発元の前の版)
Nex AGI新興Nex-N2.5-miniNex-N2(同じ開発元の前の版)
PrismML新興Ternary-Bonsai-2-27BQwen3.8-27B
TaichuAI(中国の研究機関系)新興ZDTaichu5.0-9BQwen3.5-9B
XingChen-AGI新興Xing4.0-29B-A4B—

新しい名前に見えても、17本のうち6本は Qwen のモデルを元に作られていました。Apple の LensVLM-9B や Xiaomi の MiMo-V2.6-Distill-Qwen-9B のように、大手が出したモデルでも、元は Qwen3.5-9B です。元になったモデルはモデルカードに書かれているので、見慣れない名前のモデルは、まず何を元にしているかを見ると性格をつかみやすくなります。

スポンサーリンク

人気はどこに集まっている?

17本の直近30日のダウンロード数を合計すると、約5,099万回でした。そのうち約76%が Qwen3.8-27B の1本に集まっています。

本体と GGUF のどちらが多くダウンロードされているかでも、はっきり分かれました。GGUF のダウンロードが本体の何倍かで並べます(Ternary-Bonsai-2-27B は最初から GGUF で配られているため除きます)。

モデル本体のダウンロードGGUF のダウンロードGGUF ÷ 本体分け方
Nex-N2.5-mini9,50716万17.1倍GGUF が多い(5倍以上)
MiMo-V2.6-Distill-Qwen-9B8,83912万14.1倍GGUF が多い(5倍以上)
Hemmingway-15,9046.1万10.3倍GGUF が多い(5倍以上)
Qwen3.8-27B673万3,208万4.8倍中間
Qwen3.8-Flash-Next123万395万3.2倍中間
LensVLM-9B1,7404,4672.6倍中間
DeepSeek-V4.1-Flash65万118万1.8倍中間
AliceAI-Foundation-80B-A3B-Base3,4564,2871.2倍中間
MiMo-V2.6-Flash-RL2.6万2.5万1.0倍中間
ZDTaichu5.0-9B1.2万1.0万0.9倍中間
Xing4.0-29B-A4B4.5万1.7万0.4倍中間
Nex-N2.5-Pro3.3万8,3870.3倍中間
MiniCPM5-2B77万11万0.1倍本体が多い(GGUF が5分の1未満)
MiMo-V2.6-Pro-RL7.5万1,7260.0倍本体が多い(GGUF が5分の1未満)
Nex-N2.5-Max1.3万2460.0倍本体が多い(GGUF が5分の1未満)
Edge0-35B-A3B-preview8.0万00.0倍本体が多い(GGUF が5分の1未満)

GGUF は自分のPCで動かすための形式なので、GGUF が多いモデルは、自分のPCで使う人が多いと推測できます。反対に本体ばかりのモデルは、サーバーで動かす人向けか、GGUF がまだ出ていないものです。

ただし、これはダウンロード数からの推測です。もし GGUF のダウンロードの多くが、人ではなく自動の仕組み(配布の中継や試験用の取得)によるものなら、この読み方は成り立ちません。Hugging Face はダウンロード数の内訳を公開していないため、この点は確かめようがありません。

スポンサーリンク

GGUF は公開から何日で出た?

モデル最初の GGUFGGUF の数(9/28)
DeepSeek-V4.1-Flash当日16
Nex-N2.5-mini当日15
MiMo-V2.6-Distill-Qwen-9B当日25
Hemmingway-1当日19
MiniCPM5-2B当日(開発元が配布)34
Xing4.0-29B-A4B当日(開発元が配布)7
Qwen3.8-27B1日後141
Qwen3.8-Flash-Next1日後111
MiMo-V2.6-Flash-RL1日後13
MiMo-V2.6-Pro-RL2日後3
Nex-N2.5-Max2日後1
LensVLM-9B2日後4
Nex-N2.5-Pro4日後4
AliceAI-Foundation-80B-A3B-Base10日後2
ZDTaichu5.0-9B12日後3
Edge0-35B-A3B-previewまだ出ていない(20日経過)0

Ternary-Bonsai-2-27B(最初から GGUF で配られているモデル)を除く16本のうち、9本は公開の翌日までに GGUF が出ていました。一方、Edge0-35B-A3B-preview は公開から20日経っても GGUF が1つもありません。本体のダウンロードは約8万回あります。モデルカードによると、Edge0 は、スマートフォン並みの少ないメモリで動かすための独自の形式で配られていて、GGUF は用意されていません。GGUF が出ない理由は、関心の低さよりも、配り方の違いにあると考えられます。

GGUF が出ても、すぐ動くとは限りません。DeepSeek-V4.1-Flash は公開当日に GGUF が出ましたが、当ブログの測定用PCの llama.cpp(2026年9月時点の版 b10605)では読み込みに失敗しました(DeepSeek V4.1-Flashが動かない〜ローカル動作を試みた)。新しい設計のモデルは、llama.cpp 側が対応するまで読めないことがあります。

スポンサーリンク

同じPCで動かすと、どれくらい速い?

同じPC(GMKtec EVO-X2・メモリ128GB)、同じ llama.cpp の版、同じ形式(Q4_K_M)で、動かせるモデルの速さを測っているところです。まとまりしだい、読ませる速さと書く速さ(tok/s=1秒あたりに処理する言葉のかけら「トークン」の数)をここに載せます。

スポンサーリンク

この記事で確かめていないこと

  • 「得意なこと」は開発元の説明で、当ブログでは試していません
  • 17本の選び方は Hugging Face の人気一覧に依存します。一覧の並び方の仕組みは公開されていません
  • GGUF の数は、Hugging Face 上で元のモデルが登録されているものだけを数えています。登録していない GGUF は数に入っていません
  • ダウンロード数は人と自動の取得を区別できません

まとめ〜自分のPCなら、まずどれを試す?

最近出た17本のうち、自分のPCで動かしやすい24GB以下は9本、100GB を超えて家庭のPC1台では動かしにくいものは6本でした。話題の中心にいる大きなモデルと、自分のPCで試せるモデルは別のものだと考えたほうが、追いかけやすくなります。

自分のPCで試すなら、メモリの量で候補がほぼ決まります。

VRAM/メモリの目安モデル用途注意
8GB 前後MiniCPM5-2B小型・エージェント
8GB 前後ZDTaichu5.0-9B画像も読める・エージェント
8GB 前後MiMo-V2.6-Distill-Qwen-9Bエージェント・プログラミング
8GB 前後LensVLM-9B画像も読める
8GB 前後Ternary-Bonsai-2-27B推論・小型1.75ビットの独自形式
24GBQwen3.8-27Bプログラミング・エージェント
24GBHemmingway-1文章作成
24GBXing4.0-29B-A4Bエージェント・プログラミング
24GBNex-N2.5-miniエージェント・画像も読める22.3GBあり、24GB では収まらない可能性が高い
64〜128GB(本体のメモリ)AliceAI-Foundation-80B-A3B-Base土台(Base)土台モデルで、チャットにはそのまま使いにくい

最初の1本に迷ったら、ダウンロードが最も多く、GGUF も翌日に出ていた Qwen3.8-27B が無難です。VRAM が足りない場合は、同じ一覧の8GB以下の中から、用途の合うものを選んでください。新しいモデルの名前を見かけたら、まず「Q4_K_M で何GBか」「MoE か」「GGUF はあるか」の3つを見ると、自分に関係あるかどうかがすぐ分かります。

あわせて読みたい

この記事以外のローカルAI関連の記事は、下のまとめから探せます。

スポンサーリンク