ローカルLLM おすすめモデル 2026〜VRAM と用途で、最初の1本と次の1本を実測で選ぶ
Ollama のモデル一覧を開くと、名前が何百も並んでいます。どれを最初に入れればいいので ...
Qwen4 の先行版は家で動く?〜Qwen3.8-Flash-Next の2ビット版を RTX 5060 Ti と RTX 3060 で測った
X のタイムラインで「Qwen3.8-Flash-Next が家で動いた」という投稿を続け ...
最初の出力までに、どれくらい時間がかかる?〜ローカルLLMの最初の待ち時間を測定してみた
ローカルLLMの「待ち時間」を測った記事を、以前記載しました。 その時は、プロンプトの長さ ...
設定したのに効いていない?〜KVキャッシュの圧縮が無視されていた話
ローカルでLLM(大規模言語モデル。文章を扱うAIの本体)を動かしていると、長い文章を読ま ...
ミニPCの蓋が閉まらない?〜M.2→OCuLink変換アダプタを3種類試した
以前、GMKtec EVO-X2(以下、EVO-X2)というミニPCの中にあるM.2ポート ...
Intel Arc B580でできたこと・できなかったこと〜Intel Arc B580ローカルLLM 第7話
以前から使っている NVIDIA GeForce RTX 3090 の隣に、12GB の ...
メーカーの違うGPUを混ぜたらどうなるのか〜RTX 3090とIntel Arc B580で実測 Intel Arc B580ローカルLLM 第6話
このデスクトップPCには、NVIDIA GeForce RTX 3090(VRAM 24G ...
外付けGPUがThunderboltで動かない? 3世代のGPUで検証〜Intel Arc B580ローカルLLM 第5話
手持ちのPCで、外付けGPU(eGPU: パソコンの外にGPUを箱で接続する仕組み)を、世 ...
AMDが「全部公開した」LLMモデルは自分で作れるのか〜Instella-MoEについて調べてみた
AMD が2026年7月に、自社として初めての完全オープンなMoEモデル「Instella ...
12GBに収まったのにQwen3:14bなどが遅くなっていく?〜Intel Arc B580ローカルLLM 第4話
第3話で Intel Arc B580 のサイズ別速度を測ったとき、1つだけ説明のつかない ...









