同じPCの2枚で、どこまで差が出る?〜RX 9060 XT と RTX 3090 の速さと電気代|RX 9060 XT 連載 第2話

本ページは広告(アフィリエイトプログラム)を含みます。詳しくはプライバシーポリシーをご覧ください。

前回、デスクトップPCに挿した Radeon RX 9060 XT が、特別な追加ソフトを入れなくてもローカルLLMのソフトから見えることを確かめました。速度はそこでは測らず、次回に回しています。

同じPCには RTX 3090 も入っています。同じ本体の中、同じモデル、同じ測り方で2枚を並べたとき、この新しい16GBのカードはどこまで出るのでしょうか?

2026年9月時点の実測です。

前回の記事はこちら

使用した機器の概要

測定に使ったデスクトップPCは、下記のとおりです。前回と同じ構成で、1台の中に2枚のGPUが入っています。

CPUAMD Ryzen 9 3950X(16コア)
メモリー62GB
GPURTX 3090(CPU直結のスロット)、ASUS DUAL Radeon RX 9060 XT 16GB(チップセット側のスロット)
OSUbuntu 24.04.4 LTS(カーネル 7.0.0-30-generic)
画面出力RTX 3090 に接続(RX 9060 XT にはモニタをつないでいない)

使用したGPU:ASUS DUAL Radeon RX 9060 XT 16GB(DUAL-RX9060XT-16G)

ファンが2つ並んだ、飾りのない見た目のカードです。前回そのまま挿したものを、今回も抜き差しせずに測りました。

[kimono_product id="17459″]

何を測ったのか

ローカルLLMの速さには、性質の違う2つがあります。こちらが送った文章をAIが読む速さと、AIが答えを書き出す速さです。前回の記事では、書く速さと消費電力を4枚分並べました。

今回は同じ測定の中から、まだ出していない読む速さを取り出し、あわせて次の3つを見ます。

  • 読む速さと書く速さで、2枚の差は同じように付くのか
  • 長く書かせ続けたとき、その速さは保てるのか
  • 電気代あたりでは、どちらがたくさん書けるのか

比べるのは、同じPCに入っている RTX 3090 と RX 9060 XT の2枚だけにしました。本体が違うGPUを並べると、ソフトの版や接続の違いが数字に乗ってしまうためです。

どうやって測ったのか

測り方は下記のとおりです。2枚とも同じ本体、同じソフト、同じ重みファイルを使いました。

測定日2026年9月6日
モデルqwen3:8b(4.87GB)と qwen3:14b(8.64GB)。どちらも Q4_K_M という圧縮のかかった形式
測定器llama.cpp に付属する llama-bench(ビルド b9859)
経路2枚とも Vulkan。NVIDIA 用の CUDA も AMD 用の ROCm も使っていない
読む速さ512トークンの入力を読ませたときの速さ
書く速さ128トークンを書かせたときの速さ。読む測定とは別に起動した
回数各4回。1回目はモデルの読み込みを含むため外し、残り3回の中央値
電力速さとは別に測定。20回続けて生成させ、0.25秒ごとに採取。立ち上がりと末尾を捨てた区間の中央値
電気代1kWhあたり31円で計算

トークンというのは文章を細かく区切った単位で、日本語ならだいたい1文字が1〜2トークンです。

回数について、ひとつ断っておきます。この測定を行ったのは9月6日で、当時は4回測って1回目を外していました。その後、5回測って上下をひとつずつ落とし、残る3点の中央値を採る形に改めています。

そこで9月23日に、同じ本体・同じソフト・同じ重みで、上の8通りをすべて5回ずつ測り直しました。

GPUモデル測るもの9月6日 [tok/s]9月23日 [tok/s]
RTX 3090qwen3:8b読む速さ4,628.44,588.4−0.9%
RTX 3090qwen3:8b書く速さ119.9120.2+0.3%
RTX 3090qwen3:14b読む速さ2,772.82,738.2−1.2%
RTX 3090qwen3:14b書く速さ77.577.3−0.2%
RX 9060 XTqwen3:8b読む速さ2,125.52,118.5−0.3%
RX 9060 XTqwen3:8b書く速さ54.554.6+0.1%
RX 9060 XTqwen3:14b読む速さ1,182.51,173.3−0.8%
RX 9060 XTqwen3:14b書く速さ32.132.1±0%

いちばん動いたところで1.2%でした。以下の数字は、消費電力と同じ日に揃えた9月6日の一組をそのまま使っています。

読む速さと書く速さで、差の付き方は変わるのか?

2枚の結果です。

GPUモデル読む速さ [tok/s]書く速さ [tok/s]
RTX 3090 24GBqwen3:8b4,628.4119.9
RX 9060 XT 16GBqwen3:8b2,125.554.5
RTX 3090 24GBqwen3:14b2,772.877.5
RX 9060 XT 16GBqwen3:14b1,182.532.1

RX 9060 XT は、RTX 3090 に対しておおよそ4割です。ここで目に付いたのは、その割合が読む速さでも書く速さでもほとんど同じだったことでした。

モデル読む速さの比書く速さの比
qwen3:8b45.9%45.5%
qwen3:14b42.6%41.5%

2つの速さは、本来ちがう部分で決まります。読む速さは主に計算する力、書く速さは主にメモリの読み出しの速さです。それでも比が揃ったので、この2枚のあいだでは、どちらの用途で見ても順番も差の大きさも変わらないという結果でした。

短い質問を投げるのか、長い文章を読ませるのかで選び分ける、という話にはならないようです。

長く書かせ続けても、速さは落ちないのか?

上の数字は、1回あたり数秒で終わる短い測定です。実際の使い方では、もっと長く書かせます。そこで20回続けて生成させ、そのあいだの速さも見ました。

GPUモデル短い測定 [tok/s]続けたとき [tok/s]続けた長さ
RTX 3090 24GBqwen3:8b119.9119.123秒−0.7%
RX 9060 XT 16GBqwen3:8b54.554.550秒−0.1%
RTX 3090 24GBqwen3:14b77.561.445秒−20.8%
RX 9060 XT 16GBqwen3:14b32.131.885秒−0.9%

落ちたのは RTX 3090 の14Bだけで、2割です。RX 9060 XT は2つのモデルとも1%以内に収まりました。

この差は、そのまま2枚の距離を縮めます。短い測定では RX 9060 XT は RTX 3090 の41.5%でしたが、続けて書かせたときは51.9%でした。

RTX 3090 の14Bだけが落ちたのはなぜか

電力の記録を見ると、RTX 3090 は生成しているあいだ 344〜346W に張り付いていました。最小値の178.9Wは立ち上がりの数値で、そこから先はほぼ一定です。

この数字が何に当たっているのかは、カードの定格と見比べると分かります。NVIDIAが公表している GeForce RTX 3090 のグラフィックスカード電力は350Wです。344〜346Wは、その一歩手前でほぼ止まっている状態です。上限に当たって、それ以上は出せなかったと考えられます。

もしこれが上限に当たったことによるものなら、同じカードでも軽い8Bでは起きないはずです。実際、8Bでの落ち込みは0.7%にとどまりました。14Bだけで起きたことは、この見方と矛盾しません。

ただし、電力の上限で止まっているのか、発熱で止まっているのかは分けられていません。今回の測定では温度もクロックも記録していないため、ここは未確認です。

補足として、同じ本体の同じ RTX 3090 で、8月に別の作業(画像生成)を測ったときの記録が手元に残っています。そちらでは速度が落ちた理由をGPUが申告する値まで取っており、電力の上限と発熱の両方が同時に立っていました。電力は345〜352Wで、ちょうど350Wで止まった回もあります。

つまり「電力か、発熱か」という二択の立て方自体が、たぶん正しくありません。両方が同時に効いていることがあります。別の作業・別の月の記録なので今回の14Bにそのまま当てはめられませんが、次に測るときは理由の値も一緒に取るつもりです。

電気代あたりでは、どれくらい書けるのか

生成しているあいだの消費電力は、RTX 3090 が約345W、RX 9060 XT が159Wでした。1kWhを31円として、1円でどれだけ書けるかを出します。

GPUモデル短い測定での1円あたり [tok]続けたときの1円あたり [tok]
RTX 3090 24GBqwen3:8b40,46540,198
RX 9060 XT 16GBqwen3:8b39,83439,813
RTX 3090 24GBqwen3:14b26,11420,685
RX 9060 XT 16GBqwen3:14b23,46023,248

短い測定では RTX 3090 が上ですが、14Bを続けて書かせたときは入れ替わります。速さが2割落ちても電力は下がらないため、1円あたりの量が減るという形です。

続けたときの数値は、測った速さと測った電力から計算したものです。1円あたり=書く速さ×3600÷(電力÷1000×31円)で出しています。GPU単体の電力だけで、CPUや電源の損失は入っていません。

何もしていないときの電力も、差が大きいところでした。

GPU待機時の電力 [W]24時間つけっぱなしにしたときの月額
RTX 3090 24GB15.4約344円
RX 9060 XT 16GB3.0約67円

この2つは同じ条件ではありません。前回も書いたとおり、RTX 3090 はモニタとデスクトップ画面を受け持っており、その分が乗っています。RX 9060 XT にはモニタをつないでいません。並べて優劣を言える数字ではなく、それぞれの状態での値としてご覧ください。

前回の記事では RX 9060 XT の待機電力を3.5Wと書きました。こちらは別の日に30回測った中央値で、今回は60回測って3.0Wです。この程度の幅がある数値だとお考えください。

Vulkanに揃えると、どれくらい損をするのか?

今回は2枚とも Vulkan で測りました。経路を揃えないと、GPUの差なのかソフトの差なのか分からなくなるためです。ただし RTX 3090 には CUDA という、NVIDIA が用意した速い経路があります。

この差がどれくらいかは、別の日に、別の本体へ外付けで繋いだ RTX 3060 で測った記録があります。同じカード・同じモデルを、CUDA と Vulkan で回した比較です。

モデルCUDA [tok/s]Vulkan [tok/s]
phi4-mini99.893.8−6.0%
nemotron-3-nano:4b92.788.2−4.9%

この測定は Windows 上で、外付けで繋いだ RTX 3060 に対して行ったものです。今回のデスクトップPCとは環境が違うため、上の表の RTX 3090 の数字に足し引きできる値ではありません。NVIDIA のカードでは経路を変えると数%動く、という幅を知るための材料としてご覧ください。

AMD 側にも ROCm という別の経路があります。こちらは入れていないので、RX 9060 XT の数字がどう動くかは分かりません。NVIDIA で数%だったから AMD でも数%だろう、という当てはめもできません。描画の仕組みが別で、同じ話にならないためです。

この記事で確かめていないこと

  • ROCm を入れた場合に RX 9060 XT の速さがどうなるか
  • 16GBに収まらない大きなモデルを動かしたとき、どうなるか。今回は2枚とも全部載る大きさだけを測りました
  • RX 9060 XT が挿してあるのはチップセット側のスロットで、CPU直結ではありません。これが何を遅くしているのかは、まだ分けられていません
  • RTX 3090 が14Bで落ちた原因が、電力の上限なのか発熱なのか
  • 2枚を同時に使ったときに何が起きるか

まとめ〜同じPCの中で2枚を測って分かったこと

  • RX 9060 XT は、同じPCの RTX 3090 に対して読む速さ・書く速さとも4割強。どちらの用途で見ても差の付き方は変わらなかった
  • 短い測定では2.4倍の差でも、14Bを続けて書かせると1.9倍まで縮む。RTX 3090 の速さが2割落ちるため
  • 落ちているあいだ、RTX 3090 は345Wに張り付いていた。RX 9060 XT は1%以内で、159Wのまま最後まで同じ速さだった
  • 1円あたりに書ける量は、短い測定では RTX 3090 が上。14Bを続けて書かせると入れ替わる
  • 何もしていないときの電力は3.0Wで、つけっぱなしなら月額約67円。RTX 3090 は約344円だが、こちらは画面表示を受け持った状態の値で同じ条件ではない

速いカードが、ずっと速いままとは限らないという結果でした。短い時間で測った数字だけを見ていると、この部分は見えません。

RX 9060 XT を選ぶかどうか、どう決めるか

今回測った範囲で言えることを、使い方ごとに分けました。測っていないことは、測っていないと書いています。

こういう使い方なら今回の測定から言えること
8Bから14B程度のモデルを使い、待ち時間より電気代が気になる待機3.0W・つけっぱなしで月約67円。書く速さは RTX 3090 の4割強で、そのぶん電力は半分以下
長い文章を続けて書かせる85秒続けても速さが落ちませんでした。続けたときの差は1.9倍まで縮みます
とにかく速く答えてほしいRTX 3090 のほうが速いままです。短い受け答えでは2.4倍の差が出ました
16GBに収まらない大きなモデルを動かしたい今回は測っていません。この記事では判断できません
AMD の ROCm を使いたい入れていないので分かりません。Vulkan での値です

最初の一歩としては、自分が使うモデルのファイルの大きさを見て、16GBに収まるかどうかを先に確かめるのが確実です。収まる範囲で使うなら、今回の数字がそのまま目安になります。

次回は、このカードが挿してあるチップセット側のスロットで何が遅くなるのかを、モデルの読み込みと生成に分けて測ります。

本記事の数値は2026年9月時点・上記の構成で測ったものです。GPUの世代やソフトの版が変われば結果も変わります。

検証に使用した機材

今回測定したグラフィックボードです。

[kimono_product id="17459″]