記事

実際に動かして測った数字と、料金・仕様の変化の記録だけを書いています。

実測

AI APIのキャッシュ割引を172モデルで比較|中央値85%引き、最大は99%引きだった

プロンプトキャッシュの割引率を172モデルで集計しました。割引率の中央値は85%、90%以上引きが80モデル、最大はDeepSeek V4 Proの99%引きです。2026-08-03時点の実測データ。

2026/08/03

実測

中国製AIモデルと欧米モデルの価格差は、入力より出力で大きい — 304モデルを実測

有料APIモデル304件の単価を集計したところ、入力単価の中央値の差は5.8倍だったのに対し、出力単価では9.1倍に開いていました。2026-08-03時点の実測データです。

2026/08/03

実測

100万トークン対応AIモデル77件の実費を計算した|32件は長文で単価が上がる

コンテキスト長100万以上のモデル77件について、90万トークンを入力したときの実費を計算しました。32件は長文になると単価が上がる段階料金で、表示価格の最大6.7倍になります。2026-08-03時点の実測データ。

2026/08/03

実測

オープンウェイトのAIモデル152個は、APIで借りるといくらか|ローカル実行を検討する前の価格表

公開されているAIモデル152件について、APIで使った場合の単価を集計しました。オープンウェイトの入力単価の中央値は$0.200で、クローズドモデルの$1.100に対して5.5倍の開きがあります。2026-08-03時点の実測データ。

2026/08/03

実測

月20ドルをAPIで使うと何トークン使えるか|定額プランと従量課金の分かれ目を計算した

月20ドルを各モデルのAPIで使った場合に処理できるトークン数を計算しました。GPT-5.5で200万、Qwen3.7 Flashで4億と、200倍の開きがあります。2026-08-03時点の単価で試算。

2026/08/03

実測

中国製AIモデル5社を全部並べた|DeepSeek・Qwen・Kimi・GLM・MiniMax の料金と仕様

DeepSeek、Qwen、Kimi(Moonshot AI)、GLM(Z.ai)、MiniMax の87モデルについて、料金・コンテキスト長・オープンウェイト公開状況をまとめました。2026-08-03時点の実測データ。

2026/08/03

実測

ローカルLLM 4モデルをT4で実測した|速度は十分、ただし日本語の事実は全モデルが間違えた

Gemma 3・Qwen3・Llama 3.2・Phi-4 mini を Tesla T4 で実行し、生成速度・VRAM使用量・日本語の出力を測定しました。速度は51〜75 tok/s と実用域でしたが、4モデルすべてが日本の税制を誤って回答しました。2026-08-03の実測。

2026/08/03