MetaのAPI料金(Llama)
【2026年8月最新】全8モデルの単価一覧

Llama系モデル。オープンウェイトで公開されています。 2026-08-03 時点のデータで、毎日自動で取り直しています。

8
モデル数
$0.027
最安の入力単価
100万トークンあたり
$0.400
最高の入力単価
100万トークンあたり
1.3M
最大コンテキスト長
価格帯ごとのモデル数 全8モデル
4 0
$0.01$0.1
$0.027 Llama 3.2 1B Instruct $0.4 Llama 3.1 70B Instruct

中国発 0 その他 8 横軸は100万トークンあたりの入力単価(対数目盛)。最安と最高で15倍ひらいています。

同じ Meta のモデル内でも、入力単価は 15倍 の開きがあります(Meta: Llama 3.2 1B Instruct と Meta: Llama 3.1 70B Instruct)。用途に対して過剰なモデルを選ぶと、 そのまま請求額の差になります。

モデル 入力 /1M 出力 /1M キャッシュ読取 コンテキスト長 最大出力
Meta: Llama 3.1 70B Instruct OW $0.400 約¥64 $0.400 約¥64 131K 16K
Meta: Llama 4 Maverick OW $0.200 約¥32 $0.800 約¥128 1.0M 16K
Meta: Llama Guard 4 12B OW $0.180 約¥29 $0.180 約¥29 1.0M 16K
Meta: Llama 3.3 70B Instruct OW $0.130 約¥21 $0.400 約¥64 131K 128K
Meta: Llama 4 Scout OW $0.100 約¥16 $0.300 約¥48 1.3M 16K
Meta: Llama 3.1 8B Instruct OW $0.050 約¥8 $0.080 約¥13 $0.025 131K 131K
Meta: Llama 3.2 3B Instruct OW $0.050 約¥8 $0.330 約¥53 131K 131K
Meta: Llama 3.2 1B Instruct OW $0.027 約¥4 $0.201 約¥32 60K 60K

コストを下げる3つの基本

モデルを変えずに請求額を下げる方法があります。どれもMetaに限らず使えます。

  • キャッシュを使う。 同じ前置き(システムプロンプトや長い資料)を繰り返し送る場合、キャッシュ読取の単価が 適用されます。上の表の「キャッシュ読取」列が入力単価より大幅に安いモデルほど効果があります。
  • 即時性が不要ならバッチ処理にする。 多くの提供元が非同期のバッチ処理に割引を用意しています。
  • タスクごとにモデルを分ける。 分類や抽出のような単純な処理にフラッグシップを使う必要はありません。 上の表のとおり、同じ提供元の中でも単価は大きく違います。

取得元は OpenRouter の公開API、 2026-08-03 時点。単価は100万トークンあたりのUSD建てです。 「OW」はオープンウェイト、「段階」は入力が長いと単価が上がるモデルで、 表示単価は短い入力のときの値です。

掲載価格は参考値です。実際の請求は契約条件・リージョン・バッチやキャッシュの適用状況で変わります。 契約前に必ずMetaの公式ページでご確認ください。 誤りを見つけた場合はお問い合わせからご連絡ください。

全326モデルを横断で比較する →