すべてのガイド
AI

実際の使い方に合わせて AI モデルの料金を比較する

入力単価が安くても、合計額は高くなることがあります。2つの計算例で比較のポイントを確認しましょう。

あるモデルは入力トークン100万個あたり0.20ドル、別のモデルは0.40ドルかかります。一見、前者の方が安く見えますが、両方に長い回答を書かせてみると話は変わります。

リクエスト全体のコストを比較しましょう。送信するテキスト、期待する回答、実行頻度を考慮します。そして、その価格を提示しているプロバイダーが必要な機能をサポートしているか確認します。

実際のタスクから始める

実際に実行するタスクを選びます。文書の要約、投稿の書き直し、サポート質問への回答などです。入力としてカウントするのは、最終的な質問だけでなく、指示、会話履歴、添付テキストも含みます。トークンはテキストの断片であり、言語やモデルによって単語数が固定されているわけではありません。

AIモデルカタログを開き、モデルを選択してからコスト見積もりを開きます。タスクのプリセットから始めるか、入力トークン、出力トークン、リクエスト数を自分で入力します。プリセットは編集可能な例であり、あなたの文書の測定値ではありません。

APIの使用ログがすでにある場合は、そのトークン数を使用します。ない場合は、見積もりから始めて、小規模なテストの後に置き換えます。コンテキスト制限は、どれだけ収まるかを示すものであり、各リクエストのコストを示すものではありません。

入力単価だけでは比較できない理由

以下は、100万トークンあたりのUSDでの架空の料金プランです。計算を説明するためのものであり、特定のモデルの現在の価格ではありません。

料金プラン 入力価格 出力価格
A $0.20 $1.00
B $0.40 $0.40

入力トークン8,000、出力トークン500のリクエストを10,000回行う場合、Aは21ドル、Bは34ドルかかります。

タスクを入力トークン1,000、出力トークン4,000に変更し、リクエスト数を10,000回に保つと、Aは42ドル、Bは20ドルになります。回答が長くなると順位が逆転します。

total = requests × ((input tokens × input price) + (output tokens × output price)) / 1,000,000

2026年10月10日に、カタログと同じトークンコスト関数を使用して両方の例を確認しました。入力と結果をダウンロード。これは計算の検証であり、モデルの品質やプロバイダーの実際の請求書を検証するものではありません。

この単純な式は、割引やティアのない通常のテキスト価格を前提としています。キャッシュレートや長いコンテキストのティアによって結果が変わることがあります。ツール呼び出し、画像、音声、リクエストごとの手数料、税金などがテキスト見積もりに追加される場合があります。実際の実行では、見積もりとプロバイダーの使用記録を比較してください。OpenRouterは返す使用フィールドを文書化しています。

同じ提供先の料金と条件を比較する

モデルを開発する会社と、そのAPIをホストするサービスは、別々の選択肢です。カタログでは、モデル開発元を使用してモデルファミリーを絞り込み、API 提供元を使用して使用場所を選択します。どちらも複数選択できます。公式 APIラベルは、開発者の直接APIを示します。

選択する前に、モデルのプロバイダーリストを開きます。価格、コンテキスト、出力制限を一緒に確認します。あるホストの低価格と別のホストの大きなコンテキストウィンドウを組み合わせても、利用できる料金プランにはなりません。

呼び出す予定のプロバイダーからモデルIDをコピーします。似たようなモデル名でも、API識別子が同じとは限りません。アグリゲーターを使用する場合は、ルーティングも確認します。OpenRouterは同じモデルを異なるエンドポイントにルーティングできます。選択したルートによって、利用可能な機能と価格が変わります。

フィルターで候補を絞り込む

モデルを除外する要件から始めます。入力と回答に十分なコンテキスト、必要に応じて画像サポート、アプリケーション用のツール呼び出しや構造化出力などです。次に、価格帯を絞り込み、いくつかの候補を比較します。

速度には2つの要素があります。最初のトークンまでの時間は、回答が始まるまでの待ち時間を示します。出力トークン/秒は、その後の継続速度を示します。測定値がない場合は不明であり、遅いことを意味しません。プロバイダーの観測値は、あなたの接続やプロンプトを保証するものではありません。

ベンチマークスコアは、何をテストするかを選ぶのに役立ちます。しかし、モデルがあなたの特定の指示に従うかどうかはわかりません。候補リストに対して、同じ代表的なプロンプトの小規模なセットを実行し、回答、失敗、実際のトークン使用量を確認します。

カタログは約6時間ごとの更新を予定しています。特に価格や速度が異常に良い場合は、情報元の更新日時を確認してください。フィルターと並べ替えはURLに保持されるため、アドレスをコピーして同じビューを共有できます。

アプリやエージェントから比較を繰り返す

カタログAPIは、フィルター検索、プロバイダー比較、トークンコスト見積もりをサポートしています。カタログの読み取りはCozyToolkitクレジットを消費せず、APIキーなしで公開されたレート制限内で動作します。モデルを実行するわけではありません。

モデルリサーチスキルは、エージェントの代わりに検索を実行できます。普遍的な「最良のモデル」を尋ねるのではなく、ワークロードを指定します。たとえば、入力トークン8,000、出力トークン500の文書要約リクエストを10,000回行う場合の候補を3つ見つけ、プロバイダーID、推定コスト、ソースを含めます。