모든 가이드
AI

실제 사용량으로 AI 모델 요금 비교하기

입력 단가가 낮아도 총요금은 더 높을 수 있습니다. 두 가지 계산 예시로 차이를 확인하세요.

모델 A는 입력 토큰 100만 개당 0.20달러, 모델 B는 0.40달러입니다. 첫 번째가 더 저렴해 보이지만, 두 모델 모두에게 긴 답변을 작성하라고 요청하면 결과가 달라집니다.

전체 요청 비용을 비교하세요: 보내는 텍스트, 예상되는 답변, 실행 빈도를 고려하세요. 그런 다음 해당 가격을 제공하는 제공업체가 필요한 기능을 지원하는지 확인하세요.

실제 작업 하나로 시작하기

실제로 실행할 작업을 선택하세요: 문서 요약, 게시물 재작성, 지원 질문에 답변 등. 입력에는 최종 질문뿐만 아니라 지침, 대화 기록, 첨부 텍스트도 포함됩니다. 토큰은 텍스트 조각이며, 언어나 모델에 따라 단어 수가 고정되어 있지 않습니다.

AI 모델 카탈로그를 열고 모델을 선택한 다음 비용 추정을 여세요. 작업 사전 설정으로 시작하거나 직접 입력 토큰, 출력 토큰, 요청 수를 입력하세요. 사전 설정은 편집 가능한 예시일 뿐, 문서를 측정한 값이 아닙니다.

이미 API 사용 로그가 있다면 해당 토큰 수를 사용하세요. 그렇지 않으면 추정값으로 시작하고 작은 테스트 후에 교체하세요. 컨텍스트 제한은 얼마나 많은 내용이 들어갈 수 있는지를 알려주지만, 모든 요청의 비용을 의미하지는 않습니다.

더 저렴한 입력 가격이 손해일 수 있는 이유

다음은 가상의 제안 두 가지로, USD/백만 토큰 기준입니다. 계산을 설명하기 위한 것이며, 특정 모델의 현재 가격이 아닙니다.

제안 입력 가격 출력 가격
A $0.20 $1.00
B $0.40 $0.40

각각 8,000 입력 토큰과 500 출력 토큰으로 10,000건의 요청을 실행하면 A는 $21, B는 $34입니다.

작업을 각각 1,000 입력 토큰과 4,000 출력 토큰으로 변경하고 10,000건의 요청을 유지하면 A는 $42, B는 $20입니다. 긴 답변은 순위를 뒤집습니다.

total = requests × ((input tokens × input price) + (output tokens × output price)) / 1,000,000

두 예시를 2026년 10월 10일에 카탈로그와 동일한 토큰 비용 함수로 확인했습니다. 입력값과 결과 다운로드. 이는 산술 계산을 확인하는 것이지, 모델 품질이나 제공업체의 실제 청구서를 확인하는 것이 아닙니다.

간단한 공식은 할인이나 등급이 없는 일반 텍스트 가격을 가정합니다. 캐시 요금과 긴 컨텍스트 등급은 결과를 바꿀 수 있습니다. 도구 호출, 이미지, 오디오, 요청당 수수료, 세금은 텍스트 추정치에 추가 비용을 발생시킬 수 있습니다. 실제 실행에서는 추정치를 제공업체의 사용 기록과 비교하세요. OpenRouter는 반환하는 사용 필드를 문서화합니다.

동일한 제공업체 제안 비교하기

모델을 개발하는 회사와 API를 호스팅하는 서비스는 별개의 선택입니다. 카탈로그에서 모델 개발사를 사용하여 모델 계열을 좁히고 API 제공업체를 사용하여 사용 위치를 선택하세요. 둘 다 다중 선택이 가능합니다. 공식 API 라벨은 개발자의 직접 API를 식별합니다.

선택하기 전에 모델의 제공업체 목록을 여세요. 가격, 컨텍스트, 출력 제한을 함께 확인하세요. 한 호스트의 낮은 가격과 다른 호스트의 큰 컨텍스트 창이 하나의 사용 가능한 제안을 만들지 않습니다.

호출하려는 제공업체에서 모델 ID를 복사하세요. 유사한 모델 이름이 동일한 API 식별자를 보장하지 않습니다. 애그리게이터를 사용하는 경우 라우팅도 확인하세요: OpenRouter는 동일한 모델을 다른 엔드포인트로 라우팅할 수 있으며, 선택한 경로는 사용 가능한 기능과 가격에 영향을 미칩니다.

필터로 후보 목록 만들기

모델을 배제할 요구 사항부터 시작하세요: 입력과 답변에 충분한 컨텍스트, 필요한 경우 이미지 지원, 애플리케이션에 필요한 도구 호출 또는 구조화된 출력. 그런 다음 가격 범위를 좁히고 몇 가지 후보를 비교하세요.

속도는 두 부분으로 나뉩니다. 첫 토큰까지의 시간은 답변이 시작되기 전의 대기 시간을 나타냅니다. 초당 출력 토큰은 계속되는 속도를 나타냅니다. 측정값이 없으면 느린 것이 아니라 알 수 없음을 의미합니다. 제공업체 관찰은 사용자의 연결이나 프롬프트에 대한 약속이 아닙니다.

벤치마크 점수는 테스트할 항목을 선택하는 데 도움이 될 수 있습니다. 모델이 특정 지침을 따를지 여부를 알려주지는 않습니다. 후보 목록에 대해 동일한 소규모 대표 프롬프트 세트를 실행하고 답변, 실패, 실제 토큰 사용량을 확인하세요.

카탈로그는 약 6시간마다 새로 고침을 목표로 합니다. 특히 가격이나 속도가 비정상적으로 좋아 보일 때 소스 타임스탬프를 확인하세요. 필터와 정렬은 URL에 유지되므로 주소를 복사하여 동일한 보기를 공유할 수 있습니다.

앱이나 에이전트에서 비교 반복하기

카탈로그 API는 필터링된 검색, 제공업체 비교, 토큰 비용 추정을 지원합니다. 카탈로그 읽기는 CozyToolkit 크레딧을 사용하지 않으며 게시된 속도 제한 내에서 API 키 없이 작동합니다. 모델을 대신 실행하지는 않습니다.

모델 연구 스킬은 에이전트가 조회를 수행할 수 있게 합니다. 보편적인 "최고의 모델"을 묻지 말고 작업량을 제공하세요: 10,000건의 문서 요약 요청(각각 8,000 입력, 500 출력 토큰)에 대해 세 가지 후보를 찾고 제공업체 ID, 예상 비용, 출처를 포함하세요.