openai/gpt-4.1-nano에 대한 API 레퍼런스이며, OpenAI에서 Comfy Router를 통해 제공됩니다.
빠른 시작
your Comfy workspace에서 키를 생성한 뒤COMFY_API_KEY로 내보내세요. Python과 TypeScript 스니펫은 Comfy SDK(pip install comfy-sdk, npm install @comfyorg/sdk)를 사용하며, cURL 스니펫은 동일한 호출을 raw HTTP로 실행합니다.
모델 ID: openai/gpt-4.1-nano
엔드포인트: POST https://api.comfy.org/v2/models/openai/gpt-4.1-nano
- Wait for the result
- Queue and collect later
스키마
입력
string[]
모델 응답에 포함할 추가 출력 데이터입니다.
string | object[]
필수
모델에 대한 텍스트, 이미지 또는 파일 입력으로, 응답을 생성하는 데 사용됩니다. 이 계약에서 Router가 제공할 수 없는 유일한 필드이며, 아래
required에 있는 유일한 항목입니다.string
모델의 컨텍스트 첫 번째 항목으로 시스템(또는 개발자) 메시지를 삽입합니다.
integer
응답을 위해 생성되는 토큰 수의 상한으로, 표시되는 출력 토큰과 추론 토큰을 포함합니다. reasoning id에서는 이 상한을 숨김 추론 토큰과 공유하므로, 작은 값은 표시되는 텍스트가 나오기 전에 전체 예산을 소진할 수 있습니다. 그래서 reasoning 스모크 케이스는 1024를 보내고 chat 스모크 케이스는 16을 보냅니다.범위:
1 ~ …string
OpenAI 모델 식별자입니다. Comfy Router에서 이 필드는 선택 사항이며 Router가
{model} 경로 세그먼트에서 값을 채웁니다. 명시적인 null도 같은 방식으로 교체됩니다. 경로와 일치하지 않는 값을 보내면 거부됩니다.boolean
모델이 도구 호출을 병렬로 실행하도록 허용할지 여부입니다.
string
이전 응답의 ID로, 다중 턴 대화에 사용됩니다.
object
REASONING TIER 전용입니다. reasoning 모델을 위한 설정입니다. 예:
{"effort": "medium"}. 변경 없이 전달됩니다. 허용되는 키는 OpenAI의 reasoning 가이드를 참조하세요. chat tier id는 이를 무시합니다.boolean
OpenAI가 생성된 응답을 나중에 검색할 수 있도록 저장할지 여부입니다.
boolean
이 필드를 보내는 호출자가 거부되지 않도록 선언되어 있지만, 이 표면에서는 아무 효과가 없습니다. Router는 디스패치 이전에 이를
false로 확정합니다. Router는 text/event-stream을 중계하는 대신 공급자 응답을 캡처하는데, openAiResponsesProxy의 ModifyResponse는 이를 디코딩할 수 없으므로 스트리밍 생성은 OpenAI가 과금하고 아무도 계량하지 않게 됩니다. 스트림이 필요하면 POST /proxy/openai/v1/responses를 사용하세요.number
샘플링 온도입니다. CHAT TIER 전용입니다. o 시리즈 reasoning id(
o1, o1-pro, o3, o4-mini)는 OpenAI에서 이 매개변수를 거부합니다. Router는 이들을 위해 이를 거부하지 않습니다(두 tier가 하나의 스키마를 공유하는 이유는 이 컴포넌트의 설명 참조). 따라서 이를 보내는 reasoning 호출은 OpenAI 자체 오류로 응답됩니다.범위: 0 ~ 2object
출력 형식 설정입니다. 예를 들어 Structured Outputs의 경우
{"format": {"type": "json_schema", ...}}입니다. 변경 없이 전달됩니다.string | object
모델이 사용할 도구를 선택하는 방식입니다. 문자열 모드이거나 도구를 지정하는 객체입니다.
object[]
모델이 호출할 수 있는 도구 정의입니다. Router는 도구 분류를 좁히지 않습니다. 허용되는 형태는 OpenAI의 Responses API 레퍼런스를 참조하세요.
number
뉴클리어스 샘플링 컷오프입니다.
temperature와 동일한 조건으로 CHAT TIER 전용입니다.범위: 0 ~ 1string
컨텍스트가 모델의 창을 초과할 때의 자르기 전략입니다. 위의 세 어휘와 달리 여기서는 enum이 실제로 강제됩니다. 이 두 값이 OpenAI가 문서화한 전체 집합이며 늘어나지 않았기 때문입니다. 명시적인
null은 위 필드들과 동일한 조건으로 여전히 허용됩니다.가능한 값: auto, disabledobject
토큰 사용량 봉투입니다. v1 오퍼레이션이 요청 본문에 이를 선언하기 때문에 이 계약에 존재합니다. OpenAI는 RESPONSE에 이를 채우므로 호출자가 보낼 이유가 없습니다.
GET /v2/models/openai/gpt-4.1-nano/openapi.json에서 제공하는 스키마에서 생성되었습니다. 이는 요청이 공급자에 도달하기 이전에 호출을 검증하는 데 사용하는 것과 동일한 문서입니다.
출력
string
모델의 컨텍스트 첫 번째 항목으로 시스템(또는 개발자) 메시지를 삽입합니다.
previous_response_id와 함께 사용할 경우, 이전 응답의 instructions는 다음 응답으로 이어지지 않습니다. 따라서 새 응답에서 시스템(또는 개발자) 메시지를 간편하게 교체할 수 있습니다.integer
응답에 대해 생성될 수 있는 토큰 수의 상한으로, 표시되는 출력 토큰과 reasoning tokens를 포함합니다.
string
응답을 생성하는 데 사용되는 모델
number
기본값:"1"
응답의 무작위성을 제어합니다범위:
0부터 2까지number
기본값:"1"
nucleus 샘플링을 통해 응답의 다양성을 제어합니다범위:
0부터 1까지string
기본값:"\"disabled\""
모델 응답에 사용할 잘림(truncation) 전략입니다.
-
auto: 이 응답과 이전 응답의 컨텍스트가 모델의 컨텍스트 창 크기를 초과하면, 모델은 대화 중간의 입력 항목을 삭제하여 컨텍스트 창에 맞도록 응답을 잘라냅니다. -
disabled(기본값): 모델 응답이 모델의 컨텍스트 창 크기를 초과하면 요청이 400 오류와 함께 실패합니다. 가능한 값:auto,disabled
string
모델에 대한 이전 응답의 고유 ID입니다. 이를 사용하여 여러 턴의 대화를 생성합니다. conversation state에 대해 더 알아보세요.
object
o-시리즈 모델 전용reasoning models을 위한 구성 옵션입니다.
string
나중 턴에서 어떤 reasoning 항목이 모델에 다시 렌더링되는지 제어합니다. 예:
auto, current_turn, all_turns.string
기본값:"\"medium\""
o-시리즈 모델 전용reasoning models의 reasoning 노력을 제한합니다. 현재 지원되는 값은
low, medium, high입니다. reasoning 노력을 줄이면 응답이 더 빨라지고 응답에서 reasoning에 사용되는 토큰이 줄어들 수 있습니다.가능한 값: low, medium, highstring
지원 중단됨: 대신
summary를 사용하세요.모델이 수행한 reasoning의 요약입니다. 디버깅과 모델의 reasoning 과정을 이해하는 데 유용할 수 있습니다. auto, concise, detailed 중 하나입니다.가능한 값: auto, concise, detailedstring
응답에 사용되는 reasoning 모드입니다.
string
모델이 수행한 reasoning의 요약입니다. 디버깅과 모델의 reasoning 과정을 이해하는 데 유용할 수 있습니다.
auto, concise, detailed 중 하나입니다.가능한 값: auto, concise, detailedobject
object
모델이 출력해야 하는 형식을 지정하는 객체입니다.
{ "type": "json_schema" }를 구성하면 Structured Outputs가 활성화되어 모델이 제공한 JSON 스키마와 일치하도록 보장합니다. Structured Outputs guide에서 더 알아보세요.기본 형식은 추가 옵션 없이 { "type": "text" }입니다.gpt-4o 및 최신 모델에는 권장되지 않습니다:{ "type": "json_object" }로 설정하면 이전 JSON 모드가 활성화되어 모델이 생성하는 메시지가 유효한 JSON임을 보장합니다. 이를 지원하는 모델에는 json_schema를 사용하는 것이 권장됩니다.string
모델 응답의 장황함(verbosity)을 제한합니다.
low, medium, high 중 하나입니다.`none`, `auto`, `required` | object
응답을 생성할 때 모델이 사용할 도구(또는 도구들)를 어떻게 선택해야 하는지를 지정합니다. 모델이 호출할 수 있는 도구를 지정하는 방법은
tools 매개변수를 참조하세요.object[]
boolean
모델 응답이 배경에서 실행되는지 여부입니다.
object
응답에 대한 결제 정보입니다.
string
응답 비용을 지불할 책임이 있는 당사자입니다.
number
이 Response가 완료된 시점의 Unix 타임스탬프(초)입니다. 상태가
completed일 때만 표시됩니다.number
이 Response가 생성된 시점의 Unix 타임스탬프(초)입니다.
object
모델이 Response 생성에 실패할 때 반환되는 오류 객체입니다.
string
필수
응답의 오류 코드입니다.Possible values:
server_error, rate_limit_exceeded, invalid_prompt, vector_store_timeout, invalid_image, invalid_image_format, invalid_base64_image, invalid_image_url, image_too_large, image_too_small, image_parse_error, image_content_policy_violation, invalid_image_mode, image_file_too_large, unsupported_image_media_type, empty_image_file, failed_to_download_image, image_file_not_foundstring
필수
오류에 대한 사람이 읽을 수 있는 설명입니다.
number
지금까지의 텍스트에서 기존 빈도를 기준으로 새 토큰에 페널티를 부과합니다.
string
이 Response의 고유 식별자입니다.
object
응답이 불완전한 이유에 대한 세부 정보입니다.
string
응답이 불완전한 이유입니다.Possible values:
max_output_tokens, content_filterinteger
하나의 응답에서 처리할 수 있는 내장 도구에 대한 총 호출의 최대 수입니다.
object
응답에 첨부할 수 있는 키-값 쌍의 집합입니다.
object
검토된 완성이 요청된 경우, 응답 입력과 출력에 대한 검토 결과입니다.
string
이 리소스의 객체 유형이며, 항상
response로 설정됩니다.Possible values: responseobject[]
모델이 생성한 콘텐츠 항목의 배열입니다.
output배열에 있는 항목의 길이와 순서는 모델의 응답에 따라 달라집니다.output배열의 첫 번째 항목에 접근하여 그것이 모델이 생성한 콘텐츠를 담은assistant메시지라고 가정하기보다는, SDK에서 지원되는 경우output_text속성을 사용하는 것을 고려해 보세요.
string
output 배열의 모든 output_text 항목에 있는 집계된 텍스트 출력을
포함하는 SDK 전용 편의 속성입니다(존재하는 경우). Python 및 JavaScript
SDK에서 지원됩니다.boolean
기본값:"true"
모델이 도구 호출을 병렬로 실행하도록 허용할지 여부입니다.
number
지금까지의 텍스트에 등장하는지 여부를 기준으로 새 토큰에 페널티를 부과합니다.
string
캐시 적중률을 최적화하기 위해 OpenAI가 유사한 요청에 대한 응답을 캐시하는 데 사용됩니다.
user 필드를 대체합니다.string
프롬프트 캐시의 보존 정책입니다(예:
in_memory 또는 24h).string
OpenAI의 사용 정책을 위반할 수 있는 애플리케이션 사용자를 감지하는 데 사용되는 안정적인 식별자입니다.
string
요청을 처리하는 데 사용되는 처리 등급입니다(예:
auto, default, flex, scale, priority).string
응답 생성 상태입니다.
completed, failed, in_progress, cancelled, queued, incomplete 중 하나입니다.Possible values: completed, failed, in_progress, cancelled, queued, incompleteboolean
API를 통해 나중에 검색할 수 있도록 응답을 저장할지 여부입니다.
object
내장 도구별로 분류된 토큰 및 요청 사용량입니다.
object
이미지 생성 도구의 토큰 사용량입니다.
integer
object
integer
integer
integer
object
integer
integer
integer
object
웹 검색 도구 사용량입니다.
integer
integer
각 토큰 위치에서 반환할 가장 가능성이 높은 토큰의 최대 수이며, 각 토큰에는 연관된 로그 확률이 있습니다.
object
입력 토큰, 출력 토큰, 출력 토큰의 세부 분류, 사용된 총 토큰을
포함한 토큰 사용 세부 정보를 나타냅니다.
integer
필수
입력 토큰의 수입니다.
object
필수
입력 토큰의 세부 분류입니다.
integer
캐시에 기록된 입력 토큰의 수입니다.
integer
필수
캐시에서 검색된 토큰 수입니다.
프롬프트 캐싱에 대한 자세한 내용.
integer
필수
출력 토큰 수입니다.
object
필수
출력 토큰에 대한 상세 분석입니다.
integer
필수
추론 토큰 수입니다.
integer
필수
사용된 총 토큰 수입니다.
string
최종 사용자에 대한 지원 중단된 식별자입니다.
safety_identifier 및 prompt_cache_key로 교체되었습니다.예시
입력
출력
배포 전 확인
SDK는Idempotency-Key를 생성하고 자동 재시도에서 재사용합니다. 수동 재시도 시에는 원래 키를 재사용하세요. Router는 연결을 최대 10분간 유지할 수 있습니다.
요청이 실패하면 Router는 이유를 설명하는 X-Comfy-Error-Type 응답 헤더를 보냅니다. 422는 Router가 프로바이더를 호출하기 전에 입력을 거부했음을 의미합니다. 생성된 에셋은 결과 URL이 만료될 수 있으므로 즉시 다운로드하세요.
헤더
인증, 멱등성, 요청 ID, 오류 분류, 재시도 간격, 지출 한도.
Router API 사용
모델 검색, 유효성 검사 오류, 재시도, 과금.
제한 사항
Router가 현재 지원하지 않는 기능과 대체 방법.