GPT-6 Sol·Luna 도구 호출: Responses 전환 전 확인할 설정
Responses와 Chat Completions의 함수 형식, 추론·샘플링 파라미터, 캐시 이전을 확인합니다. 네트워크 호출 없는 요청 검사기를 제공합니다.
GPT-6 Sol이나 Luna에서 추론과 함수 호출을 함께 사용하려면 Responses API를 사용합니다. 현재 문서에서 Chat Completions의 함수 호출은 reasoning_effort: "none"일 때 지원됩니다. 텍스트 요청 성공만으로 에이전트 루프가 준비됐다고 볼 수 없습니다.
2026년 9월 23일 이전 가이드, Sol, Luna 문서를 확인했습니다. 문서와 로컬 요청 형식을 검사했으며 유료 추론이나 재현하지 않은 서버 오류를 실측처럼 제시하지 않습니다.
엔드포인트부터 선택하기
| 목적 | 엔드포인트 | 추론 설정 |
|---|---|---|
| Chat Completions 함수 호출 | /v1/chat/completions | 최상위 reasoning_effort: "none" |
| 추론과 함수 호출 | /v1/responses | reasoning: {"effort":"low"} 등 지원 값 |
| Responses 내장 도구 | /v1/responses | 선택한 도구의 현재 조건 확인 |
지원 값은 none, low, medium, high, xhigh, max입니다. 최상위 필드를 Responses에 복사하는 것은 중첩된 reasoning.effort 설정과 다릅니다. OpenAI 호환 게이트웨이가 모든 Responses 기능을 구현한다고 가정해서도 안 됩니다.
읽기 전용 함수 요청 준비하기
Responses에서는 함수 정의를 도구 객체에 직접 넣습니다.
{"model":"gpt-6-sol","input":"Look up the status of order EXAMPLE-001.","reasoning":{"effort":"low"},"max_output_tokens":2048,"tools":[{"type":"function","name":"lookup_order","description":"Read the status of a sample order.","parameters":{"type":"object","properties":{"order_id":{"type":"string"}},"required":["order_id"],"additionalProperties":false},"strict":true}]}
이 본문은 주문 상태 조회 함수를 선언하며, 구현이나 호출을 보장하지 않습니다. 앱은 반환된 호출을 처리하고 인수를 검증하며 허용된 읽기 동작을 실행한 뒤 결과를 돌려줘야 합니다. 운영 서비스에 연결하기 전 민감하지 않은 예시 데이터로 확인하세요.
Chat Completions는 중첩된 function 객체와 최상위 추론 필드를 사용합니다. 함수 도구가 있다면 none으로 설정합니다. URL만 바꾸고 본문과 응답 처리를 그대로 두는 것은 이전이 완료된 것은 아닙니다.
충돌하는 샘플링 설정 제거하기
추론이 none이 아니면 이전 가이드에 따라 temperature, top_p, top_logprobs를 제거합니다. Chat에서는 logprobs도 제거하고, Responses에서는 include의 message.output_text.logprobs를 제거합니다.
소스에 직접 쓴 값뿐 아니라 SDK 래퍼가 삽입한 기본값도 확인합니다. 최종 요청을 확인할 때 키와 민감한 내용을 가립니다. 실패하면 실제 응답을 보관하고 다른 모델의 오류 문구를 추측해 넣지 않습니다.
로컬에서 본문 검사하기
python3 check_request.py responses responses-example.json
검사기는 통신하지 않고 이 글에서 다룬 엔드포인트, 추론 값, 파라미터 충돌만 확인합니다. 전체 Schema, 계정 권한, 결제, 한도, 도구 동작, 공급자 구현을 보증하지 않습니다. 테스트에는 의도적으로 잘못 만든 합성 요청도 포함했습니다.
기존 Chat 본문은 비밀을 제거한 뒤 첫 인수에 chat을 사용합니다. 앱이 특정 필드에 의존한다면 진단 메시지만 보고 무조건 지우지 말고, 통합 방식과 출력 처리까지 바꿔 검증합니다.
도구 상태와 캐시 설정 보존하기
도구 호출 ID와 대응 결과를 연결하고 API가 요구하는 대화 항목을 유지합니다. 전체 루프는 함수 호출 문서를 확인하세요.
GPT-5.5 이하에서 옮긴다면 현재 가이드는 prompt_cache_retention을 prompt_cache_options.ttl의 "30m"로 바꾸는 내용도 설명합니다. JSON이 파싱된다고 이전 설정이 지원되는 것은 아닙니다. 캐시 적용 조건과 비용은 별도로 확인합니다.
권한 문제는 접근 가이드, 비용은 Sol(영문)과 Luna(영문)를 참고하세요. 형식 통과는 한 단계이며 최종 확인에는 올바른 작업 결과와 실제 응답이 필요합니다.
자주 묻는 질문
- Chat Completions에서도 함수 호출이 되나요?
- 현재 Sol·Luna 문서에서는 reasoning_effort가 none일 때 지원합니다. 추론과 함께 쓰려면 Responses를 사용합니다.
- 검사기를 통과하면 API 권한도 있나요?
- 보장하지 않습니다. 요청을 보내거나 권한, 결제, 출력 결과를 확인하지 않습니다.
- 추론을 켜고 temperature를 남겨도 되나요?
- 현재 가이드는 none이 아닐 때 temperature, top_p, top_logprobs 제거와 엔드포인트별 logprobs 확인을 요구합니다.


