llmfeed

Responses API에 장시간 작업용 제어 세 가지 추가

OpenAI
  • 오픈AI가 Responses API에 장시간 작업용 제어를 추가했다.
  • 비동기 도구 호출, 응답 진행 중 추가 지시 보내기, 대화 도중 추론 강도 변경 세 가지다.

오픈AI가 Responses API 에서 GPT-6 Astra 로 오래 걸리는 작업을 할 때 쓸 제어 기능을 추가했다.

  • Async tool calling: 애플리케이션이 함수 도구나 커스텀 도구를 실행하는 동안 모델이 계속 작업을 이어가고, 결과가 준비되는 대로 돌려받는다.
  • Mid-turn steering: 응답이 진행되는 중에 WebSockets 로 추가 지시를 보낼 수 있다. 모델이 수정 사항이나 달라진 요구를 반영할 수 있다.
  • 대화 도중 추론 강도 변경: 어려운 작업에는 강도를 올리고, 일상적인 후속 질문에는 낮출 수 있다. 이때 캐시된 프롬프트 앞부분은 그대로 유지된다.

원문