GPT-6 Astra의 핵심을 한 문장으로 줄이면 “더 똑똑한 채팅 모델”보다 컴퓨터에서 복잡한 일을 끝까지 수행하는 모델에 가깝습니다.
OpenAI는 Astra를 브라우징, 컴퓨터 사용, 소프트웨어 엔지니어링, 문서·스프레드시트·프레젠테이션 제작처럼 여러 능력을 이어 쓰는 모델로 설명합니다. API에도 긴 작업을 위한 비동기 도구 호출과 진행 중 지시 변경 같은 기능이 추가됐습니다.
이 변화는 프롬프트 작성법보다 더 큰 문제를 만듭니다.
AI에게 ‘무엇을 하라’고 말하는 것만으로는 부족하고, ‘언제 끝난 것으로 볼지’까지 정의해야 합니다.
답변형 작업과 완료형 작업은 다릅니다
“우리 제품의 경쟁사를 조사해줘”는 답변형 요청입니다.
반면 아래는 완료형 요청입니다.
경쟁사 5곳을 조사하고, 가격과 핵심 기능을 표로 정리하고, 출처를 붙이고, 우리 제품과 다른 점을 1페이지 메모로 작성해 회사 템플릿에 맞춘 문서로 만들어라.
여기에는 여러 종류의 실패가 가능합니다.
- 경쟁사 선정이 틀릴 수 있다.
- 오래된 가격을 가져올 수 있다.
- 출처와 주장 연결이 끊길 수 있다.
- 문서 형식은 맞지만 결론이 약할 수 있다.
- 일부 작업만 끝내고 전체를 완료했다고 말할 수 있다.
모델 성능이 좋아져도 이 문제는 사라지지 않습니다.
CodeBridge 미니 실험: “완료 조건 없는 요청”과 “완료 조건 있는 요청” 비교
같은 AI에서 아래 두 요청을 비교해보세요.
A. 목표만 있는 요청
우리 서비스와 비슷한 경쟁사를 조사해서 보고서를 만들어줘.
B. 완료 조건까지 있는 요청
목표: 우리 서비스와 직접 경쟁하는 서비스 5곳을 조사한다.
완료 조건:
- 공식 사이트에서 현재 제공 여부 확인
- 각 서비스의 가격, 주요 기능, 대상 사용자를 표로 정리
- 가격은 확인 날짜를 함께 기록
- 각 핵심 주장 옆에 출처 표시
- 서로 다른 서비스의 기능명을 억지로 같은 기능으로 합치지 않기
- 확인할 수 없는 항목은 '확인 불가'로 표시
- 마지막에 우리가 추가로 직접 검증할 질문 5개 작성
실험할 때는 “어느 답이 더 길었는가?”보다 다음을 봅니다.
- 누락 항목이 줄었는가?
- 불확실한 정보를 숨기지 않는가?
- 결과물을 다시 사람이 검사하기 쉬운가?
- 끝났다는 판단 근거가 보이는가?
Astra 같은 모델이 강해질수록 이런 완료 조건의 가치도 커집니다.
Mid-turn steering은 왜 중요할까?
긴 작업은 시작할 때 모든 요구사항을 완벽하게 적기 어렵습니다.
조사 도중 이런 일이 생길 수 있습니다.
- “그 회사는 경쟁사가 아니니 제외해줘.”
- “가격보다 API 기능을 더 깊게 봐줘.”
- “이 문서에서는 보안 관련 데이터는 빼줘.”
OpenAI는 Astra의 Responses API에 진행 중인 작업에 추가 지시를 전달하는 mid-turn steering을 소개했습니다. 중요한 점은 기능 이름이 아니라 장시간 작업이 고정된 한 번의 프롬프트가 아니라 상호작용하는 프로세스로 바뀐다는 것입니다.
이 관점에서는 AI에게 일을 시킬 때도 프로젝트 관리와 비슷한 구조가 필요합니다.
- 목표
- 제약
- 중간 체크포인트
- 수정
- 완료 검증
컴퓨터 사용형 AI에서 실패가 더 비싼 이유
텍스트 답변이 틀리면 보통 다시 질문하면 됩니다.
하지만 컴퓨터를 조작하는 AI는 잘못된 행동이 실제 상태를 바꿀 수 있습니다.
- 잘못된 파일 삭제
- 잘못된 사람에게 메시지 전송
- 잘못된 데이터 입력
- 원하지 않는 결제나 예약
따라서 실행 권한이 커질수록 undo, 승인, 로그, 샌드박스 같은 안전장치가 필요합니다.
이 부분은 Meta Muse의 권한 설계와 하네스 엔지니어링에서도 같은 원리로 이어집니다.
실전 체크리스트: AI에게 긴 업무를 맡기기 전 6문장
다음 여섯 문장을 채울 수 없다면 아직 작업 정의가 덜 된 상태일 수 있습니다.
- 이 작업의 최종 산출물은 ___이다.
- 반드시 지켜야 할 제약은 ___이다.
- AI가 임의로 결정하면 안 되는 것은 ___이다.
- 외부 상태를 바꾸기 전에는 ___을 확인한다.
- 완료 여부는 ___로 검증한다.
- 확인하지 못한 항목은 ___로 표시한다.
결론: 모델이 강해질수록 ‘프롬프트’보다 ‘작업 계약서’가 중요해집니다
GPT-6 Astra 같은 모델은 사람이 컴퓨터에서 하던 여러 단계를 하나의 흐름으로 묶는 방향을 보여줍니다.
하지만 더 많은 일을 할 수 있다는 것은 더 많은 판단과 상태 변경을 할 수 있다는 뜻이기도 합니다.
그래서 앞으로 좋은 지시는 단순히 길고 자세한 문장이 아니라 다음에 가까워질 가능성이 큽니다.
목표 + 권한 + 완료 조건 + 검증 방법.
AI가 무엇을 말했는지보다 무엇을 실제로 끝냈는지가 중요해지는 순간, 이 네 가지가 기본기가 됩니다.