ChatGPT와 같은 생성형 AI는 질문에 답하고, 글을 쓰고, 코드를 만들어 주는 도구로 널리 사용되고 있습니다.
하지만 AI가 작성한 코드나 문서를 실제 컴퓨터에 적용하려면 대개 사용자가 내용을 복사하고, 파일을 열고, 수정한 뒤, 프로그램을 실행해 결과를 확인해야 했습니다.
OpenAI의 Codex는 여기서 한 단계 더 나아갑니다.
Codex는 사용자가 원하는 작업을 설명하면 관련 파일을 읽고, 필요한 내용을 수정하며, 프로그램이나 명령을 실행하고, 결과를 확인하는 AI 작업 에이전트입니다.
단순히 방법을 알려주는 데 그치지 않고, 사용자가 허용한 작업 환경에서 실제 작업을 수행하도록 설계되었습니다.
Codex는 질문에 답하는 데 그치지 않고, 사용자가 지정한 파일과 도구를 이용해 실제 작업을 수행하는 OpenAI의 AI 에이전트입니다.
1. Codex란 무엇인가?
OpenAI는 Codex를 코드를 작성하고 검토하며 배포하는 과정을 돕는 AI 에이전트라고 설명합니다. Codex는 사용자의 지시를 이해하고, 관련 파일을 조사하며, 코드를 작성하거나 수정하고, 필요한 명령을 실행할 수 있습니다.
예를 들어 일반적인 ChatGPT에 다음과 같이 질문할 수 있습니다.
홈페이지에서 회원가입 버튼이 작동하지 않는데 원인이 무엇인지 알려줘.
일반 ChatGPT는 가능한 원인과 수정 방법을 설명하거나 예시 코드를 작성해 줄 수 있습니다.
반면 Codex에 홈페이지 프로젝트를 연결하고 같은 작업을 맡기면 다음과 같은 순서로 작업할 수 있습니다.
- 프로젝트의 폴더와 파일 구조를 확인합니다.
- 회원가입 버튼과 관련된 파일을 찾습니다.
- 코드와 설정을 분석합니다.
- 오류 원인을 찾습니다.
- 필요한 파일을 수정합니다.
- 프로그램이나 테스트를 실행합니다.
- 수정 결과를 사용자에게 보여줍니다.
Codex의 가장 큰 특징은 답변 생성과 실제 작업 수행이 연결되어 있다는 점입니다.
2. AI 에이전트란 무엇인가?
AI 에이전트는 사용자의 목표를 이해하고, 목표를 달성하기 위해 필요한 단계를 판단한 뒤, 여러 도구를 이용해 작업을 수행하는 AI 시스템입니다.
일반적인 채팅형 AI는 사용자가 질문하면 답변을 생성합니다.
AI 에이전트는 답변을 생성하는 것뿐 아니라 다음 행동을 결정할 수 있습니다.
- 어떤 파일을 확인해야 하는가?
- 어떤 명령을 실행해야 하는가?
- 어떤 부분을 수정해야 하는가?
- 수정한 결과가 제대로 작동하는가?
- 오류가 발생하면 무엇을 다시 확인해야 하는가?
예를 들어 사용자가 다음과 같이 요청했다고 가정해 보겠습니다.
이 프로그램이 실행되지 않는 원인을 찾아서 수정해줘.
Codex는 단순히 예상 원인을 나열하는 데 그치지 않고, 관련 파일을 읽고 프로그램을 실행해 오류 메시지를 확인할 수 있습니다. 이후 원인을 찾으면 코드를 수정하고 다시 실행해 결과를 검토할 수 있습니다.
이처럼 AI가 목표를 이해하고, 여러 단계를 거쳐 결과를 만들어 내는 방식을 에이전트형 작업이라고 합니다.
3. 일반 ChatGPT와 무엇이 다른가?
일반 ChatGPT와 Codex는 같은 OpenAI 계열의 AI를 사용하지만 작업 방식에는 차이가 있습니다.
일반 ChatGPT는 대화를 중심으로 작동합니다. 사용자가 질문하거나 자료를 제공하면 내용을 설명하고, 아이디어를 제안하고, 글이나 코드를 작성합니다.
Codex는 작업 환경을 중심으로 작동합니다. 사용자가 허용한 폴더, 코드 저장소, 터미널과 개발 도구를 이용해 실제 파일을 조사하고 수정합니다. OpenAI는 Codex가 로컬 폴더, 저장소, 터미널과 개발 도구를 사용할 수 있다고 안내하고 있습니다.
| 비교 항목 | 일반 ChatGPT | Codex |
|---|---|---|
| 주요 목적 | 질문, 설명, 조사, 글쓰기 | 프로젝트와 파일을 대상으로 실제 작업 수행 |
| 작업 방식 | 대화를 통해 답변 제공 | 파일 조사, 수정, 실행, 검증 |
| 코드 작성 | 채팅창에 코드를 작성 | 프로젝트 파일에 코드를 직접 적용 가능 |
| 파일 처리 | 사용자가 올린 파일을 중심으로 분석 | 사용자가 허용한 폴더와 프로젝트 조사 |
| 명령 실행 | 제한된 실행 환경 사용 | 로컬 터미널과 개발 도구 사용 가능 |
| 오류 수정 | 해결 방법과 수정안 제시 | 원인 조사부터 수정과 테스트까지 수행 |
| 적합한 작업 | 질문, 기획, 설명, 간단한 작성 | 여러 단계가 필요한 실제 프로젝트 작업 |
그렇다고 Codex가 일반 ChatGPT보다 항상 더 좋은 것은 아닙니다.
개념을 묻거나 짧은 문장을 작성하거나 아이디어를 정리할 때는 일반 ChatGPT가 더 간단합니다.
반대로 여러 파일을 조사하고, 실제 내용을 수정하고, 결과를 실행해 확인해야 한다면 Codex가 더 적합합니다.
4. Codex는 하나의 AI 모델인가?
Codex를 하나의 AI 모델 이름으로 이해하면 혼동하기 쉽습니다.
Codex는 특정 모델 하나만을 가리키는 것이 아니라, AI 모델이 파일과 도구를 이용해 작업할 수 있도록 만든 작업 환경과 제품군에 가깝습니다.
Codex 안에서는 작업의 종류와 난도에 따라 여러 모델을 선택할 수 있습니다. 모델은 사용자의 지시를 이해하고 판단하는 두뇌 역할을 합니다.
Codex는 그 모델이 다음과 같은 도구를 사용할 수 있도록 연결합니다.
- 프로젝트 파일
- 로컬 폴더
- 코드 저장소
- 터미널
- 프로그램 실행 환경
- 테스트 도구
- Git과 GitHub
- 브라우저
- 외부 플러그인과 서비스
쉽게 비유하면 다음과 같습니다.
AI 모델이 작업자의 두뇌라면, Codex는 작업자가 파일과 도구를 이용해 실제 일을 할 수 있도록 마련된 작업실입니다.
따라서 Codex의 성능과 비용은 어떤 모델을 선택했는지뿐 아니라, 어떤 파일과 도구를 연결하고 얼마나 복잡한 작업을 맡겼는지에 따라서도 달라집니다.
모델별 성능과 요금 차이는 이 시리즈의 3편에서 별도로 다룹니다.
5. Codex는 어떻게 작업하는가?
Codex의 기본 작업 과정은 다음과 같습니다.
1단계: 사용자가 목표를 설명한다
사용자는 프로그래밍 명령어가 아니라 자연어로 원하는 결과를 설명할 수 있습니다.
예를 들면 다음과 같습니다.
홈페이지의 메뉴가 모바일 화면에서 겹치는 원인을 찾아줘.
이 프로젝트의 구조를 분석하고 실행 방법을 정리해줘.
오류가 발생하는 부분을 찾아 수정하고 테스트해줘.
2단계: 필요한 정보를 조사한다
Codex는 사용자가 허용한 범위 안에서 관련 파일과 폴더를 조사합니다.
작업에 따라 다음 내용을 확인할 수 있습니다.
- 폴더 구조
- 소스 코드
- 설정 파일
- 설치된 패키지
- 오류 기록
- 설명 문서
- 기존 테스트
- Git 변경 내역
3단계: 작업 계획을 세운다
복잡한 작업이라면 Codex는 어떤 파일을 확인하고 무엇을 수정할지 판단합니다.
예를 들어 버튼 오류를 수정하려면 화면을 구성하는 파일뿐 아니라 버튼이 호출하는 기능, 데이터 처리 코드와 설정 파일까지 확인할 수 있습니다.
4단계: 파일을 작성하거나 수정한다
Codex는 필요한 코드를 작성하거나 기존 파일을 수정할 수 있습니다.
사용자는 Codex가 변경한 부분을 비교 화면에서 검토할 수 있습니다. Codex 앱에서는 작업별 대화에서 변경된 코드를 확인하고, 의견을 남기거나 편집기에서 직접 수정할 수 있습니다.
5단계: 명령과 테스트를 실행한다
Codex는 프로그램을 실행하거나 테스트 명령을 사용해 수정 결과를 점검할 수 있습니다.
테스트에 실패하면 오류 내용을 분석하고 다시 수정할 수도 있습니다.
6단계: 결과를 사용자에게 보고한다
작업이 끝나면 Codex는 보통 다음 내용을 정리합니다.
- 무엇을 조사했는가?
- 오류의 원인은 무엇이었는가?
- 어떤 파일을 수정했는가?
- 테스트 결과는 어떠한가?
- 사용자가 추가로 확인해야 할 것은 무엇인가?
즉, Codex는 다음과 같은 반복 구조로 작업합니다.
지시 이해 → 파일 조사 → 수정 → 실행 → 결과 확인 → 필요하면 다시 수정
6. Codex는 어디에서 사용할 수 있는가?
Codex는 하나의 프로그램에서만 사용하는 도구가 아닙니다.
OpenAI는 Codex를 데스크톱 앱, 터미널용 CLI, 코드 편집기용 IDE 확장 프로그램과 클라우드 환경 등 여러 방식으로 제공하고 있습니다.
Codex 데스크톱 앱
데스크톱 앱은 Codex를 별도의 작업 화면에서 사용하는 방식입니다.
사용자는 프로젝트별로 대화를 나누고, Codex가 수정한 파일을 확인하며, 여러 작업을 동시에 진행할 수 있습니다.
OpenAI는 2026년 2월 macOS용 Codex 앱을 공개했고, 2026년 3월 4일 Windows 버전을 추가했습니다. Codex 앱은 여러 에이전트를 각 작업에 배정하고 병렬로 실행할 수 있는 작업 관리 환경으로 설계되었습니다.
처음 Codex를 사용하는 사람에게는 데스크톱 앱이 비교적 이해하기 쉬운 방식입니다.
Codex CLI
CLI는 Command Line Interface의 약자로, 터미널에서 명령어로 사용하는 방식입니다.
Codex CLI는 사용자의 컴퓨터에서 실행되며, 현재 프로젝트의 파일을 읽고 수정하고 프로그램을 실행할 수 있습니다.
OpenAI는 Codex CLI를 로컬 컴퓨터에서 코드를 읽고, 수정하고, 실행할 수 있는 경량 코딩 에이전트라고 설명합니다.
터미널과 개발 도구에 익숙한 사용자에게 적합합니다.
CLI는 Windows의 명령 프롬프트나 PowerShell, Linux 터미널처럼 문자 명령을 입력해 프로그램을 사용하는 방식입니다. Codex CLI는 이러한 터미널 환경에서 실행되지만, 실행 후에는 자연어로 원하는 작업을 지시할 수 있습니다.
IDE 확장 프로그램
DE는 Visual Studio Code, Cursor, Windsurf처럼 프로그램 코드를 작성하고 관리하는 편집 환경입니다.
Codex 확장 프로그램을 설치하면 사용자가 작업 중인 코드 옆에서 Codex를 사용할 수 있습니다.
현재 열어 놓은 파일이나 선택한 코드를 기준으로 질문하고, 수정안을 적용하며, 변경된 내용을 바로 확인할 수 있습니다.
클라우드 작업
Codex는 로컬 컴퓨터가 아니라 OpenAI가 제공하는 격리된 클라우드 환경에서도 작업할 수 있습니다.
클라우드 작업에서는 사용자가 연결한 코드 저장소를 별도의 환경에서 불러와 작업합니다. 따라서 사용자의 컴퓨터에서 다른 작업을 하더라도 Codex가 맡은 작업을 독립적으로 수행할 수 있습니다.
로컬 작업과 클라우드 작업은 파일의 위치, 접근 권한과 실행 환경이 다르므로 작업을 시작하기 전에 어떤 환경을 사용하는지 확인하는 것이 좋습니다.
7.개발자가 아니어도 사용할 수 있는가?
Codex는 소프트웨어 개발을 중심으로 만들어졌지만, 사용자는 프로그래밍 언어 대신 자연어로 원하는 작업을 설명할 수 있습니다.
예를 들어 다음과 같이 요청할 수 있습니다.
이 폴더의 자료를 분석해서 항목별로 정리해줘.
이 표의 오류를 찾아서 수정해줘.
간단한 제품 관리 페이지를 만들어줘.
반복적으로 처리하는 업무를 자동화하는 도구를 만들어줘.
기존 홈페이지의 오류 원인을 조사해줘.
개발자가 아닌 사용자는 코드를 직접 작성하지 않아도 됩니다. 그러나 Codex가 무엇을 수정했는지 확인하고 결과가 목적에 맞는지 판단할 수 있어야 합니다.
특히 중요한 작업에서는 다음 사항을 확인해야 합니다.
- 원본 파일이 안전하게 보존되어 있는가?
- Codex가 요청한 범위만 수정했는가?
- 계산이나 데이터 처리 결과가 정확한가?
- 기존 기능이 손상되지 않았는가?
- 개인정보나 비밀 정보가 포함되어 있지 않은가?
Codex는 프로그래밍 지식이 없는 사람도 작업을 시작할 수 있게 해 주지만, 모든 결과를 자동으로 보증하는 도구는 아닙니다.