TabbitBlog

GPT-5.4란 무엇인가: 변경점, 접근 방법과 확인할 경계

GPT-5.4의 네이티브 컴퓨터 사용, 전문 업무, 도구 검색, 컨텍스트와 과금 한계, 접근 경로와 실무 위험을 공식 및 독립 자료로 정리합니다.

이 글의 목차
  1. 핵심 요약
  2. 사양과 변경점
  3. 커뮤니티 신호와 Tabbit 경계
  4. 안전성, 미지수와 결론
  5. 출처와 질문
  6. ChatGPT, Codex와 API에서 같은가요?
  7. API가 정말 1.05M 컨텍스트를 지원하나요?
  8. 어떤 effort를 선택해야 하나요?
  9. 네이티브 컴퓨터 사용은 안전을 보장하나요?
  10. 도구 검색은 항상 비용을 낮추나요?
  11. Tabbit에서 사용할 수 있나요?

GPT-5.4는 전문 업무, 코딩, 도구 사용과 컴퓨터 조작 에이전트를 위해 OpenAI가 2026년 3월 공개한 프런티어 모델입니다. 파일, 앱과 웹사이트를 넘나드는 업무를 시험할 후보지만, 모델 이름만큼 접근 경로와 과금 조건이 중요합니다.

API 페이지는 1,050,000 토큰 컨텍스트를 제시하지만 272K를 넘는 입력은 전체 세션에서 입력 2배, 출력 1.5배로 계산됩니다. 이는 API 규칙이며 ChatGPT, Codex, 클라우드 제공자나 Tabbit이 같은 유효 컨텍스트를 제공한다는 뜻은 아닙니다. 먼저 GPT-5.4 모델 리소스 (English)를 보고 실제 제품과 계정을 확인하세요.

핵심 요약

  • GPT-5.4는 GPT-5.3-Codex 코딩 능력을 일반 모델에 가져오고 전문 업무와 네이티브 컴퓨터 사용을 더했습니다.

  • API ID는 gpt-5.4, 컨텍스트 1,050,000, 최대 출력 128,000이며 reasoning effort는 none부터 xhigh까지입니다.

  • OpenAI는 OSWorld-Verified 75.0%, WebArena-Verified 67.3%, Online-Mind2Web 92.8%와 250개 MCP Atlas 작업에서 도구 검색으로 47% 토큰 절감을 보고합니다.

  • API 가격은 입력 $2.50, 캐시 입력 $0.25, 출력 $15(백만 토큰 기준)입니다. 구독 한도는 별도입니다.

  • 컴퓨터 사용은 가능한 행동을 늘리지만 권한, 확인, 로그, 테스트와 사람의 승인을 대체하지 않습니다.

사양과 변경점

항목API 스냅샷경계
모델 IDgpt-5.4로그에 전체 ID를 고정하고 ChatGPT와 Codex를 구분하세요.
컨텍스트 / 최대 출력1,050,000 / 128,000 토큰API 상한이며 클라이언트는 더 작을 수 있습니다.
Reasoningnone, low, medium, high, xhighUI나 요금제가 일부만 제공할 수 있습니다.
긴 입력>272K: 입력 2배, 출력 1.5배구독 규칙이 아닌 과금 규칙입니다.
지식 기준일API 페이지 기준 2025-08-31최신 사실은 검색이 필요합니다.

OpenAI가 말하는 변화는 세 가지입니다. API와 Codex는 스크린샷, 마우스와 키보드로 컴퓨터를 조작할 수 있습니다. 도구 검색은 필요한 MCP 정의만 불러옵니다. ChatGPT Thinking은 긴 답변 전에 계획을 제시하고 실행 중 지시를 받을 수 있습니다. Fast mode는 같은 모델의 속도 경로입니다. 벤치마크마다 effort, 도구와 연구 환경이 달라 하나의 점수로 합치면 안 됩니다.

GPT-5.4 프롬프트 모음 (English), 리뷰 모음 (English), 에이전트 추론 가이드는 원자료와 평가를 구분합니다. Reddit, ORCFLO와 LayerLens도 각기 다른 표본과 판정 방법을 사용합니다.

API, ChatGPT, Codex, 클라우드 제공자와 Tabbit은 가격, 한도, 별칭과 도구를 자동으로 공유하지 않습니다. 브라우저에서는 되돌릴 수 있는 작업, 코드에서는 테스트와 diff, 문서에서는 예상 값, MCP에서는 도구 검색을 비교하세요. 모델 ID, 경로, effort, 컨텍스트, 도구, 토큰, 지연, 재시도와 사람의 수정을 기록하고 GPT-5.6 Terra, GPT-5.6 Sol, Sol 1M 가이드와 비교하세요.

커뮤니티 신호와 Tabbit 경계

Reddit 초기 글에는 5.4가 5.3-Codex보다 빠르다는 경험, 5.4 high가 대규모 리팩터링을 수행하고 5.3-Codex가 검토했다는 사례가 있습니다. 16개 worktree의 동일 Express 프로젝트 실험은 Claude Opus가 품질을 판정했고 요약 품질은 주관적이라고 밝혔습니다. 엄격한 계획이 필요하다는 부정적 보고도 있습니다. 모두 특정 클라이언트, 작업과 표본에 따른 관찰입니다. AI 브라우저 가이드로 모델 능력과 클라이언트 권한을 분리하세요.

이 초안은 인증된 Tabbit Browser에서 GPT-5.4를 실행하지 않았습니다. 따라서 선택기 표시, 유효 컨텍스트, 지연, 제공자 경로, 한도, 권한과 비용을 주장하지 않습니다. 표시된다면 공개적이고 되돌릴 수 있는 작업부터 시작해 모델 라벨과 수용 기준을 기록하세요.

Tabbit Browser

안전성, 미지수와 결론

OpenAI는 Preparedness Framework에서 GPT-5.4를 High cyber capability로 분류하고 일부 ZDR 환경에서 모니터링, 신뢰 제어와 비동기 차단을 사용합니다. 네이티브 컴퓨터 사용은 입력과 클릭을 가능하게 하지만 되돌릴 수 없는 행동에는 확인, 제한된 권한, 로그, 테스트와 사람의 승인이 필요합니다. 1M 컨텍스트가 1M 품질을 보장하는 것도 아닙니다.

GPT-5.4는 전문 문서, 코딩 에이전트와 컴퓨터 작업의 첫 시험에 적합합니다. 실제 경계는 >272K 가격 배수, 유효 컨텍스트, 도구 권한과 구독 한도입니다. 경로와 effort를 고정하고 되돌릴 수 있는 fixture에서 수용된 결과, 토큰 비용, 재시도, 지연과 사람의 수정을 따로 측정하세요. Tabbit Browser 개요는 API 크레딧을 제공하지 않습니다.

출처와 질문

주요 출처는 OpenAI의 GPT-5.4 발표, API 모델 페이지, 안전 자료입니다. 독립 출처는 LayerLens, ORCFLO, Tom's Guide입니다.

ChatGPT, Codex와 API에서 같은가요?

아닙니다. API는 gpt-5.4, ChatGPT는 GPT-5.4 Thinking, Codex는 자체 컨텍스트, effort, 한도와 도구 제어를 사용합니다.

API가 정말 1.05M 컨텍스트를 지원하나요?

API 페이지에 1,050,000 토큰이 표시되지만 모델 상한입니다. 클라이언트는 더 일찍 압축할 수 있고 272K 초과에는 다른 배수가 적용됩니다.

어떤 effort를 선택해야 하나요?

수용 기준을 통과하는 가장 낮은 effort부터 시작하세요. 높은 effort는 품질, 비용, 시간과 한도 사용량을 높일 수 있습니다.

네이티브 컴퓨터 사용은 안전을 보장하나요?

아닙니다. 확인, 권한, 로그, 테스트와 사람의 검토가 필요합니다.

도구 검색은 항상 비용을 낮추나요?

OpenAI는 MCP Atlas 250개 작업에서 47% 토큰 감소를 보고했지만 정의, 서버, 실패와 경로에 따라 결과가 달라집니다.

Tabbit에서 사용할 수 있나요?

이 초안은 인증된 Tabbit 세션을 확인하지 않았습니다. 실시간 선택기를 확인하고 한 번의 성공을 플랫폼 전체의 보장으로 해석하지 마세요.

자주 묻는 질문

GPT-5.4란 무엇인가요?

GPT-5.4는 전문 업무, 코딩, 도구 사용과 컴퓨터 조작 에이전트를 위해 OpenAI가 2026년 3월 공개한 프런티어 모델입니다. API ID는 gpt-5.4이며 ChatGPT와 Codex에서는 GPT-5.4 Thinking으로 제공됩니다.

컨텍스트와 출력 한도는 얼마인가요?

API 모델 페이지는 1,050,000 토큰 컨텍스트와 최대 128,000 토큰 출력을 제시합니다. 클라이언트나 요금제는 더 작을 수 있고 272K를 넘는 입력에는 다른 가격 배수가 적용됩니다.

GPT-5.4의 가격은 얼마인가요?

API는 입력 백만 토큰 2.50달러, 캐시 입력 0.25달러, 출력 15달러입니다. 272K를 초과하면 전체 세션에 입력 2배, 출력 1.5배가 적용됩니다.

무엇이 달라졌나요?

OpenAI는 GPT-5.3-Codex의 코딩 능력에 전문 업무, 네이티브 컴퓨터 사용, 도구 검색과 조정 가능한 추론을 결합했습니다.

어디서 사용할 수 있나요?

OpenAI는 API, ChatGPT Thinking, Codex를 안내합니다. 실제 경로는 모델 ID, 지역, 조직, 요금제, 앱 버전과 도구 권한에 따라 달라집니다.

Tabbit Browser에서 GPT-5.4를 쓸 수 있나요?

이 초안에서는 인증된 Tabbit 계정으로 GPT-5.4를 테스트하지 않았습니다. 실시간 선택기를 확인하고 되돌릴 수 있는 작업으로 검증하세요.

다음 단계

Tabbit 과 함께 일하세요.

탭 간 조사를 하고, 반복적인 브라우저 작업을 자동화하며, 모든 맥락을 손이 닿는 곳에 두세요.