[metadata]
astro-view-transitions-enabled: true
astro-view-transitions-fallback: swap
description: Pricing information for the OpenAI platform.
generator: Astro v6.0.4
og:description: Pricing information for the OpenAI platform.
og:image: https://developers.openai.com/og/api/docs/pricing.png
og:image:alt: Pricing | OpenAI API
og:image:height: 630
og:image:width: 1200
og:site_name: OpenAI Developers
og:title: Pricing | OpenAI API
og:type: website
og:url: https://developers.openai.com/api/docs/pricing
title: Pricing | OpenAI API
twitter:card: summary_large_image
twitter:description: Pricing information for the OpenAI platform.
twitter:image: https://developers.openai.com/og/api/docs/pricing.png
twitter:image:alt: Pricing | OpenAI API
twitter:image:height: 630
twitter:image:width: 1200
twitter:site: @OpenAIDevs
twitter:title: Pricing | OpenAI API
twitter:url: https://developers.openai.com/api/docs/pricing
viewport: width=device-width,initial-scale=1

[canonical-links]
https://developers.openai.com/api/docs/pricing

[document-links]
AGENTS.md: /codex/agent-configuration/agents-md
API Dashboard: https://platform.openai.com/login
API Partner Setup: /ads/api-partner-setup
API reference: /api/reference/overview
API: /api/docs
API: /blog/topic/api
AWS: /api/docs/guides/workload-identity-federation/aws
Accuracy optimization: /api/docs/guides/optimizing-llm-accuracy
Actions: /api/docs/guides/chatkit-actions
Ad Account: /ads/api-reference/ad-account
Ad Groups: /ads/api-reference/ad-groups
Add UI to your MCP server (optional): /plugins/build/chatgpt-ui
Admin APIs: /api/docs/guides/admin-apis
Admin rollout guide: /codex/enterprise/admin-setup
Ads Overview: /ads
Ads Publish and measure ads in ChatGPT: /ads
Ads: /ads/api-reference/ads
Advanced Config: /codex/config-file/config-advanced
Advanced integrations: /api/docs/guides/custom-chatkit
Agent approvals & security: /codex/agent-approvals-security
Agent definitions: /api/docs/guides/agents/define-agents
Agents: /api/docs/guides/agents
Agents: /cookbook/topic/agents
Agents: /learn/agents
All posts: /blog
Amazon Bedrock: /api/docs/guides/amazon-bedrock
Amazon Bedrock: /codex/amazon-bedrock
Analytics API: /codex/enterprise/analytics-api
App Server: /codex/app-server
Apply Patch: /api/docs/guides/tools-apply-patch
Apps SDK: /blog/topic/apps-sdk
Appshots: /codex/appshots
Audio & Voice: /learn/audio
Audio and speech: /api/docs/guides/audio
Audio: /blog/topic/audio
Authenticate users: /plugins/build/auth
Authenticate with Workspace Agent access tokens: /workspace-agents/authentication
Authentication overview: /codex/auth
Authentication: /ads/api-reference/authentication
Auto-review: /codex/sandboxing/auto-review
Background mode: /api/docs/guides/background
Batch: /api/docs/guides/batch
Best practices: /api/docs/guides/evaluation-best-practices
Best practices: /api/docs/guides/fine-tuning-best-practices
Best practices: /commerce/guides/best-practices
Blog Learnings and experiences from developers: /blog
Brainstorm use cases: /plugins/plan/use-case
Browser: /codex/browser
Build an MCP server: /plugins/build/mcp-server
Build plugins: /codex/build-plugins
Build skills: /codex/build-skills
Build skills: /plugins/build/skills
Bulk API: /ads/bulk-api
CLI customization: /codex/cli-customization
Campaign Targeting: /ads/campaign-targeting
Campaigns: /ads/api-reference/campaigns
Changelog: /api/docs/changelog
Changelog: /codex/changelog
Changelog: /codex/security/plugin/changelog
Changelog: /plugins/changelog
ChatGPT Work Overview: /codex/enterprise/chatgpt-work-overview
ChatGPT Work admin FAQ: /codex/enterprise/work-admin-faq
ChatGPT desktop app: /codex/app
ChatGPT on the web: /codex/web
ChatGPT: /
ChatGPT: /chatgpt
ChatGPT: /cookbook/topic/chatgpt
Checkout API reference: /plugins/build/monetization
Chrome extension: /codex/chrome-extension
Citation formatting: /api/docs/guides/citation-formatting
Cloud environment: /codex/environments/cloud-environment
Code Interpreter: /api/docs/guides/tools-code-interpreter
Code generation: /api/docs/guides/code-generation
Code interpreter: /api/docs/guides/tools-code-interpreter
Code review: /codex/code-review
Codex Ambassadors: /community/codex-ambassadors
Codex Ambassadors: https://developers.openai.com/community/codex-ambassadors
Codex CLI: /codex/cli
Codex IDE extension: /codex/ide
Codex Micro: /codex/features/codex-micro
Codex SDK: /codex/codex-sdk
Codex cloud: /codex/cloud
Codex for Open Source: /community/codex-for-oss
Codex for Open Source: https://developers.openai.com/community/codex-for-oss
Codex for Students: /community/students
Codex for Students: https://developers.openai.com/community/students
Codex: /blog/topic/codex
Codex: /cookbook/topic/codex
Codex: /learn/codex
Codex: https://learn.chatgpt.com/docs
Collections: /codex/use-cases/collections
Commands: /codex/reference/commands
Commerce Build commerce flows in ChatGPT: /commerce
Community Programs, meetups, and support for builders: /community
Community: /community
Compaction: /api/docs/guides/compaction
Company blog: https://openai.com/news/
Compliance API and audit events: /codex/enterprise/compliance-api
Computer History: /codex/customization/computer-history
Computer Use: /learn/cua
Computer use: /api/docs/guides/tools-computer-use
Computer use: /codex/computer-use
Config Basics: /codex/config-file/config-basic
Config Reference: /codex/config-file/config-reference
Connect and test your plugin: /plugins/deploy/connect-chatgpt
Content provenance: /api/docs/guides/content-provenance
Conversation state: /api/docs/guides/conversation-state
Conversion Setup: /ads/api-reference/conversion-setup
Conversion-Optimized Campaigns: /ads/conversion-optimized-campaigns
Conversions API: /ads/conversions-api
Cookbook Notebook examples for building with OpenAI models: /cookbook
Cookbook on GitHub: https://github.com/openai/openai-cookbook
Cost optimization: /api/docs/guides/cost-optimization
Counting tokens: /api/docs/guides/token-counting
Custom Code Review rules for Codex: /blog/custom-code-review-rules-for-codex
Customize: /api/docs/guides/chatkit-themes
Cybersecurity checks: /api/docs/guides/safety-checks/cybersecurity
Deep dive: /api/docs/assistants/deep-dive
Deep research: /api/docs/guides/deep-research
Define tools: /plugins/plan/tools
Delta Feeds API: /ads/delta-feeds
Demo apps: /learn/code
Deployment checklist: /api/docs/guides/deployment-checklist
Deprecations: /api/docs/deprecations
Designing delightful frontends with GPT-5.4: /blog/designing-delightful-frontends-with-gpt-5-4
Desktop app: /codex/linux/linux-app
Desktop app: /codex/windows/windows-app
Developer Forum: https://community.openai.com/
Developer blog: https://developers.openai.com/blog
Developer commands: /codex/developer-commands
Developer settings: /codex/developer-settings
Direct preference optimization: /api/docs/guides/direct-preference-optimization
Discord: https://discord.com/invite/openai
Docs Guides, concepts, and product docs for Codex: https://learn.chatgpt.com/docs
Docs MCP: /learn/docs-mcp
Docs: /codex
Docs: https://learn.chatgpt.com/docs
Embeddings: /api/docs/guides/embeddings
Environment Variables: /codex/config-file/environment-variables
Error codes: /api/docs/guides/error-codes
Evals: /cookbook/topic/evals
Evals: /learn/evals
Evaluate agent workflows: /api/docs/guides/agent-evals
Examples: /plugins/build/examples
Explore use cases: /codex/use-cases
Export and track findings: /codex/security/plugin/export-findings
External models: /api/docs/guides/external-models
FAQ: /codex/security/cli/faq
FAQ: /codex/security/faq
Fast mode: /api/docs/guides/fast-mode
Feature Maturity: /codex/feature-maturity
Feeds: /commerce/specs/api/feeds
File inputs: /api/docs/guides/file-inputs
File search: /api/docs/guides/tools-file-search
File transcription: /api/docs/guides/speech-to-text
Files: /ads/api-reference/files
Fine-tuning: /learn/fine-tuning
Fix findings: /codex/security/plugin/fix-findings
Flex processing: /api/docs/guides/flex-processing
Frontend prompting: /api/docs/guides/frontend-prompt
Function calling: /api/docs/guides/function-calling
GPTs and Sharing: /codex/enterprise/gpts-and-sharing
General: /blog/topic/general
Get Quote spec: /plugins/guides/local-services-request-quote-conversion-spec
Get started with Work: /codex/get-started-with-work
Get started: /commerce/guides/get-started
Getting started: /api/docs/guides/evaluation-getting-started
Git worktrees: /codex/environments/git-worktrees
GitHub Action: /codex/github-action
GitHub Actions: /api/docs/guides/workload-identity-federation/github-actions
GitHub: /codex/third-party/github
Glossary: /codex/glossary
Google Cloud: /api/docs/guides/workload-identity-federation/google-cloud
Governance: /codex/enterprise/governance
Graders: /api/docs/guides/graders
Groups and provisioning: /codex/enterprise/groups-and-provisioning
Guardrails: /api/docs/guides/agents/guardrails-approvals
Guardrails: /cookbook/topic/guardrails
HIPAA configuration: /codex/hipaa-configuration
Home: /
Home: /api/docs
Home: /codex
Home: /codex/resources
Home: /commerce
Home: /cookbook
Home: /learn
Home: /plugins
Home: /workspace-agents
Hooks: /codex/hooks
Hosted Shell: /api/docs/guides/tools-shell#hosted-shell-quickstart
How Perplexity Brought Voice Search to Millions Using the Realtime API: /blog/realtime-perplexity-computer
IP allowlist: /api/docs/guides/ip-allowlist
IP egress ranges: /api/docs/guides/ip-addresses
Image Tag: /ads/image-tag
Image generation: /api/docs/guides/image-generation
Image generation: /api/docs/guides/tools-image-generation
Image generation: /codex/image-generation
Image generation: /learn/imagegen
Image inputs: /codex/image-inputs
Images and vision: /api/docs/guides/images-vision
Import and reconciliation: /api/docs/guides/terraform/import-and-reconcile
Import from another agent: /codex/import
Improving the threat model: /codex/security/threat-model
Insights: /ads/api-reference/insights
Integrated terminal: /codex/integrated-terminal
Integrations and observability: /api/docs/guides/agents/integrations-observability
Internet access: /codex/cloud/internet-access
Key concepts: /api/docs/concepts
Kubernetes: /api/docs/guides/workload-identity-federation/kubernetes
Latency optimization: /api/docs/guides/latency-optimization
Learn Docs, videos, and demo apps for building with OpenAI: /learn
Learn more about Fast mode: /api/docs/guides/fast-mode
Learn more: https://help.openai.com/en/articles/10306912-sharing-feedback-evaluation-and-fine-tuning-data-and-api-inputs-and-outputs-with-openai#h_c93188c569
Linear: /codex/third-party/linear
Live translation: /api/docs/guides/realtime-translation
Local environments: /codex/environments/local-environment
Local shell: /api/docs/guides/tools-local-shell
Long-running work: /codex/long-running-work
MCP Server: /codex/mcp-server
MCP and Connectors: /api/docs/guides/tools-connectors-mcp
MCP server review requirements: /plugins/deploy/app-review
MCP server: /plugins/concepts/mcp-server
MCP: /codex/extend/mcp
Making private MCP servers reachable without making them public: /blog/connect-private-mcp-servers-to-openai-products
Manage app updates: /codex/enterprise/manage-app-updates
Managed configuration: /codex/enterprise/managed-configuration
Managing conversations: /api/docs/guides/realtime-conversations
Managing costs: /api/docs/guides/realtime-costs
Mastering remote engineering work from your phone: /blog/mastering-codex-remote-for-engineering
Measurement Pixel: /ads/measurement-pixel
Meetups: /community/meetups
Meetups: https://developers.openai.com/community/meetups
Memories: /codex/customization/memories
Microsoft Azure: /api/docs/guides/workload-identity-federation/microsoft-azure
Migration guide: /api/docs/assistants/migration
Migration guide: /api/docs/guides/agent-builder/migrate-from-agent-builder
Migration guide: /api/docs/guides/prompting/migrate-from-prompt-object
Model catalog: /api/docs/models
Model selection: /api/docs/guides/model-selection
Model, tool, and data controls: /api/docs/guides/terraform/project-controls
Models & Trusted Access: /codex/cyber-safety
Models and providers: /api/docs/guides/agents/models
Models: /api/docs/models
Models: /codex/models
Moderation: /api/docs/guides/moderation
Modes: /codex/environments/modes
Multi-agent: /api/docs/guides/responses-multi-agent
Multimodal: /cookbook/topic/multimodal
Multiple Pixels (Advanced): /ads/multiple-pixels
Next Model selection: /api/docs/guides/model-selection
Node reference: /api/docs/guides/node-reference
Non-interactive mode: /codex/non-interactive-mode
Notifications: /codex/notifications
Online trainings: https://academy.openai.com/home/events
Open Source: /codex/open-source
OpenAI Academy: https://openai.com/academy/
OpenAI CLI: /api/docs/libraries/openai-cli
OpenAI Crawlers: /api/docs/bots
OpenAI Developers plugin: /learn/developers-codex-plugin
OpenAI SDK: /api/docs/libraries
OpenAI for Startups: https://openai.com/business/why-openai/startups/
OpenAI models in Amazon Bedrock: /api/docs/guides/amazon-bedrock
Optimization cycle: /api/docs/guides/model-optimization
Optimization: /cookbook/topic/optimization
Optimize Metadata: /plugins/guides/optimize-metadata
Oracle Cloud Infrastructure: /api/docs/guides/workload-identity-federation/oracle-cloud
Orchestration: /api/docs/guides/agents/orchestration
Overview: /ads/api-overview
Overview: /api/docs
Overview: /api/docs/guides/agent-builder
Overview: /api/docs/guides/agents
Overview: /api/docs/guides/chatkit
Overview: /api/docs/guides/prompting
Overview: /api/docs/guides/realtime
Overview: /api/docs/guides/terraform
Overview: /api/docs/guides/tools
Overview: /codex/administration
Overview: /codex/configuration
Overview: /codex/customization/overview
Overview: /codex/developers
Overview: /codex/features
Overview: /codex/security
Overview: /codex/security-administration
Overview: /commerce/specs/api/overview
Overview: /commerce/specs/file-upload/overview
Package your plugin: /plugins/build/plugins
Permissions: /api/docs/guides/rbac
Permissions: /codex/permission-modes
Personal Access Tokens: /codex/enterprise/access-tokens
Personalize ChatGPT: /codex/personalize
Pets: /codex/pets
Plugin UI reference: /plugins/reference
Plugin architecture: /plugins/concepts/plugins
Plugin controls: /codex/enterprise/apps-and-connectors
Plugin guidelines: /plugins/app-guidelines
Plugins Extend ChatGPT and Codex: /plugins
Plugins: /codex/plugins
Predicted Outputs: /api/docs/guides/predicted-outputs
Pricing: /api/docs/pricing
Pricing: /codex/pricing
Prisma AIRS: /codex/enterprise/prisma-airs
Private Link: /api/docs/guides/private-link
Product Feeds: /ads/product-feeds
Product checkout spec: /plugins/guides/product-checkout-conversion-spec
Production best practices: /api/docs/guides/production-best-practices
Production: /api/docs/guides/production-best-practices
Products: /commerce/specs/api/products
Products: /commerce/specs/file-upload/products
Profiles: /codex/permissions
Programmatic tool calling: /api/docs/guides/tools-programmatic-tool-calling
Projects and access: /api/docs/guides/terraform/projects-and-access
Projects and chats: /codex/projects
Promotions: /commerce/specs/api/promotions
Prompt caching: /api/docs/guides/prompt-caching
Prompt engineering: /api/docs/guides/prompt-engineering
Prompt generation: /api/docs/guides/prompt-generation
Prompt optimizer: /api/docs/guides/prompt-optimizer
Prompting: /codex/prompting
Propose security hardening: /codex/security/plugin/security-hardening
Quickstart: /ads/api-quickstart
Quickstart: /api/docs/guides/agents/quickstart
Quickstart: /api/docs/quickstart
Quickstart: /codex/quickstart
Quickstart: /codex/security/cli
Quickstart: /codex/security/plugin
Quickstart: /plugins/quickstart
RFT use cases: /api/docs/guides/rft-use-cases
Rate limits and spend: /api/docs/guides/terraform/rate-limits-and-spend
Rate limits: /api/docs/guides/rate-limits
Realtime prompting guide: /api/docs/guides/realtime-models-prompting
Realtime transcription: /api/docs/guides/realtime-transcription
Realtime with tools: /api/docs/guides/realtime-mcp
Reasoning best practices: /api/docs/guides/reasoning-best-practices
Reasoning models: /api/docs/guides/reasoning
Recommended configuration: /codex/cyber-safety/recommended-configuration
Record & Replay: /codex/extend/record-and-replay
Red teaming: /api/docs/guides/red-teaming
Reddit: https://www.reddit.com/r/OpenAI/
Reference: /codex/security/cli/reference
Reinforcement fine-tuning: /api/docs/guides/reinforcement-fine-tuning
Remote connections: /codex/remote-connections
Remote: /codex/remote
Resources: /codex/resources
Resources: /learn
Responses API: /api/docs/guides/migrate-to-responses
Restaurant reservation spec: /plugins/guides/restaurant-reservation-conversion-spec
Results and state: /api/docs/guides/agents/results
Retrieval: /api/docs/guides/retrieval
Review code changes: /codex/security/plugin/code-changes
Roles and workspace permissions: /codex/enterprise/roles-and-workspace-permissions
Rules: /codex/agent-configuration/rules
Run a deep scan: /codex/security/plugin/deep-scans
Run a security scan: /codex/security/plugin/scans
Run bulk scans: /codex/security/cli/bulk-scans
Run scans in CI: /codex/security/cli/ci
Running agents: /api/docs/guides/agents/running-agents
SIP: /api/docs/guides/realtime-sip
SPIFFE: /api/docs/guides/workload-identity-federation/spiffe
Safety best practices: /api/docs/guides/safety-best-practices
Safety checks: /api/docs/guides/safety-checks
Safety in building agents: /api/docs/guides/agent-builder-safety
Sample Config: /codex/config-file/config-sample
Sandbox agents: /api/docs/guides/agents/sandboxes
Sandboxing: /codex/sandboxing
Scaling: /learn/scaling
Scheduled tasks: /codex/automations
Secure MCP Tunnel: /api/docs/guides/secure-mcp-tunnels
Security & Privacy: /plugins/guides/security-privacy
Security Review: /codex/security/security-review
Service accounts: /api/docs/guides/terraform/service-accounts
Service accounts: /codex/enterprise/service-accounts
Settings: /codex/reference/settings
Setup: /codex/security/setup
Shell: /api/docs/guides/tools-shell
Showcase Demo apps to get inspired: /showcase
Showcase: /showcase
Showcase: https://developers.openai.com/showcase
Sites: /codex/sites
Skill controls: /codex/enterprise/skills
Skills & Plugins: /codex/skills-and-plugins
Skills: /api/docs/guides/tools-skills
Skills: /plugins/concepts/skills
Slack: /codex/third-party/slack
Slash commands: /codex/reference/slash-commands
Speech generation: /api/docs/guides/text-to-speech
Speed: /codex/agent-configuration/speed
Spend limits: /api/docs/guides/spend-limits
Streaming: /api/docs/guides/streaming-responses
Structured output: /api/docs/guides/structured-outputs
Subagents: /codex/agent-configuration/subagents
Submission error reference: /plugins/deploy/submission-errors
Submit a Claude Code plugin: /plugins/guides/submit-claude-plugin
Submit and publish: /plugins/deploy/submission
Supervised fine-tuning: /api/docs/guides/supervised-fine-tuning
Supported Events: /ads/supported-events
Supported countries: /api/docs/supported-countries
Terms and policies: https://openai.com/policies
Terraform provider: /api/docs/guides/terraform
Text generation: /api/docs/guides/text
Text: /cookbook/topic/text
Tool search: /api/docs/guides/tools-tool-search
Tools: /api/docs/assistants/tools
Tools: /api/docs/guides/tools
Tools: /learn/tools
Transcription: /api/docs/guides/transcription
Triage a backlog: /codex/security/plugin/triage-backlog
Trigger workspace agent runs: /workspace-agents/trigger-runs
Troubleshooting: /codex/reference/troubleshooting
Troubleshooting: /plugins/deploy/troubleshooting
Try ChatGPT: https://chatgpt.com/
TypeScript SDK: /codex/security/sdk
UI guidelines: /plugins/concepts/ui-guidelines
Under 18 API Guidance: /api/docs/guides/safety-checks/under-18-api-guidance
Use ChatGPT: /codex/use-chatgpt
Use cases Example workflows and tasks teams can take on with ChatGPT or Codex: https://learn.chatgpt.com/use-cases
Use cases: /codex/use-cases
Use cases: https://learn.chatgpt.com/use-cases
Use the Security workbench: /codex/security/plugin/workbench
Using GPT-5.6: /api/docs/guides/latest-model
Video generation: /api/docs/guides/video-generation
Video generation: /learn/videogen
Videos: /codex/videos
Videos: /learn/videos
Vision fine-tuning: /api/docs/guides/vision-fine-tuning
Visualizations: /codex/visualizations
Voice & Audio: /api/docs/guides/realtime
Voice activity detection: /api/docs/guides/realtime-vad
Voice agents: /api/docs/guides/voice-agents
Voice: /codex/features/voice
WSL: /codex/windows/wsl
Web search: /api/docs/guides/tools-web-search
Web search: /codex/web-search
WebRTC: /api/docs/guides/realtime-webrtc
WebSocket mode: /api/docs/guides/websocket-mode
WebSocket: /api/docs/guides/realtime-websocket
Webhooks and server-side controls: /api/docs/guides/realtime-server-controls
Webhooks: /api/docs/guides/webhooks
What's new: /codex/whats-new
Widgets: /api/docs/guides/chatkit-widgets
Windows app deployment: /codex/enterprise/windows-deployment
Windows sandbox: /codex/windows/windows-sandbox
Work with files: /codex/artifacts-viewer
Working with evals: /api/docs/guides/evals
Workload identity federation: /api/docs/guides/workload-identity-federation
Workspace Agents Trigger published ChatGPT workspace agents: /workspace-agents
Workspace analytics: /codex/enterprise/workspace-analytics
Workspace model availability: /codex/enterprise/workspace-model-availability
Write vulnerability reports: /codex/security/plugin/vulnerability-reports
X.509 certificates (beta): /api/docs/guides/workload-identity-federation/x509
X: https://x.com/OpenAIDevs
Your data: /api/docs/guides/your-data
calculator: /api/docs/guides/image-generation#calculating-costs
gpt-oss: /cookbook/topic/gpt-oss
gpt-oss: /learn/gpt-oss
here: /api/docs/deprecations#update-to-openais-self-serve-fine-tuning
llms.txt: /llms.txt

[content]
Pricing | OpenAI API
For the complete documentation index, see
llms.txt
. Markdown versions of documentation pages are available by appending
.md
to the page URL.
ChatGPT
Home
API
Codex
Docs
Guides, concepts, and product docs for Codex
Use cases
Example workflows and tasks teams can take on with ChatGPT or Codex
Docs
Use cases
Resources
ChatGPT
Plugins
Extend ChatGPT and Codex
Workspace Agents
Trigger published ChatGPT workspace agents
Commerce
Build commerce flows in ChatGPT
Ads
Publish and measure ads in ChatGPT
Resources
Showcase
Demo apps to get inspired
Blog
Learnings and experiences from developers
Cookbook
Notebook examples for building with OpenAI models
Learn
Docs, videos, and demo apps for building with OpenAI
Community
Programs, meetups, and support for builders
Start searching
API Dashboard
Try ChatGPT
Overview
Models
Agents
Tools
Voice & Audio
Production
API reference
Search the API docs
Search docs
Suggested
responses create
reasoning_effort
realtime
prompt caching
Primary navigation
API
Codex
ChatGPT
Docs
Use cases
Resources
Resources
Search docs
Suggested
responses create
reasoning_effort
realtime
prompt caching
Overview
Models
Agents
Tools
Voice & Audio
Production
API reference
Overview
Models
Agents
Tools
Voice & Audio
Production
API reference
Docs section
Models
Home
Get started
Quickstart
Using GPT-5.6
Key concepts
Core concepts
Responses API
Conversation state
Background mode
Streaming
WebSocket mode
Multi-agent
Webhooks
File inputs
Compaction
Counting tokens
SDKs and CLI
OpenAI SDK
OpenAI CLI
Resources
Changelog
Deprecations
Supported countries
OpenAI Crawlers
Terms and policies
Legacy APIs
Agent Builder
Overview
Migration guide
Node reference
Safety in building agents
Evals
Getting started
Working with evals
Prompt optimizer
External models
Best practices
Graders
Fine-tuning
Optimization cycle
Supervised fine-tuning
Vision fine-tuning
Direct preference optimization
Reinforcement fine-tuning
RFT use cases
Best practices
Assistants API
Migration guide
Deep dive
Tools
Model catalog
Choose a model
Pricing
Model selection
Text and code
Text generation
Code generation
Structured output
Prompting
Overview
Prompt engineering
Citation formatting
Migration guide
Prompt generation
Frontend prompting
Reasoning
Reasoning models
Reasoning best practices
Images and video
Images and vision
Image generation
Video generation
Realtime and audio
Audio and speech
Overview
Voice agents
Specialized models
Deep research
Embeddings
Moderation
Overview
Agents SDK
Quickstart
Agent definitions
Models and providers
Running agents
Sandbox agents
Orchestration
Guardrails
Results and state
Integrations and observability
Evaluate agent workflows
ChatKit
Overview
Customize
Widgets
Actions
Advanced integrations
Overview
Function calling
Search and retrieval
Web search
File search
Retrieval
Connect tools and data
MCP and Connectors
Secure MCP Tunnel
Build tool workflows
Skills
Tool search
Programmatic tool calling
Computer and code
Shell
Computer use
Apply Patch
Local shell
Code interpreter
Media
Image generation
Overview
Get started
Voice agents
Live translation
Realtime prompting guide
Audio
Audio and speech
Transcription
File transcription
Realtime transcription
Speech generation
Connection methods
WebRTC
WebSocket
SIP
Sessions and operations
Managing conversations
Voice activity detection
Realtime with tools
Webhooks and server-side controls
Managing costs
Go live
Production best practices
Deployment checklist
Performance and quality
Latency optimization
Predicted Outputs
Fast mode
Accuracy optimization
Cost and throughput
Cost optimization
Prompt caching
Batch
Flex processing
Safety and governance
Safety best practices
Red teaming
Safety checks
Cybersecurity checks
Under 18 API Guidance
Content provenance
Your data
Permissions
Infrastructure and access
Terraform provider
Overview
Projects and access
Service accounts
Rate limits and spend
Model, tool, and data controls
Import and reconciliation
Private Link
IP allowlist
Workload identity federation
X.509 certificates (beta)
Kubernetes
AWS
Microsoft Azure
Google Cloud
Oracle Cloud Infrastructure
GitHub Actions
SPIFFE
IP egress ranges
Amazon Bedrock
Operations
Rate limits
Spend limits
Admin APIs
Error codes
Docs
Use cases
Docs
Use cases
Docs section
Docs
Plugins
Workspace Agents
Commerce
Ads
Plugins
Workspace Agents
Commerce
Ads
Docs section
Select...
Home
Quickstart
Core concepts
Plugin architecture
Skills
MCP server
Plan
Brainstorm use cases
Define tools
Build
Build an MCP server
Add UI to your MCP server (optional)
Authenticate users
Build skills
Package your plugin
Examples
Test and publish
Connect and test your plugin
Submit and publish
Submission error reference
Conversion specs
Restaurant reservation spec
Get Quote spec
Product checkout spec
Guides
UI guidelines
Optimize Metadata
Submit a Claude Code plugin
Security & Privacy
Troubleshooting
Resources
Changelog
Plugin guidelines
MCP server review requirements
Plugin UI reference
Checkout API reference
Home
Get started
Trigger workspace agent runs
Authenticate with Workspace Agent access tokens
Home
Guides
Get started
Best practices
File Upload
Overview
Products
API
Overview
Feeds
Products
Promotions
Ads Overview
Measurement
Measurement Pixel
Multiple Pixels (Advanced)
Image Tag
Conversions API
Supported Events
Advertiser API
Overview
API Partner Setup
Quickstart
Bulk API
Product Feeds
Delta Feeds API
Campaign Targeting
Conversion-Optimized Campaigns
API Reference
Authentication
Ad Account
Campaigns
Ad Groups
Ads
Insights
Files
Conversion Setup
Overview
Features
Configuration
Developers
Security
Administration
Use Cases
Resources
Overview
Features
Configuration
Developers
Security
Administration
Use Cases
Resources
Docs section
Overview
Home
Get started
Quickstart
Use ChatGPT
Get started with Work
Import from another agent
Foundations
Prompting
Personalize ChatGPT
Skills & Plugins
Permissions
Explore
What's new
Models
Pricing
Glossary
Available on
ChatGPT desktop app
Remote
ChatGPT on the web
Codex CLI
Codex IDE extension
Codex cloud
Releases
Changelog
Feature Maturity
Open Source
Overview
Workflows
Projects and chats
Sites
Visualizations
Scheduled tasks
Long-running work
Notifications
Pets
Codex Micro
Capabilities
Browser
Computer use
Voice
Plugins
Web search
Image generation
Image inputs
Appshots
Chrome extension
Work with files
Reference
Commands
Slash commands
Settings
Troubleshooting
Overview
Customization
Overview
Memories
Computer History
Config file
Config Basics
Advanced Config
Config Reference
Environment Variables
Sample Config
Agent configuration
AGENTS.md
Subagents
Speed
Rules
Extend ChatGPT and Codex
Record & Replay
MCP
Linux
Desktop app
Windows
Desktop app
Windows sandbox
WSL
Overview
Development workflows
Code review
Integrated terminal
Extend and automate
Build skills
Build plugins
Hooks
Environments
Modes
Local environments
Cloud environment
Git worktrees
Build with Codex
Codex SDK
App Server
MCP Server
GitHub Action
Non-interactive mode
Third-party integrations
GitHub
Slack
Linear
Reference
CLI customization
Developer commands
Developer settings
Overview
Permissions
Profiles
Sandboxing
Auto-review
Agent approvals & security
Internet access
Codex Security
Overview
Codex Security plugin
Quickstart
Run a security scan
Run a deep scan
Review code changes
Use the Security workbench
Triage a backlog
Fix findings
Propose security hardening
Write vulnerability reports
Export and track findings
Changelog
Codex Security CLI
Quickstart
Run bulk scans
Run scans in CI
Reference
FAQ
TypeScript SDK
Codex Security cloud
Setup
Security Review
Improving the threat model
FAQ
Cyber safety
Models & Trusted Access
Recommended configuration
Overview
Getting started
Admin rollout guide
ChatGPT Work Overview
ChatGPT Work admin FAQ
Identity and authentication
Authentication overview
Personal Access Tokens
Service accounts
Workspace access, policy, and models
Groups and provisioning
Roles and workspace permissions
GPTs and Sharing
Managed configuration
Prisma AIRS
HIPAA configuration
Workspace model availability
Plugin and connector controls
Plugin controls
Skill controls
Usage, governance, and compliance
Governance
Workspace analytics
Analytics API
Compliance API and audit events
Deployment and model providers
Manage app updates
Windows app deployment
Remote connections
Amazon Bedrock
Explore use cases
Collections
Home
Videos
Showcase
OpenAI Academy
Online trainings
Community
Codex Ambassadors
Codex for Students
Codex for Open Source
Meetups
Blog
Company blog
Developer blog
Explore use cases
Collections
Home
Videos
Showcase
OpenAI Academy
Online trainings
Community
Codex Ambassadors
Codex for Students
Codex for Open Source
Meetups
Blog
Company blog
Developer blog
Showcase
Blog
Cookbook
Learn
Community
Showcase
Blog
Cookbook
Learn
Community
Docs section
Select...
All posts
Recent
Custom Code Review rules for Codex
Mastering remote engineering work from your phone
Making private MCP servers reachable without making them public
How Perplexity Brought Voice Search to Millions Using the Realtime API
Designing delightful frontends with GPT-5.4
Topics
General
API
Apps SDK
Audio
Codex
Home
Topics
Agents
Evals
Multimodal
Text
Guardrails
Optimization
ChatGPT
Codex
gpt-oss
Contribute
Cookbook on GitHub
Home
OpenAI Developers plugin
Docs MCP
Categories
Demo apps
Videos
Topics
Agents
Audio & Voice
Computer Use
Codex
Evals
gpt-oss
Fine-tuning
Image generation
Scaling
Tools
Video generation
Community
Programs
Codex Ambassadors
Codex for Students
Codex for Open Source
OpenAI for Startups
Events
Meetups
Spaces
Developer Forum
Discord
Reddit
X
API Dashboard
Try ChatGPT
Model catalog
Choose a model
Pricing
Model selection
Text and code
Text generation
Code generation
Structured output
Prompting
Overview
Prompt engineering
Citation formatting
Migration guide
Prompt generation
Frontend prompting
Reasoning
Reasoning models
Reasoning best practices
Images and video
Images and vision
Image generation
Video generation
Realtime and audio
Audio and speech
Overview
Voice agents
Specialized models
Deep research
Embeddings
Moderation
Copy Page
Pricing
Copy Page
Flagship models
Our latest models
Prices per 1M tokens.
Standard
Batch
Flex
Fast mode
Standard
Short context
Long context
Model
Input
Cached input
Cache writes
Output
Input
Cached input
Cache writes
Output
gpt-5.6-sol
$5.00
$0.50
$6.25
$30.00
$10.00
$1.00
$12.50
$45.00
gpt-5.6-terra
$2.00
$0.20
$2.50
$12.00
$4.00
$0.40
$5.00
$18.00
gpt-5.6-luna
$0.20
$0.02
$0.25
$1.20
$0.40
$0.04
$0.50
$1.80
Regional processing (data residency) endpoints are charged a 10% uplift for models released on or after March 5, 2026, that are eligible for data residency. See our
Your data
guide for supported regions and processing details.
OpenAI models in Amazon Bedrock
are billed through AWS and may differ from direct OpenAI pricing.
Priority processing was renamed Fast mode on July 30, 2026. You can use either
service_tier: "priority"
or
service_tier: "fast"
in your API requests.
Learn more about Fast mode
.
All models
Batch
Short context
Long context
Model
Input
Cached input
Cache writes
Output
Input
Cached input
Cache writes
Output
gpt-5.6-sol
$2.50
$0.25
$3.125
$15.00
$5.00
$0.50
$6.25
$22.50
gpt-5.6-terra
$1.00
$0.10
$1.25
$6.00
$2.00
$0.20
$2.50
$9.00
gpt-5.6-luna
$0.10
$0.01
$0.125
$0.60
$0.20
$0.02
$0.25
$0.90
Regional processing (data residency) endpoints are charged a 10% uplift for models released on or after March 5, 2026, that are eligible for data residency. See our
Your data
guide for supported regions and processing details.
All models
Flex
Short context
Long context
Model
Input
Cached input
Cache writes
Output
Input
Cached input
Cache writes
Output
gpt-5.6-sol
$2.50
$0.25
$3.125
$15.00
$5.00
$0.50
$6.25
$22.50
gpt-5.6-terra
$1.00
$0.10
$1.25
$6.00
$2.00
$0.20
$2.50
$9.00
gpt-5.6-luna
$0.10
$0.01
$0.125
$0.60
$0.20
$0.02
$0.25
$0.90
Regional processing (data residency) endpoints are charged a 10% uplift for models released on or after March 5, 2026, that are eligible for data residency. See our
Your data
guide for supported regions and processing details.
All models
Fast mode
Short context
Long context
Model
Input
Cached input
Cache writes
Output
Input
Cached input
Cache writes
Output
gpt-5.6-sol
$10.00
$1.00
$12.50
$60.00
$20.00
$2.00
$25.00
$90.00
gpt-5.6-terra
$4.00
$0.40
$5.00
$24.00
$8.00
$0.80
$10.00
$36.00
gpt-5.6-luna
$0.40
$0.04
$0.50
$2.40
$0.80
$0.08
$1.00
$3.60
Regional processing (data residency) endpoints are charged a 10% uplift for models released on or after March 5, 2026, that are eligible for data residency. See our
Your data
guide for supported regions and processing details.
All models
Cyber models
Our latest Daybreak models.
Prices per 1M tokens.
Short context
Long context
Model
Input
Cached input
Cache writes
Output
Input
Cached input
Cache writes
Output
gpt-5.6-sol
$5.00
$0.50
$6.25
$30.00
$10.00
$1.00
$12.50
$45.00
gpt-5.6-cyber
$12.50
$1.25
$15.625
$75.00
-
-
-
-
All models
daybreak-blue-latest
and
daybreak-red-latest
are aliases that currently point to
gpt-5.6-sol
and
gpt-5.6-cyber
, respectively. As new frontier models are released through the Daybreak program, these aliases will be updated to point to the latest models, with pricing adjusted to match each underlying model.
Multimodal models
Realtime and audio generation models
Prices per 1M tokens unless noted.
Model
Modality
Input
Cached input
Output / cost
gpt-realtime-2.1
Audio
$32.00
$0.40
$64.00
Text
$4.00
$0.40
$24.00
Image
$5.00
$0.50
-
gpt-realtime-2.1-mini
Audio
$10.00
$0.30
$20.00
Text
$0.60
$0.06
$2.40
Image
$0.80
$0.08
-
All models
Image generation models
Prices per 1M tokens.
Standard
Batch
Standard
For image generation cost estimates, use the
calculator
in the image generation guide.
Model
Modality
Input
Cached input
Output
gpt-image-2
Image
$8.00
$2.00
$30.00
Text
$5.00
$1.25
-
All models
Batch
For image generation cost estimates, use the
calculator
in the image generation guide.
Model
Modality
Input
Cached input
Output
gpt-image-2
Image
$4.00
$1.00
$15.00
Text
$2.50
$0.625
-
All models
Video generation models
Prices per second.
Standard
Batch
Standard
Model
Size
Portrait
Landscape
Price per second
sora-2
720p
720x1280
1280x720
$0.10
sora-2-pro
720p
720x1280
1280x720
$0.30
1024p
1024x1792
1792x1024
$0.50
1080p
1080x1920
1920x1080
$0.70
Batch
Model
Size
Portrait
Landscape
Price per second
sora-2
720p
720x1280
1280x720
$0.05
sora-2-pro
720p
720x1280
1280x720
$0.15
1024p
1024x1792
1792x1024
$0.25
1080p
1080x1920
1920x1080
$0.35
Transcription models
Prices per 1M tokens unless noted.
Model
Use case
Input
Output
Estimated cost
gpt-realtime-translate
Live translation
-
-
$0.034 / minute
gpt-live-transcribe
Live transcription
-
-
$0.017 / minute
gpt-realtime-whisper
Live transcription
-
-
$0.017 / minute
gpt-transcribe
Transcription
-
-
$0.0045 / minute
gpt-4o-transcribe
Transcription
$2.50
$10.00
$0.006 / minute
gpt-4o-mini-transcribe
Transcription
$1.25
$5.00
$0.003 / minute
All models
Tools
Tool
Details
Pricing
Web search
Web search (all models)
$10.00 / 1k calls
+ Search content tokens billed at model rates.
Image Web search (all models)
$10.00 / 1k calls
+ Search content tokens billed at model rates.
Web search preview (reasoning models, including
gpt-5
,
o-series
)
$10.00 / 1k calls
+ Search content tokens billed at model rates.
Web search preview (non-reasoning models)
$25.00 / 1k calls
+ Search content tokens are free.
Containers
Hosted Shell and Code Interpreter
1 GB $0.03, 4 GB $0.12, 16 GB $0.48, 64 GB $1.92 per 20-minute session per container.
File search
Storage
$0.10 / GB per day (1 GB free)
Tool call
$2.50 / 1k calls
Agent Kit
ChatKit file and image upload storage
$0.10 / GB-day after 1 GB free per account per month
Tokens used for built-in tools are billed at the chosen model's per-token rates. GB refers to binary gigabytes (also known as gibibytes), where 1 GB is 2^30 bytes. Web search content tokens are tokens retrieved from the search index and fed to the model alongside your prompt to generate an answer. For
gpt-4o-mini
and
gpt-4.1-mini
with the non-preview web search tool, search content tokens are billed as a fixed block of 8,000 input tokens per call. File search tool call pricing applies to the Responses API only. Container pricing includes
Hosted Shell
and
Code Interpreter
. Eligible container sessions will be billed by the minute, with a 5-minute minimum per session. Responses API, Chat Completions API, Realtime API, Batch API, and Assistants API are not priced separately. Tokens are billed at the chosen model's input and output rates.
Specialized models
Prices per 1M tokens.
Standard
Fast mode
Standard
Category
Model
Input
Cached input
Output
ChatGPT
chat-latest
$5.00
$0.50
$30.00
Codex
gpt-5.3-codex
$1.75
$0.175
$14.00
All models
Fast mode
Category
Model
Input
Cached input
Output
Codex
gpt-5.3-codex
$3.50
$0.35
$28.00
Finetuning
Prices per 1M tokens.
OpenAI is winding down the fine-tuning platform. The platform is no longer accessible to new users, but existing users of the fine-tuning platform will be able to create training jobs for the coming months.
All fine-tuned models will remain available for inference until their base models are deprecated. The full timeline is
here
.
Standard
Batch
Standard
Model
Training
Input
Cached input
Output
o4-mini-2025-04-16
$100.00 / hour
$4.00
$1.00
$16.00
o4-mini-2025-04-16
with data sharing
$100.00 / hour
$2.00
$0.50
$8.00
All models
Batch
Model
Training
Input
Cached input
Output
o4-mini-2025-04-16
$100.00 / hour
$2.00
$0.50
$8.00
o4-mini-2025-04-16
with data sharing
$100.00 / hour
$1.00
$0.25
$4.00
All models
Tokens used for model grading in reinforcement fine-tuning are billed at that model's per-token rate. Inference discounts are available if you enable data sharing when creating the fine-tune job.
Learn more
.
Next
Model selection
Ask AI
Docs agent
Loading docs agent...
