GPT-4o Omni
OPENAI:GPT-4O-OMNI多模态智能极速直连负载:64%SLA:99.99%无排队 · 直连
Native Multimodal Transformer (Audio/Vision/Text)
标准调用费率
10 算力点/1K Tokens
24h +15.20%
OpenAI 旗舰全模态智能基座,打通文本、视觉与实时音频,具备毫秒级响应、极致创意指导与精准代码生成。
24小时实时调用
985.0万次
+15.20% 较昨日
累计模态交付产出
742.0万次推理
+14.1% · 全模态对齐 96%
平均响应时延 (端到端)
220ms
首字(TTFT) 140ms · 118 tok/s
高可用 SLA 与节点自愈
99.99%
自愈漂移 <50ms
模型算力与调用深度走势
OPENAI:GPT-4O-OMNIInvocations
430,955次+10.13%
实时遥测
性能指标与并发吞吐
生产级 SLA 与长尾时延监控
首字/首块延迟 (P50 TTFT)140 ms
长尾极端延迟 (P99 Latency)460 ms
平均并发吞吐能力
全网并发负载峰值3,800 req
全球专线丢包率0.0006%
计费模型与成本结构
阶梯计费与高并发折扣明细
单次任务基准消耗10 算力点
提示词输入成本 (每千字)¥0.015
生成产出计费 (每千字)¥0.045
超分辨率 4K 倍率1.0x
会员专属峰值折扣至高 25% 优惠
架构设计与技术规格
参数规模与原生分辨率上限
核心架构Native Multimodal Transformer (Audio/Vision/Text)
有效参数量Estimated 200B+ MoE
上下文窗口长度128,000 tokens
最大输出分辨率High-res Vision Tokens
最大单次时长/尺寸N/A
全球专线节点与健康拨测
实时各区网络 Ping 与负载均衡
华东节点 (上海)
25ms
华南节点 (广州)
28ms
香港专线 (Hong Kong)
32ms
亚太核心 (新加坡)
48ms
美西中心 (硅谷)
124ms
欧洲法兰克福 (EU)
146ms
