koyosim
登录
模型总揽看板OpenAIGPT-4o Omni
OpenAI

GPT-4o Omni

OPENAI:GPT-4O-OMNI多模态智能
极速直连负载:64%SLA:99.99%无排队 · 直连
Native Multimodal Transformer (Audio/Vision/Text)
标准调用费率
10 算力点/1K Tokens
24h +15.20%

OpenAI 旗舰全模态智能基座,打通文本、视觉与实时音频,具备毫秒级响应、极致创意指导与精准代码生成。

24小时实时调用
985.0万次
+15.20% 较昨日
累计模态交付产出
742.0万次推理
+14.1% · 全模态对齐 96%
平均响应时延 (端到端)
220ms
首字(TTFT) 140ms · 118 tok/s
高可用 SLA 与节点自愈
99.99%
自愈漂移 <50ms

模型算力与调用深度走势

OPENAI:GPT-4O-OMNIInvocations
430,955次+10.13%

性能指标与并发吞吐

生产级 SLA 与长尾时延监控

首字/首块延迟 (P50 TTFT)140 ms
长尾极端延迟 (P99 Latency)460 ms
平均并发吞吐能力
全网并发负载峰值3,800 req
全球专线丢包率0.0006%

计费模型与成本结构

阶梯计费与高并发折扣明细

单次任务基准消耗10 算力点
提示词输入成本 (每千字)¥0.015
生成产出计费 (每千字)¥0.045
超分辨率 4K 倍率1.0x
会员专属峰值折扣至高 25% 优惠

架构设计与技术规格

参数规模与原生分辨率上限

核心架构Native Multimodal Transformer (Audio/Vision/Text)
有效参数量Estimated 200B+ MoE
上下文窗口长度128,000 tokens
最大输出分辨率High-res Vision Tokens
最大单次时长/尺寸N/A

全球专线节点与健康拨测

实时各区网络 Ping 与负载均衡

华东节点 (上海)
25ms
华南节点 (广州)
28ms
香港专线 (Hong Kong)
32ms
亚太核心 (新加坡)
48ms
美西中心 (硅谷)
124ms
欧洲法兰克福 (EU)
146ms