GPT Audio
GPT Audio是OpenAI首款面向大众开放使用的音频模型,其最新版本升级了解码器,可生成更自然的语音效果,同时能更好地保持语音一致性,该音频模型的定价相关信息已同步公布。
上下文 128K会用工具结构化输出
适合做什么
根据公开评测与能力标签,一句话帮你判断用途
更适合先从简介和评测分数判断是否匹配你的场景。
实力怎么样
Artificial Analysis 公开指数,分数越高越好,大约按 0–100 理解
这款模型还没有公开智能指数,评测榜暂时排不上。
去评测榜看其它模型大概要花多少钱
按每百万 tokens 计价(约等于几十万到上百万汉字量级)
读入内容
$2.50/M
你把资料/问题喂给模型的费用
写出回答
$10.00/M
模型生成回复的费用,通常更贵
举个例子:读进约 50 万 tokens、写出约 5 万 tokens,大约花费 $1.75(按公开标价估算)。
能处理什么
输入、输出与常见能力开关
能看懂
文本音频
能产出
文本音频
还会这些
工具调用JSON / 结构化指定输出格式推理参数可见思考过程
