标签: GPT-4

OpenAI 复盘:我们是如何在 6 个月内完成构建 GPT-Live 实时语音系统的 GPT-Live 是OpenAI 最新一代的语音模型,它摒弃了原有的“轮流检测器”,实现了全双工(Full-duplex)——即 AI 可以边听边说,完全模仿真人的对话习惯。 为了做到不到 1 秒的极致超低延迟,OpenAI 在底层技术上做了重磅升级。 “嘴巴”和“大脑”分工合作(异步委托机制): 快路径(前端语音):专门负责“聊天和接话”,把语音…

OpenAI 复盘:我们是如何在 6 个月内完成构建 GPT-Live 实时语音系统的 GPT-Live 是OpenAI 最新一代的语音模型,它摒弃了原有的“轮流检测器”,实现了全双工(Full-duplex)——即 AI 可以边听边说,完全模仿真人的对话习惯。 为了做到不到 1 秒的极致超低延迟,OpenAI 在底层技术上做了重磅升级。 “嘴巴”和“大脑”分工合作(异步委托机制): 快路径(前端语音):专门负责“聊天和接话”,把语音…

OpenAI 用 6 个月时间构建了新一代实时语音模型 GPT-Live,通过“快慢双路径”架构和自研传输协议,把语音交互延迟压到 1 秒以内,实现了 AI 边听边说的全双工对话。

GPT-Live实时音频新架构发布

GPT-Live实时音频新架构发布

OpenAI 发布了全新的实时音频架构 GPT-Live,让模型能够“边听边说”,在推理或调用工具时也不打断对话。这件事之所以值得关注,是因为它把 AI 语音交互从“一问一答”推向连续的自然对话。

Artificial Analysis: DeepSeek’s V4-Flash costs $0.14/1M input and $0.28/1M output tokens, or $0.03 per test, far below Kimi K3’s $0.86 and GPT-5.6 Sol’s $1.86 (Eduardo Baptista/Reuters)

Artificial Analysis: DeepSeek's V4-Flash costs $0.14/1M input and $0.28/1M output tokens, or $0.03 per test, far below Kimi K3's $0.86 and GPT-5.6 Sol's $1.86 (Eduardo Baptista/Reuters)

DeepSeek 发布 V4-Flash 模型,以每百万输入 tokens 0.14 美元、输出 0.28 美元的 API 定价大幅拉低大模型调用成本,单次测试成本约 0.03 美元,远低于同期 Kimi K3 和 GPT-5.6 Sol 的报价,直接冲击现有大模型定价体系。

in prep for our computer use pod, gonna store a running list of codex cua wow moments. here it is dealing with support chat for me to escalate for faster resolution these humans have no idea they are talking to a bot…

in prep for our computer use pod, gonna store a running list of codex cua wow moments. here it is dealing with support chat for me to escalate for faster resolution these humans have no idea they are talking to a bot...

AI 博主 Swyx 记录了一个典型场景——Codex 自动帮他处理客服聊天,不仅完成了升级请求,还在客服试图推卸责任时拿出完整聊天记录“冷静反驳”。这件事的意义在于,AI 助手正在从“回答问题”进化到“独立办事并对结果负责”,这可能是最值得关注的转变。