2026 年 7 月 8 日,OpenAI 发布全双工语音模型 GPT-Live,主打自然、可实时打断的语音对话体验。与前代需"说完再等回复"的半双工模式不同,GPT-Live 支持双方同时发声、随时插话与即时纠错,并能在聆听中同步组织回应,使语音交互更接近真实人际通话。
模型内置噪声抑制与情绪语调理解,可依据语境调整语速与风格,适用于客服、教育、无障碍辅助等场景。OpenAI 表示,GPT-Live 将逐步接入 ChatGPT 语音模式与实时 API,并强调在降低延迟的同时保留安全护栏,防止深度伪造与未授权声音克隆。
2026 年 7 月 15 日,由前 OpenAI 首席技术官 Mira Murati 创办的 Thinking Machine…
2026 年 7 月,全球生成式 AI 监管进入密集落地期。多个主要经济体相继出台或更新关于大模型安全评估、数据合规、深度伪造标…
深度求索的 DeepSeek-V4 自 4 月预览版发布并开源以来,凭借百万 token 上下文与极低推理成本引发关注。官方技术…
2026 年夏季,AI 智能体(Agent)赛道融资持续升温,多家聚焦企业级自动化、编程与垂直行业 Agent 的初创公司宣布完…
7 月,国内首个面向具身智能的大规模开源数据集正式发布,覆盖多品类机器人本体在真实家庭、工厂与仓储场景下的操作轨迹、视觉与力觉信…