7 月 1 日,谷歌大规模扩充 Gemini 产品线,推出 Gemini 3.5 Flash(输出速度号称达竞品 4 倍)与多模态模型 Gemini Omni。
Omni 支持图文音视四模态输入,并可直接生成连贯视频,是 Google I/O 2026 后 Omni 系列首个面向开发者的可用版本。"文本生成视频 + 对话编辑"能力标志着视频生成从一键黑箱走向交互式创作。
同期 DeepMind 发布轻量图像模型 Nano Banana 2 Lite,单张生成延迟约 4 秒,每千张成本约 0.034 美元,把 AIGC 成本压到近乎为零,利好设计师与内容创作者的高频迭代。
2026 年 7 月 15 日,由前 OpenAI 首席技术官 Mira Murati 创办的 Thinking Machine…
2026 年 7 月,全球生成式 AI 监管进入密集落地期。多个主要经济体相继出台或更新关于大模型安全评估、数据合规、深度伪造标…
深度求索的 DeepSeek-V4 自 4 月预览版发布并开源以来,凭借百万 token 上下文与极低推理成本引发关注。官方技术…
2026 年夏季,AI 智能体(Agent)赛道融资持续升温,多家聚焦企业级自动化、编程与垂直行业 Agent 的初创公司宣布完…
7 月,国内首个面向具身智能的大规模开源数据集正式发布,覆盖多品类机器人本体在真实家庭、工厂与仓储场景下的操作轨迹、视觉与力觉信…