2026 年 7 月 9 日,英伟达开源 Nemotron 3 Ultra,定位企业级高性能基础模型。该模型采用 MoE 与 Mamba-2 状态空间模型混合架构,总参数 5500 亿,在保持长序列建模能力的同时显著降低注意力机制的计算开销,最高支持 100 万 token 上下文。
Nemotron 3 Ultra 面向推理、编程与 Agent 任务优化,开放权重可在自建算力上微调与部署。英伟达称,混合架构让模型在超长文档、代码库与多轮工具调用场景中兼顾吞吐与成本,并可作为专用小模型的教师模型进行蒸馏,帮助企业在数据合规前提下构建私有化 AI 能力。
2026 年 7 月 15 日,由前 OpenAI 首席技术官 Mira Murati 创办的 Thinking Machine…
2026 年 7 月,全球生成式 AI 监管进入密集落地期。多个主要经济体相继出台或更新关于大模型安全评估、数据合规、深度伪造标…
深度求索的 DeepSeek-V4 自 4 月预览版发布并开源以来,凭借百万 token 上下文与极低推理成本引发关注。官方技术…
2026 年夏季,AI 智能体(Agent)赛道融资持续升温,多家聚焦企业级自动化、编程与垂直行业 Agent 的初创公司宣布完…
7 月,国内首个面向具身智能的大规模开源数据集正式发布,覆盖多品类机器人本体在真实家庭、工厂与仓储场景下的操作轨迹、视觉与力觉信…