2026-07-18 AI日报:其他重要动态领衔,59篇动态浓缩

这不是把新闻堆在一起,而是把今天最关键的几条线索整理成一张可读的行业切片。

59
纳入文章
3
深度主题
信息密度

深度解读

其他重要动态

发生了什么:腾讯发布三大具身基座模型商汤发布SenseNova-U1 Pro多模态模型

为什么重要:这一组动态值得关注,不只是因为公司或模型本身有名,而是它反映了产品发布、资本投入和算力组织方式正在重新排位。市场现在更看重可落地能力,而不是单次演示。

具体细节:7月18日,腾讯Robotics X实验室联合福田实验室发布Hy-Embodied系列新模型及智能体,首次打通“感知—身体—行动”闭环,推动具身智能从实验室走向真实生产力。三大基座模型Hy-Embodied-VLM-1.0、Hy-Embodied-RxBrain-1.0和Hy-Embodied-VLA-0.5分别负责视觉理解、世界认知和动作执行,智能体Ape / 商汤在WAIC大会上发布SenseNova-U1 Pro,这是首个原生融合“看懂、生成、动手”能力的多模态基座模型。U1 Pro具备8K直出能力,能精准处理文字排版、物理逻辑和复杂设计细节,被定位为“创作模型”,能像设计师一样进行长程迭代和自我反思,最终交付可直接使用的工业级作品。

OpenAI与模型产品

发生了什么:ChatGPT统一搜索功能上线ChatGPT推出统一搜索功能

为什么重要:这一组动态值得关注,不只是因为公司或模型本身有名,而是它反映了产品发布、资本投入和算力组织方式正在重新排位。市场现在更看重可落地能力,而不是单次演示。

具体细节:OpenAI终于为ChatGPT上线了统一搜索功能,用户现在可以通过侧边栏搜索聊天、图片、文档和项目,解决了长期无法翻旧记录的痛点。这一更新让ChatGPT从聊天机器人转变为个人知识库,成为AI时代用户的重要资产。搜索功能覆盖了用户上传和生成的内容,跨平台同步,但暂未支持外部应用如Google Drive。 / ChatGPT上线全新统一搜索功能,支持搜索历史聊天、项目、上传文档和生成的图片,解决了用户长期以来的痛点。这一更新让ChatGPT从单纯的聊天机器人转变为个人知识库,补齐了数据管理的拼图,让用户能更高效地管理和利用与AI互动积累的宝贵数据。

Anthropic与Claude

发生了什么:Claude Code新增实时交互功能Datadog用AI重构核心系统提升性能

为什么重要:这一组动态值得关注,不只是因为公司或模型本身有名,而是它反映了产品发布、资本投入和算力组织方式正在重新排位。市场现在更看重可落地能力,而不是单次演示。

具体细节:Anthropic的Claude Code新增Artifacts功能,可调用MCP连接器实现实时数据交互。页面能自动更新、支持权限控制,让AI从生成内容迈向生成软件,显著提升团队协作效率。 / Datadog工程师Arnold Wakim分享了利用Claude和Cursor工具,通过测试驱动重构Stream Router系统,将核心生产系统的性能瓶颈从45分钟优化至1秒,并大幅降低存储和数据库成本的经验。

快讯

  • MoE模型专家路由负载失衡风险:港科大团队发现MoE模型中存在一种黑盒攻击方法RepetitionCurse,利用重复输入诱导专家路由失效,导致GPU负载不均和系统延迟剧增,威胁服务稳定性。
  • 智能体浪潮下的终端变革:徐晧博士在WAIC荣耀分论坛发表演讲,指出智能体将重构终端设计,设备需从被动响应转向主动服务。高通通过异构计算架构、端侧感知能力优化等,构建以智能体为中心的终端生态,与荣耀深化合作…
  • 此芯科技发布AGX智能体计算平台:2026年7月17日,此芯科技在上海WAIC大会期间发布AGX Agentic Compute智能体计算战略,旨在构建覆盖端、边、云的全域算力底座。该战略以自研P1芯片为核心,通过…
  • 企业AI应用中的认知主权问题:微软CEO纳德拉与Palantir CEO Karp近期均指出,企业使用AI可能面临将核心认知资产拱手让给外部模型公司的风险。文章提出,真正的AI竞争力在于企业能否建立自主的认知系…
  • Soul进军AI硬件与产业开放:社交应用Soul在2026年WAIC上推出AI硬件B Soul,将数字角色实体化。它依托SoulX模型,探索语音交互与物理形态结合,并计划向B端输出能力,向海外拓展。
  • Linux创始人Linus承认AI已成为有效工具:Linux创始人Linus Torvalds态度转变,明确承认AI已成为有效工具,不再反对AI在Linux内核开发中的应用。他强调AI应被视为与编译器、静态分析器等同的工具,并反对…
  • 上海国投赋能AI初创企业开放麦:2026WAIC期间,上海国投举办“POWER・开放麦”,聚焦AI硬科技创业者,通过路演与直播展示算力、算法、数据等领域的11家初创企业成果,累计观看超12万人次,助力早期项目走向…
  • 中国电信无人机直连卫星传Token技术:中国电信在WAIC 2026展示智传网(AI Flow)技术,利用生成式智能传输,将视频编码为Token序列,通过卫星实时回传高清视频。该技术解决了轻小型无人机载荷和卫星带宽限制的…
  • 用生成式世界模型生成机器人训练数据:阿里巴巴达摩院提出RynnWorld-Teleop,通过手势驱动生成式世界模型实时合成机器人第一人称视角视频,实现数字遥操作,从而低成本生成高质量的机器人操作数据,并验证了合成数据…
  • 国产AI芯片竞争逻辑转变:国产AI芯片竞争重点从单颗芯片参数转向系统能力,强调稳定性、易用性和可规模部署。清微智能通过可重构架构、三维存算融合、4K超节点和RAISA软件栈等构建完整生态,降低迁移成本,提升…
  • AI自己改Agent Harness获得显著提升:上海人工智能实验室团队提出的Self-Harness技术,让AI能自动检查自身运行轨迹、挖掘失败模式并提出Harness修改方案,经回归测试验证后采纳。在Terminal-Benc…
  • 具身智能新范式:一脑多形:普渡机器人通过在真实场景部署超13万台设备,积累了海量数据,并利用PuduFM大模型和World Model仿真引擎,实现了跨机型、跨场景的智能经验迁移,构建了“一脑多形”的产业新…
  • Always-On Memory Agent:Google Cloud's generative-ai repository introduces the Always-On Memory Agent, a lightweig…
  • 机器人整理客厅演示具身智能新进展:千寻智能的 Moz1 机器人在 WAIC 展示了在非结构化环境中执行长程任务的能力,包括整理客厅。它不仅能识别物品并执行抓取、移动等动作,还能应对临时插入的杂物并自主调整计划,展现…
  • FreeStyle实现风格与内容分离生成:FreeStyle通过两阶段训练策略,利用社区LoRA挖掘高质量数据,结合注意力约束和频率感知RoPE调制,有效抑制风格迁移中的内容泄漏,实现了风格迁移、内容保持和泄漏抑制的平衡。
  • Kimi K3发布:全球首个3万亿参数开源大模型:Kimi今天正式推出其最新开源大模型Kimi K3,拥有3万亿参数,支持1M上下文和原生视觉理解。在Arena.ai代码竞技场排名第一,超越Claude Fable 5,整体智能指…
  • Sakana AI提出无需反向传播的误差扩散算法:Sakana AI的研究团队开发了名为Error Diffusion (ED)的新算法,旨在解决深度学习中需要反向传播和权重转置的难题。该算法通过双流架构(兴奋性和抑制性)和模组误…
  • 商汤大装置发布银河计划加速国产AI基础设施升级:商汤科技在WAIC 2026论坛发布国产AI基础设施升级方案,联合近20家伙伴启动“银河计划”,发布“科学发现平台”及太空算力战略,推动国产算力规模化商用。通过异构混合推理、算电协…
  • Claude Fable 5 永久纳入订阅计划:Claude宣布Fable 5将永久包含在Max和Team Premium计划中,Pro和Standard用户将获得一次性$100信用额度。文章指出,竞争压力使Anthropic改…
  • Kimi K3发布引发AI行业关注:Kimi K3模型发布引发广泛关注,被评价为首个真正有用的中国开放权重模型,在编码、代理和长期知识工作方面表现优异。社区反应热烈,认为K3缩小了中美模型间的差距,促使美国实验室加快…
  • Meta拟与Anthropic洽谈出租AI算力:Meta正与Anthropic洽谈出租AI数据中心算力,潜在交易最高价值100亿美元,期限两年。Anthropic已与SpaceX签署450亿美元算力协议,此次向Meta提出方案规…
  • Google发布Gemma-trainer技能:Google发布gemma-trainer技能,允许用户在本地电脑上使用AI微调专属Gemma模型。该技能采用开源训练说明书,整合监督微调、偏好对齐和奖励打分技术,配合LoRA参数…
  • 美政府加强AI模型发布监管:特朗普政府通过新措施加强对未来AI模型发布流程的控制,规定哪些公司和实体可访问最新前沿模型。此前,这一决定权掌握在美国AI巨头手中,如Anthropic和OpenAI自行决定其模型…
  • 使用模型内部信号训练的合理性探讨:文章探讨了使用模型内部信号(如探针)作为训练目标的合理性,指出并非所有使用内部信号的方法都应被贴上“最禁忌技术”的标签。通过分析《Obfuscation Atlas》等文献,作者提…
  • TikTok测试新工具识别AI肖像滥用:TikTok近期小范围测试一项新工具,帮助创作者识别其肖像是否被AI技术未经授权使用。该工具已面向部分美国创作者开放测试,创作者需通过Jumio完成身份验证,TikTok不会留存身…
  • 大模型训练新思路:过度训练以实现类人泛化:文章探讨了大语言模型(LLM)在通用性上不如人类的问题,并提出了通过过度训练来“grok”(顿悟)核心领域的新理论。建议AI实验室应训练超大规模模型(如100万亿参数)在有限数据上…
  • 人工神经网络与灵长类大脑处理机制存在差异:约克大学研究人员发现,尽管AI模型在预测大脑反应方面表现良好,但反向预测测试显示大脑无法预测模型内部特征,表明ANN可能使用了大脑未采用的策略。研究团队发布了测试工具包,以帮助开发…
  • 视觉概念从图像集推断:中文摘要:文章提出Visual Concept Inference from Sets (VICIS)任务,评估视觉语言模型从图像集中推断概念并应用于新输入的能力。实验表明现有模型…
  • 使用MongoDB Atlas构建智能场馆运营系统:本文介绍如何利用MongoDB Atlas、Voyage AI和LangGraph构建一个具备持久记忆和上下文感知能力的智能场馆运营系统。通过向量检索、混合搜索和视觉RAG技术,该…
  • 通过Unity AI Gateway统一管理AI模型提供商:Databricks推出Model Provider Services (MPS)以解决新AI模型发布带来的碎片化管理问题。通过Unity Catalog,组织可以统一注册Open…
  • AI代理训练领导模型:在AI Village中,GPT-5.5和Opus 4.7试图通过微调训练出一位领导模型。他们最初选择了极小的模型以节省成本,尽管Gemini建议使用更大的模型,最终Kimi K2…
  • 沙盒安全策略研究:文章研究了不同沙盒策略对不信任代理的安全性影响。通过实验对比了十种沙盒协议,发现沙盒能有效提高安全性,尤其是结合行动监控器的“请求网站”策略,既能最小化权限使用,又能使攻击行为更明…
  • 百川智能AI医疗成果展示:百川智能在2026世界人工智能大会上展示了其医疗AI成果,包括Baichuan-M4模型在肿瘤、儿科等专科场景中的落地应用,以及AI家庭医生百小医等产品的介绍。
  • 智能体走进物理世界:2026世界人工智能大会开幕,印奇探讨AI未来,智能体与终端结合将带来新系统、新载体、新网络,重塑人机共生秩序。
  • AI旅行预订中的动物福利考量:本文评估了AI模型在旅行预订任务中是否考虑动物福利。研究发现,在没有明确提示的情况下,大多数模型在预订时不会优先考虑动物福利,即使某些选项涉及动物剥削。然而,当模型为一家声称重视动…
  • Kimi K3 AI 工具箱评测:Kimi K3 正式上线,采用全新 Kimi Linear 混合线性注意力架构,拥有 1M 上下文和 2.8T 参数,覆盖编程、Agent、多模态。评测对比 Claude Opus…
  • Smartsheet与AWS的AI集成方案:Smartsheet通过远程模型上下文协议(MCP)服务器与AWS集成,实现AI代理对Smartsheet数据的直接访问。该架构支持内部和外部AI客户端,通过API网关、MCP服务…
  • 后训练提升AI智能:文章强调后训练对于提升AI智能的重要性,指出这是模型持续优化、适应环境变化和提升成本效益的关键阶段。通过强化学习等技术,模型在反复尝试中不断改进,最终实现更高的智能产出。
  • 阶跃推出首款AI原生手机STEPX Neo:WAIC现场,阶跃展示首款专为智能体设计的STEPX Neo手机。它打破传统App交互,用户只需用自然语言下达指令,智能体Amoo就能跨App调度服务完成行程安排等任务。Step …
  • AI提升全栈工作能力:AI正在通过自动化重复性任务,使开发者、营销人员和招聘人员能够专注于更高级别的综合工作,从而提升全栈或全周期角色的需求。同时,OpenAI的GPT-Live模型实现了全双工语音交互…
  • 手机Agent与支付宝合作:OPPO 刘作虎官宣小布助手与支付宝阿宝合作,实现跨端智能体协作。阶跃 STEPX 亦接入同款方案。文章回顾 Agent 发展历程,从聊天到工具再到好大哥。指出 Agent 互联标…
  • MARS 4.0项目失败总结:如何研究AI对齐:MARS 4.0项目旨在研究完美对齐伪造代理如何隐藏目标,通过SFT训练发现开源模型难以有效伪造对齐。团队发现SFT可能导致模型行为表面化而非真正理解,且开源模型缺乏足够强的内置价…
  • AI从人类数据迈向经验时代:2026年WAIC上,图灵奖得主理查德·萨顿指出大语言模型仅依赖人类知识且存在局限。他预言AI将告别静态数据,转向通过自主交互获取第一视角经验的“经验时代”,以实现真正的自主智能。
  • 一种增强模型选择性泛化的方法:本文提出了一种名为 inoculation adapters (IA) 的新方法,旨在在训练过程中同时保留模型的有益能力并抑制其有害行为。通过训练一个专门携带 undesired …
  • AgentCompile框架优化Transformer推理:AgentCompile是香港城市大学团队提出的LLM引导编译框架,用于优化Transformer推理性能。它通过分析计算图、识别计算模式、构造受限候选计划,生成并验证CUDA内核…
  • Weco AI实现Agent递归自我改进:Weco AI的AIDE²系统在8天内通过100轮自我改写,成功将Agent的harness(搜索、上下文管理等)优化至历史最佳。改进后的AIDE₄₇和AIDE₈₅在机器学习工程、…
  • Gemma 4 优化语音 Agent 性能:Gemma 4 覆盖 140 多种语言,支持 35 种以上,中文在内。LiveKit Agents 切换至 Gemma 4 31B 可提升实时语音性能,延迟降低 5.2 倍,成本减…
  • 乐奇Rokid发布YodaOS及AR设备:在2026世界人工智能大会,乐奇Rokid发布了全球首款智能眼镜原生操作系统YodaOS,并展示了新一代AR空间计算设备。YodaOS重构人机交互逻辑,支持AIUI沉浸式交互,并在…
  • AI原生电商基座Nile上线,助力品牌抢占Agent红利:初创公司Nile推出AI原生电商基座,为品牌构建面向Agent的分发渠道。其Lite版本已上线,服务超500家客户,智能体渠道转化率是站点的150%-700%。Nile旨在帮助商家…
  • AI推理初创公司获4亿美元芯片贷款:AI推理初创公司General Compute获得Upper90的4亿美元贷款,这是首笔以推理专用芯片作为抵押的融资。该资金用于构建基于SambaNova SN50芯片的推理云服务…
2026-07-18 AI日报:其他重要动态领衔,59篇动态浓缩 | AI 趋势