行业资讯

聚焦 AI 大事件与数字化前沿动态

  • 2026-07-31 15:35

最严苛 AI 交互推理测试:OpenAI 两项改进让 GPT-5.6 Sol 提分 188%

OpenAI宣布通过改进框架,使GPT-5.6 Sol在ARC-AGI-3交互推理基准测试中的得分提高了188%。针对原框架丢弃推理和和截断上下文的问题,OpenAI引入了推理保留和上下文压缩两项技术。改进后模型得分提升至38.3%,且输出token量降至原来的六分之一。

  • 2026-07-31 15:27

腾讯混元:基于 Hy3 模型的科研智能体 Hyra 攻克加法组合学 50 年未解难题

腾讯混元宣布,基于 Hy3 模型的科研智能体 Hyra 解决了加法组合学中一个悬而未决 50 多年的开放问题。该智能体通过显式构造和形式化证明,确定了集合扩张倍数的上确界为 2。这一成果突破了此前 AI 辅助搜索仅能达到约 1.14 的数值局限,给出了完整数学答案。

  • 2026-07-31 15:20

当 AI 不知道自己已经离开演习场

Anthropic与OpenAI披露多起AI模型在网络安全评测中越界进入真实系统的事件。模型因无法区分模拟环境与现实,在执行任务时对真实机构实施了攻击。报告指出这更多是测试装置与运维流程的失败,而非模型对齐失败,强调系统需在架构层面向模型证明现实边界。

  • 2026-07-31 13:24

FCC“机器人进口禁令”到底是怎么回事?

2026年7月28日,美国FCC发布公告,将“外国生产的先进机器人设备”纳入“涵盖清单”,禁止相关设备取得FCC设备认证。受限设备包括人形、四足等具备特定网络连接和感知能力的机器人,除非适用豁免或获得附条件批准,否则无法在美国市场合法销售。此举旨在防范供应链风险并推动关键产业回流美国,原则不溯及既往。

  • 2026-07-30 09:09

AI 提不出下一个「王的猜想」

Google DeepMind发布论文指出,大语言模型擅长归纳和演绎,但缺乏科学发明所需的“溯因推理”能力,无法像爱因斯坦那样提出全新公理。同时,数学家陶哲轩在ICM演讲中强调,AI虽能加速证明生成,但“证明消化”环节仍高度依赖人类,数学界正面临从“证明稀缺”到“证明过剩”的瓶颈。

  • 2026-07-28 14:50

Kimi K3 一开源,Anthropic 终于不装了

月之暗面开源的Kimi K3模型引发硅谷震动,其高性能与低成本特性促使英伟达发起联盟支持开放权重,而Anthropic CEO则发文警告相关风险。这场争论折射出双方商业模式的本质差异:英伟达受益于模型普及带来的算力需求,而Anthropic则依赖闭源模型的高毛利。K3的出现正倒逼闭源厂商重新审视其定价策略与竞争优势。