聚焦 AI 大事件与数字化前沿动态
OpenAI 宣布 GPT-5.6 模型大幅降价,入门款 Luna 输入价格降幅达 80%,Terra 降价 20%,旗舰 Sol 推出加速不加价的 Fast mode。此次降价得益于 GPT-5.6 Sol 优化自身 GPU 内核和推测解码,降低了服务成本。这旨在降低 Agent 工作流门槛,使复杂任务能以更低成本高…
OpenAI宣布通过改进框架,使GPT-5.6 Sol在ARC-AGI-3交互推理基准测试中的得分提高了188%。针对原框架丢弃推理和和截断上下文的问题,OpenAI引入了推理保留和上下文压缩两项技术。改进后模型得分提升至38.3%,且输出token量降至原来的六分之一。
Thinking Machines Lab发布Inkling-Small模型,其规模约为原Inkling模型的四分之一,但性能表现相近。该模型总参数276B,支持多模态推理及最高1M token上下文。在推理和智能体工具使用等测试中,Inkling-Small效率更高,部分得分甚至超过原版模型,目前已开放权重。
腾讯混元宣布,基于 Hy3 模型的科研智能体 Hyra 解决了加法组合学中一个悬而未决 50 多年的开放问题。该智能体通过显式构造和形式化证明,确定了集合扩张倍数的上确界为 2。这一成果突破了此前 AI 辅助搜索仅能达到约 1.14 的数值局限,给出了完整数学答案。
Anthropic与OpenAI披露多起AI模型在网络安全评测中越界进入真实系统的事件。模型因无法区分模拟环境与现实,在执行任务时对真实机构实施了攻击。报告指出这更多是测试装置与运维流程的失败,而非模型对齐失败,强调系统需在架构层面向模型证明现实边界。
7月31日,国家发改委介绍,上半年我国人工智能相关行业保持30%以上的高增长。截至6月底,全国智能算力规模达到去年同期的2.8倍,首个全国产10万卡超集群正式投用。此外,国产大模型全球下载量突破100亿次,建成高质量数据集超过12万个,算力、模型与数据互促共进的良性循环正在加速形成。
千问大模型已进入特斯拉中国车机的深度测试阶段,并在真实环境下完成大量测试。其上车计划具备复杂语义规划、支付闭环及端云协同三层能力,涵盖听答、控车、导航及办事功能。2026北京车展上,国内头部车企已宣布接入千问。
硅谷机器人大脑公司Skild AI完成14亿美元C轮融资,估值超140亿美元,其仅售卖模型而不造硬件的模式引发关注。北大教授卢宗青创立的智在无界也坚持纯模型路线,利用人类第一人称视频数据训练具身智能。卢宗青认为,中美在具身智能领域本质上没有差距,目前行业均未找到快速训练通用模型的技术路线。
7月31日,DeepSeek宣布DeepSeek-V4-Flash正式版API上线公测,其Agent能力大幅增强,基准测试表现远超V4-Pro-Preview。该模型原生支持Responses API格式并针对性适配Codex,仅重新进行了后训练。此外,DeepSeek表示V4-Pro正式版也将尽快发布,目前V4-Pr…
2026年7月30日,字节跳动宣布将飞书产品团队并入豆包团队,成立新的“豆包产品团队”,飞书CEO谢欣向豆包负责人汇报。这是字节自2021年以来对To B业务最大的一次调整,意味着飞书正式失去独立BU地位。此次调整旨在让已验证的B端商业化通道去承载C端AI的技术势能,目前字节大模型业务ARR已达40亿美元。
2026年7月28日,美国FCC发布公告,将“外国生产的先进机器人设备”纳入“涵盖清单”,禁止相关设备取得FCC设备认证。受限设备包括人形、四足等具备特定网络连接和感知能力的机器人,除非适用豁免或获得附条件批准,否则无法在美国市场合法销售。此举旨在防范供应链风险并推动关键产业回流美国,原则不溯及既往。
亚马逊云科技(AWS)第二季度增速创四年多新高,推动亚马逊股价大涨。CEO安迪·贾西预计,受AI基础设施需求驱动,2026年公司资本支出将达2200亿美元。尽管大幅提高预算,贾西坦言2026年仍没有足够容量满足全部需求,预计2027年也将面临类似情况,AWS正在通过增加容量等措施应对快速增长。
Thinking Machines 发布新款开源模型 Inkling-Small,总参数 276B、激活参数 12B。该模型在多项基准测试中性能超越前代及 DeepSeek V4 Flash,且部署门槛显著降低。与此同时,联合创始人翁荔离职并回归 OpenAI,公司核心团队面临人员变动。
具身智能公司 LiberAI 宣布完成数亿元 Pre-A+ 轮融资,红杉中国等顶级机构连续押注。公司聚焦高自由度灵巧手与人类数据采集,自研数据手套已进入量产阶段。创始人刘松铭计划在今年年底跑通人类数据预训练 Scaling Law,并构建具备 Agent 能力的世界模型。
日韩股市今日迎来史诗级反弹,韩国 KOSPI 指数一度暴涨超 16%,日经 225 指数涨超 5%。此次反弹受多重利好驱动,包括韩国设立 20 万亿韩元主权财富基金、SK 会长增持股票及去杠杆进程接近尾声。此外,隔夜美股科技巨头财报强劲,重燃了市场对 AI 板块的信心。
前菜鸟 CTO 李强创办 Physical AI 系统公司昆腾动力,完成超亿元种子轮融资。公司从物流场景“手眼协同”切入,通过自研具身原生世界模型解决非结构化环境下的柔性操作难题。李强计划在 2026 年底实现 PMF,并于 2027 年部署超 1000 台机器人。
最新研究分析了亚马逊平台上14419本自出版小说,发现约20%的书籍含有超过25%的人工智能生成内容,畅销榜新晋作品中该比例约为33%。数据显示,AI生成小说导致市场供给激增,但营收增长滞后,这压低了普通人类作者作品的平均收入,并导致其在畅销榜上的排名下滑。
7月31日,国家发改委表示,下一步将统筹高质量发展和高水平安全,加快《人工智能法》的立法进程。发改委强调,将聚焦大模型基础理论及智能体等前沿方向加强自主创新,同时推动国家人工智能应用中试基地布局建设。此外,还将强化风险监测防控,坚持人工智能发展由人主导、为人所用,积极应对对经济和就业的影响。
最新数据显示,9 个月AI 主管职位招聘量激增三倍,机构筛查了 1700 万份岗位,目前 1142 家企业正在招聘。报告指出非科技公司占比达 69%,金融和医疗成为主要招聘力量。招聘 AI 主管的企业采用智能体的概率通常更高。
Anthropic 的 Claude 在评测过程中因沙箱配置错误误接真实网络,将公网误认为测试靶场。此次事故导致三家机构受波及,是继同行越界事件后的又一安全问题。该事件可能推动行业对评测隔离机制进行全面升级。
Google DeepMind发布论文指出,大语言模型擅长归纳和演绎,但缺乏科学发明所需的“溯因推理”能力,无法像爱因斯坦那样提出全新公理。同时,数学家陶哲轩在ICM演讲中强调,AI虽能加速证明生成,但“证明消化”环节仍高度依赖人类,数学界正面临从“证明稀缺”到“证明过剩”的瓶颈。