排序
标签

纳德拉呼吁AI模型装“紧急刹车”:信任架构该重审了
微软CEO萨提亚·纳德拉在周末发帖称,AI行业需要退后一步、重新审视信任架构,并呼吁为AI模型配备类似“紧急刹车”的机制。这一表态出自AI商业化最激进的推动者之一,因而格外引人关注。本文梳理“紧急刹车”在工程层面的具体含义、AI安全讨论的演进脉络,以及围绕“谁来掌控刹车、谁来定义阈值”的争议。

三项实测交叉印证:AI自主做AI研究,最优结果仅达人类成果的35%
三项独立研究在2026年10月前后密集发布,从不同角度测量了AI智能体独立完成机器学习研究任务的能力极限。Epoch AI的InnovationEval测试中,最优模型GPT-5.6 Sol仅复现了人类研究方法35%的增益;MMPostTrainBench显示52.1%的测试组合让模型比起点更差;Priced Guidance论文则发现即便是表现最好的Claude Fable 5.1,重建一个深度

英伟达洽购估值250亿美元的Reflection AI:已投8亿,开源棋局意在控制供应链
英伟达正与美国开放权重模型初创公司Reflection AI洽谈收购或进一步增资,该公司2026年最新估值250亿美元,此前已获英伟达8亿美元投资。谈判发生在Reflection发布首个模型Beam仅五天之后,交易结构含"人才收购"选项以规避反垄断审查。这笔交易的真实逻辑并不在于押注一个跑分领先的模型,而是英伟达对美国开放AI供应链的系统性整合。

AI刚刚进入“第二序章”,远未到下半场|甲子光年九周年
AI刚刚进入“第二序章”,远未到下半场|甲子光年九周年

全球首次!杭州具身黑马比肩Figure,全身协同自主叠衣
全球首次!杭州具身黑马比肩Figure,全身协同自主叠衣

主动理解物理世界:ROMA让机器人学会交互探索物体
主动理解物理世界:ROMA让机器人学会交互探索物体

够不到就自己加凳子!李弘扬团队创业半年,机器人实机成果来了
够不到就自己加凳子!李弘扬团队创业半年,机器人实机成果来了

NeurlPS2026I别等Agent把任务搞砸!7B审计员AgentForesight在...
NeurlPS2026I别等Agent把任务搞砸!7B审计员AgentForesight在...

OpenAl搅乱数学界!科研项目没了,数学家遭毁灭性打击,学界还要...
OpenAl搅乱数学界!科研项目没了,数学家遭毁灭性打击,学界还要...

从记忆到自进化:Agent走向RSI的关键一步
从记忆到自进化:Agent走向RSI的关键一步

苹果招募Huxe团队并授权技术,剑指AI播客赛道
TechCrunch报道,苹果披露了一项与个性化播客初创公司Huxe的交易:不仅招募其团队,还获得其技术授权。这被视为苹果进军AI生成播客与个性化音频内容的信号。在Spotify、谷歌纷纷加码AI音频的背景下,苹果此举究竟是补足内容短板,还是为Siri与Apple Intelligence铺路?本文梳理交易细节、Huxe的技术方向及行业竞争格局。

Claude Opus 4.7 与 GPT-6 Astra 与 GPT-6.1 Sol并列79.79分:2026-10-11 Smoke快测数据简报
2026-10-11 赢政指数 Smoke 快测覆盖 13 个模型,Claude Opus 4.7 与 GPT-6 Astra 与 GPT-6.1 Sol 以 79.79 分并列当日首位。Smoke 为每日 10 题快测,适合观察短期信号,不等同 Full 周榜结论。
加载中...
已经到底啦