首页 > 开源 > 被字节索赔 800 万的实习生“出道”:20 万符号造 AI 词典,打造世界模型创业公司估值 2 亿美元

被字节索赔 800 万的实习生“出道”:20 万符号造 AI 词典,打造世界模型创业公司估值 2 亿美元

OSChina资讯 2026-10-10 19:09 9 阅读 查看原文

打进字节训练集群、污染同事的模型训练,然后被辞退、被索赔 800 万、被法院判赔 50 万——两年后,同一个人的新实验室拿到近 3000 万美元融资,投后估值 2 亿美元。彭博社 10 月 8 日报道了这个名字:田柯宇,前字节跳动实习研究员,北大在读。他创办的这家还没有名字、也没有产品的隐身公司,押注的是世界模型。

把时间线拉直:2024 年 6 到 7 月,时任字节商业产品与技术部门实习研究员的田某某,因对团队资源分配不满,通过编写、篡改代码的形式恶意攻击团队研究项目的模型训练任务,造成资源损耗。2024 年 8 月,字节与他解除实习协议。字节随后通过官方渠道回应,强调该行为恶意干扰的是商业化技术团队某个研究项目,不涉及正式项目及线上业务,也明确指出网传『涉及 8000 多卡、损失上千万美元』严重夸大。公司内部的《企业纪律与职业道德委员会通报》同步了阳光诚信联盟、企业反舞弊联盟,并同步至其就读学校处理。

11 月,北京海淀区人民法院受理了字节对田柯宇的起诉,索赔 800 万元及合理支出 2 万元。据彭博社查阅的裁决书,法院最终判令田柯宇因违反合同赔偿 50 万元,并没收其全部工资。

真正让这则故事有了戏剧性弧线的是他论文的命运。被辞退后不久,他作为第一作者、与字节 Seed 研究团队及北大等合作者的论文『Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction』,拿下 NeurIPS 2024 最佳论文(Best Paper)。这篇提出 VAR 范式、用『多尺度自回归预测像素簇』替代逐 token 生成的论文,是 NeurIPS 2024 两篇正奖之一。

田柯宇接受采访时承认自己行为不当,但把当年的事描述成『替天行道』(vigilante act):他关闭了另一名研究人员的程序以腾出计算资源。『我当时是在以其人之道还治其人之身。如果我能带着今天所知道的一切回到过去,我肯定会采取更明智的做法。』

新实验室目前 10 个人,团队里还有其他前字节员工。田柯宇要把获奖论文的技术推向视觉媒体,他们为 AI 造了一部『词典』——20 万个人类无法识别的符号,帮 AI 系统处理视频。『你永远无法用人类语言完美描述一段视频,』他说,『我们首先是在为 AI 创造一种语言,然后向它输入 1 亿小时的视频。』他声称这套技术能把生成 1 秒视频的成本至少压缩一个数量级,计划在 2027 年完整模型发布前,先用线下现场活动展示能力。他明确表示没在做消费级产品,也没开发商业模式,当务之急是交付技术。

这条赛道恰好堆满了他当年的同行和前辈:李飞飞的 World Labs 估值一度达 10 亿美元级且刚被 AMD 以数十亿美元收购,原 Meta 首席 AI 科学家杨立昆为 Advanced Machine Intelligence Labs 融了 10 亿美元种子轮,国内视频生成公司 PixVerse、3D AI 开发商 Vast 也在做类 Genie 3 的互动世界模型。在这样一群巨头中间,一家连名字都还没有、估值却已经 2 亿美元的公司,本质上是投资人在给『论文作者』这个身份下注——彭博在报道里的观察是,团队没有任何公开 demo,也没有基准测试,这恰恰说明市场正在为新形态的开发者买单。

来源: