

今日,话题“田柯宇被字节开除后创业”冲上热搜。

据彭博社报道,因攻击大模型被字节跳动辞退的实习生田柯宇,如今创办的人工智能实验室拿到了近3000万美元融资,投后估值2亿美元,投资方包括五源资本、IDG资本等机构。

报道称,这家公司聚焦世界模型方向,目标是让AI学习物体如何运动、环境如何随行动变化,可应用于机器人、自动驾驶和交互式视频等场景。该公司目前尚未公开名称,也没有推出产品,团队约10人,其中包括多名前字节跳动员工。

对此,田柯宇回应称,对于“世界模型”这个标签还不急于命名或更名,其原则是专注构建基础模型、扩大规模,让结果说话。
据悉,2024年田柯宇还在字节跳动实习,被指通过编写和篡改代码等方式,故意干扰其他部门的模型训练任务,以争夺GPU资源。这一行为在网络上被称为“投毒”,引发广泛关注。
字节跳动随后将其辞退,并提起民事诉讼,索赔800万元。法院最终判令田柯宇赔偿50万元,并没收其全部工资。字节跳动当时回应称,网传“涉及8000多卡、损失上千万美元”严重夸大,受影响的是商业化技术团队某研究项目的模型训练,未影响正式项目和线上业务。
在接受彭博社采访时,田柯宇承认自己当时的做法不当,将其描述为“以暴制暴”式的举动,他觉得别人的项目不如自己有价值,所以捣乱污染了对方的训练,从而腾出更多的算力给自己用。
田柯宇还称:“如果我能带着今天所知道的一切回到过去,我肯定会采取更明智的做法。”
更富戏剧性的是,就在田柯宇被辞退后不久,字节跳动一篇论文获得NeurIPS年度最佳论文奖,这是中国团队首次拿下该奖项。而这篇获奖论文的第一作者,正是已经离开字节的田柯宇。
目前,田柯宇正将研究推向产业化。据他介绍,团队已构建了一套包含20万个符号的“视觉词典”,这些符号人类无法识读,但AI可以用它们表示、压缩和预测视频。他计划向模型输入约1亿小时的视频数据,让AI通过这套专属语言学习现实世界的物理规律。
田柯宇表示,使用这项技术可将生成1秒视频的成本至少压缩一个数量级,他计划在2027年正式发布完整模型前,通过线下活动展示技术能力。
本文来自大风号,仅代表大风号自媒体观点。