据彭博社10月8日报道,前字节跳动实习生田柯宇开始进军世界模型创业领域。他创办的公司虽尚未公开名称和产品,但已获得五源资本、IDG资本等知名风投支持,融资近3000万美元,投后估值达2亿美元。
田柯宇目前为北京大学博士研究生,过去一年将研究重点放在世界模型上,希望让AI学会模拟现实世界的物理规律和运行机制,应用于机器人、交互式视频和自动驾驶等领域。他曾以第一作者身份发表NeurIPS 2024最佳论文,提出更高效的图像生成方法。
田柯宇团队已开发出类似AI“词典”的系统,包含20万个普通人无法识读的符号,帮助模型处理视频。他认为视频信息难以靠人类语言高效表达,计划通过为AI创造专门语言并输入1亿小时视频,将生成1秒视频的成本至少降至原来的十分之一。
该公司目前有10名团队成员,包括其他字节跳动前员工。田柯宇计划在2027年正式发布完整模型前,通过现场活动展示技术能力,现阶段专注于技术研发,暂不关注消费级产品或商业模式。