← 返回新闻列表
36氪 🗓️ 2026-06-29

刚刚,独家|获超亿美元融资,Sand.ai 曹越:为什么视频是通往世界模型最重要的路径

⚡ 一句话看懂:有分析指出,“每一代模型,我们都在押注一个非共识。” 文|邓咏仪 编辑|张雨忻 Sand.ai 创始人曹越,不太关心自己站在共识的哪一边。

“每一代模型,我们都在押注一个非共识。

” 文|邓咏仪 编辑|张雨忻 Sand.ai 创始人曹越,不太关心自己站在共识的哪一边。

Sand.ai 是一家视频生成模型和产品公司,成立于2024年1月。

曹越创立Sand.ai 的故事也已经被讲过很多遍:在上一段创业“光年之外”戛然而止后,曹越很快就投入到 Sand.ai 的创业中,做视频生成模型。

彼时,市场的主流叙事是 Diffusion 路线,几乎没有人认为曹越选择的自回归(Autoregressive)路线是一种正解。

而在2025年初,发布基于自回归架构训练的模型 Magi-1 后,曹越很快意识到“只有画面是不够的”,于是团队开始探索音画同出。

后来,Sand.ai 成为了除了Google VEO 3之外最早拿出音画同出模型的团队,Magi-1也在 Google DeepMind 的 Physics IQ benchmark 上长期保持第一。

2025年11月,曹越又下了一个赌注:决定带着团队将模型架构从 Dense 转向MoE,“那个时间点,国内应该几乎没有什么视频公司在全力推进这件事。

” “发布音画同出模型 Gaga-1 之后我们发现,在Dense架构下继续 Scale Up,成本会直线上升。

视频模型存在一个不可能三角:成本、速度、效果。

突破它只能靠研究手段,MoE 就是答案。

”曹越说。

2026 年 Q3,Sand.ai 将发布新一代视频生成模型,采用 MoE 架构,兼顾高效推理与目前开源领域最大的参数规模。

曹越表示:有信心做到头部水准,并且要把它开源给所有人。

🔗 原始来源

如果你要核对细节,可以再看原文: 36氪原文链接