EN
返回档案库

档案库 · AI 与模型 · 技术决策 · 2021–2026

Twelve Labs押注视频是AI的基础;获亚马逊和英伟达1亿美元B轮融资

韩国人创办的Twelve Labs押注原生视频基础模型——Marengo和Pegasus——能让AI像人类一样观看、记忆和推理;已筹集超2.07亿美元。

Twelve Labs (트웰브랩스)

它在赌什么视频,而非语言,将成为AI的基础:原生视频模型(Marengo、Pegasus)让机器像人类一样观看、记忆和推理视频内容。在扩

做的是什么生意

Twelve Labs builds video-understanding foundation models — Marengo (index/retrieval) and Pegasus (video-language reasoning) — sold via API and Amazon Bedrock to enterprises searching and analyzing large video archives.

起因

Founded in 2021 in San Francisco by five Koreans led by Jae Lee, with core AI research done in Seoul. The founding observation: 'the world does not happen in text. It happens in motion.' Seed funding reached about $17M, and in October 2023 Nvidia made its first investment in a Korean generative-AI startup, backing a roughly $10M pre-Series A.

经过

June 2024: a $50M Series A co-led by Nvidia's NVentures and NEA, joined by Index Ventures, Radical Ventures, WndrCo and Korea Investment Partners. Products matured fast: Marengo-2.6 shipped in March 2024 for any-to-any video search, Pegasus-1 went to beta for video-language reasoning. December 2024: SK Telecom invested $3M to use the models in its AI agent and surveillance work. In July 2025 Amazon made Marengo 2.7 and Pegasus 1.2 fully managed in Bedrock; by 2026 GS Shop's video recommendation built on the models doubled click-through and raised purchase intent 9x, and U.S. government agencies were exploring video intelligence for defense and public safety.

结果

Still running and scaling: a $100M Series B announced 2026-07-01 (Naver Ventures and NEA co-led, Amazon participating) brought total funding past $207M. CEO Jae Lee says the goal is 'video superintelligence' — AI that watches, remembers and reasons like humans — with New York and London offices planned and a first AI video-creation app, Rodeo, in preview.

背景

Twelve Labs于2021年在旧金山成立,由李在领导的五名韩国人创立,核心AI研究在首尔进行,公司将视频作为AI的原生模态,而非文本的附加。其创始观察是:“世界不是以文本发生的,而是以运动发生的。”公司构建两个基础模型——Marengo将视觉、音频、语音和屏幕文本嵌入为一个可搜索的表示,Pegasus在该表示上进行推理,以回答、总结和基于视频内容进行描述。

这一逆向押注早期吸引了不寻常的支持者:2023年10月,英伟达首次投资韩国生成式AI初创公司,投入约1000万美元的A轮前融资;2024年6月,英伟达的NVentures与NEA联合领投了5000万美元A轮,Index Ventures、Radical Ventures、WndrCo和韩国投资伙伴参投。2024年12月,SK电信投资300万美元,将模型用于其AI代理和监控工作。

分发随后跟上:2025年7月,亚马逊在Amazon Bedrock中提供Marengo 2.7和Pegasus 1.2的完全托管;到2026年,GS Shop基于这些模型构建的视频推荐系统点击率翻倍,购买意向提高9倍,美国政府机构也在探索视频智能用于国防和公共安全。收入主要来自美国和欧洲企业,开发者收入年增长80%至120%。

2026年7月,Twelve Labs完成了1亿美元B轮融资,由Naver Ventures和NEA联合领投,亚马逊参投——这是首家同时获得亚马逊和英伟达投资的韩国AI初创公司——总融资额超过2.07亿美元。CEO李在将目标定位为“视频超级智能”:让AI像人类一样观看、记忆和推理录制的现实,并计划在纽约和伦敦设立办公室。

这件事要成立,得有什么

  • Twelve Labs选择视频作为主要数据类型——而非次要模态——理由是文本是现实的有损压缩,而因果关系存在于序列中。
  • 该架构使视频成为机器可读的记忆:视频被一次理解、持久存储,并可精确到秒寻址——这正是拥有大型档案的企业真正需要的。
  • 英伟达2023年的投资是首个验证和切入点:它表明在模型发布之前,这一押注是可信的,三年的合作促成了B轮融资。
  • 商业证明来自一个狭窄的领域——GS Shop的点击率翻倍和购买意向提高9倍——表明平台在“视频超级智能”实现之前就能变现。

可借鉴之处

押注大多数AI忽略的模态——视频而非文本——吸引了英伟达和亚马逊作为支持者;但这种逆向押注仍需转化为企业收入才能实现复利增长。

后续进展

截至2026年9月2日,Twelve Labs已筹集超过2.07亿美元:2026年7月的B轮融资(1亿美元,由Naver Ventures和NEA联合领投,亚马逊参投)为Marengo、Pegasus及其视频认知系统提供资金。企业收入集中在美国和欧洲,开发者收入年增长80%至120%,采用者包括GS Shop和美国机构,其模型在Amazon Bedrock中完全托管。公司计划在纽约和伦敦设立办公室,预览了视频创作应用Rodeo,并继续推动韩国构建的视频模型成为新兴视频智能时代的领导者。

资料来源

发现哪里写错了?告诉我们。

轮到你了

你刚读完一家。说说你在做什么,看看谁在赌同一件事。

免费账号 · 3 次免费提问 · 不用绑卡

相关案例