档案库 · 开发与企业工具 · 产品决策 · 2024–2026
InfiniMind押注企业将挖掘未观看视频;UTEC领投580万美元种子轮
前谷歌日本二人组构建无代码基础设施,将PB级'暗'视频转化为可查询数据;TV Pulse已上线,DeepFrame于2026年推出。
InfiniMind
做的是什么生意
InfiniMind makes enterprise video-intelligence infrastructure: TV Pulse analyzes broadcast TV in real time for media and retail clients, and DeepFrame turns up to 200 hours of footage into a searchable knowledge base with visual, audio and speech understanding, deployable in a VPC or on-premises.
起因
Aza Kai and Hiraku Yanagita spent nearly a decade together at Google Japan, Kai in cloud/ML/data science and Yanagita in brand and data solutions. At Google they watched clients sit on petabytes of broadcast and camera footage and fail to answer even basic questions about it — object tagging existed, but nobody could track narrative, causality or long-form content. Kai says 2021–2023 advances in vision-language models changed what was possible, and by 2024 the market demand was clear enough that the two left to found InfiniMind (formerly SDio) in Tokyo, joining programs like AWS GAIA 2025, METI's GENIAC and NVIDIA Inception along the way.
经过
InfiniMind launched its first product, TV Pulse, in Japan in April 2025: it analyzes broadcast TV in real time so media and retail companies can track product exposure, brand presence, sentiment and PR impact. After pilots with major broadcasters and agencies it signed paying customers among wholesalers and media companies, and DeepTech reported the platform had analyzed more than 100,000 hours of content. In February 2026 the startup announced a $5.8M seed round led by UTEC, with CX2, Headline Asia, Chiba Dojo and an a16z Scout-linked AI researcher participating; it said it would relocate its headquarters to the US while keeping its Tokyo engineering office, hire more engineers, and ship its flagship DeepFrame — long-form video intelligence over up to 200 hours of footage, with audio and speech understanding — in beta in March 2026 and full release in April 2026.
还没有结局,它还在跑。
背景
InfiniMind是一家东京创立的初创公司,由两位前谷歌日本员工创建,销售让未观看视频变得有用的基础设施。企业持续产生视频——广播档案、门店摄像头、制作素材——但大部分未被分析。InfiniMind的产品TV Pulse和DeepFrame将这些所谓的暗数据转化为结构化、可查询的信息,企业可使用自然语言进行搜索。
其押注是一个时机判断。CEO Aza Kai表示,视频AI多年来仅停留在对单个帧进行对象标记,无法追踪叙事、因果关系或长视频内容。当视觉语言模型在2021至2023年间显著进步,且GPU成本持续下降时,他与COO Hiraku Yanagita判断技术终于成熟——遂于2024年创立公司。他们的切入点是企业级基础设施,而非面向消费者的通用API:无代码工作流、无长度限制的视频,以及针对数据主权要求企业的VPC或本地部署。
目前的验证都在日本。TV Pulse于2025年4月推出,实时分析广播电视,服务媒体和零售客户追踪产品曝光、品牌呈现、情感和公关影响;截至2026年初,DeepTech报道已分析超过10万小时,并与批发商和媒体公司达成付费合作,此前与主要广播公司和广告代理商进行了试点。2026年2月,UTEC领投580万美元种子轮,参投方包括CX2、Headline Asia、Chiba Dojo及一位与a16z Scout关联的AI研究员。
InfiniMind计划利用这笔资金将总部迁至美国,保留东京工程办公室,增聘工程师,并在2026年3月推出DeepFrame(支持200小时长视频智能平台)测试版,4月全面发布。其战略主张是,视频理解是通往AGI的路径——将现实世界事件像数据库一样索引,即使超越当前买单的工业应用场景,也值得构建。
这件事要成立,得有什么
- 未分析的视频供给已存在于每个档案和摄像头流中,因此解锁的是分析成本和能力,而非新数据采集。
- 2021至2023年视觉语言模型的飞跃使2024年创业成为理性选择——同样的理念提前两年不会奏效。
- 企业约束——隐私、数据主权、无代码工作流、长视频查询——是防御通用视频API(面向消费者和高端用户)的护城河。
- 日本的广播公司和广告代理商提供了紧凑的试验场,在进军美国前可让严苛客户验证技术。
- 通过自适应采样和混合索引控制成本,瞄准目前长视频分析难以触达的每分钟经济性。
可借鉴之处
创业应等待能力曲线:视频AI多年仅能标记对象,因此Kai等待视觉语言模型能够理解叙事——时机使2024年对UTEC而言值得信服。
后续进展
截至2026年9月2日,InfiniMind已运营并获得种子资金:TV Pulse拥有付费日本媒体和批发客户,已分析超过10万小时视频,且580万美元资金支持DeepFrame开发、招聘和美国总部迁移。DeepFrame测试版原定于2026年3月,全面发布为4月;本条目未核实后续里程碑。拥有10余名东京员工及东京大学合作者,InfiniMind主张长视频、因果、多模态理解——而非片段级标记——是可防御的企业利基。
资料来源
- Ex-Googlers are building infrastructure to help companies understand their video data
- 前谷歌团队创办公司,把闲置视频变成结构化数据
- 东京初创InfiniMind以AI破解企业视频暗数据难题,获580万美元种子轮融资推动全球扩张
发现哪里写错了?告诉我们。
轮到你了
你刚读完一家。说说你在做什么,看看谁在赌同一件事。
免费账号 · 3 次免费提问 · 不用绑卡