中国合成媒体初创公司诗云科技如何在3个月内获得融资?

发布于: 3 月 2, 2021
编辑: Amy Liu

如果我们不再需要摄像头来制作视频,而是可以通过几行代码来生成视频,会怎么样呢?

机器学习的进步正在将这个想法变成现实。我们已经看到了deepfakes如何在家庭照片中换脸,并将一个人的自拍变成著名的视频剪辑。现在,具有人工智能研究背景的创业者正在设计工具,让人们利用算法生成高度逼真的照片、声音和视频。

构建这项技术的创业公司之一是中国的诗云科技。该公司成立仅三个月,但已经获得了红杉中国和真格基金两家知名投资人200-300万美元的种子轮投资。诗云科技创始人兼首席执行官Xu Zhuo表示,在本轮融资中,诗云科技收到了近十份投资意向,投资者争相押注由AI生成内容塑造的未来。

不过,诗云科技无意取代人类创作者或艺术家。事实上,Xu Zhuo认为机器在未来几十年内无法超越人类的创造力。”我们有一个内部公式:视觉故事等于创意加制作。我们注重的是制作的部分。”

从某种程度上来说,机器视频生成就像一个灵魂化的视频工具,比我们今天看到的视频滤镜更上一层楼,也让抖音(TikTok的中文版)流行起来。短视频应用大大降低了制作专业好看视频的门槛,但仍然需要相机。

“短视频的核心绝对不是短视频形式本身。它在于拥有更好的相机技术,从而降低视频创作的成本。”。

一些世界上最大的科技公司,如谷歌、脸书、腾讯和字节跳动,也有研究团队在研究。Xu Zhuo的策略并不是直接面对重量级客户。相反,诗云科技要追求的是中小客户。

诗云科技的软件目前只面向企业客户,他们可以用它来改变上传内容中的人脸,或者生成一个全新的图像或视频。Xu称诗云科技为 “视频的谷歌翻译”,因为这款软件不仅可以换人脸,还可以相应地翻译他们所说的语言,并为他们的嘴唇配上声音。

用户按视频或图片收费。未来,诗云科技的目标不仅仅是把人脸做成动画,还可以把人的衣服和动作做成动画。虽然诗云科技拒绝透露其财务业绩,但徐说,该公司已经积累了约1000万张照片和视频订单。

像诗云科技这样的公司也带来了新的法律挑战。谁拥有机器生成的图像和视频?为了避免侵犯版权,诗云科技要求客户对其上传的内容拥有修改权。为了追踪和防止滥用,诗云科技在其生成的每一个内容上都添加了一个加密的隐形水印,并声称对其拥有所有权。诗云科技制作的 “人 “与现实生活中的某个人相吻合的几率很高,所以该公司运行一种算法,该算法会交叉检查其创建的所有面孔与在线查找的照片。

科技