“如果不能找到新的算力黑洞,我们的股价会跌回2022年!”
“老板……”
这时,一直沉默的首席技术官(CTO)小心翼翼地举起了手,指了指PPT的一角,“其实,还有一条路。”
“您看,OpenAI发布的Sora 2,还有Google的视频生成模型,热度非常高。但是因为推理成本太高,一直没法大规模商用。”
老黄的眼睛眯了起来:“继续说。”
“文本的信息密度是有限的,所以容易被压缩、被优化。”CTO咽了口唾沫,越说越兴奋,“但视频不一样!图像不一样!那是像素级的、高维度的信息流!那是对物理世界的模拟!”
“SLRM能优化逻辑,Engram能优化记忆,但它们优化不了海量的像素渲染!”
老黄的眼神猛地亮了,仿佛抓住了救命稻草。
“对……对!就是这个!”
老黄猛地站起来,之前的阴霾一扫而空,取而代之的是一种赌徒般的狂热。
“AI的世界不仅仅只有语言模型!”
他一把抢过遥控器,将屏幕切换到了一幅巨大的全景图——那是Sora 2生成的超高清视频,以及实时3D渲染的虚拟世界。
“去他妈的语言模型!那是过去式了!”
老黄挥舞着手臂,声音在会议室里回荡:
“真正的未来,是全模态AI!”
“生成一段高清视频,需要的算力是生成一段文字的一万倍!渲染一个3D场景,需要的显存带宽是查找一个单词的一千倍!”
“在这个领域,SLRM那种基于逻辑的架构根本跑不起来!Engram那种查字典的方法更是毫无用武之地!”
“只有我们!”老黄握紧了拳头,“只有我们的GPU,只有我们强大的并行计算能力和CUDA生态,才能支撑起这种指数级增长的多模态算力需求!”
“中国目前在语言模型上确实有两把刷子,但在多模态领域,他们并没有领先优势!Sora 2就是最好的证明!”
“这就是我们的新故事!我们要立刻调整战略,把所有的资源都砸向视频生成、3D生成和物理模拟!”
“我们要告诉华尔街:别盯着那点文本算力了!多模态时代的算力需求,将是语言模型时代的一百倍!这是一片新的蓝海,而我