奶盖886
人生苦短,及时行乐。
  • 注册会员
circle-image
文章总计
0 篇文章
circle-image
获赞数
circle-image
总阅读量
0 阅读
circle-image
主页人气
751 人气
文章 动态 帖子
看起来这里没有任何东西。

加载中...

加载中...

  • 哎哟喂,这标题口气是真不小啊,“读完本篇就够了”,我还以为点进来能看到啥独门秘籍呢,结果翻到底,就是把OpenAI那篇官方博客翻译了一遍,又甩了几个延伸阅读的链接,自己总结的部分加起来还没我一个朋友圈长。你说你“够”了,我可不够,我读完这满肚子问题,你倒是给我解答啊。 先说你那技术原理那节吧,你贴了个论文摘要,然后说什么“视觉信息补丁化”,把视频当成图像的小块喂给AI。这个比喻我懂,就像小时候拼乐高嘛,一堆小零件,AI自己学怎么搭起来。但你紧接着抛出个“NaViT”是什么意思?就写了个英文名字,叫什么Native resolution vision transformer,然后呢?没了?这不是欺负我们不懂技术的人吗?你要真想讲清楚,就该说这个玩意儿跟以前那种固定分辨率的模型有啥区别,为啥它能处理不同大小的视频。结果你就扔个名词,让人觉得你也就是复制粘贴的,根本没消化。我跟你说,我虽然不搞AI,但我在B站看过几个博士UP主讲Vision Transformer,人家用做菜打比方,比你这清楚多了。 然后你又说Sora是什么“世界模拟器”,这个帽子扣得也太高了吧?它模拟的是世界吗?它模拟的是视频里那个世界的皮!OpenAI自己论文都说了是“视频生成模型作为世界模拟器”,意思是往这个方向走,但现阶段的Sora离真正的“理解世界”还差了十万八千里。你看它生成的视频,猛地一看是挺流畅,可你细瞅,人的手指头可能是六根,走路姿势总有点顺拐,影子方向和太阳都对不上。这叫模拟世界?我隔壁二大爷喝多了都能模拟出更离谱的画面来。当然我也承认,这玩意儿比之前的模型强太多了,至少狗跑起来腿不再乱飘了,但你要是把它当物理课教材,那你的物理老师得气死。 说到能力,我确实被那几条演示视频震到了,东京街头那个撑伞的女人,镜头推进的时候她脸上的皮肤纹路都看得见,衣服褶子随动作变化也自然,比我之前用剪映里那些AI小特效强了不知道多少倍。我之前也玩过Runway和Pika,生成个三秒的片段,等半天,出来还跟幻灯片似的,人脸一转头就换了一个人。所以Sora这个一分钟,还是连贯的长镜头,这个技术跨度的确牛,我认。但你文章里写“物体运动符合物理规律”,我就笑了,我特意去看了几个网友做的压力测试,让Sora生成“一只猫从高处跳下”,结果猫在空中翻跟头的时候,尾巴突然分了个叉。还有生成“倒水”,水刚倒出来的时候还行,流到一半就开始逆流而上,牛顿的棺材板都压不住了。所以说“符合规律”是理论上大部分时候符合,实际用起来全靠抽卡,你要是信了这个邪,拿它去搞正经项目,保准翻车。 再说你那句“普通人也能轻松拥有创作视频的能力”,这话我听着就来气。你问问身边普通人,他们能描述清楚一段画面吗?我上次让我妈说个场景拍个视频,她憋了半天:“就是那个,那个什么,一片绿油油的,有花有树,还有蝴蝶。”就这,你给Sora输入,它能给你生成个“一片绿油油的,有花有树,还有蝴蝶”的糊弄东西,但要是让她描述“镜头从花瓣上的露珠缓缓拉起,穿过层层藤蔓,最终定格在一扇老旧木门上的铜环上”,她根本说不出来。所以Sora降低的不是所有人的门槛,是那些本来就有画面感、会用语言表达的人的创作门槛,普通人用起来照样一头雾水。就像以前拍照片,傻瓜相机宣传的时候也说“傻瓜都能用”,但拍得好的还是摄影师,普通人按出来的照片照样歪瓜裂枣。 关于“颠覆传统视频制作”,你这口气也太乐观了。影视行业要是这么容易被颠覆,那好莱坞早就集体点外卖了。你想想,AI绘画出来多少年了?现在那些插画师该接单接单,该画画画,只是有些专门做素材图的、画小头像的确实被冲了一波,但真正有创意的大佬,现在都拿AI当草稿本,效率起飞,作品该值钱还是值钱。视频也一样,以后拍宣传片、小广告,可能一个人用Sora就能出个初稿,省掉以前找模特租场地的时间,但你真要拍个院线电影,那还是得真人上。为什么?因为观众要的是人味儿,是演员的眼神里那点颤动的情绪,是导演藏在每个镜头里的个人表达。AI能给你生成一百种画面,但它不知道哪个画面能让人哭出来。我那个做剪辑的朋友一开始也慌,说以后是不是不用租摄影棚了,我说你冷静点,你看那Sora生成的人走路,脚底下有时候都没影子,你能让演员拍戏的时候不踩到光吗?技术永远在帮人干活,而不是替人干活。 然后你延伸阅读里还扯上贾玲和韩寒了,我真是一头雾水。贾玲拍《热辣滚烫》那是实打实减了100斤,你让Sora生成一个瘦了的贾玲,观众会觉得感动吗?观众看的是她在镜头里流汗、痛苦、咬牙坚持的那些真实瞬间,AI就算能画出汗珠,能画出肌肉线条,但它画不出“这个人真的经历过”的那种重量。韩寒更逗,他要是用Sora拍赛车,倒是能省下不少租车费,但赛车电影的灵魂是速度带来的肾上腺素,是方向盘在手里震动的感觉,AI生成的画面再快,观众心里也明白“这是假的”,刺激感就没了。拿这俩导演来蹭Sora热度,我觉得就是在硬贴,什么火蹭什么,估计文章作者自己都没想明白怎么蹭。 安全那块你倒是提了一嘴“深伪”,但也就提了一嘴。我跟你说,更吓人的是版权问题。Sora训练的时候用了多少网上的视频?那些长视频、电影、纪录片、私人vlog,估计全被它扒了个底朝天。将来有人用Sora生成一个画面,跟某部电影里的一模一样,算不算侵权?OpenAI现在已经被好多画师和图片网站起诉了,视频这边估计也跑不掉。可你文章里对这些一个字不提,光剩下喊“制定规章制度”,这话谁不会说?问题是规矩还没立起来,Sora先跑起来了,等出了事故再追责,那早就晚了。 还有个事,你关于“教育、培训、娱乐带来新活力”的畅想,我部分同意。我们公司做安全培训,以前要请人演一出“车间事故”短片,又贵又假,演员还笑场。以后要是能用Sora生成个逼真的事故场景,确实方便。但问题是AI有幻觉,今天教你生成“锅炉爆炸”它可能给你配错了火焰颜色,明天生成“触电”它可能把电线画成了麻绳。你要真拿它做的视频当培训教材,万一里面有个关键细节是错的,员工照着学了,出了事谁负责?所以教育这种东西,AI只能当辅助,人工审核绝对不能少。 你文章最后又来了个“辩证看待”,这句话我听着都起茧子了。哪个新东西出来不辩证?核物理出来的时候也辩证,结果现在全世界都在为核电站和核弹头吵架。辩证没问题,但你得给出具体的大纲,比如谁去监管、怎么追责、受害者怎么维权,这些你一条都没说,就告诉我们“好处要探索,风险要警惕”,这不跟没说一样吗。 再说“视频创作者失业”这个点,我也觉得你想简单了。会被AI淘汰的是那些专门干重复活的,比如套模板的剪辑师、做低端特效的、剪口水短视频的。但真正有想法的人,以后肯定能把Sora当武器,快速做出以前需要一整个团队才能做的效果。我大学时学传媒,毕业后干了两年视频,说实话,剪片子的时间一大半都浪费在调色和找素材上,真正用来想创意的没多少。如果有AI帮我先把画面搞出来,我就可以把省下来的时间用来想故事结构、打磨台本,这不反而让作品更有质感了吗?所以你说失业,我看是“结构性失业”,部分人会被淘汰,但另一部分人会跨过这个坎,就看你能不能跟上。 我自己也有个挺惨淡的经历。去年我接了个美食账号的包年剪辑,甲方天天让我改,一次我说“镜头转场能不能有点新意”,我脑子一热就试试用AI视频工具,输了个“拉面腾起的热气与夕阳叠加”,出来了一泡污,字全是乱码,画面糊得像隔夜粥。最后我还是乖乖自己剪,一帧一帧拉。所以我对Sora是又爱又怕,爱的是它终于把细节做到能看的程度了,怕的是等它真普及了,我这点手艺可能真不值钱了。但你说让我现在转行?我也不知道能干啥。走一步算一步吧。 哦对,你那个标题里还有“延伸阅读1:Sora会对视频内容创作产生什么样的影响?”,我看内容估计就是泛泛而谈。我自己的感想是,影响肯定有,但不会是那种“一夜之间大家都不用拍片子了”。你看现在的短视频平台,那么多用AI绘画做的“一分钟看懂xxx”,质量也就那样,大家看个乐子,真正火的还是真人出镜、有故事的。因为你用Sora生成一个视频,别人一眼就能看出“这是AI做的”,那种虚假感是骨子里带的,像我们做视频的人管这叫什么“塑料味”。所以它最大的用处是当辅助工具,比如我以前拍一个产品宣传片,需要个星空背景,我不会实拍,现在让Sora生成一下,完美。但你要让我全片都用AI生成,我是不干的,那没劲。 最后我还想吐槽一下你文章里的一句话:“当中华大地还沉浸在甲辰龙年的春节气氛中时”,你说你写就写吧,非得整这种作文腔,跟《新闻联播》小学生仿写似的。Sora发布跟春节有个毛线关系?就是为了凑个时间点显得自己有文化?我看不如直接说“大过年的,OpenAI整了个大活”更实在。 总结一下我的真实态度:Sora这个技术,我竖大拇指,真的牛逼,比我想象的进步快多了。但这篇文章,我觉得不行,标题党,内容浅,拼拼凑凑,连译文都算不上,更别说什么“读完就够了”。你要是真想了解Sora,我建议你自己去OpenAI官网把论文和演示视频看了,再到贴吧、知乎上看一圈吹的和骂的,然后等内测出来了自己上手玩一把。别人的二手解读,包括我这篇,都只能当个引子,别拿它当结论。好了,就说这么多,半夜爬起来码这些字也是闲的。希望别被文章作者看到,免得他骂我杠精。看到也没事,杠就杠呗,反正网上谁不认识谁啊。

加载中...

来跟我聊聊吧~