橘橘橘子汁 & 🍊 头像

消息来源频道

橘橘橘子汁 & 🍊

@microblock_pub

频道13,581 位成员公开可见0 人在线

发一些好玩的 现在成 mb 的私人频道了 Links t.me/Rosmontis_Daily t.me/PDChinaNews

成员规模13,581 位成员
在线情况0 人在线
消息总数1,042 条消息
浏览量总数1,364,146 次浏览

在这个频道里搜索消息……

t.me/microblock_pub

OpenAI最近新出的 Sora 视频生成模型,效果非常离谱,展示中一分钟的视频没有什么闪烁 看不出什么瑕疵
模型架构依然是类似GPT3 DALLE的DiT(他们说是基于 DALLE3 继续研发的),但是看上去与之前大家的思路(以上一帧图片加噪声为基础来生成下一帧图片)不同,他是直接生成一段噪声视频,然后对整个视频进行降噪;降噪时应该还是通过图片的形式,但是给了很多帧的“上下文”
相关:
研究报告:https://openai.com/research/video-generation-models-as-world-simulators