7月2日,《每日经济新闻》记者获悉 ,百度商业研发团队对外发布了自研视频生成模型“MuseSteamer”及配套创作平台“绘想 ”,正式进军AI(人工智能)视频生成领域。
2024年,Sora爆火引发生成式视频大模型热潮 ,李彦宏则在一场内部讲话中称,Sora这种视频生成模型的投入周期太长,10年、20年都可能拿不到业务收益 ,无论多火爆,百度都不去做 。
7月2日,一位接近百度的人士对《每日经济新闻》记者分析称 ,Robin(李彦宏)点评Sora其实还有后半句,基于多模态需求,可以做一个相对特定的视频生成场景。“包括百度前段时间的罗永浩数字人其实也是特定场景的视频生成。原本商业侧已有擎舵这个平台,那么去服务B端商业客户生成AIGC(人工智能生成内容)产品宣传视频 ,其实就是特定场景,也是有用户需求的 。”
关键优势在于极致遵循力
当前,AI生成视频在生成质量 、画面稳定性和长度等方面仍是各大技术厂商持续攻坚的领域。
百度商业体系商业研发总经理刘林表示 ,在数字内容创作领域,视频时长与画质的突破往往意味着创作自由度的质变。MuseSteamer可支持电影级审美下的10秒长视频的生成,1080P的高清晰度 ,为视频创作提供了更大的表现空间 。
刘林表示,传统AIGC视频创作实践中,往往是先生成视频 ,再进行配音和添加音效。割裂的创作环节不仅消耗大量时间,更会削弱作品的完整艺术表达。MuseSteamer创新性支持一体化生成带有音效和人物台词的视频 。
此外,在视频长度方面 ,MuseSteamer目前支持生成5秒和10秒两个版本,并可达1080p清晰度。百度此次同步发布了MuseSteamer模型的家族版本,包括Turbo、Lite、Pro,以及各版本对应的有声版 ,分别面向不同的创作需求和成本考量。
刘林强调,MuseSteamer的关键优势在于其对创作指令的理解与执行能力,即所谓的极致遵循力 ,能实现创作者“所思即所得”的表达自由。此外,镜头运用能力也是其差异化竞争力之一,百度希望通过该模型降低专业创作门槛 ,让更多人获得“镜头平权 ” 。
据介绍,MuseSteamer模型的技术基础包括三大方面:首先,在数据准备阶段 ,通过“筛选—净化—配比”的方式,对超过10亿条异构数据进行处理,并结合三级标签体系和Active Learning(主动学习)机制 ,以保证训练数据的审美和结构质量。
其次,在模型训练过程中,采用多目标反馈的强化学习优化路径,试图在保证视频动作幅度的同时 ,保持主体内容的一致性稳定输出。同时,MuseSteamer引入美学条件控制调优,通过隐式批判学习和影视标准严选 ,让模型懂美 、创造美 。
MuseSteamer如何面对劲敌
相比OpenAI、字节跳动、Pika等更早投入文生视频赛道的企业,百度此次推出MuseSteamer确属“后发”。无论是国外如Pika 、Runway,还是国内如快手旗下的可灵AI、字节跳动旗下剪映团队孵化的AI创作平台即梦AI ,均从2024年起就密集发布各类模型、功能和平台,并已完成多次迭代。
今年5月,快手可灵AI宣布推出全新2.1系列模型 ,高品质模式(1080p)下生成5秒视频仅需不到1分钟 。快手官网信息显示,可灵AI在推出10个月之后(即今年3月)的年化收入运行率(Annualized Revenue Run Rate)突破1亿美金,其今年4月和5月的月度付费金额均超过1亿元人民币。
百度是最早布局大模型的国内科技企业之一。自2023年起 ,百度发布文心一言 、迭代多个版本的文心大模型,同时已在搜索、地图、文档、企业服务等多个业务线中落地大模型能力 。
但在视频生成这一AIGC下一个爆发点上,百度此前并未公开大动作,仅在2024年宣布领投清华系视频大模型公司生数科技。此外 ,2025年3月,百度发布的文心大模型4.5和4.5 Turbo实现了文本 、图像和视频的混合训练。
2024年,Sora爆火引发国内生成式视频大模型热潮 ,李彦宏则在一场内部讲话中称,Sora这种视频生成模型的投入周期太长,10年、20年都可能拿不到业务收益 ,无论多火爆,百度都不去做 。
7月2日,一位接近百度的人士对《每日经济新闻》记者分析称:“之前提到的不做类似Sora ,更多是不去训一个general-purpose(通用)的视频生成模型,但是在特定场景、特定目的下的视频生成能力是需要的,或者说基于对市场需求的判断 ,外界确实没有这种能力,会自己来生产 、研发这样的能力。 ”
上述人士表示,Robin(指李彦宏)点评Sora其实还有后半句,基于多模态需求 ,可以做一个相对特定的视频生成场景。“包括百度前段时间的罗永浩数字人其实也是特定场景的视频生成。原本商业侧已有擎舵这个平台,那么去服务B端商业客户生成AIGC产品宣传视频,其实就是特定场景 ,也是有用户需求的 。”
记者注意到,MuseSteamer由百度商业研发团队主导推出,或许意味着其背后的直接应用场景有可能是广告创意生成与内容投放。
此外 ,7月2日,百度搜索还宣布进行十年来最大改版,从搜索框、搜索结果页到搜索生态全面革新。具体而言 ,百度搜索框升级为“智能框”,支持超千字的文本输入,拍照、语音 、视频等能力也全面加强 ,支持直接调取AI写作、AI作图等工具 。 百度搜索还宣布接入视频生成模型MuseSteamer。
未来,MuseSteamer如何融入百度搜索、营销与智能助手等核心业务,将决定它是否能从工具演化为平台,从模型能力走向商业杠杆。
(文章来源:每日经济新闻)
股市中的加杠杆是什么意思:股票软件哪个最好-三部门召开加强新能源汽车安全管理工作视频会
股票维权平台哪个正规:股市有没有杠杆-LABUBU二手价格下跌 压力给到“黄牛”炒家 玩家:持续断货只会消耗热情
手机股票软件哪个好用:股市金融杠杆-6月18日晚间上市公司利好消息一览(附名单)
股票哪个证券公司开户好:正规股票杠杆平台-美上诉法院裁定特朗普关税非法!一文读懂:接下来事态将如何发展?
股票开户哪个平台:炒股能加多少杠杆-国常会:听取当前防汛抗旱情况和下一步工作安排汇报
看股票用哪个app:股票杠杆哪个平台好用一点-新高!又新高!银行股再度刷屏 后市如何演绎?
红腾网app-专业股票配资公司_股票线上配资_配资服务平台提示:文章来自网络,不代表本站观点。
红腾网app-专业股票配资公司_股票线上配资_配资服务平台㉖投资者在选择股票配资平台时,可以关注其是否具备全球化的运营网络和服务能力,以满足跨国投资者的需求。
记者|赵阳戈继“遇见小面”后,溜溜果园集团股份有限公司(以下简称溜溜果园)向香港联交所递表,由中信证券、...
当地时间14日,以色列国防军称监测到伊朗对以色列的新一轮导弹袭击。以色列多地再次拉响防空警报,以军称防空系统正在对伊...
3月24日,业内权威专家表示,MLF(中期借贷便利)不再有统一的中标利率,标志着MLF利率的政策属性完全退出。3月24日...
3月24日,易方达国证自由现金流ETF公开发售。该产品跟踪国证自由现金流指数,这个指数是什么?有哪些优势?投资价值如何?...
界面新闻记者|陈靖3月1日,财信证券发布了高级管理人员变更的公告。此次变更中,公司新任命了两名高级管...
记者王珍3月23日,国务院参事、清华大学苏世民书院院长薛澜在“中国发展高层论坛2025年年会”间隙接受...
近期美股市场波动显著放大,区域政治风险叠加政策不确定性,或为扰动投资者情绪的核心因素。日前,国海富兰克林基金分析指出,特...
国家卫健委主任雷海潮在参加十四届全国人大三次会议江苏代表团开放团组会议时指出,人口问题仍是一个需要深入和动态研究的重要问...
2025年4月11日,邦德股份(838171.BJ)发布了限售股份上市流通公告。本次股份上市类型为发行前股份限售流通,上...
今日A股反弹,大消费震荡回调。消费ETF(159928)三连阳后首度回调,全天成交额8.55亿元。资金持续涌入,全天再获...
【导读】*ST天喻及实控人之一、*ST海越被证监会立案 6月6日晚间,*ST天喻(300205)公告称,因涉嫌信息...
界面新闻记者|杨志锦界面新闻编辑|王姝建设银行3月末披露的2024年年报显示,2024年该行利润总额下降...
美东时间4月10日,美国多家电影公司的股价大幅下跌。华特迪士尼和华纳兄弟探索公司的股价当日分别下跌6.79%和12.53...
10年期美债收益率站上4.5%,为2月中旬以来首次。(金十数据APP)...
作者:ACE1.对于中国的互联网大亨来说,刚刚过去的2021年,是被载入史册的一年。只不过,载入...