可灵AI全系模型上线“视频音效”功能 可同步生成高质量立体声音效
可灵AI全系模型上线“视频音效”功能 可同步生成高质量立体声音效
可灵AI全系模型上线“视频音效”功能 可同步生成高质量立体声音效6月27日,可灵AI宣布全系列视频(shìpín)模型上线“视频音效”功能,用户在使用可灵AI进行视频创作时,不仅能获得高质量的视频画面,更能体验到与视频精准匹配、富有空间感的立体声音效,真正实现“所见即所听(tīng)”的沉浸式(shì)体验。目前,该功能已无缝(wúfèng)集成至文生视频、图生(túshēng)视频、多模态编辑等多种创作模式中,并限时免费开放。
与此同时,平台原有的(de)“音效生成”也进一步升级,新增“视频生音效”功能。用户现在不仅可以通过文本生成音效,更可以直接上传本地视频,或选用在可灵(kělíng)平台创作的历史视频,一键(yījiàn)为无声的画面匹配(pǐpèi)上语义契合、节奏同步的音效,自动适配动作、环境、氛围等多种场景,极大地提升了视频内容的表现力和沉浸感,有效(yǒuxiào)降低了创作者在音频后期制作上的时间(shíjiān)与技术成本。
从实际效果来看,可灵AI的音效功能在多个典型案例(ànlì)中展现了极高的音画同步精度和极佳的空间听感。例如,在生成(shēngchéng)“婴儿(yīngér)在活泼地笑”的视频片段中,模型不仅还原了婴儿清亮的笑声,甚至连婴儿笑容间隙短促的吸气声都完美捕捉,与画面中肉嘟嘟脸颊的起伏动作精准匹配,其富有(fùyǒu)空间感的立体声效果,让(ràng)整个画面的温馨感与生命力(shēngmìnglì)扑面而来。
在另一段山体滑坡导致巨石砸中汽车的视频中,系统自动生成了(le)金属扭曲断裂声、石块飞溅与尘土扬起的细节音效,声音(shēngyīn)定位清晰、动态层次丰富,提升了整体灾难场景的视觉冲击力与沉浸(chénjìn)感。
据悉,上述(shàngshù)功能的(de)实现(shíxiàn),依托于可灵AI自主研发的多模态视频生音效模型——Kling-Foley。Kling-Foley 支持基于视频内容与可选文本提示(tíshì)自动生成(shēngchéng)与视频画面语义相关、时间同步的高质量立体声音频,涵盖音效、背景音乐等多种类型(duōzhǒnglèixíng)声音内容。它支持生成任意时长的音频内容,还具备立体声渲染的能力,支持空间定向的声源建模和渲染。
今年3月,可灵AI首次推出AI音效(yīnxiào)功能,用户可通过输入文本生成相应的环境(huánjìng)音或(huò)动作音,并可进一步结合平台生成的视频进行语义理解与自动匹配(pǐpèi)。随后,在可灵2.1模型中正式加入了视频音效功能,在生成视频的同时,系统也会自动生成与之匹配的音效,增强了整体视听体验。随着视频音效生成技术的成熟(chéngshú)落地,将进一步释放可灵AI在广告创意、影视、短(duǎn)视频、游戏等内容等领域的发展潜力。
(本文来源(láiyuán):日照新闻网。本网转发此(cǐ)文章,旨在为读者提供更多信息资讯,所涉内容不构成投资、消费建议。对文章事实有疑问,请与有关方核实(héshí)或与本网联系。文章观点非本网观点,仅供读者参考。)
6月27日,可灵AI宣布全系列视频(shìpín)模型上线“视频音效”功能,用户在使用可灵AI进行视频创作时,不仅能获得高质量的视频画面,更能体验到与视频精准匹配、富有空间感的立体声音效,真正实现“所见即所听(tīng)”的沉浸式(shì)体验。目前,该功能已无缝(wúfèng)集成至文生视频、图生(túshēng)视频、多模态编辑等多种创作模式中,并限时免费开放。
与此同时,平台原有的(de)“音效生成”也进一步升级,新增“视频生音效”功能。用户现在不仅可以通过文本生成音效,更可以直接上传本地视频,或选用在可灵(kělíng)平台创作的历史视频,一键(yījiàn)为无声的画面匹配(pǐpèi)上语义契合、节奏同步的音效,自动适配动作、环境、氛围等多种场景,极大地提升了视频内容的表现力和沉浸感,有效(yǒuxiào)降低了创作者在音频后期制作上的时间(shíjiān)与技术成本。
从实际效果来看,可灵AI的音效功能在多个典型案例(ànlì)中展现了极高的音画同步精度和极佳的空间听感。例如,在生成(shēngchéng)“婴儿(yīngér)在活泼地笑”的视频片段中,模型不仅还原了婴儿清亮的笑声,甚至连婴儿笑容间隙短促的吸气声都完美捕捉,与画面中肉嘟嘟脸颊的起伏动作精准匹配,其富有(fùyǒu)空间感的立体声效果,让(ràng)整个画面的温馨感与生命力(shēngmìnglì)扑面而来。
在另一段山体滑坡导致巨石砸中汽车的视频中,系统自动生成了(le)金属扭曲断裂声、石块飞溅与尘土扬起的细节音效,声音(shēngyīn)定位清晰、动态层次丰富,提升了整体灾难场景的视觉冲击力与沉浸(chénjìn)感。
据悉,上述(shàngshù)功能的(de)实现(shíxiàn),依托于可灵AI自主研发的多模态视频生音效模型——Kling-Foley。Kling-Foley 支持基于视频内容与可选文本提示(tíshì)自动生成(shēngchéng)与视频画面语义相关、时间同步的高质量立体声音频,涵盖音效、背景音乐等多种类型(duōzhǒnglèixíng)声音内容。它支持生成任意时长的音频内容,还具备立体声渲染的能力,支持空间定向的声源建模和渲染。
今年3月,可灵AI首次推出AI音效(yīnxiào)功能,用户可通过输入文本生成相应的环境(huánjìng)音或(huò)动作音,并可进一步结合平台生成的视频进行语义理解与自动匹配(pǐpèi)。随后,在可灵2.1模型中正式加入了视频音效功能,在生成视频的同时,系统也会自动生成与之匹配的音效,增强了整体视听体验。随着视频音效生成技术的成熟(chéngshú)落地,将进一步释放可灵AI在广告创意、影视、短(duǎn)视频、游戏等内容等领域的发展潜力。
(本文来源(láiyuán):日照新闻网。本网转发此(cǐ)文章,旨在为读者提供更多信息资讯,所涉内容不构成投资、消费建议。对文章事实有疑问,请与有关方核实(héshí)或与本网联系。文章观点非本网观点,仅供读者参考。)




相关推荐
评论列表
暂无评论,快抢沙发吧~
你 发表评论:
欢迎