首页»版块 更多荣耀手机 荣耀Robot Phone 【有奖共创】把“百万调音师+顶级影院”装进口袋!聊聊 ...
#星火共创营#

【有奖共创】把“百万调音师+顶级影院”装进口袋!聊聊你对极致视听的疯狂脑洞

[复制帖子标题和链接]

175250

数码爱好者  LV7  发表于 8-25 11:30:15 江苏 来自:荣耀Magic7 Pro
系统级K歌伴唱模式,一键压低原人声音量,支持升降调

现状问题

日常手机K歌,大多需要专门下载K歌APP。普通音乐软件播放原唱歌曲,原唱人声无法减弱,想要跟着唱,人声容易跟原唱打架。
普通播放器升降调功能缺失,想降调、升调适配自己嗓音很不方便。第三方K歌软件体积大、广告多,只想简单跟着哼唱,没必要打开专门K歌应用。

脑洞构想

系统音频层面增加K歌伴唱模式,不用跳转第三方APP,在普通音乐播放界面就能开启。

1. AI音频分离,自动压低歌曲里面原唱人声音量,保留伴奏音乐,实现简易伴唱效果。

2. 提供音调调节滑块,用户可以自由升高、降低整首歌的音调,适配自己的嗓音。

3. 可以随时开关,关闭之后立刻恢复原版歌曲,原始音频文件不会被修改。

区别专业K歌软件:不做录音、混音保存,只做播放层面的伴唱,满足随口哼唱的需求。

实现思路

1. 用户手动开启K歌伴唱模式,功能默认关闭。

2. 端侧NPU做人声伴奏分离,衰减原唱人声,保留伴奏;提供音调升降调节。

3. 实时播放生效,不改动本地源文件,一键切回原版音乐。
数码爱好者  LV7  发表于 8-25 16:22:15 江苏 来自:荣耀Magic7 Pro
基于虚拟多声道算法,实现视频声源三维方位动态调度

现状:目前手机外放仅双声道,只能简单调节左右音量,无法模拟前后、侧面的声源方位,看电影视频时空间沉浸感不足,游戏脚步声定位的思路没有复用在普通视频场景。

构想:借助杜比全景声虚拟环绕技术,把5.1/7.1多声道音频信号,通过HRTF头部声学模型实时折算调度到手机双扬声器。播放视频时,识别画面里人物、物体的三维位置,动态调整左右声道的音量、相位、延时,模拟声音从前方、左右侧、后方传来的环绕效果;爆炸、撞击等冲击音效同步触发马达短促震动,强化体感。全程只做软件算法优化,无需新增硬件。

约束:外放受双扬声器物理布局限制,环绕方位感做合理适配;提供独立开关,用户可自由切换普通立体声模式;低电量模式自动降级为基础声道调度;加密音轨、单声道老旧视频自动适配普通音效。

收益:利用现有硬件实现影院级空间音频体验,让声音方位和画面对应,大幅提升观影沉浸感,希望纳入音频算法迭代预研评估。感谢工程师打磨!
喳喳艺  LV3  发表于 8-25 20:28:46 河南 来自:荣耀30 Pro+
1. 画质体验

- 场景自适应画质引擎:根据内容类型(电影/游戏/直播/短视频)自动切换色彩模式,电影场景增强暗部细节和对比度,游戏场景降低延迟并提升动态清晰度,直播场景自动优化人脸区域美颜同时保留背景真实感。

- AI 超分修复:对低分辨率老剧、经典演唱会录像进行实时超分辨率修复,去噪、去划痕、色彩增强,让老内容焕发新生。

- HDR 动态映射:针对不同亮度的屏幕做精准 HDR  tone mapping,避免高光过曝或暗部死黑,在手机小屏上也能感受到影院级明暗层次。

2. 音质体验

- 空间音频个性化适配:根据用户耳廓形状和佩戴方式校准空间音频,让演唱会、K歌场景的声场定位更精准,仿佛置身现场前排。

- 智能均衡器:AI 识别内容类型(人声/音乐/电影/游戏),自动调节 EQ。人声对话增强清晰度,音乐增强低频和空间感,电影增强环绕效果。

- 降噪分级调节:地铁、飞机、街道等不同噪声场景自动匹配降噪强度,同时保留必要的环境声(如演唱会现场的欢呼声),营造沉浸感又不失安全。

3. 录音录像及后处理编辑

- AI 一键 Vlog 生成:自动从拍摄素材中挑选精彩片段,匹配音乐节奏卡点,智能添加转场、字幕、滤镜,30 秒生成高质量短视频。

- 多机位自动剪辑:演唱会、聚会等场景,支持同时调用多台设备录制,AI 自动切换最佳机位,生成专业级多机位混剪视频。

- AI 修音助手:K歌录音后自动修音,修正音准、节奏,添加混响和和声,让普通人也能唱出录音棚效果;同时保留个人音色特色,不过度修音。

4. 互动体验

- 实时弹幕互动升级:直播场景下支持弹幕特效,观众发送特定关键词触发屏幕特效(如烟花、爱心);K歌房支持实时合唱、接唱,跨地域用户同台演唱。

- 观演互动模式:线上演唱会支持多视角切换(主唱/乐队/观众席/后台),用户可以自由选择观看角度;支持虚拟应援棒,手机屏幕同步变色挥舞。

- 短剧互动分支:互动短剧支持剧情分支选择,用户的选择影响故事走向;支持”上帝视角”模式,可查看其他分支剧情,增加复看率。
沃沃爱分享 实习版主  发表于 8-25 22:48:21 河南 来自:荣耀GT Pro
作为日常拍生活vlog、剪短视频、追长剧、也常去现场演唱会的荣耀老用户,从录制、剪辑到观影听歌全链路都在用手机完成。用得越久越觉得,现在的影音体验很多环节还是割裂的,录制、后期、播放各是各的逻辑,不同场景都要自己折腾参数,很多真实使用的需求没被照顾到,分享几个实打实的想法。

现在最大的感受是:影音功能大多还是单点工具——录像只管录,剪辑要跳去第三方APP,播放又是另一套设置;演唱会、户外、室内不同场景,都要手动调画质调音效,拍完剪完还要反复转格式、修正细节,人一直在迁就工具,而不是工具适配人的创作与观看需求。

关于具体的影音娱乐升级,有几个完全能落地的方向:

1. 场景智能录制,拿起就出好效果
现在不同场景录视频,参数全靠自己调。演唱会现场人多嘈杂,录出来人声糊、低音爆,暗光舞台要么过曝要么一片黑;户外拍vlog逆光脸黑、风噪呼呼响;室内录K歌、网课又有回声。
希望能做场景化智能录制:自动识别演唱会、户外vlog、室内K歌、网课等场景,自动匹配最优参数。演唱会模式自动压制环境欢呼杂音,强化舞台人声与乐器质感,暗光下平衡舞台高光与暗部细节,同时联动防抖;户外vlog自动开启逆光人像增强+动态风噪抑制;室内场景自动开启人声增强+空间混响适配。不用提前翻设置,拿起手机就能录出干净饱满的效果。
2. 端侧一键精修,降低创作门槛
拍完的素材想剪一下很麻烦,要导去第三方APP,加字幕、调色、踩点、去杂音,步骤多又耗时间,很多普通用户拍了素材就一直躺在相册里。
可以在相册内置一键影音精修能力,全在端侧完成。比如演唱会素材一键自动混剪高光片段、提取清晰人声、匹配对应节奏BGM、自动生成歌词字幕;生活vlog一键智能调色、平稳画面、去除路人杂音、配上合适的背景音乐。不用学专业剪辑,也不用跳转多个APP,在相册里点一下就能出成片,让普通人也能轻松做好内容。
3. 自适应观影,点开就是最佳观感
看剧看片的时候,白天户外屏幕发暗看不清,夜里看又觉得亮得刺眼;老剧、饭拍视频画质模糊噪点多;外放听着单薄,戴耳机又经常音量忽大忽小,每次都要手动调半天。
希望做智能观影引擎:根据环境光和片源类型自动适配画质音效。户外自动提亮暗部、增强对比度,阳光下也能看清细节;夜间自动降低蓝光、柔化高光,久看不累;针对低画质片源自动AI修复清晰度、去除噪点;外放时模拟环绕空间音效,耳机端根据内容切换模式——影视剧增强人声对白,演唱会开启现场环绕感。不用每次手动调设置,点开视频就有最合适的观感。
4. 情感化互动,让影音不止于播放
现在看完好剧、听到喜欢的歌想分享,只能截张图配文字,很难传递当下的情绪和精彩感;和朋友异地追剧,进度不同步,没法一起吐槽共鸣,少了很多乐趣。
可以加入情感化互动分享能力:看剧听歌时一键生成「高光片段+心情标签」的分享卡片,自动截取最精彩的片段,附上当下的情绪,发给朋友点开就能直接看;支持异地同步观影,进度自动对齐,还能发实时表情弹幕,不用凑时间也能一起追剧共情;还能根据观看、收听的内容,匹配适合当下情绪的片单歌单,不只是冰冷的播放器,更能接住用户的情绪。

其实荣耀的影音硬件底子一直很扎实,屏幕显示和录音素质都很能打。现在更期待能从“单点的参数升级”,延伸到“全链路的场景体验”,从录制、剪辑到观看、分享,每个环节都不用用户折腾,让创作更简单、观看更沉浸。作为老用户,真心希望荣耀的影音娱乐能做得更顺手、更有温度。
数码爱好者  LV7  发表于 7 天前 江苏 来自:荣耀Magic7 Pro
AI响度归一自适应音量,切换视频音量不再忽大忽小

现状痛点

刷短视频、跨APP看视频时,不同片源录制标准不一样。媒体音量档位不变的前提下,上一条视频声音震耳刺耳,下一条又音量微弱听不清楚;频繁手动调节音量,打断观看体验,突然的大音量还容易惊吓耳朵。
另外首次打开短视频APP时,如果之前音量设置很高,安静环境下会瞬间爆音,猛地被巨响吓到。部分系统自带音量平衡功能效果生硬,音量跳转突兀,缺少平滑过渡。

构想

系统底层引入响度归一化AI自适应音量能力,依托端侧NPU低功耗实时处理音频流:

1. 实时分析正在播放音频的感知响度,自动做平滑增益补偿;吵的片段自动压低音量,音量偏小的片段适度放大,输出到人耳的音量维持在稳定舒适区间。增益变化采用渐变平滑调节,不会出现音量猛地跳变。

2. APP首次启动音频防护:打开短视频类应用刚要播放声音瞬间,结合麦克风采集的环境噪音。环境安静时,自动临时压低初始播放音量;环境嘈杂则维持原有音量,防止安静环境下突然爆音惊吓用户。

3. 覆盖短视频、在线剧集、本地视频等绝大多数媒体音频;通话、闹钟、提示音不受该功能影响,避免干扰。

约束条件

1. 设置独立总开关,用户可以自由开启/关闭,不强制生效;

2. 做安全上限保护,微弱音频放大有最大增益阈值,不会把噪音放大得刺耳;APP启动的临时降音量,不会改动用户保存的媒体音量档位。

3. 低电量模式下可自动降级或者关闭该功能,控制NPU功耗;

4. 音乐播放场景可以单独设置开关,部分用户听歌希望保留音源原始动态范围,可以关闭归一效果;

5. 环境音采样仅做音量判断,音频数据本地处理,不会录音保存。

预期收益

不用反复手动调音量,切换视频不会被忽大忽小的声音打扰,同时解决短视频APP刚打开瞬间爆音惊吓的问题,提升日常刷视频、观影的影音舒适度,属于贴近日常使用的细节体验优化,希望纳入音频模块预研评估。感谢工程师打磨!
睡觉呼噜噜睡  LV8  发表于 7 天前 湖北 来自:荣耀90 GT
我的影音娱乐创意围绕画质、音质、录音录像与后处理编辑、互动体验、情感共鸣五大维度展开,覆盖短视频刷看、长剧追更、直播观看、演唱会录制、手机K歌、Vlog创作等高频影音场景,打造从消费到创作全链路的极致视听体验。

一、画质:场景化动态画质引擎,不同内容匹配最优显示策略

打破目前”一档画质走天下”的模式,针对不同影音内容类型自动匹配显示参数。刷短视频时,针对快节奏剪辑内容强化画面锐度与色彩饱和度,让每一帧都清晰出彩;追长剧、看电影时,自动切换影院级色域与对比度,暗部细节保留更完整,夜景、烛光场景不再一片死黑;看体育赛事、动作大片时,动态插帧算法优先保证流畅度,高速运动画面不拖影、不模糊。

针对折叠屏设备,新增”影音分屏沉浸模式”,上半屏播放视频,下半屏同步显示弹幕、剧情简介、演员信息或商品链接,看剧的同时不用切出查资料,看直播带货可以一边看展示一边浏览商品详情。户外强光环境下,自动触发”阳光下可视增强”,在不明显增加功耗的前提下局部提亮画面关键区域,保证户外也能看清屏幕内容。

二、音质:空间音频+场景声场,耳机外放都有沉浸感

在荣耀空间音频基础上做场景化声场适配。看电影时自动切换到”影院模式”,强化环绕感和低频表现,爆炸声、雨声的方位感和距离感更真实;听音乐时根据曲风自动调节,流行歌突出人声清晰度,古典乐还原乐器空间定位,电子乐强化低频下潜;看直播时优化人声频段,主播说话更清晰,不会被背景音乐盖过。

手机外放方面,升级双扬声器的”立体声场扩展”算法,横屏看视频时左右声道分离度更高,不用戴耳机也能感受到方位感。针对蓝牙耳机,优化低延迟传输,看剧、K歌时声音和画面完全同步,不会出现口型对不上的问题。还可以加入”智能音量保护”,耳机音量突然变大(比如视频转场、广告插入)时自动平滑过渡,避免刺耳。

三、录音录像及后处理编辑:手机也能拍出专业级影音素材

录像方面,新增”演唱会专用模式”,针对大音量现场环境做音频限幅和动态压缩,录出来的歌声不会爆音、失真,同时保留现场氛围感;加入”实时人声增强”,在嘈杂环境下录制视频,自动突出画面中主体人物的说话声,过滤背景噪音。

后处理编辑上,在荣耀相册内置”一键影音精修”功能。视频剪辑支持AI自动识别精彩片段,根据音乐节奏自动卡点剪辑,生成15秒、30秒等不同时长的短视频版本;音频方面,支持一键降噪、人声增强、背景音乐自动匹配,还能添加”影院级混响””录音棚质感”等音频滤镜。针对Vlog创作者,新增”多设备素材自动同步”,手机、平板、运动相机拍摄的素材通过荣耀账号自动归集,在平板大屏上可以直接调用手机素材进行剪辑,不用反复传输文件。

四、互动:从单向观看到双向参与,增强社交属性

看剧场景加入”同步观影房”,邀请好友进入同一房间同步观看,进度条实时同步,支持语音边看边聊,还能在精彩时刻发送”表情弹幕”,异地也能一起追剧。K歌场景升级”多人合唱房”,支持跨设备实时合唱,延迟控制在可接受范围内,还能根据每个人的声线自动调整音调,让合唱更和谐。

直播互动方面,新增”多视角自由切换”,体育赛事、演唱会直播可以在主机位、特写机位、观众席视角之间自由切换,还能开启”画中画”同时看两个机位。短视频互动上,支持”AI合拍”,选择喜欢的视频片段,AI自动帮你匹配运镜和节奏,生成合拍作品,降低创作门槛。

五、情感共鸣:个性化推荐+沉浸式氛围,让影音内容更打动人心

打造”情绪影音模式”,根据用户当前心情推荐匹配的影音内容——疲惫时推荐治愈系慢综艺和轻音乐,兴奋时推荐高能动作片和摇滚歌单,难过时推荐温暖电影和抒情歌曲。还能根据观看时间自动适配,深夜看剧自动降低屏幕亮度和音量,避免影响他人。

加入”影音记忆墙”功能,自动整理用户一年中看过的电影、听过的歌、录过的视频,生成年度影音回忆报告,用数据和画面唤起情感共鸣。在重要纪念日,主动推送当年一起看过的电影、听过的歌,让影音设备成为情感记忆的载体。

整套方案从”看、听、拍、剪、玩、忆”六个环节全面升级,既满足用户日常刷短视频、追剧的基础需求,也照顾K歌、Vlog创作、演唱会录制等进阶场景,让荣耀设备真正成为装进口袋的”百万调音师+顶级影院”
数码爱好者  LV7  发表于 7 天前 江苏 来自:荣耀Magic7 Pro
AI角色音色译配,外文影视保留演员原声特征实时转中文配音

现状痛点

观看原版外语电影、剧集,一边盯着中文字幕一边看画面,眼睛来回切换,观看比较吃力。普通机器配音全部是统一机械音色,丢失演员原本的声线、情绪,代入感很差。如果下载专门译制版片源,资源又很有限。希望可以直接在播放原片的时候,生成贴合演员音色的中文配音。

脑洞构想

依托端侧AI大模型,在系统视频播放链路增加角色音色保留实时译配功能:

1. 播放外文影片时,AI自动区分画面里不同演员,提取每位演员独有的音色、情绪、说话节奏。

2. 将台词翻译成通顺自然的中文,沿用该演员原本的声线特征生成中文配音,每个角色说话依旧是自己的声音质感,只是语言变成中文,保留愤怒、欢笑、叹气等情绪细节 。

3. 提供多种混音模式:可以关闭原音只听AI中文配音;也可以原人物小声做背景,中文配音为主音;字幕依旧可以正常显示。

4. 不需要提前预处理完整视频,播放过程流式实时生成,本地视频、部分在线视频都可以生效。

约束条件

1. 独立开关,用户手动开启,不强制启用;随时切回原版声音。

2. 属于辅助娱乐工具,翻译、音色生成无法做到100%完美,复杂长句会存在误差,保留字幕作为兜底。

3. 运算消耗NPU算力,旗舰机型优先体验;低电量模式自动关闭该译配功能。

4. 版权约束:受第三方APP限制,部分流媒体APP无法调用;优先支持本地下载视频、系统播放器。

5. 不改动原视频文件,只实时处理播放音频流,不会修改本地源文件。

预期收益

看外语影视不用费力紧盯字幕,配音保留演员原本声线与情绪,大幅提升原版影视剧观看体验,拓展MagicOS AI影音能力,希望纳入AI多媒体预研评估。感谢工程师打磨!
数码爱好者  LV7  发表于 7 天前 江苏 来自:荣耀Magic7 Pro
AI歌曲音色替换,把原唱音色更换为自选音色播放歌曲

现状痛点

听歌的时候,有些歌曲旋律很喜欢,但原唱音色不是自己偏好的风格。
希望可以保留原歌曲伴奏、旋律、节奏不变,只把演唱的人声音色替换成别的音色,带来全新的听歌体验。

脑洞构想

在系统音乐播放器增加AI歌声音色替换功能,仅做本地个人娱乐使用。

1. AI首先把歌曲的人声和伴奏分离开,伴奏保持原样不动,完整保留编曲、鼓点、乐器。

2. 提取原曲人声的旋律、节奏、咬字、气息;只替换歌手的音色,音高、快慢、歌词完全不改动。

3. 用户可以选择音色库里面的声音,替换掉原歌手的人声;合成之后再和伴奏重新合并播放。

4. 两种模式:

- 实时播放模式:播放歌曲时实时转换音色,边播边处理;

- 生成本地音频模式:处理完成保存到本地,方便反复收听。
数码爱好者  LV7  发表于 7 天前 江苏 来自:荣耀Magic7 Pro
音频‑马达同步调度,跟随视频声源方位实现方位化触觉震动

现状痛点

现在视频空间音频可以把撞击、爆炸、碰撞声音分配到左右扬声器,听觉有方位感,但是触觉震动是整机统一一起震动,不分左右方位。
爆炸从画面右侧传来,声音走右扬声器,但是手机整台一起震,缺少触觉上的方位沉浸感。

脑洞构想

需要硬件基础:机身左右两颗独立线性马达(双X轴马达),单马达机型不启用该功能。
系统音频链路新增音频‑马达同步调度模块,和空间音频管线联动:

1. 播放电影、视频的时候,系统解析音频流,识别撞击、爆炸、物体碰撞这类瞬态声音事件,同时读取声音的空间方位信息(左、右、中间)。

2. 声音输出到哪一侧扬声器,对应一侧的马达就同步触发震动:

- 撞击来自画面右侧:右扬声器发声,右侧马达震动,左侧不震动/弱震动

- 撞击来自画面左侧:左扬声器发声,左侧马达震动,右侧不震动/弱震动

- 画面中间爆炸:两颗马达同时一起震动。

3. 震动的强度跟随声音响度动态变化;轻微磕碰就微弱震动;大爆炸就强震动;人声、背景音乐不会乱触发震动,系统会过滤持续人声、背景音乐,只针对撞击、击打、爆炸这类瞬态冲击音效触发马达。

通俗类比:耳朵听到哪边响,手上哪一侧就同步感受到震动,视听触觉三者方位保持统一。
数码爱好者  LV7  发表于 7 天前 江苏 来自:荣耀Magic7 Pro
马达低频发声融合扬声器协同出声,重构音频超低功耗发声架构

现状痛点

目前手机扬声器承担全频段发声,尤其是低频轰鸣、撞击、低音鼓点、爆炸震动等厚重闷声,需要扬声器振膜大幅度冲程运动,存在两个长期无法解决的短板:

1. 低频极其耗电:低音需要大振幅、大功率推动振膜,音频功耗主要浪费在低频段,长期高负载易发热、破音、失真。

2. 马达震动自带天然低频闷响被浪费:X轴线性马达震动时,机身本身会发出低沉、浑厚的低频轰鸣,和视频撞击、爆炸、重低音的音色高度重合,但目前这部分天然发声完全闲置、被当成杂音压制,没有被利用。

简单说:
手机马达本身就会产生完美的低频声音,却白白浪费;扬声器拼命高功耗硬扛低频,耗电又失真。

远期创新构想(软硬件协同新架构)

重构手机发声逻辑:高低频分工发声

- 高频、清亮、人声、乐器细节 → 由扬声器负责

- 低频轰鸣、撞击闷响、爆炸底噪、重低音 → 由马达震动带动机身主动发声替代

利用马达震动自带的天然低频音色,与扬声器音频做AI融合混音,实现「马达补低频、扬声器保中高频」的全新省电发声体系。

核心技术原理(通俗、精准、可落地)

1. 线性马达振动本身自带可利用低频声波
X轴马达谐振振动时,会带动整机壳体共振,产生20Hz–200Hz纯正低频闷声。
这个音色刚好对应:爆炸、撞击、坠落、轰鸣、重鼓点等视频最耗电的低频声道。

2. AI音频分频调度
系统对音乐、视频音轨实时分频:

- 将高功耗低频段剥离,不再让扬声器播放

- 将低频信号同步输送给马达,让马达振动发声替代该声道

- 扬声器只保留人声、中频、高频清亮细节

3. 双声源融合混音
马达发出的浑厚低频 + 扬声器清亮中高频,自然叠加融合。
听觉效果:低音更沉、更震、更立体,比纯扬声器低音质感更强。

4. 从根源大幅降低扬声器功耗
手机扬声器最耗电、最容易发热失真的就是大振幅低频冲程。
把低频发声交给马达之后:

- 扬声器振膜冲程大幅缩小

- 功放功耗显著下降

- 低音不破音、不撕裂、更浑厚
您需要登录后才可以评论 登录 | 立即注册
简体中文 - China
快速回复 返回顶部 返回列表