传音多媒体团队揽获 CVPR NTIRE 2025 两项挑战赛冠亚军,推动视频画质升级

传音多媒体团队揽获 CVPR NTIRE 2025 两项挑战赛冠亚军,推动视频画质升级

IT资讯 2025-06-25 18:11:11 6小时前

近日,在计算机视觉领域最具影响力的国际竞赛 CVPR NTIRE 2025 中,传音多媒体团队与上海交通大学图像所 MediaLab 联合团队分别斩获高效超分辨率挑战赛(NTIRE 2025 Efficient Super-Resolution Challenge)第一名,短视频 UGC 图像超分辨率挑战赛(NTIRE 2025 Short-form UGC Image Super-Resolution Challenge)第二名,展现了传音在视频画质领域的深厚积累与领先实力。

CVPR NTIRE(New Trends in Image Restoration and Enhancement)是计算机视觉顶会 CVPR (Conference on Computer Vision and Pattern Recognition) 旗下极具影响力的国际学术竞赛,素有“影像算法奥林匹克”之称。该赛事聚焦视频复原、图像增强、生成技术及质量评估等底层视觉任务,旨在推动技术突破并解决实际应用难题。今年的赛事设置了多项挑战赛,吸引了全球顶尖科研与产业队伍参与。

传音深耕非洲、南亚等新兴市场多年,始终围绕用户需求进行本地化创新。近年来数字媒体飞速发展,传音洞察到用户对智能手机图像和视频素质提出了更高的要求。据 Dataspark 的数据显示,2024 年非洲用户月均在社交、视频类 App 上花费约 52 小时,然而非洲用户观看视频在线播放网速平均不到 10M/S,观看体验较差。面对非洲等目标市场存在的网速慢、流量贵等现实问题,传音持续投入资源,与上海交通大学图像所 MediaLab 深入合作,研发轻量化、低功耗、高性能的画质增强技术,让更多用户在有限条件下也能享受高清视觉体验。

技术成果一:高效图像超分辨率中的蒸馏监督下的卷积低秩适应

在高效超分辨率挑战赛中,传音多媒体团队和上海交通大学图像所 MediaLab 提交的论文“高效图像超分辨率中的蒸馏监督下的卷积低秩适应 (Distillation-Supervised Convolutional Low-Rank Adaptation for Efficient Image Super-Resolution)”提出 DSCLoRA 技术,其借鉴大语言模型中的低秩适应并结合知识蒸馏策略,在不增加计算成本的前提下显著提升了高效超分辨率模型的性能。

多个基准数据集上的实验结果表明 DSCLoRA 在模型复杂度和性能表现之间实现了出色的均衡。在不增加模型体积和计算开销的前提下,DSCLoRA 能够大幅提升图像超分辨率效果,提升弱网环境下视频通话与流媒体播放清晰度,同时具备推理速度快、功耗低等优点。通过将该算法集成至手机影像引擎,用户在在线视频播放、视频通话、图像放大、数码变焦拍摄等场景中,均可体验更高分辨率、更锐利自然的画面。

模型架构总览

技术成果二:用于短视频 UGC 图像超分辨率的增强语义提取与引导

在短视频 UGC 图像超分辨率挑战赛中,传音多媒体团队和上海交通大学图像所 MediaLab 提交的论文“用于 UGC 图像超分辨率的增强语义提取与引导(Enhanced Semantic Extraction and Guidance for UGC Image Super Resolution)”,提出一种基于 Diffusion 的新型模型以处理短视频平台 UGC 场景下低分辨率退化图片,有助于实现更稳健、感知可信和实际适用的图像修复。

该模型通过制作特定数据集,消除现实 UGC 场景下图片退化类型和合成退化之间存在的差异。其次,通过引入语义提取模块,利用 SAM2 预训练模型提取高层次的上下文信息,协助模型进行图像重建任务。最后,针对不同的数据集进行参数微调,使模型在不同数据集上表现达到最优。

该项技术突破,将有效处理模糊、压缩、结构变形等常见失真问题,生成更自然、真实、语义一致的修复图像,极大提升用户在短视频截图、社交图片增强等场景中的视觉体验。

模型架构总览

此次联合高校团队参加国际顶级竞赛体现传音对核心技术创新的重视与投入,也为后续画质增强功能的产品化奠定坚实基础。未来,传音将加速将画质增强技术部署到旗下手机产品中,构建起一套适应新兴市场特色、兼顾性能与体验的视频增强解决方案,为更多新兴市场用户带来更为高清、流畅的视觉体验。

文章版权声明:除非注明,否则均为网络转载文章,转载或复制请以超链接形式并注明出处。

相关阅读

  • 邀请 VR 领域记者和创作者参加 WWDC,侧面表明苹果会推首款头显
  • 国际数博会在筑启幕,启明信息打造数智化浪潮新引擎
  • 就在今天,国产大飞机 C919 大型客机开启首次商业载客飞行
  • 辛巴开播引领 618 狂潮,超级品牌齐聚辛选直播间
  • 快播公司迎来最终结局,已破产注销
  • 推特打击 AI 虚假图片,将对图片添加由用户生成的事实核查信息
  • 狂欢 618,三星商城电视超值特惠季火热开启
  • 英雄索向!索泰携重磅新品及多款明星产品亮相 2023 台北电脑展
  • 三星与上海迪士尼合作影片 10 天点击量超 2.5 亿,全程由 Galaxy S23 Ultra 手机拍摄
  • 14 分钟破亿,斩获七个第一!追觅 618 开门红强势领跑行业
  • 10 万美元 / 年 / 千人:微软 Office 365 AI 助手价格曝光,比原版订阅贵 40%
  • 2.4G or 5G,Wi-Fi 频段你分清了吗
  • 吉利第 4 代帝豪 2023 冠军款车型 6 月 6 日上市
  • 618 菜鸟在香港首推次日达、晚到必赔服务,每单最高赔付 60 元
  • 工信部装备工业发展中心上线新能源汽车事故上报平台新系统(附链接)
  • 特斯拉诉车顶维权车主侵犯名誉权一案开庭,索赔 500 万元
  • 数字加密货币交易所 Coinbase 被 SEC 起诉:违反美国证券法
  • Mac 版《死亡搁浅》上线苹果 App Store:预售价 39.99 美元,最低要求 M1 芯片
  • 加州神童 14 岁大学计算机工程专业毕业,成 SpaceX 最年轻工程师
  • 助推学习手机趋势品类发展 小度与京东签署战略合作协议
  • 最新资讯

    热门资讯