人工智能在多媒体技术中的应用探析

赵 健 ( 杭州海康威视数字技术股份有限公司 )

孟凡华 ( 扬州市邗江区碧水栖庭幼儿园 )

https://doi.org/10.37155/2717-5170-0806-72

Abstract

随着生成式AI与大模型技术的突破,人工智能与多媒体技术深度融合,成为推动多媒体行业转型的核 心动力。本文立足Transformer、Diffusion等核心架构,探析人工智能在图像、音频、视频及交互式多媒体中的具体应 用,剖析当前技术、应用、伦理层面的问题与挑战,提出针对性优化策略,并预判未来发展趋势,为人工智能在多媒 体领域的规范化、多元化应用提供理论参考与实践借鉴。

Keywords

人工智能;多媒体技术;应用

Full Text

PDF

References

[1]王蕴红,李萌.扩散模型底层算法演进与多媒体生成
技术研究综述[J].计算机学报,2024,47(8):172-175.
[2]刘群,陈龙.多模态大模型底层对齐算法与多媒体内
容智能生成范式[J].软件学报,2023,34(11):458-461.
[3]周明全.生成式A I在多媒体内容创作中的底
层技术与应用进展[J].计算机辅助设计与图形学学
报,2024,36(5):765-782.
[4]杨超,李锦涛.轻量化AI算法在实时多媒体生成与处
理中的应用研究[J].计算机应用研究,2023,40(9):271-277.
[5]张晗,王树徽.跨模态语义对齐底层算法缺陷与多媒
体生成质量优化策略[J].中国图象图形学报,2025,30(2):210-
223.

Copyright © 2026 赵 健,孟凡华 Creative Commons License Publishing time:2026-06-30
This work is licensed under a Creative Commons Attribution 4.0 International License