今天是:

部门新闻

部门新闻

当前位置: 首页 >> 部门新闻 >> 正文

喜报|科研实力再突破!我校教师参与的两项成果双双入选国际顶会ACM Multimedia 2026

发布日期:2026-08-13    作者:     来源:     点击:

近日,武汉传媒学院智能科学与工程学院科研工作再传喜讯!学院教师参与完成的两项人工智能研究成果,双双被国际多媒体领域重要学术会议ACM Multimedia 2026录用。

两项成果均聚焦当前备受关注的AIGC智能创作领域,分别在AI自动故事书创作和AI多角色绘画优化上取得技术突破,充分展现了我校在人工智能与传媒创作交叉领域的科研实力。

ACM Multimedia 是国内计算机学界公认的CCF-A类会议,是国际多媒体与人工智能交叉领域具有重要影响力的学术会议之一,全球竞争激烈、录用难度极大,能成功录用,代表研究成果达到了国际认可的高水平。

成果一:AI一键做整本故事书!打造跨文化智能创作系统

此次,罗鸿苍、王钟声两位老师共同第一作者完成的论文,成功入选本次会议的演示与视频赛道。该赛道重点展示能够实际运行、具有完整功能和应用潜力的研究系统。


团队研发出一套名为BedaiaTi.ai的智能故事书创作系统,主要面向阿拉伯文化主题的数字故事创作。以往制作一本完整的原创故事书,往往需要编剧撰写故事、画师绘制插图、设计师完成排版,还需要进行语言翻译和文化内容检查,整个过程涉及多个环节,耗时较长。

BedaiaTi.ai将这些环节整合到一个智能系统中。用户只需输入故事创意、人物设定和文化主题,系统便可以自动完成故事编写、画面规划、插图生成、阿拉伯语适配和整本故事书排版。


它并不是一个只能写文字或生成单张图片的普通AI工具,而是一套能够连续完成多项创作任务的完整系统。为了让故事书顺利生成,团队重点解决了人物形象前后不一致、创作过程容易中断、任务进度难以掌握等问题,打通了从创意输入到完整数字故事书输出的自动化流程。

该成果为跨文化数字内容创作和国际文化传播提供了一种新的智能化解决方案,其技术创新性和应用价值获得了国际同行评审的认可。

成果二:解决行业痛点!让AI多人物绘画不再“画崩、串脸”

与此同时,王钟声老师以第一作者身份,联合新西兰奥克兰大学团队完成的另一项算法研究,也成功入选本次会议。

在使用AI绘画时,单独生成一个人物通常比较容易,但当同一张画面中同时出现多个角色时,AI就容易出现问题。例如,不同人物的脸部特征混在一起,衣服、发型和身份发生错位,甚至出现角色缺失。参与绘制的角色越多,生成难度往往越大。

针对这一问题,团队提出了SDO子空间冲突消解算法。通俗地说,每个角色都有一组需要重点保留的外貌和身份特征。当多个角色同时出现在画面中时,这些特征可能会互相干扰。SDO就像一名“角色协调员”,能够分析不同角色之间发生冲突的部分,并自动减少这些干扰。

通过这种方式,系统可以更好地保留每个角色各自的身份特征,减少人物串脸、特征混杂和角色错位,使多人画面更加稳定、自然和协调。

这项方法还有较强的实用性。它不需要重新训练原有角色模型,也不需要大幅改动原有AI绘画系统,可以较方便地加入现有的多角色AI绘画流程中。实验结果表明,该方法能够有效改善多角色生成效果,并在多项评价指标上优于相关对比方法。

该研究为解决AI多角色绘画中的人物混淆问题提供了新的技术思路,也可为数字插画、虚拟人物设计和影视视觉创作等应用提供支持。

深耕科创融合,赋能传媒新发展

两项研究成果同时获得国际A类学术会议录用,是我校以人工智能技术赋能传媒艺术创新的重要标志性成果。

作为特色传媒高校,我校始终重视技术与艺术的交叉融合,积极探索AIGC和数字智能技术在内容创作、文化传播、艺术设计等领域的创新应用,推动传统传媒创作方式不断升级。

未来,智能科学与工程学院将继续围绕人工智能前沿技术开展研究,推进科研成果与实际应用相结合,以科技创新助力学科建设、人才培养和数字文化产业发展。

(来源 武汉传媒学院官方微信公众号)