
文艺新声
Journal of New Voices in Arts and Literature
- 主办单位:未來中國國際出版集團有限公司
- ISSN:3079-3602(P)
- ISSN:3080-0889(O)
- 期刊分类:文学艺术
- 出版周期:月刊
- 投稿量:1
- 浏览量:1158
相关文章
暂无数据
新质生产力视域下AIGC赋能高校声音景观研究
Research on AIGC-Enabled Soundscape Studies in Higher Education Institutions from the Perspective of New Quality Productive Forces
引言
当前我国高校文化传播仍以视觉呈现为主,多感官交互与沉浸式体验的应用相对不足。这种以视觉为核心的传播方式在一定程度上限制了文化记忆的深层建构,也不利于受众形成稳定的情感认同。作为融合空间感知、情绪体验与文化记忆的重要媒介,声音景观在高校文化传播中的价值尚未得到充分挖掘。
在生成式人工智能(AIGC)、云计算与大数据等技术快速发展的背景下,文化生产与传播方式正在发生转变,呈现出数据驱动与平台化发展的趋势。基于此,本文以中国传媒大学建校70周年为研究情境,尝试将声音景观理论、AIGC技术与云端交互平台相结合,探索高校文化数字化传播的新路径。研究重点回应传统传播方式单一、校史资源利用效率不高以及智能化应用场景不足等现实问题,并在实践中构建具有一定推广价值的应用模式。
一、理论基础与文献综述
(一)声音景观理论与高校文化价值
“声音景观”(Soundscape)概念由R. Murray Schafer于1977年提出,解释了人在某个环境里对听觉环境的感知、认知以及意义的形成过程。校园文化是由自然音效、生活化噪音、教学活动音质、文化仪式性声音等众多元素构成的,它通过唤醒记忆、引发情绪、辨别空间、认同文化等作用,具有非常独特文化内涵与教育意义。经研究得知,和视觉符号相比,听觉信息更易引起深刻的情感记忆,对高校历史传承以及校友个体身份认同的建构起了重要的影响。目前学界对于听觉传播的研究还处在初级阶段,这样的研究空白一方面制约了高校文化传播效果的进一步扩大,另一方面也影响了相关领域理论体系的建立。
(二)新质生产力与文化数字化逻辑
新质生产力依靠科技创新,把数据当作主要的生产要素,通过平台化、生态化、智能化的方式来重新塑造新型的生产关系,在文化上引发了生产方式、资源配置、传播方式的全方位变革。在此阶段,文化产业创作由原来的单线制的手工制作发展成现在的机器加人力的新型创作模式,使文化产品从原来的静态变成动态,从单向的传播变成多主体间的相互作用,从而极大地提高了文化产品的创新速度和市场竞争力。本研究以新质生产力理论为立足点,把技术赋能、数据驱动、平台优化、跨媒体融合、成果转化等重要的实践要素整合在一起,给高校开展文化数字化转型赋予了系统的理论支撑和可以执行的途径。
(三)AIGC与声景融合研究现状
虽然AIGC技术已经被用来生成图像、创造文字、合成乐曲等诸多方面,但是它还不足以对营造声音景观、建构空间历史叙述、推动历史与文学的多维跨界等等产生显著效果。国内一些高校已经在虚拟现实校园导览和数字档案资源管理方面做了初步的探索,但是目前的项目大多只注重展示的功能,缺少平台化架构、交互式体验以及商业化运作的整合;与之相比,“城市记忆”等国际声学艺术项目更加重视生态环境保护和文化价值的表达,在高校校史教育领域中的深度合作和创新应用模式还没有形成。本文试图创建起“依靠AIGC造声音的环境营造、云端服务的历史文化教育培训平台”这一项,努力冲破传统框架的束缚,把学术研究变成实践应用。
(四)政策与市场双重驱动
国家层面有“十四五”数字经济规划、“全面加强和改进新时代学校美育工作”、“国家文化数字化战略”等重要的顶层设计文件相继发布,就沉浸式体验、虚拟展示、数字化文创产品开发、文化遗产数字化保护等进行了重点聚焦,为它的创新发展指明了方向并给予了制度上的保证。就市场而言,以Z世代为代表的新消费群体对于互动化、定制化、多感官体验的文化消费模式有明显的倾向性,它推动着文化产业朝着数字化的方向发展,并给声景云平台的创建和使用赋予了更多的可能性。
二、研究设计与技术路线
(一)研究目标
本研究主要达到以下四点目的,创建起高校声景的标准数据和评价体系,创建起时间、空间、听觉一体的交互式云平台,用人工智能图像生成技术开展视听融合的跨媒体叙事设计工作,探寻普适的高校文化数字化转型路径,给予相似项目以可参照的实践案例和理论参照。
(二)研究内容
本研究建立起来的系统框架有七个方面,分别是校园声景数据收集与知识库创建、声景评价模型开发和用户需求分析、利用AIGC技术进行图像生产与个性化内容生成、五层分布式平台架构的设计和改进、多终端兼容方案以及交互性能优化、商业模式革新和文创生态打造、研究成果的社交传播和社会价值转化。该体系的创建目的在于使学术研究可以有效地转化为实践活动并且加以发展。
(三)技术路线
本文创建起一种四层次递进式的技能操作计划。从数据层面来说,依靠声景采集,降噪,元数据规范化整理,多源数据库创建等一系列工作来改善数据集品质和完备程度。从技术层面来讲,使用GAN、前端的JavaScript框架、后端的Python脚本开发以及云服务部署等主要手段,来实现系统的各项功能。平台方面按照五维交互的框架(时空映射模块、音效感知引擎、创意生成引擎、文化产品展示区)来搭建起完整的系统。从应用角度来说,根据校园场景推广、跨校联合项目合作、城市文旅融合应用等方式推进研究成果的转化和应用,使研究成果得到最大的社会价值,并且达到最好的社会效益。
三、高校声音景观云平台构建逻辑与核心要素
(一)构建原则
本工程主要从五个方面来确定实践路径,即以文化为根本原则,在传承和展示上体现教育价值,保持校园面貌的历史痕迹;坚持技术适配性原则,在满足技术性能、经济成本和操作便利性的基础上,选择成熟可靠的先进技术支持手段;在平台生态化策略下,把展示、互动、文创开发、文化传播等各方面结合起来;采用可复制的设计思维,用标准化流程和规范化的文档保证经验向相似场景的快速迁移和广泛运用。
(二)核心要素
音频获取模块是在教学区域、生活空间、文化景观等一共超过20个典型地点做分时段、分阶段录音采样的工作。通过声源属性、音量分布、情感表达特征、环境音效舒适性四个方面数据分析,加上校内外师生、校友的问卷调查结果来创建理想化声景数据库,给平台内容创作提供科学的依据和实证的支持。
多维度交互体系,从年度时间序列、校园地理位置、声效元素这三种角度出发创建起“时空+音效”三重融合的框架,并以此为基础对历史校园进行动态重现和沉浸式的呈现,促使各个年龄段的校友产生情感的联系并加强记忆的归属。
跨模态生成技术在校园场景中新的应用就是依靠Midjourney和Stable Diffusion的结合来完成校园环境与艺术风格的有机结合。该系统利用用户自拍影像,产生个性化的数字合影或者漫画形式的明信片,通过嵌入音频二维码创建交互式的多媒介叙事结构来加强用户的情感共鸣。
五级交互体系框架的建立是为了创建起一个多层次的页面互动结构。一级界面是首页,包括年份选择、广告、校歌播放、功能导航等模块;二级界面以历史或者现状的校园地图可视化展示为主,可以实现年份切换和定位点的选择;三级界面主要是对地点图文信息进行具体的展示,语音场景同步播放也在这里完成;第四级是口述历史故事内容解析的展现与交互选项的设置,第五级才是实景声音景观的实际体验入口,并且能为用户进行个性化定制服务。该系统依靠明显的层次架构以及条理清楚的交互流程得以支撑。
盈利机制和生态体系的建立,即把文创商品交易、以AI为手段的个性化的合影和明信片设计、互动娱乐服务、品牌广告推广、高校间的合作授权等多条盈利路径纳入到体系中,从而创建起一个能够给社会和经济带来双重效益的良性循环系统,保证平台可以长期稳定地运转并不断改进自身机能。
四、AIGC赋能声景云平台的实现机制
(一)生产机制:从人工到人机协同
人工智能生成技术(AIGC)的运用促使校园文化生产模式由原来的线下化走向线上化、由传统的有形向无形的转变。本技术用自动处理的方式对图像资源进行处理,进而完成个性化的文创产品批量生产,大大缩减了内容制作的成本,提高了生产效率。该种人机协同创作的新范式是依靠技术创新、文化传播、创意设计等诸多方面展开的,在这个新范式的构建过程中体现出了依托技术革新产生的新质生产力的主要表现形式。
(二)数据机制:从零散到资产化
本文主要针对校园音频录制的多种类型、学生的兴趣喜好和平台互动日志这些多元化的非结构化数据展开研究,力求把这些数据转换成有实际应用价值的数据资产,促使文化资源由静态保存转变为动态革新并加以有效利用的过程得以实现。突出数据是重要生产要素的关键功能特征,给内容生产优化、个性服务的设计和战略决策的作出给予科学研究和技术支持。
(三)传播机制:从单向到沉浸式共创
基于云计算架构搭建的交互平台冲破了传统文化流传里一直存在的单向灌输状况。此平台凭借引导用户全面沉浸于听觉感知、视觉体验、互动娱乐、内容创设及知识交流等诸多场景之中,塑造起一种“传达—反馈—再创造—二次流传”运转链条。该种创新性运作模式大大加强了用户的文化认同感,又提升了内容的传播效率,给沉浸式与互动化文化传播开拓了新途径,提出了新的理论依据。
(四)商业模式:从公益到可持续运营
依托轻量化云计算技术所创建的多元盈利模式,试图在文化公益价值同商业可持续发展这两者之间找到契合点,依靠系统的办法来突破高校文化项目对传统财政资源的过度依赖难题。此模式注重改善资金链的经营管理效率以及闭环运作状况,促使平台达成长久稳定的运转并且推进业务朝着可持续发展路径迈进。
五、项目实施与阶段性成果
(一)整体进展
截至目前,项目整体进度约为70%,较原计划周期有所延长。当前阶段已基本完成核心技术模块的初步搭建,主要成果包括:校园声音景观数据库的构建、云端服务平台的基础开发,以及基于AIGC技术的图像生成与处理模块的实现。同时,围绕平台传播效果开展了初步的用户体验收集与分析工作,逐步形成了集“数据采集—内容生成—平台呈现—传播反馈”于一体的技术应用框架。现阶段项目正处于技术整合向应用转化过渡的关键阶段。
(二)声音景观数据库建设
在声音数据采集方面,项目选取校园内20余个具有代表性的空间节点开展实地调研与录音工作,共收集并整理声学样本200余份。在此基础上,围绕声源类型、响度分布、情绪感知以及听觉体验等维度,对校园声景进行分类与分析,逐步建立起较为系统的声音数据结构。
同时,结合面向在校师生及校友的问卷调查结果,对不同声音类型的记忆关联与偏好特征进行了归纳整理。在此基础上,初步构建了包含“声学特征—情感感知—记忆关联”多维信息的声音景观数据库,为后续声景优化设计与内容呈现提供了基础支撑。
(三)AIGC 图像生成与交互研发
在视觉呈现方面,项目基于Midjourney与Stable Diffusion等生成模型开展图像生成实验,探索AIGC技术在校园文化表达中的应用路径。研究重点在于将用户上传的个人图像与特定校园场景进行融合处理,从而生成具有个性化特征的视觉内容。
目前已实现的功能包括:用户自定义图像与指定校园地点的融合生成,以及基于漫画风格的数字明信片输出。与此同时,结合二维码技术,将音频与视频内容嵌入图像载体之中,实现“视觉—听觉”联动的内容呈现形式,初步形成跨媒介叙事结构,并在不同使用场景中开展了功能测试与应用验证。
(四)云平台系统开发
在平台开发方面,项目基于五级页面结构完成了网站基础框架的设计与实现。系统已集成音频播放、地图展示及基本交互功能,实现了时间维度(校史信息)、空间维度(地理位置)与声音维度(环境音效)的初步整合。
此外,平台引入IP形象“传传”作为导览载体,通过角色引导的方式优化用户浏览路径,在一定程度上提升了平台的趣味性与沉浸体验。目前系统已具备基础运行能力,为后续功能扩展与内容完善提供了技术基础。
(五)传播与用户验证
在传播与测试阶段,项目通过校园场景的线下展示与小范围试用,收集了初步的用户反馈信息。从已有反馈来看,用户对融合声音播放、地理信息标注及交互功能的综合呈现形式表现出较高的兴趣,尤其是在声音引发情感共鸣方面,获得了较为积极的评价。
相关结果表明,该项目在用户认知与情感层面具备一定的连接能力,对于在校学生及校友群体具有潜在吸引力。同时,也反映出基于声音景观的文化表达方式在传播层面具有一定的延展空间。
六、创新点与研究价值
(一)创新点
本文取得诸多创新性成果,主要是创建起校园声景数字化系统的框架模型,并搭建起一个标准的声音景观数据库,利用可视化的方式对音空间关系加以解析,采用跨媒介叙事手段把音频,影像,文本和历史材料融合起来形成文化阐释体系,引入生成式人工智能(AIGC) 技术来打造图像自动生成,场景融合改良以及交互式文化内容创作的技术支撑体系,依靠云平台创建起多层次互动生态,探寻文创产品同沉浸式体验相融合的经营途径,为可持续发展赋予新思路,从理论上探究新技术推动文化数字化转变的机制以及它的潜力。
(二)研究价值
本文站在文化角度上,利用数字化技术对校园历史声景展开系统的采集与创造性转化工作,从而促使校史文化实现动态的传承以及可持续发展目的。从技术创新角度出发,以AIGC(生成对抗网络)为代表前沿技术的运用,为跨学科资源整合以及文化领域里的技术革新给出具体的范例。具有一定的教育性,符合美育和人文素质的培养要求,加强师生文化认同、情感联系。就社会角度而言,它既推进了高等教育文化资源的数字化转型,也对城市更新、乡愁记忆保存起到积极的作用,并且借助创建声音经济生态以及数字文创平台,促使文旅融合走向高质量发展的新阶段。这些综合维度一起表现出了本研究的社会学价值和发展潜力。
七、难点与应对策略
声学数据的采集以及规范化处理存在着明显的挑战。有必要建立系统的声学数据采集规范,对文件格式、时长、采样参数等重要指标作出规定,建立统一的数据质量检验标准,建立统一的标签体系和分类结构,提高数据质量以及其在实际应用中的价值。
AIGC对于内容风格一致性以及产生出的稳定质量没有保障。为了更好的解决问题,需要建立校园场景专用低秩近似LoRA模型。
改善网页多媒体数据加载效率和交互性能的方法有三个方面的内容,即用压缩算法优化音视频及图像资源,改进接口响应逻辑,改进渲染算法等,从而使网页的加载时延得到大大减少;并且同时开始前端代码模块化以及跨终端适配性重构的任务。
文化核心价值同经济利益之间存在怎样的关系,怎样做到两者之间的平衡问题,还须进一步加以研究。在坚持文化本体定位的基础上,通过开发轻量化的文创产品并加入适度的商业运作来达到两者协调统一的目的,在保持公益属性的基础上推进可持续发展的进程。
版权保护同网络信息安全存在着潜在的矛盾之处,必须明确音视频以及肖像权的授权边界,提高平台的数据安全监管水平和对个人隐私保护的程度。必须创建完善的风险防控机制,来加强防御的整体效果。
八、未来发展与推广规划
(一)近期规划
目前主要的工作就是全面优化云平台的功能模块,升级小程序到最新的版本,重点提高AIGC图像生成技术性能的改进,开始测试版系统部署工作,同时展开用户调研和需求分析工作,对文创商品的展示与交互体验做更精细的设计,撰写学术论文和专业研究报告,申请软件著作权和相关专利,为项目最后的验收和评价打下良好基础。
(二)中期规划
中期发展目标有如下主要要素:1.完成云平台的部署工作,即完成中国传媒大学官方网站、校友系统以及校史馆数字化平台的搭建,并且依靠学校融媒体资源扩大用户的范围;2.改善文创商城的功能模块以及界面交互的设计质量,明显改善用户使用的感受;3.采取多种多样的多媒体内容创作技术,借助于校园内外的网络媒体以及主流传播途径全方位地宣传项目,从而提升项目的社会认知度和社会影响力。
(三)远期规划
该战略方案主要从两方面入手,第一,在校际合作层面创建起标准化的创建体系,并且促使高校声景联盟产生,助力高校进行文化数字化转型;第二,在城市规划实践上依靠政企协同机制,对历史文化街区、老城区开展特色声音地图创建活动,利用前沿科技保护并传承地域文化遗产。致力于解决虚拟现实(VR)、三维音效、实时定位等技术方面的重大难题,探索出在平台功能扩展上新的应用途径,大幅度改善用户置身感和综合服务水平。
九、结论
本文从新质生产力理论的角度出发,把人工智能生成技术(AIGC)和声音景观分析方法结合起来,利用云计算平台建立创新性的高校文化场所数字化传播体系。该体系冲破传统文化流传视觉居多,交互单薄,记忆效果差的主观制约。经过声音采样处理、数据资源管理、AIGC内容创作和多层级互动平台的建立,引入用户共创机制,对校史文化进行数字化还原和沉浸式展示,产生有学术价值和应用前景的研究成果和典型经验。声景、AI生成、云端共享这三个交叉学科的学术研究还处于起步阶段,在没有相关研究的基础上为实践提供了一个参考。未来成果将被运用到全国各个高校以及城市文化旅游之中,用声音媒介加强历史文化记忆同空间感知之间的联系,推动文化遗产在数字时代进行传承革新,推进高等教育信息化建设以及文化遗产保护工作共同发展。
参考文献:
- [1] 中共中央办公厅,国务院办公厅.关于全面加强和改进新时代学校美育工作的意见 [Z].2020-10-15.
- [2] 国家“十四五”数字经济发展规划 [Z].2022-03-25.
- [3] Schafer R M. The Tuning of the World [M]. New York: Knopf,1977.
- [4] 李洋红琳.基于声音可视化的跨模态听音训练研究 [R]. 中国传媒大学,2023.
- [5] 郑志亮.文本、地方、仪式:数字出版中的声音景观 [J]. 出版发行研究,2024(05):45-51.
- [6] 蔡碧湾,齐宏.基于中轴线文化传播的地铁空间声音景观构建研究 [J]. 科技传播,2025(17):31-36.
- [7] 国家网信办等七部门.生成式人工智能服务管理暂行办法 [Z].2023-07-13.
