人工智能是当前世界最先进的科学技术,若要保证其赖以运转的大模型的研发与应用的安全性、稳定性与可控性,就必须构建与其技术样态相匹配的伦理治理体系,让技术的演化逻辑与现实样态在科学的伦理治理体系规制下发挥正向功能。国家主席习近平在2026世界人工智能大会暨人工智能全球治理高级别会议开幕式上的讲话中指出,要高度重视人工智能引发的各类内生和衍生风险,推动构建法律法规、技术监测、风险预警、应急响应体系,筑牢安全底线,防范滥用恶用,确保人工智能始终处于人类控制之下。2026年4月,我国十部门联合印发《人工智能科技伦理审查与服务办法(试行)》,首次将“增进人类福祉、尊重生命权利、坚持公平公正、合理控制风险、保持公开透明、保护隐私安全、确保可控可信”七大伦理原则纳入刚性审查要求,为人工智能大模型伦理治理工作供给了政策保障,同时从共建、共创、共享、共治等维度为人工智能的发展确立了伦理价值原则,推动人工智能不断造福人类、建成和谐共生的现代化人机协同关系。
制度设计是前提基础
我国人工智能大模型伦理治理体系建设已从“原则制定”阶段加速进入到“制度建构”阶段。
从内容上看,《人工智能科技伦理审查与服务办法(试行)》与2022年中共中央办公厅、国务院办公厅印发的《关于加强科技伦理治理的意见》形成呼应,二者皆强调了要对以人工智能为代表的先进科学技术进行严格的伦理审查和监管,从服务建设、主体规范、工作程序和监督管理等几个维度规制人工智能科技伦理审查与服务,为人工智能大模型伦理治理体系建构供给制度前提。
从制度设计维度搭建人工智能大模型伦理治理体系,核心是将制度约束贯穿人工智能大模型研发与应用全过程。搭建国际标准化交流合作平台,鼓励发展伦理审查技术创新与能力提升,为搭建人工智能大模型伦理治理体系供给服务性支持。丰富科技伦理审查和治理主体,在具有伦理主体责任的高等学校、科研机构、医疗卫生机构与企业等单位设立人工智能科技伦理委员会,通过人力资源整合和物资调配来巩固伦理治理的资源禀赋,系统地研判人工智能可能产生的科技伦理风险,培育高素养治理队伍,强化伦理治理主体力量。完善科技伦理审查工作程序,规范审查流程、明确审查原则、加大审查力度,同时进一步加强多职能部门协同监管,为科技伦理审查与治理工作提供科学指导。
在现实应用层面,要对可能引起决策偏见和意见歧视的大模型算法进行“公平性测试”,在设计和推广涉及公众利益和公共安全的人工智能大模型应用时,适时对全社会公开该大模型的“风险影响评估报告”,为降低大模型应用风险,保障大模型使用安全提供相应的制度抓手。
技术赋能是重要路径
“以技术治理技术”是当前对人工智能技术研发及应用进行有效治理的核心理念。对人工智能进行伦理治理也必须依靠技术手段,重塑治理理念、改革和创新治理方式,才能在对先进科学技术研发与应用底层逻辑予以充分理解的基础上,构建具有现实效用的治理体系并发挥治理效能。要大力支持对人工智能伦理审查工作进行技术维度的创新,包括推动高质量伦理数据开源、研发通用性风险评估工具等。
通过研发和升级对抗性训练技术,筑牢人工智能大模型伦理防线。人工智能大模型区别于面向单一场景、单一任务的专用小模型,是依托海量数据训练,具备通用感知、理解、生成、推理和交互能力的复杂模型,对人工智能技术的应用无论是内容生成、人机交互、决策生成、行业赋能抑或是软硬件智能化升级,本质上都是大模型能力的延伸与外化。因此,作为一种不断扩充语料库、有着自主学习和自我成长禀赋的开源模型,在输入内容良莠不齐的情况下极容易生成与事实不符的错误内容或做出有悖于客观规律的错误决策,并在未得到强制性干预的基础上将此类言论与决策进行演化,危害国家安全、社会安定和群众利益。基于此,可以通过积极构建对抗性样本库,涵盖极端言论、虚假信息和隐私泄露等多种伦理风险场景,并对人工智能大模型在特定领域的内容生成与人机交互过程进行持续性训练,有针对性提升大模型对不良语言和错误内容的识别和筛查。
加快推进人机协同治理机制建设。人工智能大模型伦理治理是一个复杂的系统工程,既涉及技术层面的开发与迭代革新,也涉及应用层面的伦理适配性,因此,单纯依靠技术手段难以应对现实社会错综的伦理难题,这就需要人机协同充分发挥各自优势,让从事人文社会科学研究的学者与使用技术的公众都参与到模型的伦理规则制定、风险评估和决策的过程中,为技术赋能人工智能大模型伦理治理建构需求侧价值原则,在发挥技术的效率与规模优势的同时也融入人类社会的伦理经验和价值体系,确保人工智能大模型伦理治理体系兼顾科学、理性、客观与公正的价值内涵,符合社会公序良俗和人类共同价值追求。
生态共建是发展方向
构建人工智能大模型伦理治理体系是一项超越国界的全球性工作。习近平总书记指出,在人工智能发展问题上要践行真正的多边主义,早日形成具有广泛共识的全球治理框架,让这一前沿技术更好造福人类社会。这彰显了我国在技术治理理念与技术共建共享方面的价值原则与人文胸怀。2023年10月,中央网信办发布《全球人工智能治理倡议》,倡导以人类命运共同体理念为思想引领,推动建立全球主要人工智能技术持有国家主导、兼顾世界各国利益的技术伦理治理规则。
在实践维度上,我国一方面以“标准互认+案例共享”的方式,与“一带一路”共建国家开展人工智能伦理治理的合作;另一方面,在国内构建“政府—企业—公众”协同治理的人工智能大模型伦理治理生态。政府通过不断出台人工智能技术监管和治理的相关政策来供给人工智能大模型伦理治理的制度保障;企业和科研机构依托技术监管委员会建立行业自律机制,在扩展大模型语料库、促进人工智能深度学习和自主学习的同时按照技术伦理准则的要求规范技术研发、试验和应用生成等各环节,严格研判和控制技术伦理风险;公众则通过接受主题宣传教育,自主学习应用伦理相关知识来提升新兴技术的监督能力。这种以主体协同为基础的人工智能大模型伦理治理生态充分发挥多元主体在政策制定、技术研发和共识建设等维度的作用,既为人工智能大模型的创新演化供给了驱动力,也为大模型伦理风险设置了研判与治理路径,为人工智能大模型赋能社会发展和造福人类作出应有的贡献。
(作者单位分别为江苏警官学院、江苏省公共安全研究院,淮安大学)