分享好友 最新资讯首页 最新资讯分类 切换频道
郑庆华:实现人机价值对齐的技术路径 | WAIC社科分论坛
2025-08-05 12:39

确保人工智能正向赋能科技向善的前提是实现人机价值对齐。对此,我有以下几点认识:

AI是一种新质生产力。我们已经进入人机混合增强智能的智能社会。AI的本质是赋能。

AI正在影响文化和文明。生成式人工智能技术可能引发文化价值、伦理、知识产权等问题的再思考,特别是由于算法偏见,可能导致语言和文化的多样性受损。

大模型正在重塑知识生产传播的格局。如果大模型背后的语料、算法、模型存在意识形态偏见,将对大模型的平权性造成极大影响。

AI正在影响人类的认知逻辑。AI已经具备知识生产和逻辑演绎的能力,正朝着如何具有意识这样的方向发展。

AI的物化力量在于拓展认知边界。AI解决了从定性到定量,从模糊到精准的难题,已成为人类认知的超级显微镜、超级望远镜和超级计算器,AI实现了知识的外化和工具化。

人机价值对齐有两方面内涵:一是AI对齐人类,其目的是创建安全、符合人类伦理的人工智能系统;二是人类对齐AI,其核心目标是确保人类负责任地使用AI。人机价值对齐面临三大技术挑战:价值的定义理解难;价值的学习推断难;价值的安全性和鲁棒性。对此,可采取以下技术路径:

路径1:基于有监督调优的价值观对齐。利用明确高质量标注数据训练大模型,让大模型学习输入文本和人类标定价值观标签之间的映射关系,强化学习让模型学习人类的价值和偏好。

路径2:基于反馈强化学习的价值观对齐。主要思路是定义一套价值观相关的奖励信号,在模型内容生成过程中,能够根据环境中获得的奖励或惩罚等反馈信号,不断调整自身策略,最终输出符合人类期望的内容。

路径3:推理阶段的价值观对齐。在模型推理阶段嵌入价值观规则和原则,以指令引导或后处理形式对模型输出进行动态调整,使得输出结果符合人类价值观标准。

(作者为同济大学党委书记、教授,中国人工智能学会副理事长)

最新文章
赤水润京华| 习酒·品酒师以智雅盛宴,敬呈北京君子
千年古城韵,一脉习酒香。7月16日至19日,习酒・品酒师北京站活动如约而至,在古都的烟火与风雅间,铺展开一场关于北京生活新范
具身智能,正在翻越三座大山
过去十几年,科技圈最不缺的就是“风口”。VR眼镜、虚拟货币区块链、元宇宙,这些概念哪个曾经不是看着前途无量,到最后却都“哑
致敬峥嵘岁月,八一慰问传递社区温情
在“八一”建军节来临之际,为弘扬拥军优属光荣传统,表达对退役军人的关怀,7月29日,姑苏区双塔街道杨枝社区组织开展八一走访
销售易14周年:14载同行以数智之力,共绘增长新篇
14年,在时间的长河中,是信任沉淀的年轮,也是无数客户与我们共同书写增长故事的旅程。2011年,销售易怀揣着“让销售更容易”的
TCL华星“屏宇宙”进阶亮相ChinaJoy2025
8月1日-4日,第二十二届中国国际数码互动娱乐展览会(下称“ChinaJoy2025”)开幕,作为为数不多硬件展商之一,TCL华星携手三星
关于警惕黄金投资领域非法金融活动的风险提示
(一)认准持牌机构。根据中国人民银行《关于黄金资产管理业务有关事项的通知》(银办发〔2018〕215号)规定,黄金资产管理业务是指银
触摸非遗 传承匠心 狮山横塘街道狮山一社区开展御窑金砖博物馆亲子研学
为弘扬中华优秀传统文化,增强文化自信,丰富青少年暑假生活,8月7日下午,狮山横塘街道狮山一社区新时代文明实践站组织辖区15组
沈阳2斤装巴拿马茅台酒瓶整套回收日常收购价在线查看
沈阳2斤装巴拿马茅台酒瓶整套回收日常收购价在线查看1、30年茅台酒瓶子回收:常年高价提供30年茅台酒瓶子、30年贵州茅台酒瓶、30
离家3年不见父母,这个老兵这样劝
东新分局茅店派出所社区民警舒德强1995年入伍2018年转业这位从陆军工程大学军械士官学校转业的老兵现已在警营里坚守了7年从穿军
腾讯又上一层楼?连续两年狂增后,瓦手暑期压轴登场!
昨晚(8月3日),在上海复星艺术中心举办的发布会上,《无畏契约:源能行动》官宣定档8月19日,一下点燃了国内射击玩家圈子。原
推荐文章