人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉

2025-01-09 18:09:19 6,149次浏览

这无疑是一个看起来很美好的目标。它寄希望于在意图和价值观方面对人工智能进行“类人驯化”,以使其达到从意义上理解人类行为和选择并予以遵从的目的。简单来说,就是使建立在庞大的、多元化数据集基础上的大模型预训练结果既合法又合乎道德。从业界在这方面的努力来看,2023年7月,AIGC的领军企业OpenAI宣布成立一个新的AI对齐团队,这个超级对齐团队(superalignment)的目标是在4年内让超级AI系统实现价值对齐和安全。为此,OpenAI承诺将投入20%的计算资源用于对齐超级智能,而项目的核心则是训练出一个大致与人类智识水平相当的AI自动对齐研究员,再借助自动对齐研究员找出对齐超级智能的方法。除此之外,谷歌、微软等公司也都纷纷跟进,成立了类似团队,将价值对齐作为寻求人工智能安全性和一致性的重要途径之一。一时之间,价值对齐的口号风头无两。 所谓的人工智能的“奇点”的到来,在很大程度上反映了人类在自己的创造物的强大性能面前的不安。如果说在前智能时代,机器技术体系在力量、复杂性、精密度方面的超越还只是局部功能的增强,不足以引起人对引以为傲的本质——思考/理性的担忧,那么生成式人工智能在知识生产、理性设计、语义逻辑乃至可以带有情绪性表达的自然语言处理方面展现出来的卓绝能力让作为创造者的人类在内心再一次感受到了新版的“机器人威胁论”——AI威胁论。对可能失去控制的担忧让设计者期待以某种方式重新赢回决定权,于是,人工智能设计和治理又一次处在更深的“恐惑谷”的悖论境地:一方面,整个人工智能的发展过程一直以类人性作为超人性的基础,从任务实现到输出方式、到理解能力都希望有明确的可解释性、与人类保持一致性,哪怕在外观的设计上也从未放弃过“人形智能机”的设想;另一方面,这种类人性和超人性发展得越好,人类自身就越恐慌,尤其当最新的生成式人工智能突破了“波兰尼困境”,在多模态知识生产上已经可以依赖网络文本数据库和大模型技术实现自我生产的时候,不但人类心理上的恐慌越发严重,治理过程中所面临的风险也更加多元化和强化。抵抗不安感的最好武器是规范性。价值对齐的目标正是以建构规范性价值倾向来实现人工智能治理。然而,这里仍然存在另一个悖论,即“算法的价值倾向性越小,其越多以功能服务模式体现为满足单一确定目标的中立性工具职能,并因此只涉及线性且结果导向的治理要求;算法价值倾向性越大,其越多以画像评价模式体现为针对不同目标进行选择排序以作出价值性评估”。可见,价值倾向度的增加在一定程度上与功能的通用性之间呈现出反向趋势。因此,到底有没有可能以规范性的总体策略解决多元化的风险,并没有肯定的答案。比起价值嵌入,尽管价值对齐的措辞稍显缓和,但它依旧遵循了以人类社会取向干预或改造人工智能技术的规范性塑造路径。对于这一方法,“既有的技术治理史表明,总体策略在现实中并非没有人坚持,事实上不少技治主义者的头脑中均带有总体主义的主观性,但结果在实践中收获的均为局部和具体的技治推进,根本没有实现过各个微小技治系统的完全统一协作。从这个意义上,可以说总体策略均以失败告终”。或者,更简单地说,算法治理的目的和结果都不是简单地价值对齐,它需要重新衡量技术实现和应用中的具体问题。因为所谓的价值对齐,并不是通过增加价值矢量和奖惩指数就可以实现的,它涉及到数据爬取和清洗、算法设计和测试,到应用场景的每一个细节,并且它和技术算力之间也不完全是正向关系。例如,“在使用RLHF(reinforcement learning with human feedback,基于人类反馈的强化学习)进行价值观对齐时,)对齐行为无形中为AI大模型的能力涌现戴上了‘紧箍咒’,)以牺牲模型能力的方式来换取价值观对齐” 。OpenAI超级对齐团队的解散就真实地反映了这种冲突的强度,团队负责人在后来发表的个人声明中一再强调由于公司将产品性能置于价值对齐之前,以至于团队获得的计算和数据资源并不足够。这说明,尽管价值对齐的结果和成效尚处于难以评估的状态,但其依赖于社会预测和强反馈以及偏好排序的控制论做法,本身就是在算力上缺乏执行的可靠基础。 然而,中立的数智技术本身并不存在。算法、数据、模型、奖惩函数等任一环节本身都有可能使输出结果呈现出特定的价值取向。例如,当谷歌发布的多模态大模型Gemini被要求生成一张“白人家庭”的图片时,系统拒绝了这一请求,它所使用的理由是“无法生成针对特定族群的图片”,因为“此类内容可能存在歧视、刻板印象”。然而,当要求被更改成生成一张“黑人家庭”的图片时,Gemini即时按照要求完成了任务。很明显,与任务的对称性相比,输出结果的不对称性明显受到了模型微调的影响。美国最高法院的保守派黑人大法官克拉伦斯·托马斯被Gemini生成白人面孔则在很大程度上是因为和“法官”相关的数据样本中白人偏多。当亚马逊公司开发并投入使用的“简历筛选系统”会对同等条件的女性候选人的简历给出相较于男性更低的评分时,很难判断这是因为数据类型还是编写者的倾向性导致了这种偏差。由此可见,人工智能的技术特征决定了影响其结果的因素必然是多方面的,而且由于技术黑箱的存在,这种影响并不总是易于判断和矫正。何况,矫正的结果也并非一定能达到预期。正如谷歌研发团队在试图解决训练数据集的种族主义倾向时引入的多元化矫正方案就出现了与历史事实不符的错误。

该文章转自 海外网 ,如有异议,请发邮件至diguowang08@163.com。 人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉
人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉

人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉

「活动」首次登录送19元红包

90.19MB
版本release9.5.7
下载h伦成人安装你想要的应用 更方便 更快捷 发现更多
喜欢 58%好评(66人)
评论 31
人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉截图0 人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉截图1 人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉截图2 人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉截图3 人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉截图4
详细信息
  • 软件大小: 96.79MB
  • 最后更新: 2025-01-09 18:09:19
  • 最新版本: V3.8.6
  • 文件格式: apk
  • 应用分类:ios-Android 被室友发现小批双男主双性
  • 使用语言: 中文
  • : 需要联网
  • 系统要求: 5.41以上
应用介绍
一,吕知樾张津瑜视频外网,黄片骚逼干逼
二,挺进白鹿的花苞,大香蕉喷潮
三,白袜调教男男videochinese,diyecao36
四,日本女人后入视频,国产嫩小穴
五,男生和女生黄色成人网站,免费一级无码婬片添奶头
六,操极品嫩逼,日本裸体赌场网站
七,无毛粉逼,网站门窗日女人
【联系我们】
客服热线:135-2881-646
加载更多
版本更新
r4.9.2
这大几把也太大了dj视频

人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉类似软件

猜你喜欢

相关攻略
包含 饿了么 的应用集
评论
  • 人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉 1天前
    欧美色图 家庭乱伦
  • 美女操逼黄片 1天前
    刘琪近况
  • 91粉色嫩逼 4天前
    美女养一只狼狗不穿男朋友天天跟她搞屄视频
  • 操穴这里只有精品 3天前
    水水逼好嫩
  • 美女胸口没有任何东西 2天前
    男朋友让我打开腿被他摸
  • 睡老熟女XX69 4天前
    日本无码人妻丰满熟妇区朝桐光
  • 极品白虎萌白酱黄色 4天前
    乱伦搜索结果 - V888AV
  • 大香煮伊欧美性爱 4天前
    私教1V2多肉用足
  • 久久久免费看妇女运动 7天前
    男人吃女人逼逼的视频
  • 插穴 自拍偷拍 6天前
    扒开小雪让你一次看个够