人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉

2025-01-06 11:38:52 5,364次浏览

所谓的人工智能的“奇点”的到来,在很大程度上反映了人类在自己的创造物的强大性能面前的不安。如果说在前智能时代,机器技术体系在力量、复杂性、精密度方面的超越还只是局部功能的增强,不足以引起人对引以为傲的本质——思考/理性的担忧,那么生成式人工智能在知识生产、理性设计、语义逻辑乃至可以带有情绪性表达的自然语言处理方面展现出来的卓绝能力让作为创造者的人类在内心再一次感受到了新版的“机器人威胁论”——AI威胁论。对可能失去控制的担忧让设计者期待以某种方式重新赢回决定权,于是,人工智能设计和治理又一次处在更深的“恐惑谷”的悖论境地:一方面,整个人工智能的发展过程一直以类人性作为超人性的基础,从任务实现到输出方式、到理解能力都希望有明确的可解释性、与人类保持一致性,哪怕在外观的设计上也从未放弃过“人形智能机”的设想;另一方面,这种类人性和超人性发展得越好,人类自身就越恐慌,尤其当最新的生成式人工智能突破了“波兰尼困境”,在多模态知识生产上已经可以依赖网络文本数据库和大模型技术实现自我生产的时候,不但人类心理上的恐慌越发严重,治理过程中所面临的风险也更加多元化和强化。抵抗不安感的最好武器是规范性。价值对齐的目标正是以建构规范性价值倾向来实现人工智能治理。然而,这里仍然存在另一个悖论,即“算法的价值倾向性越小,其越多以功能服务模式体现为满足单一确定目标的中立性工具职能,并因此只涉及线性且结果导向的治理要求;算法价值倾向性越大,其越多以画像评价模式体现为针对不同目标进行选择排序以作出价值性评估”。可见,价值倾向度的增加在一定程度上与功能的通用性之间呈现出反向趋势。因此,到底有没有可能以规范性的总体策略解决多元化的风险,并没有肯定的答案。比起价值嵌入,尽管价值对齐的措辞稍显缓和,但它依旧遵循了以人类社会取向干预或改造人工智能技术的规范性塑造路径。对于这一方法,“既有的技术治理史表明,总体策略在现实中并非没有人坚持,事实上不少技治主义者的头脑中均带有总体主义的主观性,但结果在实践中收获的均为局部和具体的技治推进,根本没有实现过各个微小技治系统的完全统一协作。从这个意义上,可以说总体策略均以失败告终”。或者,更简单地说,算法治理的目的和结果都不是简单地价值对齐,它需要重新衡量技术实现和应用中的具体问题。因为所谓的价值对齐,并不是通过增加价值矢量和奖惩指数就可以实现的,它涉及到数据爬取和清洗、算法设计和测试,到应用场景的每一个细节,并且它和技术算力之间也不完全是正向关系。例如,“在使用RLHF(reinforcement learning with human feedback,基于人类反馈的强化学习)进行价值观对齐时,)对齐行为无形中为AI大模型的能力涌现戴上了‘紧箍咒’,)以牺牲模型能力的方式来换取价值观对齐” 。OpenAI超级对齐团队的解散就真实地反映了这种冲突的强度,团队负责人在后来发表的个人声明中一再强调由于公司将产品性能置于价值对齐之前,以至于团队获得的计算和数据资源并不足够。这说明,尽管价值对齐的结果和成效尚处于难以评估的状态,但其依赖于社会预测和强反馈以及偏好排序的控制论做法,本身就是在算力上缺乏执行的可靠基础。 人工智能日益广泛的应用,在日常生活领域悄无声息地掀起了一场革命,无数的在线服务和应用程序将处于不同地区的人类基本活动的每一个细节联系起来,不但几乎所有的社会关系被在线技术重构,而且同时伴随的还有一些关系的消亡和另一些新型关系的形成。作为数字实体运营的网络平台拥有的活跃用户数量有可能超过很多国家的人口。然而,与这种技术上的连续性形成鲜明对照的是,观点、价值、立场的多元化和冲突也更加以显性的方式得到展现,它们甚至超越了前数字时代的地缘界限。“聚集在流行网络平台上的大量用户群体比政治地理意义上的群体边界更为分散,而且网络平台运营主体的利益可能与国家利益产生分歧”。人工智能装置的出现只是在已经足够复杂的多元化和冲突之间增加了一些新的维度而已,技术的连续性从来就不是也不可能是价值一致性的形式保证。 这种二元对立与价值对齐背后的心理机制如出一辙,都体现了对智能对象的控制化叙事——无论是最初的简单工具化还是后来以辨别(《仿生人会梦见电子羊吗》)或拯救(价值对齐)的方式来重新赢回控制权的可能。菲利普·K.迪克以反讽的方式对人类的这一核心特质和潜在的优越性进行了颠覆:其一,在他的笔下,仿生人蕾切尔不但几乎通过了测试,甚至展现出对同类仿生人的移情,而这正是人类无论如何也做不到的。不仅如此,小说中的真正人类,不管是其他的仿生人追捕者,还是男主人与其妻子,彼此之间都以自身为中心,缺乏理解和关切。在两相对照下,移情作为被人普遍相信的区分特征的地位摇摇欲坠。其二,在小说的第十八章,移情共鸣箱被揭露为是一个巨大的骗局,它所表现出来的融合感以及测试量表的标准不过是一种人为的编织和表演。于是,无论是根据“移情”与否所进行的对仿生人的猎捕,还是关于“移情”本身的神话,都不过是维护人类居上位的优越感制造出来的叙事。它可以是“移情”,也可以是人类假设人工智能不具有或无视其具有(正如将智能装置设想为价值“中立”的空心体一般)的其他特质。当用这种特质对客体进行判断的时候,往往和客体的真实情形无关,而仅仅和据此做出结论的预设有关。

该文章转自 海外网 ,如有异议,请发邮件至diguowang08@163.com。 /
杰里斯女篮

杰里斯女篮

西女甲 | 2024-11-17 19:00
0
-
0

格尔尼卡女篮

格尔尼卡女篮

分析数据赛程

直播信号

赛事信息

北京时间:2024年11月17日 19:00分,西女甲【杰里斯女篮VS格尔尼卡女篮】准时开始,喜欢看西女甲比赛的朋友可以提前收藏本页面以免错过直播。还为您在本页面索引了相关西女甲直播、杰里斯女篮、格尔尼卡女篮直播的近期比赛列表以及两队历史交锋、两队最新比赛赛程。本站不参与制作、不存储,资源由热心网友提供信号源

相关标签

人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉

2025-01-06 11:38:52 3,847次浏览

所谓的人工智能的“奇点”的到来,在很大程度上反映了人类在自己的创造物的强大性能面前的不安。如果说在前智能时代,机器技术体系在力量、复杂性、精密度方面的超越还只是局部功能的增强,不足以引起人对引以为傲的本质——思考/理性的担忧,那么生成式人工智能在知识生产、理性设计、语义逻辑乃至可以带有情绪性表达的自然语言处理方面展现出来的卓绝能力让作为创造者的人类在内心再一次感受到了新版的“机器人威胁论”——AI威胁论。对可能失去控制的担忧让设计者期待以某种方式重新赢回决定权,于是,人工智能设计和治理又一次处在更深的“恐惑谷”的悖论境地:一方面,整个人工智能的发展过程一直以类人性作为超人性的基础,从任务实现到输出方式、到理解能力都希望有明确的可解释性、与人类保持一致性,哪怕在外观的设计上也从未放弃过“人形智能机”的设想;另一方面,这种类人性和超人性发展得越好,人类自身就越恐慌,尤其当最新的生成式人工智能突破了“波兰尼困境”,在多模态知识生产上已经可以依赖网络文本数据库和大模型技术实现自我生产的时候,不但人类心理上的恐慌越发严重,治理过程中所面临的风险也更加多元化和强化。抵抗不安感的最好武器是规范性。价值对齐的目标正是以建构规范性价值倾向来实现人工智能治理。然而,这里仍然存在另一个悖论,即“算法的价值倾向性越小,其越多以功能服务模式体现为满足单一确定目标的中立性工具职能,并因此只涉及线性且结果导向的治理要求;算法价值倾向性越大,其越多以画像评价模式体现为针对不同目标进行选择排序以作出价值性评估”。可见,价值倾向度的增加在一定程度上与功能的通用性之间呈现出反向趋势。因此,到底有没有可能以规范性的总体策略解决多元化的风险,并没有肯定的答案。比起价值嵌入,尽管价值对齐的措辞稍显缓和,但它依旧遵循了以人类社会取向干预或改造人工智能技术的规范性塑造路径。对于这一方法,“既有的技术治理史表明,总体策略在现实中并非没有人坚持,事实上不少技治主义者的头脑中均带有总体主义的主观性,但结果在实践中收获的均为局部和具体的技治推进,根本没有实现过各个微小技治系统的完全统一协作。从这个意义上,可以说总体策略均以失败告终”。或者,更简单地说,算法治理的目的和结果都不是简单地价值对齐,它需要重新衡量技术实现和应用中的具体问题。因为所谓的价值对齐,并不是通过增加价值矢量和奖惩指数就可以实现的,它涉及到数据爬取和清洗、算法设计和测试,到应用场景的每一个细节,并且它和技术算力之间也不完全是正向关系。例如,“在使用RLHF(reinforcement learning with human feedback,基于人类反馈的强化学习)进行价值观对齐时,)对齐行为无形中为AI大模型的能力涌现戴上了‘紧箍咒’,)以牺牲模型能力的方式来换取价值观对齐” 。OpenAI超级对齐团队的解散就真实地反映了这种冲突的强度,团队负责人在后来发表的个人声明中一再强调由于公司将产品性能置于价值对齐之前,以至于团队获得的计算和数据资源并不足够。这说明,尽管价值对齐的结果和成效尚处于难以评估的状态,但其依赖于社会预测和强反馈以及偏好排序的控制论做法,本身就是在算力上缺乏执行的可靠基础。 人工智能日益广泛的应用,在日常生活领域悄无声息地掀起了一场革命,无数的在线服务和应用程序将处于不同地区的人类基本活动的每一个细节联系起来,不但几乎所有的社会关系被在线技术重构,而且同时伴随的还有一些关系的消亡和另一些新型关系的形成。作为数字实体运营的网络平台拥有的活跃用户数量有可能超过很多国家的人口。然而,与这种技术上的连续性形成鲜明对照的是,观点、价值、立场的多元化和冲突也更加以显性的方式得到展现,它们甚至超越了前数字时代的地缘界限。“聚集在流行网络平台上的大量用户群体比政治地理意义上的群体边界更为分散,而且网络平台运营主体的利益可能与国家利益产生分歧”。人工智能装置的出现只是在已经足够复杂的多元化和冲突之间增加了一些新的维度而已,技术的连续性从来就不是也不可能是价值一致性的形式保证。 这种二元对立与价值对齐背后的心理机制如出一辙,都体现了对智能对象的控制化叙事——无论是最初的简单工具化还是后来以辨别(《仿生人会梦见电子羊吗》)或拯救(价值对齐)的方式来重新赢回控制权的可能。菲利普·K.迪克以反讽的方式对人类的这一核心特质和潜在的优越性进行了颠覆:其一,在他的笔下,仿生人蕾切尔不但几乎通过了测试,甚至展现出对同类仿生人的移情,而这正是人类无论如何也做不到的。不仅如此,小说中的真正人类,不管是其他的仿生人追捕者,还是男主人与其妻子,彼此之间都以自身为中心,缺乏理解和关切。在两相对照下,移情作为被人普遍相信的区分特征的地位摇摇欲坠。其二,在小说的第十八章,移情共鸣箱被揭露为是一个巨大的骗局,它所表现出来的融合感以及测试量表的标准不过是一种人为的编织和表演。于是,无论是根据“移情”与否所进行的对仿生人的猎捕,还是关于“移情”本身的神话,都不过是维护人类居上位的优越感制造出来的叙事。它可以是“移情”,也可以是人类假设人工智能不具有或无视其具有(正如将智能装置设想为价值“中立”的空心体一般)的其他特质。当用这种特质对客体进行判断的时候,往往和客体的真实情形无关,而仅仅和据此做出结论的预设有关。

该文章转自 海外网 ,如有异议,请发邮件至diguowang08@163.com。 人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉
人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉

人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉

「活动」首次登录送19元红包

48.24MB
版本alpha6.4.1
下载女人脱裤子让男人桶爽歪歪安装你想要的应用 更方便 更快捷 发现更多
喜欢 61%好评(74人)
评论 69
人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉截图0 人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉截图1 人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉截图2 人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉截图3 人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉截图4
详细信息
  • 软件大小: 50.41MB
  • 最后更新: 2025-01-06 11:38:52
  • 最新版本: V1.5.6
  • 文件格式: apk
  • 应用分类:ios-Android 好爽 好紧 宝贝69XXGIF
  • 使用语言: 中文
  • : 需要联网
  • 系统要求: 5.41以上
应用介绍
一,妇人色视频,潮吹乱交番号
二,免费剧烈运动扑克网站大全,西西人体44RT大胆高清张悠雨
三,宝宝坐下来自己慢慢摇网站,少妇99P
四,好爽 好紧 清纯在线观看鉴黄师,人妖操逼逼
五,别揉我胸 啊 嗯~接吻,www女自慰被 喷水直播
六,美女张开腿被操,亚洲av口交网址
七,X99AV成人免费,男人女人床上搞机网站下载
【联系我们】
客服热线:135-2881-646
加载更多
版本更新
snapshot5.2.9
淫香操逼

人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉类似软件

猜你喜欢

相关攻略
包含 饿了么 的应用集
评论
  • 人工智能价值对齐的哲学思考|价值嵌入与价值对齐:人类控制论的幻觉 8天前
    国产做受 入口竹菊
  • 国产福利导航网操骚逼 3天前
    西西人体大胆瓣开下部毛茸茸
  • 特种兵被改造成精牛的背景故事 3天前
    水嫩骚逼
  • 裸体无码AAAAAAAA观看 9天前
    太紧了夹得我的巴好爽欧美
  • 亚洲有码第11页 9天前
    在公交车上破了两个六年级小学生
  • 淫妻导航 8天前
    美女和男人靠逼
  • 操骚妇逼 7天前
    爱爱视频骚货
  • 强行扒开小受双腿进入男男 4天前
    鸡巴操穴图偷偷操
  • 国产婬妇 視频软件动漫 9天前
    国服玄策喷水瑶视频链接
  • 双乳被一左一右吃着奶 6天前
    张筱雨《渴望》78张

近5次交锋

杰里斯女篮近5场比赛

格尔尼卡女篮近5场比赛