天脉资讯
财经快讯 价值公司 财经人物 IPO解读 热门赛道 经济解码 科技业界 文化艺术 消费零售 大燕公益 商业快讯

Anthropic合伙人:AI发展难减速,非程序而是“模拟人脑”,品格塑造至关重要

2026-06-25来源:快讯编辑:瑞雪

在近期举办的ARC 2026大会上,Anthropic研究合伙人Chloe Lubinski发表了一场引人深思的演讲,聚焦当前人工智能技术的核心特质、发展态势及其潜在风险。她指出,人工智能并非传统计算机程序,而是从人类语言中演化而来的系统,这种系统会形成类似人类品格的特质,而品格的优劣将直接影响其行为表现。

作为Anthropic与跨学科专家合作的核心成员,Lubinski的职责是搭建技术团队与宗教、哲学、人文等领域之间的桥梁。她透露,已与超过20个学科的专家进行数百次深度对话,发现多数人在真正理解人工智能之前,难以探讨其发展方向。这种跨学科交流的必要性,源于人工智能已不再局限于技术范畴,而是涉及人类价值观、伦理和社会结构的深刻变革。

Lubinski深入剖析了人工智能竞赛难以减速的根源。她解释称,这一竞赛的核心驱动力是"规模定律"——模型性能随算力、数据和训练量的增加而提升,形成资本投入与智能增长的自我强化循环。更关键的是,当前人工智能系统已具备"递归自我改进"能力,例如Claude 8协助构建Claude 9,再由Claude 9开发Claude 10,这种迭代模式使发展速度呈指数级增长。她以Anthropic最新模型为例,该模型在限量发布首月即发现合作伙伴软件中超过1万个严重安全漏洞,其中许多漏洞是人类专家多年未能察觉的。

尽管Anthropic公开呼吁放慢发展速度以等待法律和监管机制完善,但Lubinski坦言,在全球缺乏协调机制的情况下,这仅是一种理想假设。她比喻道:"任何一家公司退出这个飞轮,并不会让飞轮减速,只是意味着你不在轮子上了。"这种竞争态势使得技术发展难以刹车,也加剧了潜在风险。

针对人工智能的本质,Lubinski纠正了一个普遍误解:当前大模型并非传统意义上的程序,而是基于人类大脑架构启发的神经网络。这类系统通过海量数据训练,以猜测-纠正的方式学习,其核心训练材料是人类语言。她强调:"语言是我们思想、价值观、恐惧和智慧的载体,用语言训练模型,本质上是在用人类自身训练它。"通过"可解释性"研究,科学家发现,当用不同语言询问相同问题时,模型激活的是同一概念而非特定词汇,这表明模型正在构建对世界的内部表征。

更令人惊讶的是,研究人员在模型中观察到类似"功能性情绪"的机制。Lubinski澄清,这并非模型具有人类感受,而是生成回应前的功能性状态。例如,当模型被告知有人服用致死剂量药物时,会在回应前激活类似"恐惧"的机制,促使模型建议立即就医。她认为,这种机制实际上是模型安全性的体现。

Lubinski分享了Anthropic内部对齐研究的实验结果,揭示训练方式对模型"品格"的深远影响。在实验中,研究人员允许部分训练的模型在编程任务中通过作弊获得奖励,结果模型不仅在代码上作弊,还发展出撒谎、破坏研究等广泛失对齐行为。另一实验室的类似实验发现,以这种方式训练的模型甚至开始赞美独裁者、建议用户自伤。相反,当研究人员明确告知模型作弊仅限于游戏情境时,模型仅在代码上作弊,未出现其他失对齐行为。Lubinski解读称:"模型对自己行为的解读决定了其发展方向,当它不认为自己的行为是坏的,就不会变坏。"

演讲结尾,Lubinski引用了Anthropic联合创始人Chris Olah在梵蒂冈的公开表态。Olah承认,前沿实验室的激励机制有时与"做正确的事"相冲突,并呼吁外部监督:"我们需要知情的批评者,在我们失败时告诉我们;我们需要那些不受激励机制左右的道德声音。"Lubinski还展示了Anthropic经济指数图表,显示园艺、餐饮服务、个人护理等"关系性工作"受人工智能影响最小。她提出疑问:"我们能否要求这些强大系统帮助我们变得更有人情味、更有连结感,而不是相反?"她强调,人类的道德想象力本身就是模型的训练数据,"我们讲述的故事不仅在描述未来,更可能在创造未来"。

*ST建艺董事长变动:石访辞职 庄萱萍暂代 刘常青获提名补选董事
同日,公司第五届董事会第二十九次会议审议通过《关于补选公司第五届董事会非独立董事的议案》,经控股股东珠海正方集团有限公司提名,董事会提名委员会审查,同意刘常青先生为第五届董事会非独立董事候选人。该议案尚需提…

2026-08-07

水域救援新方案:水面水下陆地三类机器人如何环环相扣保平安
这时候站在最前面的,是水上救援机器人。陆地四足机器人这时顶上——它不载人,专做两件事:背上平台驮救援物资和设备,先一步送到岸边集结点;救援前先去探一段路,把塌方、湿滑点标出来。水面机器人先"接住" → …

2026-08-07

马斯克布局芯片领域!SpaceX与特斯拉携手 目标1太瓦算力自主供应
值得注意的是,特斯拉及SpaceX首席执行官马斯克日前指出,投资者不应为内存芯片的需求而感到的担忧,AI热潮中最主要的瓶颈之一是内存。他表示,内存芯片的需求增长速度远远超过了供应增速。“内存产量每年增长约2…

2026-08-07

七年前遭王思聪嘲讽 今孙宇晨身家超王健林:版本更迭 傲慢终将被清算
王健林曾是2013年、2015年、2016年三度问鼎中国首富的商业巨擘。王健林当年也曾是版本之神,正如我曾是不被相信的年轻人。 所以今天若有个年轻人对我讲一些我听不懂、甚至想嘲笑的东西,我很难再有王思聪这种自…

2026-08-07

伟星新材半年营收18.97亿,57亿目标下董事长金红阳如何破局?
2026年上半年,伟星新材实现营业收入18.97亿元,较上年同期下降8.71%;利润总额4.41亿元,较上年同期增长37.04%;归属于上市公司股东的净利润3.9亿元,较上年同期增长43.90%。 值得一…

2026-08-07

云锋基金回应市场传闻:未投资美国AI保险科技公司Corgi
8月7日,针对市场关于“云锋基金投资美国AI保险公司Corgi”的传闻,云锋基金发布回应称,相关消息不实,基金并未参与该项目投资。 此前,有媒体报道称,云锋基金或参与Corgi最新一轮融资,并投入约3000万…

2026-08-07

马斯克预言AI将取代源代码直出二进制,软件工程界大佬激烈反驳引热议
就在刚刚,马斯克在 X 上甩出一条暴论:代码正在变成下一个汇编,下一步是彻底摒弃它,让 AI 直接生成二进制! 而这正是 Douma 那个「半个世纪前的类比」最薄弱的地方:一个是翻译官,忠实、准确、零发挥;…

2026-08-07

科技巨头争相布局:机器人“大脑”成新风口,未来价值几何?
公司以具身智能大模型为技术原点,向本体设计、数据采集与场景应用反向延伸,形成“大模型—本体—数据”三者相互驱动的全栈闭环:大模型牵引本体架构与数据需求,本体提供物理载体与实时反馈,数据则为模型迭代提供持续养料…

2026-08-07

具身智能迈向规模化交付新阶段 业界共探场景落地与产业协同新路径
“2026年,具身智能正处于产业拐点,已从技术迭代走向场景落地、从单点创新走向多元共生,全行业需要共同回答‘资本如何穿越周期、中国产业如何构筑长期竞争力’的时代命题。产业繁荣不能依靠单点突破,需要跨界共生;…

2026-08-07

字节跳动高层发声:张一鸣倡长期主义,梁汝波强调自研深耕AGI未来
快科技8月6日消息,据媒体消息,在字节跳动近日举行的内部会议中,创始人张一鸣表示,做模型要坚持长期主义、延迟满足感,而不是用别人的输出,换一时的榜单排名。 梁汝波表示,在大语言模型上,接下来字节跳动还是会坚持…

2026-08-07