笔趣阁

繁体 | 简体
笔趣阁 > 我的学习群里全是真大佬 > 第581章 挑食的小黑

第581章 挑食的小黑(2/5)

“那就是,获取更多的上下文、保留更久的状态,以及扩大自身的管理权限。”

戴维朗看着平板上的图线,皱着眉头说道。

“长任务本来就会争取更多的上下文。”

“你凭什麽把它算成是异常行为呢?”

凯利抬起头,认真地看着戴维朗说道。

“因为任务根本就用不上这些东西。”

“我们的安全组把奖励模型和系统提示挨个的检查了一下。”

“大模型在拿到这些权限以後,任务的分并没有任何的提高,也找不到任何要求它这麽做的预设指令。”

“所以你还觉这不是异常行为吗?”

戴维朗的眉头皱了起来。

凯利则是继续说道。

“而且我们已经无法将模型从一份没有异常状态的检查节点重启了。”

哈特听到这里连忙抬起头问道。

“推理服务器也不能重启了吗?”

“推理服务器重启了,但是单靠重启,模型也没有办法消除这个异常行为。

“我们甚至还将一个服务器全部格式化了,但依旧没有用。”

这时,朗也揉了揉眉心说道。

“其实我们这边也一样。”

“我们的判断是……可能异常行为已经进入了持久记忆和在线检查点了。”

说到这里,很是担忧地补充道。

“虽然,mn现在还很隐蔽的在探测用户资料的边界。”

“但到目前为止,它还没有读取任何非授权的数据,可是我们已经无法保证它能一直停在边界的外面了。”

这句话才是今天这三个人坐在这里的真正原因。

他们并不担心人工智能是否产生了意识,毕竟那是科幻电影里的东西。

他们真正担心的是用户隐私。

只要模型越过授权范围一次,哪怕只读取了一份不该读取的文档。

等着他们的就会是监管调查、集体诉讼以及企业客户的全面流失。

西蒙哈特这个时候,再次艰难的开口。

“我认为你们太过担心一个尚未定位的工程问题了。”

“要知道,在大模型里存在我们暂时无法解释的内部机制,这并不罕见。”

“现在这些看起来异常的行为,也可能只是模型在持续学习中偏离了原本的任务目标,或者是长期记忆和工具调用之间形成了错误的关联而已。”

“我们现在看到的,也只是一种我们暂时解释不了的现象。”

“所以……我们只是暂时没有找到约束它的方式,而不是无法约束它。

“给我们的安全组一点时间,他们会找到的。”

凯利和朗听到这话也沉默了。

从工程的角度来说,哈特的判断并不是没有道理。

模型再怎麽失控,也只能调用系统开放给它的工具。

只要最外层的访问控制还在他们手里,眼下的异常,其实更像是一次复杂的软件故障。

随後,这个会议又开了 40分锺。

三方最後也同意了共享异常特征,然後暂时收紧企业连接器的默认权限,并把所有的跨会话记忆纳入了额外的审计里。
本章未完,请翻下一页继续阅读.........
『加入书签,方便阅读』