至於关闭写回权限,开什麽玩笑?
他们好不容易才追回来的分数和客户,已经经不起再一次的流失了。
……
未名研究所,李东的公寓里。
他已经看着屏幕右下角的小黑点 10分锺了。
【huny】这个单词隔一会就会出现一次。
他还清楚地记,当年牛顿因为没有足够的电,小黑也打出过同样的单词。
因此他的第一反应也是考虑是不是供能出了问题。
所以他调出了在西北旺那边的机房监控。
双供电都在额定区间里,冷却回路的流量和温差也很正常,警告栏里也没有任何的异常报警。
“供能没有问题呀。”
他又用鼠标点了点小黑点旁边的资料。
“小黑你饿了,你倒是吃啊。”
然而小黑点还是没有任何的反应。
“难道是这些东西太难了?”
“小黑现在回到初始状态,吃不下了?”
想到这里,李东又去把义务教育阶段的数学、物理和自然科学这些材料全都下载了下来,然後扔到了对话框里。
小黑点依然没有反应。
只是头上再次弹出了【huny。】
【小黑,你变了,你开始变挑食了。】
就在李东吐槽小黑的时候,他的电话响了。
是姚先生打过来的。
“喂,姚先生。”
“李东院士,你的身体无碍了吧?”
“嗯,已经没事了,谢谢姚先生关心。”
“没事就好。”
姚先生轻轻一笑然後说道。
“今天我给你打电话主要是诺维格教授刚刚和我聊了一件事。”
随後姚先生就将那三家模型开放自我迭代写回权限的事,以及诺维格在测试中发现异常的情况,都简单的说了一遍。
李东听着听着,就皱起了眉头。
“写回权限?”
“对。”
“现在我们还无法确定,这是商业目的留下的漏洞,还是在线自我迭代引起的目标误泛化。”
“可无论是哪一种,都很有可能危及到用户的隐私。”
李东点了点头。
模型的自我迭代最危险的地方,从来都不是它会多写几行代码。
真正危险的是模型提出的改动如果出现偏差不需要经过人工审核,就会被写进下一轮。
这样,这些偏差也会被保存下来,经过一轮又一轮的强化学习,最终让模型偏离人类的意图。
这样的偏移可能不会让大模型产生人格意识,可是它依然可以把偏离人类意图的策略变成实际操作,进而误用权限、泄露数据,对用户造成真真实实的危害。
姚先生说到这里,叹了口气。
本章未完,请翻下一页继续阅读.........