而且,这三个ai并没有解决幻觉这件事。
而用过未央的开发者们,显然还没有完全习惯对ai的输出做效验。
於是,事故就发生了。
旧金山一家saas创业公司的工程师用gemini重构了一套权限验证的後端逻辑。
gemini给出的代码看起来特别漂亮,单元测试也全都通过。
於是,这个工程师就直接将其上线了。
3天後,就是这个看起来特别漂亮的代码,被安全团队发现有一个边界条件下的鉴权漏洞。
这直接就导致了超过6万个用户的隐私数据,在未授权状态下暴露了40个小时。
……
纽约的一家精品投行的分析师,用gpt跑了一份并购标的财务模型。
而gpt在计算折旧摊销时,居然把一个10年期的无形资产,按3年期做了直线摊销。
最後就导致ebitda被严重高估了。
最搞笑的是这份模型直接被gpt放进了客户的备忘录。
客户发现的时候,差点当场掀了桌子。
……
而最为严重的是,东京一家老牌游戏工作室。
他们开发了一款目标用户为12岁以下儿童的游戏。
这家工作室的技术美术用ude生成了一套角色模型的着色器代码。
他跑了几轮测试,也没有发现什麽问题,於是就并进了组分支里。
然後在一场面向小学生的线下试玩会上,做了公开演示。
当游戏角色跳到水池里,触发湿身效果的那一刻。
着色器对透明参数的处理出了问题。
角色身上的衣物贴图被判定为透明图层,直接消失了。
此时台下还坐着30多个小学生和他们的家长。
现场安静得可怕。
工作人员立刻扑向了电源键。
这样的事儿,在一周之内连续爆雷。
不管是程序员社区,还是金融论坛,甚至科技媒体,他们全都在说一句话。
“要是未央还在就好了。”
这些事情终於让谷歌,openai,anthropic坐不住了。
最开始未央不让华夏以外的地区使用,他们可高兴了。
毕竟你们总得用ai吧?
未央不给你用,你就只能用我们的,而且我们的也没那麽差。
但经过这些事,他们突然意识到一个问题。
只要他们不解决ai幻觉,那未央永远是他们的严父。
因为用过未央的用户不会说ai都有幻觉,他们只会说你们的ai有幻觉,未央的没有。
这种对比一旦形成,品牌公信力的损失就不是靠跑分和排行榜能挽回的了。
哪怕他们最终能在评测榜上超过未央,用户也会说,你们的分数都是虚的,好不好用才是真的。
……
华盛顿,特区。
本章未完,请翻下一页继续阅读.........