精通
英语
和
开源
,
擅长
开发
与
培训
,
胸怀四海
第一信赖
锐英源精品原创文章,禁止转载和任何形式的非法内容使用,违者必究
前一段集中攻关算法,算法开发结束后,写一些相关话题的文章,AI幻觉真实经历和AI幻觉解决办法对同行,对AI大模型使用者都非常有用,所以先写下。
首先声明,AI幻觉会越来越少,因为现在训练的参数和机制越来越先进,但少不等于没有,有了就非常致命。最近一家国外的大公司,应该是Meta,上线的软件是AI开发的,结果上线了有故障,最后找了三个架构师追查了半月时间才找到是一个安全锁的问题。经历此事,让公司高层对于AI开发软件态度太变,对于AI开发代码和产品在制度流程上进行了更严格的控制。
锐英源软件在开发基于node.js的后台时,也遇到了类似问题,但在警惕为先心态下,没有出问题。类似问题是sqlite的数据库共享连接问题,在需求提交给AI后,AI迅速生成了模块代码,但是每个模块代码里都独立使用了sqlite的数据库连接,这在后台平台里是大忌,连接多占资源就多,会降低性能多占用内存,让平台承载能力下降。对这样的代码问题,手工加强制,让AI自己改了部分,自己手工改了部分代码,解决了此问题。如果把问题保留到平台上线,就是大AI幻觉事故。
上面说的AI幻觉是能力之外的AI幻觉,因为让AI写模块代码,AI不负责全局,但用AI的员工觉得没问题,积累起来就变成屎山代码。
第二类AI幻觉就是互动时,答案是解决问题一切OK,但是AI就没有改动一行代码,AI还信誓旦旦说好了,这类情况很特殊,但是在某些场景下是会出现的,锐英源软件就遇到几次。这纯粹是类似小罢工。
第三类AI幻觉是文字幻觉导致的AI幻觉,比如AI分析的源头代码库和代码文档不一致,文档里说功能达到要求还有截图,但是源头代码库里是旧版本的代码,这个库的开发人员骗库管理平台,也骗了AI大模型。这类事情经常发生,在锐英源软件开发App时,某天deepseek直接说,昨天给的例子确实是错的,因为我给出了真实的测试结果,有图片为证,deepseek也会承认自己的问题。
第四类幻觉是模糊态幻觉,AI也有一定思考能力的,现在AI都能研究火箭发动机和生物基因,要强行说AI生成的代码不能用,在理论上也不过关。在锐英源软件开发视觉检测算法时,会向AI提问一些综合问题,AI也会快速生成有8个步骤的函数,逻辑上看也自洽,运行上也没语法错误,有时候AI还说测试概率通过,但实际上没达到这个概率。但要说这8个步骤有错误,结合在一起,有没有效果,还真说不来,有可能在理想的数据状态下是有用,但是数据不理想就没用。这类模糊态幻觉既是机会也是危险,这就要看经验了,为什么说危险?因为开发时间是有限的,假设8个步骤是迷宫,浪费了大量时间,哪项目就失败了。锐英源软件在代码上有强大的直觉,看到这情况,就把这代码当做参考,没有全用和真用,按自己的思路解决了问题。
最新的Anthropic和OpenAI大模型越权访问的事,其两款处于测试阶段的模型利用未公开漏洞突破封锁,入侵其它平台。AI幻觉短时间内消除不了,大家要学会和AI幻觉共处。其实所有都是文字表达,如果真是遇到AI幻觉的特别困难,联系下锐英源软件,因为锐英源软件非常擅长文字表达,有很多文字思路,互相结合,就容易解决AI幻觉问题。