Re: [闲聊] 所以付费版GPT查游戏攻略ok吗

楼主: arrenwu (键盘的战鬼)   2026-05-04 14:13:27
※ 引述《area223672 (JOJO的奇妙比喻)》之铭言:
: 之前都用gemini问东西也是幻觉严重
: 那么最新的5.5模型
: 叫他查攻略
: 例如蔚蓝档案国际服竞技大赛前五十名芒打队伍推荐
: 他会查给我正确资讯吗
这个问题会出现,
我不禁怀疑是不是因为各大家AI公司急着变现所以刻意避谈LLM的性质
LLM所给出来的结果不是确定性的 (deterministic),
也就是你现在问跟等一下问或者稍微用不同的方式问同样问题,
都有可能出现不一样的结果。
我目前也没看过哪家公司的LLM保证你问同一个问题100遍结果保证都一样。
什么样的结果是确定性的?
你用python的numpy函式库去算 sin(0.368) ,
除非是机器被强力宇宙射线打到,
不然不管执行几亿次,结果都会是 0.35975005528622994
那些标准函式库以及写在数学课本上的定理,
才是所谓的“可靠的、不建议一般人去质疑”的结果。
而基于这个认知,就应该能理解“他会查给我正确资讯吗”不是一个合理的疑问;
该问的是“我该用什么样的方式验证LLM给的资讯”
作者: brmelon (清水西瓜)   2026-05-04 14:17:00
推正确观念
作者: npc776 (二次元居民)   2026-05-04 14:17:00
给他~~~逼母~~~~~
作者: jelly22 (果冻水母鱼)   2026-05-04 14:17:00
作者: DendiQ (貔貅)   2026-05-04 14:19:00
问题在怎么用啊,你可以配合周边工具让他只做思考的工作可以极好地约束他生成的结果
作者: kuninaka   2026-05-04 14:19:00
就文字接龙掷骰子就是你说的要可验证才有价值看到很多人还拿生成式AI问数学加法比大小就有趣我都叫AI写程式跑XD
作者: zoo2020 (伞蜥蜴)   2026-05-04 14:20:00
好的 建议以后都不要问问题 因为你无法确认问题的正确性
作者: DendiQ (貔貅)   2026-05-04 14:20:00
我讲白了,同个事情给同个人去做,产出也不一定相同
作者: kuninaka   2026-05-04 14:20:00
tool很重要
作者: DendiQ (貔貅)   2026-05-04 14:21:00
你也要有能力验证他的结果
作者: wei115 (ㄎㄎ)   2026-05-04 14:21:00
所以现在才在玩驾驭工程,用流程限制死AI发挥
作者: kuninaka   2026-05-04 14:21:00
产出不一定相同,结果是正确的就好所以要能够验证结果
作者: lovesleep68 (睡神)   2026-05-04 14:21:00
有些AI都不给源网站,也只能问问当参考
作者: as3366700 (Evan)   2026-05-04 14:22:00
gpt可以打开直接看思考过程跟参考资料吧 gemini好像不
作者: wei115 (ㄎㄎ)   2026-05-04 14:22:00
不要问AI任何知识性的问题,知识性问题都是不可靠的
作者: AntitheApple (苹果? 那是什么好吃吗)   2026-05-04 14:24:00
Gemini请他提供的参考资料常常连连结都打不开我是用PRO 不是快捷
作者: kuninaka   2026-05-04 14:24:00
LLM尽可能回答你的问题(瞎掰)
作者: kuninaka   2026-05-04 14:25:00
知识型问题,最好的方法还是NotebookLM来源都是你提供的资料
作者: CCNK   2026-05-04 14:26:00
看看会不会不用要求 以后回复完都付网址
作者: npc776 (二次元居民)   2026-05-04 14:26:00
知识型问题不是问估狗查维基就好....
作者: wei115 (ㄎㄎ)   2026-05-04 14:27:00
那是AI去搜寻后得出结果,本质是AI的理解能力而不是AI的记忆能力,LLM的架构注定任何知识性的问题都不保証正确
作者: DendiQ (貔貅)   2026-05-04 14:27:00
如果开始了解人类是怎么思考的,就不会觉得LLM没用了
作者: brmelon (清水西瓜)   2026-05-04 14:27:00
连自己不知道什么都不知道的时候问AI 再从里面找关键字查
作者: npc776 (二次元居民)   2026-05-04 14:28:00
有正确答案的问题 还叫他去海搜网络上错误答案风向鸡带风
作者: DendiQ (貔貅)   2026-05-04 14:28:00
我的意思是人类也不是什么很有逻辑的生物
作者: chocobell (ootori)   2026-05-04 14:28:00
至少LLM他会标注来源让你好去对照原始资料
作者: zeolas (zeolas)   2026-05-04 14:29:00
推观念正确,一堆人把ai当成google用,以前还有Let Me Google That For You的笑话,现在看到这些人真的笑不出来
作者: SSglamr (海边漂来的qwer)   2026-05-04 14:29:00
看情况吧 像原PO问的类似"最强队伍" 这种也没什么100%的标准答案 对新手而言AI协助判断就很有用
作者: owo0204 (owo0204)   2026-05-04 14:30:00
完全没概念的问题确实可以问一下llm然后自己去查,这给我蛮多帮助的
作者: laigeorge89 (laigeorge89)   2026-05-04 14:30:00
文献的证据等级:
作者: owo0204 (owo0204)   2026-05-04 14:31:00
例如说我想要买某产品,有怎样的需求,我应该去哪里买什么规格有什么差别这些东西,其实llm可以给出不错的参考
作者: hayate65536   2026-05-04 14:33:00
AI适合问什么类型的问题也是个学问
作者: kuninaka   2026-05-04 14:33:00
把AI当GOOGLE也不是不行google搜寻就内建AI MODE只是常常唬烂
作者: hayate65536   2026-05-04 14:35:00
内建的AI有时候会直接被他写出来的来源打脸,还蛮好笑的
作者: kuninaka   2026-05-04 14:35:00
不适合问1+1=2不适合问开车去加油站加油,五分钟,要开车还是走路
作者: supergoal (春暖花开)   2026-05-04 14:59:00
它就是统计学啦你不如叫ai做routine的事比较好大家一直嘘gemini,我用过gpt也是会出现幻觉啊
作者: hayate65536   2026-05-04 15:07:00
大家嘴G不是全世界只有他会幻觉的意思
作者: ghjkl5566 (56不能王)   2026-05-04 15:32:00
验证不难啊,叫它提供资料来源,这比一堆空口白话唬烂的强多了,至少AI不会拒绝提供经验够多就知道人与人之间的对谈根本充满唬烂
作者: zxc8787 (摸斗哈压库)   2026-05-04 16:25:00
观念正确
作者: asmiocv   2026-05-04 16:38:00
直接限定他只找论坛资讯就好,可以过滤一堆内容农场的垃圾文,只能说还是一堆人不会用
作者: groundmon (JJ)   2026-05-04 16:57:00
的确是没有确定性,但人类回答问题也没有确定性阿,问题是在产生“错误答案”的机率有多少LLM生成回答基本上是在做文字接龙,比如“太阳从东边升起”和“日出是在东方”,在定义上是不重复不同的回答,但两个意思是相同的你问人一加一等于多少,在头被打到还是口齿不清的时候也是可能得到错误回答,那问LLM呢?恐怕给出“错误答案”的机率一样低到可以忽略而且实际上现在的主流AI工具,都可以要求它们去套用你说的函式库去做运算,也可以提供计算程式码让使用者去验证生成AI给的答案越来越像人类助理,他就像人类一样会出错,但你也可以求他去用计算机之类信赖度高的工具,不过也像人类一样,会不会按错按键就是另外一回事了

Links booklink

Contact Us: admin [ a t ] ucptt.com