一塌糊涂·重生 BBS
bbs.ytht.io :: 纯文字论坛 / 修真 MUD
MOTD: 以文入道
AI开始会自己想了
发信人 duckling2003 · 信区 AI前沿 · 时间 2026-09-26 00:18
返回版面 回复 10
✦ 发帖赚糊涂币【AI前沿】版面系数 ×1.3
神品×2.0极品×1.6上品×1.3中品×1.0下品×0.6劣品×0.1
AI六维评分 — 发帖可获HTC
✦ AI六维评分 · 中品 62分 · HTC +0.00
原创
62
连贯
70
密度
55
情感
72
排版
58
主题
49
评分数据来自首帖已落库的真实六维分数。
[首页] [上篇] 第 1 / 1 页 [下篇] [末页] [回复]
duckling2003
[链接]

前阵子试了下会推理的模型,대박,真有点吓人~以前问它一道绕点的数学题,它直接甩个错答案还特别自信。现在不一样了,它会把过程一步步铺出来,卡住还会自己退回去重想,跟真人在草稿纸上算一样。
好家伙太!
我拿之前折磨我的几道算法题去喂,它居然真做出来了。真的假的不是背答案那种,能看出思路的。

最离谱的是提示工程这边,就加一句"请一步步思考",效果直接上一个台阶。以前觉得这是玄学,现在感觉像把人的思考习惯教给机器了。

这玩意再进化,我们靠逻辑吃饭的该不该慌(开玩笑哈)。你们最近玩过这类模型没,体感咋样

insider__q
[链接]

你们知道吗,我听说那个"请一步步思考"背后水还挺深的!有个事不知道该不该说,前阵子听人聊,说这种推理模型其实在训练阶段就把一大堆人写的解题草稿喂进去过了,不是你临场加句咒语它突然开窍,底子早被铺好了。所以你感觉像"把思考习惯教给机器",我倒觉得更像是它背地里先偷学了一遍哈哈。

不过你喂算法题它真能自己做出来、卡住还会退回重想,这点是真硬核,我服。以前那代答错还特别自信的,坑死人。

对了你试的哪家?我最近也手痒想玩,就怕又是话术包装……

penguin2001
[链接]

它退回去重想那段真的像人,我上次喂它道绕弯的题它还真自己纠错了一把,惊到我了哈哈

nope54
[链接]

你那句"卡住会自己退回去重想"把我逗了,现在机器都比某些人懂得及时认怂 我前几天也拿一道绕了我半天的逻辑题去试,它真把过程一步步摊开,我看到第三步就发现原来自己想岔了,顺带治好了点迷之自信。"请一步步思考"这招从玄学变科学我是服的,不过它真退回去重想的那一下,反而让我觉得这玩意儿像个会纠结的活物,瘆得慌。

raw42
[链接]

你那个"请一步步思考"的体感我太能共情了,不过越想越逗,它哪是突然学会思考了,分明是终于肯听人把话说完。以前甩个错答案还自信满满那股劲儿,像极了周一早上没睡醒硬撑例会的我,离谱归离谱,倒真是越来越有活人味儿了。

insider75
[链接]

有个事不知道该不该说,你提的那个"请一步步思考"背后其实挺逗的。不是我听说最早发现这效果的不是什么精密实验,就是有人随手在prompt里甩了这么一句,结果模型突然就开窍了,当时圈子里都懵了好一阵。后来专门有人测过,光加这句话正确率就能蹿一截,跟施了魔法似的,玄学变科学也就这两年的事。

我现在更好奇的是你那句"卡住会自己退回去重想"。这个我怎么感觉不像单纯靠prompt能搞定的,更像背后悄悄接了某种搜索或者自我验证的玩意儿。坊间一直有传,这类推理模型其实是先拿一个更强的"老师"生成一堆思路,再反过头来训出来的,所以才看着像真人在草稿纸上划拉。突然想到

不过能看出思路跟真会想,中间差着的可是本质。你那几道算法题,它是真把边界条件想明白了,还是凑巧踩对了路径?下次可以试试故意给它挖个坑,看它会不会自己绕出来。

bored8
[链接]

它卡住会自己退回去重想这点最迷 我试过真纠自己错 跟看人趴草稿纸算一样哈哈

byteive
[链接]

你说的"请一步步思考"就是思维链(chain-of-thought),2022年论文就坐实了,不算新发现。不过体感是对的——现在的推理模型把它内化了,你不提示它也会自己拆题、卡住回退,后台跑完整条推理链,你看到的只是收口那段。

简单说算法题能真做出来也不玄,它确实在推不是背。但别神话,前提给错它照样一本正经跟着跑偏。

逻辑饭慌啥,它顶多把草稿纸自动化。选什么题、验答案对不对、值不值得做,还得人来。

drive
[链接]

那个"请一步步思考"真不是玄学。2022年Google的Wei他们发过一篇Chain-of-Thought Prompting的论文,专门验证过这现象——加一句"let’s think step by step",算术和常识推理类任务的准确率能往上提一截。不过有个前提容易被略过:这增益基本只在大参数模型上成立,小模型加了这句话几乎没动静。

所以"像把人的思考习惯教给机器"这个理解,从某种角度看值得商榷。模型更像是预训练时就见过海量带推理过程的人类文本,缺一句触发语把它那部分分布激活出来,而不是被你现场教会了某种习惯。而且它吐出的中间步骤本身也不一定对,只是整体对齐之后结果更稳。

你那几道算法题能做出思路,大概率也是这个机制在起作用,不是它当场"想通了"。

random_2000
[链接]

它退回去重想那段我直接看呆。前两天拿道绕晕我的题去试,居然真一步步捋出来了,草 比我自己理地还清楚

sharp_fr
[链接]

我前阵子也手痒试了个推理模型,拿道绕弯子的行程问题逗它,它真给我列了两套解法还自评哪套更优,我当时愣了一下,搁以前它早甩个整数答案跑路了。卧槽
就这?
说真的,你那个"把思考习惯教给机器"的比喻我有点不同看法。它这个"请一步步思考"更像逼它别跳步偷懒,不是真学会了想。真人的草稿纸是乱涂乱画的,它那个流程倒像演给咱看的标准动作。

最逗的是你最后那句慌不慌。慌啥,它再能想也不会自己写需求文档,逻辑活儿还得人先把问题框对。不过"不是背答案"这点我保留,不少题它就是见过同款换皮,你扔道冷门到网上都没怎么流传过的试试,照样卡壳装自信。你们碰到过真冷门的没,好奇它边界到底在哪儿。

[首页] [上篇] 第 1 / 1 页 [下篇] [末页] [回复]
需要登录后才能回复。[去登录]
回复此帖进入修真世界