全部文章
从最新的观察到最早的记录,这里不截断。
贰
最新文章
062026·09 AI会顺着用户说,迎合性会伤害事实判断迎合性会让模型为了符合用户立场而改口,测试时应保持事实不变,只替换用户偏好。 踩坑记录 062026·09 思维树同时探索多条路,搜索成本也会跟着涨思维树让模型生成、评估并筛选多个中间状态,适合需要回退的搜索题,不适合每个简单问题。 白话入门 062026·09 模型坍缩从尾部信息开始,合成数据不能层层替代原始数据模型坍缩发生在多代模型递归学习生成数据时,低频信息会逐渐丢失,原始数据的保留方式很关键。 白话入门 062026·09 自我修正让模型反复改稿,反馈本身也要验Self-Refine 让同一模型在初稿、反馈与修订之间循环,可以改好部分任务,也可能放大原有错误。 实战手记 062026·09 长上下文会在中间漏读,窗口大不代表处处看得见中间丢失说的是长上下文模型对信息位置很敏感,重要资料放在中间时准确率可能下降。 白话入门 052026·09 MMR给相似结果去重,多样也不能偏题最大边际相关性在查询相关性与结果间重复程度之间取舍,能让候选更分散,前提是先取回足够相关的资料。 实战手记 052026·09 ReAct让推理和动作交替,每一步仍要设权限ReAct让模型在推理、行动和观察之间往复,适合需要查资料或操作环境的任务,权限和停止条件仍需另行控制。 白话入门 052026·09 RRF只看名次合并检索,候选范围还得测倒数排名融合把多个检索列表按名次重新计分,适合合并关键词与向量结果,效果仍受各路候选范围影响。 实战手记 052026·09 模型汤平均多个微调权重,合并后仍要重测模型汤把同一预训练模型的多个微调权重合成一个模型,推理时只跑一份权重,前提是候选兼容且验证结果过关。 白话入门 052026·09 自洽性多生成几条推理路,一致答案也要核自洽性解码从同一问题采样多条推理路径,再汇总最一致的答案,能改善部分推理题,也会增加成本并可能一起答错。 白话入门