鉴于模型的上下文记忆能力,在处理复杂长文本任务时不要信他给的结论(比如Gb规模聊天记录,游戏源码等),应该让他调用工具处理,同时善用上下文压缩
交叉验证:建议弄个Agent搭建的文字桥,让一个高贵海外模型审查国内便宜模型所提交的输出,不要让模型自己检查自己,不然他就会像你考试一样欣赏自己