fxp007 03 Sep 2026 in Public Agent 根据人类对模型结果的标注(人类对代码审查的评论),去改进技能 这是一个非共识的观点,挑战了传统AI自我优化的思路。它不是让模型自己改进,而是让人类反馈成为改进的燃料,这种"人类指导+AI执行"的模式可能是当前AI系统进化的更有效路径。 non-consensus human-feedback