The subagents ran thousands of numerical checks against known zeta zeros and refereed one another's work
子agents互相审核彼此的工作——scalable oversight在数学领域的实践。数学有客观正确性标准,所以AI peer review是可信的。真正的挑战是:在没有客观标准的领域(伦理、价值判断),这套机制是否还能成立?
The subagents ran thousands of numerical checks against known zeta zeros and refereed one another's work
子agents互相审核彼此的工作——scalable oversight在数学领域的实践。数学有客观正确性标准,所以AI peer review是可信的。真正的挑战是:在没有客观标准的领域(伦理、价值判断),这套机制是否还能成立?