同时使用两个模型并让它们相互批评,效果优于单独使用任何一个。
AI translation, not an official translation. Refer to the original for technical details.
Adapted from @peterwildeford我目前的看法是,GPT 6 Astra 在我的个人工作中并不比 Fable 5.1 有实质性优势,但两者并排使用仍然很有帮助,且能产生叠加效果。 过去两天里,我大量使用了 GPT 6 Astra 和 Fable 5.1,主要用于政策分析、备忘录撰写,以及一些虽然概念上仍颇具难度、但相对简单的软件开发(例如制作仪表板和预测模型)。 在我完成的各类任务中,哪个模型表现更好相当随机,很难事先预判。 对于概念上最为复杂的任务,我发现先用两个模型分别完成项目,再让它们相互交流意见、互相批评,所产生的输出质量远优于任何一个模型单独完成的结果。 我认为,一个理性的人完全可以得出任一模型是"最佳模型"的结论,这在很大程度上取决于个人的主观判断和具体任务需求。