CRITIC: Large Language Models Can Self-Correct with Tool-Interactive Critiquing
2023-05-19 · 已核验
论文信息
从这篇论文开始研究
选择研究模式后,论文和原始模型会进入工作台上下文。
复现状态
代码尚未核验
权重尚未核验
配置尚未核验
环境尚未核验
尚未补充结构化复现记录。
模型角色拓扑
这里只展示数据明确记录的角色与模型关系,不推断未记录的 workflow 边。
策略
GPT-3.5 Turbo
批评者
text-davinci-003
基线
Llama 2 70B Chat
当前论文记录没有 workflow 边;上方仅展示已记录的角色拓扑,不把 Actor、Environment、Critic 或 Optimizer 关系当作事实。
模型角色
GPT-3.5 Turbo
策略 · 未更新权重 · GPT-3.5 Turbo 作为初始生成器,通过工具交互式批评进行纠正。
text-davinci-003
批评者 · 未更新权重 · text-davinci-003 作为 CRITIC 骨干接受评估。
Llama 2 70B Chat
基线 · 未更新权重 · Llama-2-70B-Chat 作为开源 CRITIC 骨干接受评估。