haoailab· @haoailab · X·· 11 小时前AI 评分
Sky Computing Lab 用 LLM 智能体进化提示词
我们从机器人自身的日志中进化提示词,使用 SOTA LLM 智能体和人工监督。无需训练。对抗满技能的脚本对手,v1 每局皆输;不到两小时后的 v9,每局皆赢。
我们利用机器人自身的日志,借助最先进的 LLM 智能体和人工监督来迭代提示词,无需训练。面对满级技能的脚本对手,v1 输掉了每一局;不到两小时后,v9 赢下了每一局。
来源:haoailab · x.com