CoderZD
24-09-15 22:25 微博认证:投资内容创作者

http://t.cn/A6RDHbyt Reflexion: Language Agents with Verbal Reinforcement Learning
http://t.cn/A6RDHby5 Self-Reflection in LLM Agents
GPT O1发布没有太多技术细节,但从思路上看,这两篇PAPER有重要参考价值。第一篇去年非常有名 O1模型大概率是基于它的思路延伸的;第二篇比O1早了几天发表 类似基于llama的O1

发布于 广东