#智能时刻的观察[超话]#
//巨硬出品,
SkillOpt:自我进化的智能体技能执行策略
像训练神经网络一样训练智能体技能——使用训练轮次、(小)批量大小、学习率和验证门控,但无需修改模型权重。
用训练模型的思路优化 skill,每次对skill的MD内容做一些调整,然后跑结果,好了就继续推进,这个思路蛮有意思
http://t.cn/AX6lKJug
#大模型##智能体##ai学习营##ai探索计划##ai工程##人工智能##aictri#
发布于 北京
