爱可可-爱生活
26-07-02 05:50 微博认证:AI博主 2025微博新锐新知博主

今日推介(第2184期):基于元认知反馈的强化学习促使LLM产生忠实的不确定性表达、自我解释训练在固定监督下实现对行为变化的追踪、开源大语言模型何时能有效解释闭源模型、基于层级化语义记忆的自适应分辨率 KV 缓存助力长上下文大语言模型推理、面向机器人操控的自由形式偏好学习 公·众·号:爱可可爱生活 http://t.cn/AXoUDK4c #机器学习##人工智能##论文#

发布于 北京