AI Research · research
WMLLM: Self-Evolving Optimization Agents via Predict-Then-Act World Modeling
论文摘要:WMLLM:围绕大语言模型的能力、评测或对齐问题展开,适合关注方法与实验结果。
为什么重要
该论文来自一手研究源并通过 3qk7 Research Radar 的新鲜度、来源与研究价值筛选;后续代码、模型权重、复现和相关产品事件可继续关联到该记录。
检测到的变化
- 研究论文进入 3qk7 高价值 Research Radar
一手证据
- arXiv cs.LG · 2026-09-03T22:05:20Z