– arxiv.org/abs/2610.04862 Title: "GitSwarm: Decentralized Compounding Inference"
#论文/研究
#论文/研究
rohanpaul_ai@rohanpaul_aiAI 评分 rohanpaul_ai@rohanpaul_aiAI 评分 dair_ai@dair_aiAI 评分 omarsar0@omarsar0AI 评分 rohanpaul_ai@rohanpaul_aiAI 评分 rohanpaul_ai@rohanpaul_aiAI 评分
dair_ai@dair_aiAI 评分 omarsar0@omarsar0AI 评分 rohanpaul_ai@rohanpaul_aiAI 评分 rohanpaul_ai@rohanpaul_aiAI 评分 rohanpaul_ai@rohanpaul_aiAI 评分 rohanpaul_ai@rohanpaul_aiAI 评分 rohanpaul_ai@rohanpaul_aiAI 评分 清华、牛津与斯坦福的新论文《Thinking Inertia: LLMs Keep Thinking When Told Not To》(arxiv.org/abs/2610.11765)发现。
rohanpaul_ai@rohanpaul_aiAI 评分 rohanpaul_ai@rohanpaul_aiAI 评分 – arxiv.org/abs/2610.12367 标题:"选哪个技能来蒸馏?SGUID:为模型-技能协同进化选择紧凑技能库"
rohanpaul_ai@rohanpaul_aiAI 评分 rohanpaul_ai@rohanpaul_aiAI 评分 rohanpaul_ai@rohanpaul_aiAI 评分 微软研究人员提出 CABRA,可生成合成编码任务并每次只提升一种难度,对 8 个 LLM 和 6 个智能体在 6,840 个任务上运行,并将每次工具调用标注为阅读、分析、搜索、编辑或测试。
Ars Technica · AIAI 评分哈佛研究:AI 编码智能体产出更多代码,但未提升软件产出
哈佛大学研究人员 Fiona Chen 和 James Stratton 的一项研究发现,AI 编码工具带来的编码阶段效率提升被生产流程下游约束吸收,代码审查环节显著变长、pull request 更可能需要修改、审查者留下更多评论, firms 并未因此增加软件产出或减少用工。
dongxi_nlp@dongxi_nlpAI 评分 emollick@emollickAI 评分 omarsar0@omarsar0AI 评分 dair_ai@dair_aiAI 评分 dair_ai@dair_aiAI 评分 Meta Superintelligence Labs 发表论文,提出在 Agent RL 训练中用专门的用户模拟器替代过于配合的 LLM 扮演用户。
rohanpaul_ai@rohanpaul_aiAI 评分 rohanpaul_ai@rohanpaul_aiAI 评分 rohanpaul_ai@rohanpaul_aiAI 评分 KyleCranmer@KyleCranmerAI 评分 emollick@emollickAI 评分 thexpin@thexpinAI 评分 BenjaminDEKR@BenjaminDEKRAI 评分 maithra_raghu@maithra_raghuAI 评分 _akhaliq@_akhaliqAI 评分 _akhaliq@_akhaliqAI 评分 _akhaliq@_akhaliqAI 评分 _akhaliq@_akhaliqAI 评分 _akhaliq@_akhaliqAI 评分 _akhaliq@_akhaliqAI 评分 Agent Plasticity 通过经验衡量自我改进 论文:huggingface.co/papers/2610.0…
dair_ai@dair_aiAI 评分 omarsar0@omarsar0AI 评分 作者引述一篇论文指出,在整仓库迁移任务中,同一 GPT-5.6 Sol 模型与相同 effort 设置下,把 Codex 换成 HERMES harness 后成功率从 6.5% 升至 31.0%。