全部AI 动态
全部动态
geekbb@geekbbAI 评分 PixVerse@PixVerseAI 评分 PixVerse@PixVerseAI 评分 vikingmute@vikingmuteAI 评分
The DecoderAI 评分Google 研究者提出 RRSI,防止自我改进智能体记住测试任务
Google 研究者提出 RRSI(Regularized Recursive Self-Improvement of Agent Harnesses),通过随时间收缩的编辑预算和严格评审机制,阻止智能体在自我优化中记住测试任务。
shobhitbanga@shobhitbangaAI 评分 testingcatalog@testingcatalogAI 评分 testingcatalog@testingcatalogAI 评分 testingcatalog@testingcatalogAI 评分 omarsar0@omarsar0AI 评分 elonmusk@elonmuskAI 评分 elonmusk@elonmuskAI 评分 elonmusk@elonmuskAI 评分 elonmusk@elonmuskAI 评分 elonmusk@elonmuskAI 评分 elonmusk@elonmuskAI 评分 elsleightholm@elsleightholmAI 评分 XFreeze@XFreezeAI 评分 hone_sns@hone_snsAI 评分 AJSturrock@AJSturrockAI 评分 MeshyAI@MeshyAIAI 评分 AravSrinivas@AravSrinivasAI 评分 beffjezos@beffjezosAI 评分
The DecoderAI 评分NASA 与 IBM 发布开源月球基础模型,基于 17 年轨道器数据
NASA 与 IBM Research 联合多家学术机构发布 NASA-IBM Lunar Foundation Model,称其为最早的开源月球科学基础模型之一。
The DecoderAI 评分Aleph Alpha 研究:Qwen、DeepSeek、Kimi 等中国 AI 模型在敏感话题上回避或复述官方立场
Aleph Alpha 用自建基准测试了阿里 Qwen、DeepSeek 和月之暗面 Kimi 等中国模型,覆盖天安门、台湾、新疆等 967 个敏感话题,其评分系统仅将 17% 至 41% 的回答评为平衡,其余为复述官方立场、回避或拒答。
elonmusk@elonmuskAI 评分 frxiaobei@frxiaobeiAI 评分 Thom_Wolf@Thom_WolfAI 评分
The DecoderAI 评分Google 调整 Gemini 订阅分层,免费用户仅剩 Flash-Lite
从 2026 年 10 月起,Google 将限制个人账户用户对 Gemini 模型的访问:不订阅只能使用最小的 Flash-Lite,不再包含更强的 Flash 和 Pro,而当前免费档位提供 3.6 Flash 和不同程度的 3.1 Pro 访问。
dair_ai@dair_aiAI 评分 dongxi_nlp@dongxi_nlpAI 评分 dongxi_nlp@dongxi_nlpAI 评分 rohanpaul_ai@rohanpaul_aiAI 评分 rohanpaul_ai@rohanpaul_aiAI 评分 rohanpaul_ai@rohanpaul_aiAI 评分 rohanpaul_ai@rohanpaul_aiAI 评分 美国财政部长 Scott Bessent 谈中国 Kimi,谈他与 Axios 的新专访 完整视频在 "Axios" YouTube 频道,(链接在评论区)
omarsar0@omarsar0AI 评分 rohanpaul_ai@rohanpaul_aiAI 评分 rohanpaul_ai@rohanpaul_aiAI 评分 rohanpaul_ai@rohanpaul_aiAI 评分