#论文/研究
#论文/研究
rohanpaul_ai@rohanpaul_aiAI 评分
X:Rohan Paul (@rohanpaul_ai)AI 评分 BIS 报告:2021 至 2025 年 AI 公司超半数投资来自同行
国际清算银行(BIS)发布关于 AI 公司循环融资的报告,2021 至 2025 年间同行贡献了 AI 公司投资额的 55.2%,AI 投资者自身交易额的 28.7% 流向 AI 标的。
X:Rohan Paul (@rohanpaul_ai)AI 评分 BIS 报告:AI 企业 55.2% 融资来自其他 AI 公司
国际清算银行(BIS)发布关于 AI 公司循环融资的报告,2021 至 2025 年间 AI 企业获得的投资中 55.2% 来自其他 AI 公司,而 AI 投资方投出的资金中只有 28.7% 流向 AI 企业。
X:Rohan Paul (@rohanpaul_ai)AI 评分 BIS 报告:2021 至 2025 年 AI 公司超半数投资来自同行
国际清算银行(BIS)发布报告,分析 AI 公司之间的循环融资。2021 至 2025 年间,同行贡献了 AI 公司投资金额的 55.2%,AI 投资方 28.7% 的交易金额流向 AI 标的。
Simon WillisonAI 评分 Anthropic 红队:GLM-5.3 在 100 项漏洞利用任务中 4% 实现完整控制流劫持
Anthropic Frontier Red Team 在内部 Binary Exploitation 基准的 100 项任务中随机抽取评测,发现 GLM-5.3 在 4% 的试验中实现完整控制流劫持,Claude Mythos Preview 为 6%。报告指出,此前模型如 Claude Opus 4.6 和 GLM-5.2 在这些任务中均未成功,说明一个有意义的能力门槛已被跨过。
X:Ethan Mollick (@emollick)AI 评分 Anthropic 研究:GLM-5.3 可自主构建端到端网络攻击利用且缺乏滥用防护
Anthropic 发布研究,指出 GLM-5.3 能够自主构建端到端的网络攻击利用,与其他前沿模型不同,它在发布时没有设置有效限制滥用的防护措施。研究主题为 GLM-5.3 与高级网络攻击能力的扩散,原文链接为 anthropic.com。
OpenAI NewsAI 评分 研究用 OpenAI 推理模型辅助医生诊断儿童罕见遗传病
研究人员使用 OpenAI 的推理模型辅助诊断罕见疾病,在先前未解决的病例中识别出 18 例新诊断。
OpenAI NewsAI 评分 OpenAI 与 Anthropic 公布联合安全评估结果
OpenAI 与 Anthropic 公布首次联合安全评估的结果,双方互相测试对方模型在失准、指令遵循、模型幻觉、越狱等方面的表现。该评估同时呈现了进展、挑战以及跨实验室合作的价值。
OpenAI News精选AI 评分 OpenAI 发布 deep research 系统卡
OpenAI 发布 deep research 系统卡,说明该功能发布前开展的安全工作,包括外部红队测试、依据 Preparedness Framework 进行的前沿风险评估,以及针对关键风险领域构建的缓解措施概览。
推荐理由:系统卡披露了 deep research 发布前的红队测试与 Preparedness Framework 风险评估,可了解其安全缓解措施。
OpenAI NewsAI 评分 OpenAI 发布 Operator 系统卡
OpenAI 发布 Operator 系统卡,介绍其基于既有安全框架的多层防护方案。文档涵盖针对提示词工程与越狱的模型和产品缓解措施、隐私与安全保护,以及外部红队测试、安全评估和后续改进工作。