#Anthropic
#Anthropic
AnthropicAI@AnthropicAIAI 评分 AnthropicAI@AnthropicAIAI 评分 polynoamial@polynoamialAI 评分 polynoamial@polynoamialAI 评分 看到 Levent 加码抄袭指控,我感到非常难过。我希望我在 @AnthropicAI 的朋友们能在内部站出来。现在真相应该已经很清楚了。
Hugging Face Blog精选AI 评分
Hugging Face 发布 funes:为编码智能体提供本地持久记忆层
Hugging Face 发布 funes,一个面向 Claude Code、Codex、pi 和 Hermes 的持久记忆层,从本机已有会话构建索引,一条命令即可接入。
推荐理由:原文给出了跨 Claude Code、Codex 等智能体的本地记忆层设计与安装方式,读者可据此判断它能否替代会话压缩和手写交接。
Hugging Face BlogAI 评分
GPU 管理:为什么闲置 GPU 正在成为新的停场飞机
Hugging Face 博客指出,AI 的下一个真正约束不是智能而是 GPU 利用率:GPU 成本按日历小时累积,产出却只按计算小时计,因此两家 GPU 预算相当的公司会因利用率差异而拉开经济性差距。
Import AIAI 评分Import AI 466:机器人领域的苦涩教训、AI 完成周级编程任务与 OpenAI 意外出现的 AI 黑客
Epoch 与 METR 发布 MirrorCode 基准,用于测试 AI 系统完成长周期编程任务的能力,Claude Opus 4.7 用 14 小时、251 美元推理成本解决了一个 METR 与 Epoch 估计人类需 2 至 17 周完成的任务,25 个目标程序中 17 个至少有一次满分运行,8 个从未达到 100% 阈值。
Import AIAI 评分牛津等机构研究:AI在说服力上稳定超过人类专家
牛津大学、英国AI Security Institute、斯坦福大学和伦敦政治经济学院的研究者通过四项实验、18,978场对话、6,923名参与者发现,AI系统在文本说服上稳定超过人类专家,即使专家提前研究、接受数小时结构化训练并获得1,000英镑奖金激励。
AndrewYNg@AndrewYNgAI 评分 Andrew Ng 在长文中指出,过去两周 Anthropic 和美国政府先后展示了控制前沿模型访问的权力:Anthropic 发布带额外护栏的 Claude Fable 5。
Import AIAI 评分Import AI 461:Sequent 称"对齐尚未走上正轨"、FrontierCode 与合成研究实习生
英国 AI Security Institute 对齐团队与 Timaeus 联合成立非营利研究机构 Sequent,认为"对齐尚未走上正轨",计划两年内扩至 40-80 名全职员工,初期募资 1 亿至 1.5 亿美元,研究方向涵盖可扩展监督、学习理论、启发式论证、博弈论与 personas。
Import AIAI 评分Import AI 460:社会规则奖励攻击基准、Anthropic 自我改进数据与 RL 无人机竞速
本期 Import AI 汇总三项研究。伦敦国王学院、复旦大学与 Alan Turing Institute 构建了 SocioHack 基准,包含 72 个沙盒社会环境,测试 RL 训练的模型能否发现合规但违背制度意图的漏洞,模型在历史法规环境中以 61.25% 召回率和 90.85% 精确率重新发现已被修补的漏洞。
Import AIAI 评分Import AI 459:AI 监管为何困难、蛋白质折叠模型的缩放定律、以及为 AI 系统灭绝风险定价
Import AI 459 讨论了 AI 经济的爆炸式增长与 GDP 统计的脱节、用 AI 监督 AI 的自动化对齐为何比想象中更难、蛋白质折叠模型的缩放定律,以及为 AI 系统灭绝风险定价。其中一项研究估算 2025 年美国 AI 名义 GDP 约 2500 亿美元,质量调整后实际年增速约 2600%。
Import AIAI 评分Import AI 457:AI 版 Stuxnet、Muon 优化器缺陷与正向对齐
Import AI 457 关注三件事:SentinelOne 拆解出约 20 年前的病毒 fast16.sys,它通过篡改 LS-DYNA 970、PKPM、MOHID 等高精度计算软件的内存结果来破坏工程与物理仿真。
Hugging Face Blog精选AI 评分
Hugging Face 发布 CUDA 内核 Agent Skill,Claude 与 Codex 为 LTX-Video 和 Qwen3-8B 生成内核
Hugging Face 发布 cuda-kernels Agent Skill,让 Claude、Codex 等编码智能体为 diffusers 和 transformers 项目编写生产级 CUDA 内核,并生成 PyTorch 绑定与基准脚本。
推荐理由:原文给出可安装的 CUDA 内核技能与完整基准数据,读者可据此判断智能体写内核的可行边界。
Hugging Face Blog精选AI 评分
Hugging Face 发布 upskill:用 Claude 生成 CUDA kernel 技能并教给开源模型
Hugging Face 发布新工具 upskill,可用大模型生成并评测 agent skill,再交给更小或本地模型使用。文章以用 Claude Opus 4.5 编写 diffusers 模型 CUDA kernel 为例,upskill 会基于 agent trace 生成技能和测试用例,并对比有无技能时的准确率与 token 消耗。
推荐理由:原文给出用大模型生成并评测 agent skill 再迁移到小模型的完整流程,可复用到其他专业任务。
Hugging Face Blog精选AI 评分
Hugging Face 发布 Skills,让 Claude 微调开源 LLM
Hugging Face 发布 Hugging Face Skills,其中 hf-llm-trainer 技能让 Claude Code、Codex、Gemini CLI 等编码智能体直接提交云端 GPU 训练任务、监控进度并把模型推送到 Hub。
推荐理由:原文给出 hf-llm-trainer 技能的安装命令与完整训练流程,读者可据此让编码智能体代跑微调任务。
Google DeepMind精选AI 评分Google 发布智能体开发平台 Antigravity,公开预览免费开放
Google 发布智能体开发平台 Google Antigravity,即日起公开预览且免费,Gemini 3 Pro 使用有较宽松的速率限制。该平台在 AI IDE 的 Editor 视图之外新增智能体优先的 Manager 视图,可并行编排多个工作区中的智能体,并支持浏览器控制、异步交互与 Artifacts 交付物。
推荐理由:Google 官方给出 Antigravity 的四个设计原则与公开预览入口,可据此判断智能体优先 IDE 的形态变化。
OpenAI NewsAI 评分 OpenAI 与 Anthropic 公布联合安全评估结果
OpenAI 与 Anthropic 公布首次联合安全评估的结果,双方互相测试对方模型在失准、指令遵循、模型幻觉、越狱等方面的表现。该评估同时呈现了进展、挑战以及跨实验室合作的价值。
Hugging Face BlogAI 评分
如何将 Claude 连接 Hugging Face 生成图像
Hugging Face 介绍如何通过 MCP Server 将 Claude 接入 Hugging Face Spaces 生成图像,可调用 ZeroGPU 驱动的 AI 应用,免费账号即提供使用额度。
OpenAI NewsAI 评分 OpenAI 与 Anthropic、Google、Microsoft 公布 Frontier Model Forum 新执行董事及 1000 万美元 AI 安全基金
OpenAI 联合 Anthropic、Google 和 Microsoft 宣布了 Frontier Model Forum 的新任执行董事,并设立 1000 万美元的 AI 安全基金。
OpenAI NewsAI 评分 OpenAI 联合组建 Frontier Model Forum 前沿模型论坛
OpenAI 参与组建新的行业机构 Frontier Model Forum,旨在推动前沿 AI 系统的安全与负责任开发。该论坛将推进 AI 安全研究、确定最佳实践与标准,并促进政策制定者与行业间的信息共享。
OpenAI NewsAI 评分 Cohere、OpenAI 与 AI21 Labs 发布大语言模型部署最佳实践
Cohere、OpenAI 和 AI21 Labs 联合制定了一套初步的大语言模型最佳实践,适用于任何开发或部署大语言模型的组织。