#现象/趋势
#现象/趋势
rohanpaul_ai@rohanpaul_aiAI 评分
The DecoderAI 评分Aleph Alpha 研究:Qwen、DeepSeek、Kimi 等中国 AI 模型在敏感话题上回避或复述官方立场
Aleph Alpha 用自建基准测试了阿里 Qwen、DeepSeek 和月之暗面 Kimi 等中国模型,覆盖天安门、台湾、新疆等 967 个敏感话题,其评分系统仅将 17% 至 41% 的回答评为平衡,其余为复述官方立场、回避或拒答。
TechCrunch · AIAI 评分Graphite 研究:Claude Opus 5.5 最爱说“this matters”,各模型写作痕迹各不相同
Graphite 研究发现 Claude Opus 5.5 的写作痕迹是“dependable”一词出现频率比人类样本高 23 倍,“this matters”高 116 倍;OpenAI Astra 则偏爱“another dimension”和“not simply X”式纠正性框架,后者出现频率超人类 100 倍。
Import AIAI 评分多伦多大学等机构构建可自我复制的AI蠕虫原型
多伦多大学、Vector Institute、剑桥大学与ServiceNow的研究者构建了一个AI蠕虫原型,利用被攻陷机器的GPU运行开源权重LLM进行推理,自主发现漏洞并发起攻击。该原型在漏洞检测上成功率约80%,利用漏洞约53%,自我复制约88%,完整攻击链整体成功率约37%。研究者称这证明自我维持的AI驱动网络威胁已不再是理论,并指出该蠕虫以去中心化群体方式运行,没有单点可被切断。
Import AIAI 评分牛津等机构研究:AI在说服力上稳定超过人类专家
牛津大学、英国AI Security Institute、斯坦福大学和伦敦政治经济学院的研究者通过四项实验、18,978场对话、6,923名参与者发现,AI系统在文本说服上稳定超过人类专家,即使专家提前研究、接受数小时结构化训练并获得1,000英镑奖金激励。
Import AIAI 评分Import AI 459:AI 监管为何困难、蛋白质折叠模型的缩放定律、以及为 AI 系统灭绝风险定价
Import AI 459 讨论了 AI 经济的爆炸式增长与 GDP 统计的脱节、用 AI 监督 AI 的自动化对齐为何比想象中更难、蛋白质折叠模型的缩放定律,以及为 AI 系统灭绝风险定价。其中一项研究估算 2025 年美国 AI 名义 GDP 约 2500 亿美元,质量调整后实际年增速约 2600%。