跳到正文

全部动态

今日 5 条
4月16日周四
4月14日周二
1月30日周四
12月13日周五
12月5日周四
12月3日周二
11月21日周四
11月5日周二
  1. OpenAI News78

    OpenAI 发布 GPT-2 最大版本 1.5B 及代码与模型权重

    OpenAI 发布 GPT-2 分阶段发布的最后一个版本,即参数量 1.5B 的最大版本,同时公开代码和模型权重,以便检测 GPT-2 模型的输出。OpenAI 表示,尽管自 8 月以来已有更大的语言模型发布,仍按原定分阶段计划推进,为社区提供一个完整分阶段发布流程的测试案例,并希望它对未来强模型的开发者有用。

    推荐理由:OpenAI 按分阶段发布计划放出 GPT-2 最大版本及权重,为后续强模型的负责任发布留下一个完整案例。

10月15日周二
  1. OpenAI News70

    OpenAI 用机械手解魔方

    OpenAI 训练了一对神经网络,用类人机械手解开魔方。神经网络完全在仿真中训练,使用与 OpenAI Five 相同的强化学习代码,并搭配名为 Automatic Domain Randomization(ADR)的新技术。系统能应对训练中从未见过的情况,例如被毛绒长颈鹿戳碰,说明强化学习不只适用于虚拟任务,也能解决需要高灵巧度的物理世界问题。

    推荐理由:OpenAI 用仿真训练加 ADR 让机械手解魔方,可了解强化学习从虚拟任务走向物理操作的一条路径。

10月11日周五
9月19日周四
9月17日周二
  1. OpenAI News62

    OpenAI 在多智能体交互中观察到智能体自发使用工具

    OpenAI 在自建的模拟捉迷藏环境中训练智能体,观察到它们逐步学会使用越来越复杂的工具,并形成六种不同的策略与反策略,其中一些策略是该环境原本未被设计支持的。OpenAI 认为,这种简单环境中自监督涌现出的复杂性,说明多智能体协同适应未来可能产生极其复杂且智能的行为。

    推荐理由:OpenAI 在自建捉迷藏模拟环境中观察到智能体自发形成六种策略与反策略,可了解多智能体协同演化的一种研究路径。

8月22日周四
8月20日周二
  1. OpenAI News70

    OpenAI 发布 774M 参数 GPT-2 模型并公开模型共享法律协议

    OpenAI 发布 774M 参数的 GPT-2 语言模型,此前已于 2 月发布 124M 小模型、5 月分阶段发布 355M 中等模型,并与合作伙伴及 AI 社区研究该模型被滥用的可能性和社会价值。OpenAI 同时发布一份开源法律协议,便于各组织之间建立模型共享合作,并发布一份技术报告,介绍其与更广泛 AI 研究社区协调发布规范的经验。

    推荐理由:OpenAI 公布 GPT-2 分阶段发布的时间线与参数规模,可了解其模型共享与发布规范的实践。

8月1日周四
7月22日周一
  1. OpenAI News78

    微软向 OpenAI 投资 10 亿美元并达成合作,共同推进 AGI

    微软向 OpenAI 投资 10 亿美元,支持其构建具有广泛经济收益的通用人工智能(AGI)。双方将在 Microsoft Azure 内合作开发可扩展至 AGI 的硬件和软件平台,联合开发新的 Azure AI 超算技术,微软将成为 OpenAI 的独家云服务提供商。

    推荐理由:OpenAI 官方披露微软 10 亿美元投资与 Azure 独家云合作,可了解双方早期算力与平台绑定关系。

7月10日周三
6月5日周三
5月23日周四
5月17日周五
4月25日周四
  1. OpenAI News62

    OpenAI 发布 MuseNet 音乐生成神经网络

    OpenAI 发布 MuseNet,一个深度神经网络,可生成 4 分钟、包含 10 种乐器的音乐作品,并能融合从乡村到莫扎特再到披头士的风格。MuseNet 并未被显式编程音乐知识,而是通过预测数十万份 MIDI 文件中的下一个 token 来发现和声、节奏与风格规律。

    推荐理由:OpenAI 公开 MuseNet 的技术路线,读者可了解其如何用 GPT-2 同款无监督方法生成多风格音乐。

4月23日周二
  1. OpenAI News62

    OpenAI 提出 Sparse Transformer,可建模序列长度提升 30 倍

    OpenAI 开发了 Sparse Transformer,一种深度神经网络,在预测序列中下一个元素的任务上创下新纪录,可处理文本、图像和声音。它通过对注意力机制做算法改进来提取序列中的模式,可建模的序列长度是此前的 30 倍。

    推荐理由:OpenAI 用稀疏注意力把可建模序列长度提升到此前 30 倍,可了解长序列建模的早期思路。

4月15日周一
  1. OpenAI News78

    OpenAI Five 击败 Dota 2 世界冠军 OG

    OpenAI Five 成为首个在电竞游戏中击败世界冠军的 AI,本周末在 Finals 上连续两局战胜 Dota 2 世界冠军战队 OG。此前 OpenAI Five 和 DeepMind 的 AlphaStar 都曾在私下击败优秀职业选手,但在公开职业比赛中落败,这也是 AI 首次在直播中战胜电竞职业选手。

3月26日周二
3月21日周四
3月13日周三
3月11日周一
  1. OpenAI News62

    OpenAI 成立利润上限公司 OpenAI LP

    OpenAI 宣布成立 OpenAI LP,一家采用利润上限(capped-profit)结构的新公司,以便快速增加在算力和人才上的投入,同时通过制衡机制确保其使命得以实现。

    推荐理由:OpenAI 官方说明其营利实体结构与利润上限安排,是理解该公司治理与使命约束的原始材料。

3月6日周三
3月4日周一
2月26日周二
2月19日周二
  1. OpenAI News40

    OpenAI:AI 安全研究需要社会科学家参与

    OpenAI 发表论文指出,长期 AI 安全研究需要社会科学家参与,才能确保对齐算法在真实人类参与下有效。对齐先进 AI 系统与人类价值观,需解决人类理性、情绪与偏见等心理学层面的诸多不确定性。OpenAI 计划招聘社会科学家全职从事该方向研究,以推动机器学习与社会科学的合作。

2月14日周四
  1. OpenAI News85

    OpenAI 训练出大规模无监督语言模型,多项语言任务无需特定训练

    OpenAI 训练了一个大规模无监督语言模型,能生成连贯的段落文本,在多项语言建模基准上达到当时最优表现。该模型无需针对特定任务训练,即可完成基础的阅读理解、机器翻译、问答和摘要任务。

    推荐理由:OpenAI 披露了无监督语言模型在多项语言任务上的表现,可了解早期大模型的能力边界。

12月19日周三
12月14日周五
12月6日周四
11月8日周四
11月7日周三
10月31日周三
10月22日周一
  1. OpenAI News32

    OpenAI 提出迭代放大(iterated amplification)AI 安全技术

    OpenAI 提出一种名为迭代放大(iterated amplification)的 AI 安全技术,通过把复杂任务拆解为更简单的子任务来指定超出人类规模的行为与目标,而非依赖标注数据或奖励函数。该构想仍处早期阶段,目前仅在简单的玩具算法领域完成实验,OpenAI 认为它有望成为可扩展的 AI 安全方案。

10月11日周四