Claude 近期创意作品集:Opus 5.5 打造水车、浮雕卡片与 3D 交互项目
Anthropic 展示了近期用 Claude 制作的一批创意项目,包括用 Opus 5.5 构建的可运转水车、浮雕卡片、木星卫星 3D 飞行网站和可拆解的喷气发动机交互 3D 模型。另有用户用 Claude Code 创作插画诗歌,用 Sonnet 5.5 制作纸折弹出式城市。
Anthropic 展示了近期用 Claude 制作的一批创意项目,包括用 Opus 5.5 构建的可运转水车、浮雕卡片、木星卫星 3D 飞行网站和可拆解的喷气发动机交互 3D 模型。另有用户用 Claude Code 创作插画诗歌,用 Sonnet 5.5 制作纸折弹出式城市。
Anthropic 展示用户用 Claude 制作的创意项目,包括用 Opus 5.5 构建的可运行水车、可拆解的交互式 3D 喷气发动机,以及用 Sonnet 5.5 制作的纸折弹出式城市。另有用户在 Claude Code 中创作插画诗歌,以及跟随西雅图实时天气与时间的像素漫步项目。
Anthropic 展示了一批用户近期用 Claude 创作的作品,包括用 Opus 5.5 搭建的可运转水车、浮雕卡片、从银河系外飞抵木星卫星的 3D 网站,以及用 Claude Code 配图的诗歌。另有用户用 Sonnet 5.5 制作了纸折建筑组成的弹出式城市,以及可拆解的喷气发动机交互 3D 模型。
Anthropic 展示近期用 Claude 创作的作品合集,其中包括用 Opus 5.5 搭建的可运转水磨、3D 星际飞行网站和可拆解的喷气发动机交互 3D 模型,以及用 Sonnet 5.5 制作的折纸弹出城市。还有一件作品是 Claude Code 配合相机在 Old Street 通宵运行。
Thariq(@trq212)正在为下一篇面向企业领导者的文章征集素材,主题是如何应对 AI 编程智能体带来的变化。他询问读者希望管理层理解智能体的哪些方面,以及正在经营公司的人遇到了哪些问题。
一位开发者借助 Claude 学习动画制作并查找参考,让 Claude 搭建了一个动画编辑器,用于反复迭代游戏原型中的跳跃动画,并放出了对比视频。他强调这是个人副业项目,认为做游戏的过程本身极具创造性,不应外包给 AI,而应让 AI 配合自己实现构想。
美中多家实验室的论文提出 AgentBug-Smith,把 GitHub 上智能体框架的真实 bug 报告自动转成可运行测试,形成一套 200 个 bug 且持续增长的基准。
Grok 4.7 正在 Grok 网页版和移动端推送,成为 Fast、Expert、Build、Heavy 全部模式的基座模型,并上线 Google 的 Gemini Enterprise Agent Platform;Grok Bot 逐步转向主动建议,Grok Build 新增 /dashboard 智能体面板。
Claude Sonnet 5.5 以 xHigh 推理模式进入 Code Arena: WebDev,得分 1786 分排名第 3,混合价格 $8/M tokens。
Arena 发布本周榜单更新,四款新模型改变了 Text、Code 和 Agent Arena 的帕累托前沿。
Arena 公布 Claude Sonnet 5.5(Max)首次进入 Agent Arena 即排名第 3,净提升 +12.5%,比排名第 13 的 Claude Sonnet 5(High,+4.4%)高出 8.1 个百分点;在 Chat 分类中以 +15.6% 位列第 1,高于 Fable 5.1(+11.49%)和 Opus 5.5(+10.29%)。
Arena 公布 Claude Sonnet 5.5 (Max) 在 Agent Arena 首次上榜即排名第 3,净提升 +12.5%,比排名第 13 的 Claude Sonnet 5 (High) 高出 8.1 个百分点。
推荐理由:榜单给出了 Claude Sonnet 5.5 在 Agent Arena 与 Code Arena 的排名、分数和每任务成本,可据此比较它与 Opus 5.5、GPT-6 Astra 的性价比。
OpenAI Developers 与 Casey 对谈创意未来,展示如何从一个想法直接做出可在 ModRetro 掌机上实际游玩的游戏。讨论焦点在于想法到可玩成品之间的落差正在迅速缩小,且该游戏需运行在 160×144 屏幕上,当生成能力趋于无限时,约束反而成为稀缺的创意输入。
OpenAI 为 DevDay 上线 side quest 活动,含 10 项 builder 挑战,完成任意 5 项即可各获 1 张抽奖券,奖品为 5 台 Codex Micro,全球均可参与。报名窗口还剩 48 小时,提交将于 10 月 3 日下午 2:30 PT 截止。
开发者 Elizabeth Siegle 用 OpenAI 智能体做出首款 ModRetro Chromatic 掌机游戏,玩家在游戏中经营马萨诸塞州西部一家关注新冠防护的女同性恋酒吧,并撑过小丑学校 Zoom 混乱的周六班次来赚取积分和社区支持。该项目上周末以 webapp 起步,拿到 Chromatic 硬件后转为 Gameboy 应用,全部智能体会话记录发布在 EntireHQ 上。
一名用户在自动驾驶汽车行驶途中,用 Codex 安装了一款由 AI 在他睡觉时自行制作的游戏。该用户称这一体验"太疯狂了",并 @OpenAI 与 @OpenAIDevs 分享。评论区有人追问游戏内容,也有人调侃"Codex 交付了游戏,汽车交付了通勤"。
OpenAI Developers 介绍 dot 能学习用户工作方式、跨应用保留上下文、协调 Codex 任务并提示需要关注的事项。开发者 dominik kundel 表示 dot 与 Codex 配合良好,dot 已成为他使用 Codex 的首选方式,可减少心智负担,其主动性很实用。
Tibo(@thsottiaux)表示,未来的模型将在代码删除和简化方面表现得更好,而且来得正是时候。原文未透露具体模型名称、版本或时间表。
Andrew Milich 的 PR #464 新增 SCIM 2.0 用户管理 API(`/scim/v2`),共 16 个文件、2402 行新增代码,审查结论为 request changes。
Claude Code 的 mods 本质上是带有若干特殊函数的插件,能让你的代码在 Claude Code 内部运行,作用类似中间件。官方表示可以直接让 Claude 帮你编写这些 mods。
Claude Code 新增内置插件 You should Know,可扫描 Claude 的输出,找出用户可能遗漏的重要信息,帮助用户保持同步。该插件通过 `/plugin enable cc-plugin-you-should-know@builtin` 命令启用。
OpenCode 宣布 inclusionAI 的最新模型 Ling-3.1-flash 在其平台免费开放,该模型为 560B 总参数、25B 激活参数、262K 上下文。评论区集中追问是否有基准测试、编码表现如何、免费是否有每日用量上限以及会持续到什么时候。
有开发者基于 opencode v2 构建了一个浏览器侧边栏,能够运行脚本、修改并控制用户当前所在的页面。该开发者称在 opencode v2 之上构建客户端"极其强大",并表示在进一步测试后会将其作为 Chrome 插件发布。
GitHub 提出 AI 时代开发者应强化的三项技能:学会指挥 AI 智能体而非仅使用它、不轻信 AI 的首次回答、用 AI 节省的时间去解决更大的问题。文中以 GitHub Copilot 内置的 Rubber Duck agent 为例,说明它用第二个模型对计划、代码和测试进行批判性审查,以发现首个模型遗漏的问题。
Airbnb CTO Ahmad Al-Dahle 向 Latent Space 介绍了公司的 AI 原生改造:目前 60% 的代码由 AI 编写,功能交付量同比增长近 80%,工程师人均 PR 吞吐量提升约 1.6 倍。
一位开发者用 Claude 辅助学习动画并生成参考,让 Claude 做出一个可迭代跳跃动画的动画编辑器,并晒出对比视频。他表示效果令人满意,但自知仍有不少问题,受限于自身技能水平,需要提升判断力。这是他的个人游戏原型副业项目,他主张不要用 AI 外包游戏创作,而是让 AI 配合实现自己的构想。
一位开发者借助 Claude 学习动画制作并查找参考资料,让 Claude 构建了一个动画编辑器,用于反复迭代游戏原型中的跳跃动画。他发布了前后对比视频,并表示对结果很满意,但坦言自己已到技能上限,仍需提升判断力。他强调这是个人副业项目,主张用 AI 辅助实现创意而非外包。
LangChain 在 Open SWE 智能体 Harness 内构建模型路由器,按任务分类选择最低成本合适模型,将编码线程中位数成本降低 64% 且质量变化可忽略。Olmo-core 3 面向大规模 MoE 训练,在八块 B300 配置下吞吐量较前代提升 2.7 倍。Cohere 发布 Embed 5 嵌入模型系列,含 Pro 和 Fast 版本,面向搜索与智能体工作流。
Chatham Financial 借助 OpenAI 的 Codex 和 GPT-5.6 构建技术并重构工作流,将交易验证时间从 30 分钟缩短到 4 分钟以内。该举措用于扩展其在资本市场领域的专业能力。
Cursor 宣布 GLM 5.3 和 GLM 5.3 Flash 已在其平台上线。其中 GLM 5.3 Max 在 CursorBench 4.0 上是得分最高的开源权重模型。
Grok Build 上线 Agent Dashboard,可将所有智能体集中在一个自上而下的视图中管理,并用 /dashboard 或 grok dashboard 命令调用。用户能从该视图派发新智能体、并行启动任务,或用 Ctrl+W 让智能体在各自的 git worktree 中运行。
Claude Code 上线 Mods,用户可以通过提示词定制 Claude 的工作方式和外观,改变其行为、自定义 UI,或替换成自己的功能。Mods 用几行 TypeScript 编写,也可以让 Claude 代写,并以插件形式分发,在 CLI 或桌面应用中用 /plugin 安装,还能作为插件分享给他人使用。
fal CTO @gorkem 在 GenMedia Conference 上表示,生成式媒体已达到“token market fit”,专业人士如今整日坐在电脑前用 AI 生成视频。他指出,AI 市场中只有编程智能体和视频生成能让单个用户高效消耗如此大量 token,这是过去一年生成式媒体最大的变化。
Google 放出 Gemini 4 Argon 的早期预览,称其在复杂工作流、网络防御和软件工程上展现前沿性能,Google 内部团队已从编码到量子计算广泛使用。在 PostTrainBench 上,Gemini 4 达到 45.3%,高于 Gemini 3.1 Pro 的 21.99%。作者表示这是朝构建能负责任自我改进的 AI 迈出的一步,并附上了基准测试结果。
Anthropic 上线 Claude.dev,作为面向 Claude 开发者的新站点,提供工程深度解析、Claude Code 与 API 指南,以及来自 Claude 构建团队的技巧,还藏有一些彩蛋。
Google 发布 Gemini 4 Argon 模型,宣称在编码、知识工作和网络安全方面具备行业领先性能,但目前仅限公司内部有限测试,外部用户尚不能使用。
Google 发布 Gemini 4 Argon,官方称其为面向真实世界编码、企业知识工作和网络防御的前沿模型,即将逐步开放。Google 员工 Logan Kilpatrick 表示该模型由 Google 内部多方协作完成,目前只是开始,期待更多人使用。
Google DeepMind 发布新前沿模型 Gemini 4 Argon,面向编码、企业知识工作和网络安全防御等复杂工作流。该模型今天起通过 Fairwind Program 向一批受信任测试者开放。
Grok Bot 面向软件开发的能力增强,机器人可以把编码任务交接给 Cursor,并通过 GitHub 和 Origin 插件管理 PR,还能分享所构建内容的视频演示。作者同时给出 x.ai 机器人市场中的工程类机器人入口。
Crosby 律所让 Devin 承担一线响应,每天调查 20–40 个 bug 和告警,将 Sentry 噪音降低 50%。在法务团队规模扩大 5 倍的情况下,其 12 名工程师仍将 on-call 值班保持在一人。