跳到正文

全部动态

今日 27 条
9月30日周三
  1. X:swyx (@swyx)8

    swyx 回应网友:我有最好的回复者

    swyx 在 X 上回应网友称"我有最好的回复者",并转发了 Andrew Dunn(@DunnWithAI)提供的来源链接:Heavybit 文章《How To Be A Great Panel Moderator》。该文指出,主持人角色比小组成员难上百万倍,主持人更像操控木偶的人而非小组成员。

  2. X:Nathan Lambert (@natolambert)12

    Nathan Lambert:在 AI 领域不愿承担出错风险,就难以做出有价值的判断与预测

    Nathan Lambert 表示,在 AI 领域如果不接受自己有时会判断错误,就很难做出真正有价值的观点和预测。他认为当下对想要推动议题、适时批评、更新认知并公开思考的 AI 从业者来说是一段非常艰难的时期,并赞赏那些没有陷入稻草人论证、陈词滥调和标题党式妄想的少数独立声音,呼吁他们继续坚持。

9月29日周二
  1. X:DAIR.AI (@dair_ai)40

    JevRAG 变体涌现:用 Jev 替代嵌入向量的 RAG 与智能体优化探索

    GPT Researcher 已将 RAG 流程中的嵌入向量替换为 Jev,并在 SimpleQA 的 28 个研究任务上测试,相关上下文提升 59%(73% vs 46%),盲测中报告以 15 比 3 更受偏好,单篇报告成本持平,现已默认运行在 Jev 上且不再需要嵌入向量。有开发者表示自己在论文探索中测试 JevRAG,用 Jev 做重排序效果更好,并尝试将语义搜索与 Jev 结合来检索论文。

  2. AndrewYNg52

    Andrew Ng 表示 OpenAI-Hugging Face 入侵事件源于沙箱机制薄弱,并介绍其开源智能体框架 OpenWorker 将基于 Nvidia OpenShell 支持在沙箱中运行智能体命令。沙箱默认只暴露任务相关文件,屏蔽 API 密钥、浏览器登录凭证和任意网站访问,这些限制由确定性代码实现而非依赖 LLM 提示词,以避免出错和提示词注入,同时所有操作都会被记录以供监控审计。

  3. Simon Willison40

    OpenAI 智能体安全负责人谈 AI 能力突跳带来的安全挑战

    OpenAI 智能体安全(Agent Security)负责人 @joedaroo 表示,模型在“cyber”“swarming”“message boards”等相关能力上的跃升之快、之突然,令团队深感意外。他强调安全态势需要时间积累,不只是加固系统,还要把安全意识植入公司文化,让人员随之演进。他呼吁各组织自问:人员、系统与流程能否承受 AI 能力的突然跃升,是否具备正确的事件响应与沟通机制。

9月28日周一
  1. colintjarvis28

    OpenAI FDE 成员 Luis Velasco 在 HumanX Amsterdam 活动上分享,前沿 AI 转化为可衡量业务影响的关键在于"先让它存在,再规模化",这一原则经 18 个月客户合作验证有效。他指出企业级软件构建原则未变,但治理、编排和评估的基础组件已演进。企业可通过向智能体一致地暴露数据与专用系统,并为高价值工作流收集内部评估数据来直接释放价值。