#部署/工程
#部署/工程
SemiAnalysis_@SemiAnalysis_AI 评分 SemiAnalysis_@SemiAnalysis_AI 评分
Latent SpaceAI 评分Standard Bots 分享工业机器人 AI 可靠执行的经验
Latent Space 采访了 Standard Bots 联合创始人兼 CEO Evan Beard 和 AI 负责人 Leif Jentoft,介绍这家自称美国最大 AI 原生工业机器人制造商的技术栈。
SemiAnalysis_@SemiAnalysis_AI 评分 SemiAnalysis 指出,Nvidia 在最新 10Q 中披露六个科目的表外担保总额达 $530B,较上季度披露的 $184B 大幅跳升。
hongming731@hongming731AI 评分 BestBlogs 10-10 早报精选 10 条 AI 内容,涵盖前 Intel CEO Pat Gelsinger 谈 AI 芯片与内存能源瓶颈、Ai2 将 GPU 配额改为时间预算的调度实践。
Simon WillisonAI 评分 Cloudflare 收购 Deno,一年后停止维护 Deno runtime
Cloudflare 宣布整体收购 Deno,目标是基于 Deno 团队 8 月发布的开源项目 celld,让 workerd 自托管成为使用 Workers 编程模型构建和运行应用的一等支持方式。
Ars Technica · AIAI 评分乌克兰无人机击中俄罗斯搜索引擎公司旗下AI数据中心
据 Reuters 报道,乌克兰无人机击中了俄罗斯搜索引擎公司(被称为俄罗斯的 Google)旗下的一座 AI 数据中心,受影响的俄罗斯服务还包括一款约会应用、房产聚合平台、自助出版平台以及俄超最成功职业足球俱乐部的网站。
SemiAnalysis_@SemiAnalysis_AI 评分 SemiAnalysis_@SemiAnalysis_AI 评分 我们的智能体推理利润计算器估算,Vera Rubin NVL72 即使运行略逊于前沿水平的开源模型(如 @MiniMax_AI M3 428B),也能产生 39B 的年利润。(2/3)
thexpin@thexpinAI 评分 SemiAnalysis_@SemiAnalysis_AI 评分 更多此类报道见 SemiAnalysis Energy Model (4/4) semianalysis.com/energy-mode…
SemiAnalysis_@SemiAnalysis_AI 评分 SemiAnalysis_@SemiAnalysis_AI 评分 你能用卡车运送的天然气来运营一个AI数据中心园区吗?SemiAnalysis 负责AI建设天然气报道的 Ellie Holbrook 告诉 Bloomberg,这远远不够。(1/4)🧵
fal@falAI 评分
SemiAnalysis_@SemiAnalysis_AI 评分 SemiAnalysis_@SemiAnalysis_AI 评分 Google@GoogleAI 评分 SemiAnalysis_@SemiAnalysis_AI 评分 SemiAnalysis_@SemiAnalysis_AI 评分 SemiAnalysis_@SemiAnalysis_AI 评分
rohanpaul_ai@rohanpaul_aiAI 评分
TechCrunch · AIAI 评分Lambda 拟在 2027 年 IPO 前融资 40 亿美元,估值 145 亿美元
据 The Wall Street Journal 报道,云服务商 Lambda 计划以 145 亿美元投前估值融资至多 40 亿美元,由 Coatue Management 和 Blackstone 领投,这可能是其 2027 年 IPO 前最后一轮私募。
SemiAnalysis_@SemiAnalysis_AI 评分
SemiAnalysis_@SemiAnalysis_AI 评分 NVIDIA BlogAI 评分
电信运营商为何将 AI 战略建立在开放模型之上
NVIDIA 最新《State of AI in Telecommunications》报告显示,89% 的电信运营商受访者认为开源模型和软件对其公司 AI 战略很重要。
rohanpaul_ai@rohanpaul_aiAI 评分
SemiAnalysis_@SemiAnalysis_AI 评分 SemiAnalysis_@SemiAnalysis_AI 评分 SemiAnalysis_@SemiAnalysis_AI 评分
X:Peter Steinberger (@steipete)AI 评分 Peter Steinberger:Apple 新开发者协议导致其全部开源发布停摆,Linux/Windows 版本一并被锁
Peter Steinberger 称其所有开源发布因 Apple 上线新开发者协议而停摆,由于发布流程 lockstep 绑定,Linux/Windows 版本也被一并阻断。评论指出,一个平台专属的协议签署成了跨平台发布的单点故障,有人建议拆分发布任务,但认为真正的解法是在发布前就检测到该阻塞。
X:SemiAnalysis (@SemiAnalysis_)AI 评分 SemiAnalysis 复测 Lambda:ClusterMAX 2.0 可靠性改进与 XID 79 未监控问题
SemiAnalysis 在 ClusterMAX 2.0 复测中指出,Lambda 的被动健康检查自动修复了测试中模拟的三个错误,两个合成 XID 在 15 分钟内被自动修复,并有配套仪表盘监控节点健康。
X:SemiAnalysis (@SemiAnalysis_)AI 评分 SemiAnalysis:定制 HBM 可将 Nvidia Rubin 计算芯片的 HBM4 控制器与 PHY 占用面积减少约 60%
SemiAnalysis 估算 HBM4 控制器和 PHY 约占 Nvidia Rubin 计算芯片 16% 面积。定制 HBM 用紧凑 D2D 链路替代标准 PHY,Samsung 数据显示其标准 HBM4 PHY 占 8mm x 4mm,定制 D2D 接口仅需 8.5mm x 1.5mm,面积减少约 60%,同时内存控制器从计算芯片移至 HBM base die。
X:SemiAnalysis (@SemiAnalysis_)AI 评分 SemiAnalysis:定制 HBM 可将 HBM4 控制器与 PHY 占用面积减少约 60%
SemiAnalysis 估算 HBM4 控制器和 PHY 约占 Nvidia Rubin 计算芯片 16% 面积,定制 HBM 可将这部分空间还给计算或缓存。
SemiAnalysis_@SemiAnalysis_AI 评分 X:Elvis Saravia (@omarsar0, DAIR.AI)AI 评分 Volantis 用光学技术破解 AI 内存瓶颈,目标单用户 10000 tokens/秒推理速度
Volantis 完成 8800 万美元 A 轮融资,通过光学技术为每颗芯片提供更大容量和更高带宽的内存,目标在超过 10T 参数的模型上实现每用户最高 10000 tokens/秒的推理速度。该方案旨在解决 AI 内存瓶颈,初期可让原本耗时数小时的编程智能体在几分钟甚至几秒内完成。团队曾参与首款 CoWoS 产品、早期 HBM 及首款硅光 CPO 系统等半导体技术研发,下一代产品已完成流片。
semiDL@semiDLAI 评分 cohere@cohereAI 评分 perplexitydevs@perplexitydevsAI 评分
GoogleAI@GoogleAIAI 评分
Latent SpaceAI 评分Airbnb CTO 谈 AI 原生改造:60% 代码由 AI 编写,Everest 上下文图谱加速产品落地
Airbnb CTO Ahmad Al-Dahle 向 Latent Space 介绍了公司的 AI 原生改造:目前 60% 的代码由 AI 编写,功能交付量同比增长近 80%,工程师人均 PR 吞吐量提升约 1.6 倍。