跳到正文

全部动态

今日 175 条
9月23日周三
  1. NVIDIA Blog22

    Sakeena Fiza 如何保障 NVIDIA 硬件大规模成功

    NVIDIA 验证工程师 Sakeena Fiza 负责在量产前发现数据中心系统问题,团队曾见证 Rubin GPU 首次在系统层面成功枚举。验证工作覆盖从托盘到机架再到 AI 工厂的各环节,单板含数万个组件,机架接近 50 万个组件。她在实验室中排查高速信号、散热余量、电源完整性等各类故障,确保问题在客户遇到前被解决。

  2. Latent Space84

    Anthropic 发布 Claude Opus 5.5,OpenAI 同日以 GPT-6 Sol 和 Luna 降价应战

    Anthropic 发布 Claude 5.5 系列首个模型 Claude Opus 5.5,称多数任务达到 Claude Fable 5.1 水平、比 Opus 5 快约 30%、任务成本低约 40%,定价从 $5/$25 降至 $4/$20 每百万输入/输出 token,并成为 Claude Code 和 Claude 应用的默认模型。

    推荐理由:汇总了 Claude Opus 5.5 发布日的官方数据与第三方评测,包括价格争议和 effort 反常结果,信息密度高。

9月22日周二
  1. MIT Technology Review · AI46

    不要被这个夏天的 AI 炒作迷惑

    MIT Technology Review 刊文指出,Anthropic 与 OpenAI 近几个月宣称的 Claude Mythos 漏洞挖掘能力、数学突破等成就在专家检验后大打折扣:安全专家认为黑客事件更多是 OpenAI 忽视基本安全实践,数学家则指控 Astra 的“突破”涉嫌剽窃、并非新颖成果。文章批评“超级智能”叙事被用来转移问责,呼吁政策制定者咨询独立专家、对营销式炒作保持怀疑。

9月21日周一
  1. Import AI35

    Import AI 473:美国的超级智能战略;小鼠颅中的人类大脑;机器诠释学

    RAND 发布长篇报告,提出美国应在通往超级智能的不确定路径上采取"自由行动"(Freedom of Action)战略,先花钱保留选择空间。报告归纳了共存、遏制、加速三大类共七种原型战略,并列出危险临近度、共存可行性等五大不确定性因素。作者评论称美国当前策略接近"加速"路线,只求快而缺少刹车与安全投入。

9月19日周六
  1. Google Research42

    Google Research 推出 MilleMiglia:面向中程物流的仿真实例生成器

    Google Research 发布 MilleMiglia,一个用 C++ 编写的实例生成器,用于为中程物流配送问题创建贴近现实的基准数据,源代码与文档已在 GitHub 开源。中程物流指区域或大陆尺度配送中心之间的大宗货物运输,因企业将网络拓扑和需求量视为机密,长期缺乏公开高质量数据。该工具以时空图上的多商品流问题建模,可生成保护隐私的数据,为后续研究奠定基础。

9月18日周五
  1. GitHub Blog · AI & ML37

    AI 热观点拆解:要不要读 AI 生成代码、RAG 是否已死、Skills 是否杀死了 MCP?

    GitHub Podcast 最新一期拆解了五个常见 AI 热观点:AI 生成代码仍需审查但风险程度有别;求职者对 AI 的态度关键是判断力而非全面依赖或拒绝;Skills 与 MCP 解决不同问题,前者提供打包知识、后者提供工具接入标准;RAG 并未过时,检索可让模型更快接近答案;微调需求往往暴露代码库可维护性问题。

9月17日周四
  1. Latent Space38

    AI 现实检验:Steve Yegge 关闭 Gas Town,Databricks 使用 Astra 支出增加 60%

    Steve Yegge 在每月花费数千美元订阅编码智能体后关闭了 Gas Town,承认只用它做出了这一个项目;Databricks 向约 3,500 名工程师推出 GPT-6 Astra,虽在复杂长程任务上优于 Opus 5 / Sol 5.6,但编码总支出增加约 60%。OpenAI 同时发布了模型 misalignment 事件的披露框架及六份案例报告。