跳到正文

全部动态

今日 175 条
9月26日周六
  1. Ars Technica · AI80

    美国上诉法院裁定国防部可将拒绝开放 Claude 功能的 Anthropic 列入黑名单

    美国哥伦比亚特区巡回上诉法院以 2 比 1 裁定,特朗普政府有权因 Anthropic 拒绝向军方开放部分 Claude AI 功能而将其列入黑名单,即使 Anthropic 并无恶意。判决称国防部长在供应链安全法授权下平衡过度受限与不受限模型的风险未越权,驳回其复审请求;该法院此前已在 4 月驳回 Anthropic 的紧急暂缓动议。

    推荐理由:法院裁决说明政府有权因模型能力限制对企业实施供应链黑名单,对 AI 厂商与军事合作的边界有直接参考意义。

  2. GitHub Blog · AI & ML58

    GitHub Copilot app 新手教程:如何用 canvases 构建自定义工作流

    GitHub 官方教程介绍 GitHub Copilot app 的 canvases 功能,用户在 agent 会话中运行 /create-canvas 并用自然语言描述工作流,即可生成看板、发布清单等可共享的双向界面。canvas 支持人与 agent 同时操作、状态实时同步,还能保存为扩展供个人或团队复用;社区已通过 Awesome Copilot 分享了现成的 canvas 扩展。

  3. Simon Willison63

    John Gruber 谈 Meta Muse 智能体:外表可爱但实力和风险被低估

    Simon Willison 转引 John Gruber 文章:Meta 的 Muse 被视为首个消费者可用的 agentic AI 系统,每位用户在 Meta 云端获得独立持久 Linux VM,以吉祥物形象包装得易装易用;但 Gruber 质疑消费者是否理解其强大与危险,尤其运行在自己 Mac 上时,类比用户买电锯时知道自己买了什么,却未必意识到 Muse 的风险。

  4. AWS Machine Learning Blog29

    在 Amazon EKS 上结合 EFA 与 DeepEP 扩展 MoE 强化学习,吞吐量提升 40%

    AWS 提出在 Amazon EKS 上结合 EFA 与 DeepEP 的架构,加速 MoE 模型的大规模强化学习训练,吞吐量提升 40%。该方案针对 RLHF 与 GRPO 等流程中 rollout 生成与策略训练资源竞争、跨节点通信带宽受限等问题,由 DeepEP 优化 Expert Parallelism 的 all-to-all token 路由通信。

9月25日周五
  1. GitHub Blog · AI & ML60

    GitHub Security Lab 用 Taskflow Agent 构建 AI 驱动的自主模糊测试流水线

    GitHub Security Lab 的 Antonio Morales 发布 Fuzzing Taskflow,面向 C/C++ 项目的自主模糊测试流水线,只需给出 GitHub 仓库即可自动识别入口点、编写 harness、运行 AFL++、读覆盖率、改进 harness 并分诊崩溃、生成漏洞报告。

    推荐理由:作者亲述用 LLM 智能体自动化 C/C++ 模糊测试全流程的设计取舍,覆盖覆盖率反馈循环和崩溃分诊等可借鉴的工程细节。

9月24日周四
  1. Ars Technica · AI52

    美中启动 AI 安全会谈,美方提议建立 AI 安全警报通报机制

    美中本周开始 AI 安全相关会谈,财政部长 Scott Bessent 称双方已讨论建立新的 AI 安全通知机制,若中国参与将为两国互通 AI 系统风险警报提供渠道。但中国方面暂未表态,文章指出美国持续的出口管制、国会拟议的芯片限制,以及两周前司法部指控六家中国头部 AI 企业窃取美国前沿实验室成果等摩擦,可能让中方怀疑此类安全对话旨在限制中国能力。

  2. Ars Technica · AI37

    YouTube 承诺今年晚些时候推出自定义信息流及更多 AI 功能

    YouTube 在 Made on YouTube 活动上宣布,将于今年晚些时候向观众和创作者推出多项新功能,包括可通过输入描述生成并可保存多个的自定义信息流(Custom Feeds),将率先在美国的网页、移动和电视端上线。此外,评论区将支持发布 GIF,私信功能将新增群聊,后者初期仅在美国、英国、新加坡、巴西及部分欧洲国家可用。

9月23日周三