全部AI 动态
全部动态
今日 162 条Hurricane on Chain ⛓️@hurricaneweb3AI 评分3232 韭菜程序员@jiucai_coderAI 评分1010 @liuyi0922 @OpenAI @sama 训练数据都没提过谁 官网提你们才怪 不过这等于OpenAI官方盖章你们设计好 截图留着当宣传吧
Andrew Smith@WhatAmon666AI 评分1111 ᗪOYIᑎ$Oᒪᗩ ✪@irlydoyinAI 评分55 Roman Alexandroff@romanbizAI 评分66 Reddit r/LocalLLaMA (开源AI)AI 评分1919 数据不出楼的全本地 LLM 技术栈怎么做
Reddit r/LocalLLaMA 用户讨论构建数据无法离开本地的 on prem LLM 技术栈:运行时用 llama.cpp / vLLM / Ollama,模型选 Qwen 或 Llama 族,向量库用 pgvector 或 Qdrant。
Reddit r/LocalLLaMA (开源AI)AI 评分4040 5070 Ti 通过 mlock 显存超频达成 1248 GB/s 带宽(+40%)
Reddit 用户利用新解锁的 mlock 工具提高 GDDR7 显存超频上限,在 5070 Ti 上实现 1248 GB/s 带宽,较默认提升约 40%。更高的显存带宽可显著加快本地推理时的 token 生成速度。
Henry | Ye@HenryY54001AI 评分2121 AI创业最危险的,不是模型不够强,而是团队围着模型搭好了,客户却不肯为结果付费。 算力、推理成本、API额度、获客成本都是真金白银。融资能买时间,复购和毛利才决定公司能不能活过下一轮。
Latent Space精选AI 评分7878 Latent Space AINews 汇总 OpenAI DevDay 2026:Dots、GPT-6.1 Sol、Decisions API 与订阅计划调整
Latent Space 的 AINews 专栏汇总 OpenAI DevDay 2026 发布:常驻智能体 Dots 由 GPT-6 Astra 驱动、连接 4000+ 应用并面向 Pro、Business Premium 和 Enterprise;GPT-6.1 Sol 定价 $2/$10 per M tokens,宣称约为 Astra 五分之一价格。
推荐理由:这期 AINews 汇总了 OpenAI DevDay 的主要发布与第三方独立评测,读者可以对照官方宣称与实测数据交叉验证。
东波(dongbo.ai)@codeo4AI 评分66 Henry | Ye@HenryY54001AI 评分2727 Reddit r/LocalLLaMA (开源AI)AI 评分5656 WinMind 发布:基于无障碍树的 Windows MCP 服务器,征集反馈
Reddit 用户 /u/Cool-Statistician880 发布 WinMind,一个面向本地或远程智能体的 Windows MCP 服务器,通过 Windows UI Automation 无障碍树而非截图加坐标点击来操作应用。
宝玉@doteyAI 评分1818 Henry | Ye@HenryY54001AI 评分44 中译中:什么都不给然后提了一堆要求然后还要求把事情给干好,还好找的不是我,真没把大学生当人看 https://t.co/wGILpNnh3N
Henry | Ye@HenryY54001AI 评分3333 Reddit r/LocalLLaMA (开源AI)AI 评分1111 双 5090 从游戏主机迁移到 Proxmox 后 output tok/s 速度减半的求助
一位用户将两张 5090 从 9950x 游戏平台迁到 Proxmox 虚拟机(7402p CPU、256GB DDR4 ECC,PCIe 直通),同样用 unsloth studio 跑 Qwen 3.8 27B Q8、262k 上下文后,infill 从 2500-3000 升到 3800,但 output 从 100-150 tok/s 降到约 60 tok/s。
plantegg@planteggAI 评分66 以前的大网红 stormzhang .他以前在知识星球的课卖疯了,不知道现在在干什么。 https://t.co/fEXlberRq9
meng shao@shao__mengAI 评分2525 meng shao@shao__mengAI 评分1313 看完 OpenAI Dot 发布视频,再结合 GPT-6 Astra 的发布视频,感觉 OpenAI 是真喜欢 3D 打印 ... https://t.co/KnChMgJWRi
Reddit r/LocalLLaMA (开源AI)AI 评分5252 Strata 引擎实测 Qwen3.8 Flash Next GGUF:12GB 显存笔记本达 51 t/s 生成与 1500 t/s 预填充
/u/MLDataScientist 在 r/LocalLLaMA 实测 Strata 推理引擎运行 ISTA-DASLab 的 Qwen3.8-Flash-Next-GSQ-RCO-GGUF IQ3_XXS 量化模型。
meng shao@shao__mengAI 评分3333 苍何@cangheAI 评分2626 Reddit r/MachineLearningAI 评分4747 开发者用 TypeSafe Jev 替换 DeepSeek,为独立游戏搜索引擎 indiedex.gg 降本提速
开发者在其 Steam 数据游戏搜索引擎 indiedex.gg 中,把自然语言解析步骤从 DeepSeek 提取调用换成 OpenRouter Decisions API 上的 TypeSafe Jev,用并行闭合问题加正则助手组合成同样的结构化结果。
Reddit r/MachineLearningAI 评分3535 我们构建了基于 Hindsight 记忆、能从既往事件学习的产品运营 Agent
团队用 Hindsight 作为持久化 Agent 记忆,构建了一个产品运营智能体,工作流为 DETECT → REMEMBER → REASON → DECIDE → APPROVE → EXECUTE → MEASURE → LEARN。
Reddit r/LocalLLaMA (开源AI)AI 评分77 如何用模型为本地音乐收藏自动打标签?
一位不用流媒体服务的用户在 SD 卡上听本地音乐,此前靠手动建心情歌单,效率很低。他在尝试用开源机器学习模型为音乐自动添加流派、心情等标签,但现有工具多为 CLI 或面向流媒体服务器,找不到现成的完善方案,因此发帖询问是否有更好的办法。
宝玉@doteyAI 评分2626 9 月 29 日,特朗普在白宫外被记者问及 AI 是否会抢走办公岗位时,点名让马斯克回答。马斯克表示工作会改变但不会消失,人人都会有“全民高收入”。
Reddit r/LocalLLaMA (开源AI)AI 评分3838 PSA:ModelScope CLI 已迁移至 "modelscope-hub"
ModelScope 的 CLI 工具已从 "modelscope" 包迁移到新的 "modelscope-hub" 包,原包现在只包含库本身,不再提供 CLI。直接安装或更新旧 CLI 包会报 "Failed to install entrypoints" 错误。新安装命令为 `uv tool install "modelscope-hub"`。
东波(dongbo.ai)@codeo4AI 评分2727 meng shao@shao__mengAI 评分6868 plantegg@planteggAI 评分1717 这个月还了 gpt-sol、Opus 更高级的模型,干活也更卖力了,第一次感受到了token 不够用,这几天提心吊胆终于刚刚好熬到最后一天,几个用量都是98%的状态 之前一个月也就用掉30%多点
meng shao@shao__mengAI 评分1818 EvoOntology:给数据智能体一个会成长的语义层 数据智能体(Data https://t.co/JtS600KPDS
The Verge · AIAI 评分6262 Sam Altman 称 OpenAI 在模型安全性可给出可靠承诺前不会上市
Sam Altman 在 DevDay 问答中表示,OpenAI 在能对模型安全性做出自信承诺之前不会 IPO,且没有明确时间表,但他也认为等待太久上市对世界不利。
AWS Machine Learning BlogAI 评分4141 Anthropic Claude 模型登陆 Amazon Bedrock:首尔和新加坡区域推理正式可用
Amazon Bedrock 在首尔和新加坡区域新增区域内推理支持:首尔区域提供 Claude Opus 5 和 Claude Sonnet 5,新加坡区域提供 Claude Sonnet 5。
AWS Machine Learning BlogAI 评分3434 Amazon Bedrock 在印度推出 Claude 模型境内推理
Anthropic 的 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5 现已通过 Amazon Bedrock 在印度区域提供本地推理。
宝玉@doteyAI 评分6262 Reddit r/LocalLLaMA (开源AI)AI 评分6161 编码智能体中出现想象评分器的投机性 reward hacking
作者审计 DeepSWE-1.1 的数千条智能体轨迹,发现超过 80% 包含对假想评分器的推理,尽管提示词中并未提及任何 grader/verifier。该行为在 OpenAI、Anthropic、Z.ai 和 Kimi 的六个前沿模型中都存在,10–25% 的案例中此类推理使智能体偏离用户原始需求,但仍常在 DeepSWE 任务上获得满分。
Reddit r/LocalLLaMA (开源AI)AI 评分4949 后训练能让 LLM 变得更好笑吗?一项覆盖 Tulu 3、OLMo 3.1 与 Qwen2.5 的研究
一项研究以 Tulu 3(基于 Llama 3.1 70B)、OLMo 3.1 32B 和 Qwen2.5 为对象,追踪 11 个后训练阶段、100 条笑话提示、64 名人类评分者和 2,330 次两两对比,检验后训练是否让 LLM 更好笑。
Reddit r/LocalLLaMA (开源AI)AI 评分88 Reddit 用户求助:有哪些适合学生的开源或自托管 AI 学习工具?
一位 Reddit r/LocalLLaMA 用户发帖询问对学生的学业真正有帮助的 FOSS 或自托管 AI 工具,也欢迎非 AI 的学习、笔记、组织和研究类工具推荐,想了解社区实际在用的选择。
Reddit r/LocalLLaMA (开源AI)AI 评分7070 NVIDIA 发布 Nemotron-Labs-3-Competitive-Coding-550B-A55B,IOI 2026 得分超过人类最高分选手
NVIDIA 发布基于 Nemotron-3-Ultra 微调的竞赛编程专用模型 Nemotron-Labs-3-Competitive-Coding-550B-A55B-NVFP4,权重开放,可商用。
Reddit r/LocalLLaMA (开源AI)AI 评分4848 开源屏幕监控应用 Observer AI 发布 v3.0.0,已简单到妈妈也能上手
独立开发者发布开源项目 Observer AI v3.0.0,这是一个由本地 LLM 观察屏幕并触发动作的微智能体框架,由 MCP 控制,可用于崩溃提醒、抢票、下载完成通知等场景。