跳到正文

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

最新精选

第 21–24 条 · 共 24 条
4月23日周四
  1. Google Research63

    Google Photos Auto frame 上线基于 3D 场景重构图视角的照片编辑功能

    Google 宣布将一项新的视角重构方法上线 Google Photos 的 Auto frame 功能,可自动调整拍摄视角优化人像照片。方法分两阶段:先用内部 3D point map 估计模型重建场景并近似焦距,再用生成式 latent diffusion 模型补全新视角下被遮挡的内容,并自动修正广角前置镜头造成的透视畸变。

    推荐理由:原文解释了方法如何用 3D 场景估计加生成补全来改换拍摄视角,读者可以理解它与常规裁剪编辑的本质差异。

4月16日周四
3月29日周日
  1. Google DeepMind61

    Google DeepMind 探索 AI 指针,交互原则落地 Chrome 与 Googlebook

    Google DeepMind 发布由 Gemini 驱动的实验性 AI 指针,并提出四条交互原则:保持工作流、指向即上下文、自然指代交流、把像素变成可操作实体。用户现可在 Google AI Studio 和 Chrome 中用指针加语音向 Gemini 提问,Googlebook 的 Magic Pointer 也即将推出。

    推荐理由:文章给出 AI 指针的四条交互原则,并结合 Chrome 与 Googlebook 说明落地入口,读者可据此理解指针交互的变化。

3月12日周四
  1. Google Research75

    Google AMIE 完成真实门诊前瞻性可行性研究,100 名患者中未触发安全停止

    Google 与 Beth Israel Deaconess Medical Center 合作,在真实门诊环境中对对话式诊断 AI 系统 AMIE 开展前瞻性单中心可行性研究,100 名成年患者完成了就诊前与 AMIE 的问诊交互,由医生通过视频实时监督,全程未触发预设的四项安全停止标准。

    推荐理由:原文给出真实门诊中 AMIE 的安全数据与诊断准确率,读者可以据此了解对话式医疗 AI 落地临床的证据进展。