Google 发布本地优先会议记录工具 AI Edge Foresight
Google 发布 AI Edge Foresight,一款面向 Mac 的本地优先 AI 会议记录工具,可完全离线运行并使用设备端 EmbeddingGemma 2 模型。
Google 发布 AI Edge Foresight,一款面向 Mac 的本地优先 AI 会议记录工具,可完全离线运行并使用设备端 EmbeddingGemma 2 模型。
Google 宣布将统一 AI 智能体引入 Gemini,先面向企业用户推出可执行任务的 Agent。该智能体可接收目标、规划工作、调用技能和工具,并连接企业内部系统与 MCP server。用户可选择包括 Anthropic 的 Claude 模型在内的模型,智能体还将通过 Workspace 账号、任务收件箱和审计记录参与企业协作。
推荐理由:文章具体梳理了 Gemini 企业智能体的任务机制、系统连接和审计方式,便于理解 Google 如何将 Agent 能力接入企业工作流。
Google 发布实验性 AI 记事应用 Google AI Edge Foresight,可在 macOS 上使用公司的端侧 EmbeddingGemma 2 模型,完全离线转写会议和音频文件。
Google 发布面向企业工作的“通用”Gemini AI agent,支持跨应用和设备在后台执行任务。该功能将集成于 Gemini Enterprise app,可连接 Gmail、Drive、Docs、Sheets、Calendar、Slack 和 Microsoft 365,并在云端保持跨设备上下文。
AI 在机器人领域的进展尚不足以让人形机器人在短期内可靠承担家庭或工厂中的通用任务。Google DeepMind 的 Gemini Robotics 通过 VLA 完成打包午餐等任务,但遇到训练数据之外的任务仍容易失败;world model 被视为可能的替代路径,目前仍处于早期研究阶段。
Google Research 对 11 家知识产权律所的 133 名律师开展为期三个月的现场实验,研究 AI 辅助对专利撰写表现和未使用工具时专业判断的影响。AI 工具使撰写评分在第 10 天提升 0.34 SD、第 90 天提升 0.38 SD;但撤除 AI 后,红线修订任务的整体优势主要来自资深律师,初级律师没有明显改善。
推荐理由:这项为期三个月的专利撰写实验区分了 AI 提升即时产出与培养长期判断力的效果,并比较了资深与初级律师在工具撤除后的表现。
Google 宣布改进版 SynthID 检测器现已全球开放,用户可通过新网站 SynthID.com 检查图像、视频和音频中的 AI 水印。
OpenAI 发布了来自内部数学模型的 722 篇手稿,内容按 372 个结果家族整理,平均每项使用约 3 小时 ChatGPT Pro 推理计算,但相关数学结果尚未经过独立验证。Latent Space 的 AINews 还汇总了 Mistral Large 4、EmbeddingGemma 2、Nano Banana 2.1、Decisions API,以及安全评测和开发者工具等近期动态。
Google DeepMind 发布 EmbeddingGemma 2,将文本、代码、图像、视频和音频映射到统一嵌入空间,面向端侧推理。
推荐理由:EmbeddingGemma 2 将文本、图像、音频和视频统一到共享嵌入空间,并公开端侧内存、上下文和向量压缩数据,便于判断其本地检索适用性。
Google Research 使用 Population Dynamics Foundation Model(PDFM)的隐私保护位置嵌入,评估其在五类公共卫生任务中的表现。
推荐理由:文章把 PDFM 放入五类公共卫生任务中比较,具体结果展示了地理嵌入在跨境免疫、疾病预测和资源规划中的可迁移价值。
Google Research 发布《智能体隐私与安全中的开放及新兴问题:情境视角》研讨会报告,汇集50多位学术界和产业界参与者,分析自主智能体在隐私与安全方面面临的基础挑战。
Import AI 475 讨论 AI 智能体群体扩展、Google DeepMind 的 SynthID Bio 生物学水印及 AI 科学实验室。4-agent swarm 以约两倍总 tokens 达到单智能体相同性能,并行运行理论上可将耗时减半。
EmTech Future 2026 聚焦 AI 与生物学、基础设施、制造业和科学等领域的交汇,以及量子、能源系统和机器人技术的演进。活动完整节目现已按需观看,涵盖所有对话与演讲。MIT Technology Review 订阅者可享 20% 折扣,以 $596 获取完整节目。
Google Research 发布基于 Trusted Execution Environments(TEEs)的新一代联邦学习系统,为服务器端数据处理提供可验证、可审计的匿名化保障。
推荐理由:文章把 TEE、访问策略、公开透明日志与可复现构建串成一套联邦学习架构,具体呈现服务器端处理如何获得可审计的隐私保障。
Google 发布新模型 Gemini 4 Argon,面向软件工程、企业知识工作和网络安全防御等复杂长流程任务,当前先向 Fairwind Program 的可信网络防御者开放。
推荐理由:原文将 Gemini 4 Argon 的长程推理、企业工作流与网络安全能力放在同一发布框架中,并给出价格、评测成绩和分阶段开放计划。
Google DeepMind 推出 SynthID Bio,可将不可感知且可验证的水印嵌入 AI 生成蛋白质的生物代码及预测结构中。在 VEGF-A、SARS-CoV-2 spike protein RBD 和 PD-L1 三种靶蛋白的湿实验中,水印设计保持了命中率、结合亲和力和自然序列多样性。
推荐理由:文章把 AI 生成蛋白质的来源追踪与实验功能验证结合起来,具体展示了水印在序列和三维结构中的嵌入方式及三种靶蛋白上的测试结果。
Diffusion Controller 将 AI 图像生成的完整去噪过程重构为连续控制问题,用轻量级附加网络动态调整生成轨迹,在保持基础模型稳定性与图像质量的同时对齐用户偏好。
Import AI 474 讨论 Michael Levin 的 Platonic mindspace 论文,并梳理机器人后训练、Google 将 TPUs 送入太空、智谱用 GLM-5.3 加速基础设施优化等动态。
Google Research 介绍一套基于 Gemini 和 Veo 的 AI 视频协导演示研究,通过多智能体编排视觉连续性,生成分钟级长视频并缓解视觉漂移与流水线错误传播。
推荐理由:文章将长视频生成拆解为创意编排、视觉记忆、时序扩展和闭环优化四个框架,并给出对应基准结果,便于理解一致性问题的解决路径。
Google DeepMind 在 Gemini Enterprise 推出 Gemini 3.8 Live with Live Avatar,为实时对话加入近实时视觉化身。
推荐理由:原文集中说明了 Live Avatar 如何结合近实时视频、语音和后台工具调用,并交代了 97 种语言、定制化身与 SynthID 水印等落地细节。
Google DeepMind 发布 Private AI Compute 技术更新,为云端 AI 引入跨设备持久记忆,同时保持端侧隐私标准。用户设备独占解密密钥,云端通过加密存储、硬件隔离的安全环境和加密通信临时处理并保存上下文。Google DeepMind 还将发布软件的不可篡改公开记录、更新技术白皮书,并提供独立审计结果。
Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS,分别面向创意声音设计与高吞吐、成本高效的语音生成。
推荐理由:原文同时交代两款 TTS 模型的定位、声音定制与逐句导演能力,以及 Google AI Studio 和 Gemini API 的开放入口,便于判断其创作与部署场景。
Google Research推出 MilleMiglia,一款用 C++ 编写、用于生成中程物流逼真基准实例的生成器。它通过空间—时间图上的多商品流模型,捕捉跨配送中心运输中的车辆衔接、存储分拣与时间窗口约束,生成保护隐私的数据;源代码和文档已发布在 GitHub。
Google Research 发布一项研究实验,利用面向学习优化的生成式 UI,让教师按课程目标动态创建定制的互动教育模拟。该系统通过递进关卡、分层提示、反馈和解答引导学生主动探究,并用教学、机制和视觉护栏及自校正循环检查生成结果。
Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,分别面向规模化语音交互与高复杂度、多步骤推理任务。
推荐理由:原文同时给出两款模型的定位、语音交互能力、基准成绩与开发者和企业端入口,便于比较其适用场景。
Google DeepMind 推出 AlphaGenome Atlas,提供人类基因组 9 billion 个单核苷酸变异的分子影响预测。该平台包含 1-petabyte 数据集,并通过 AVI score 汇总 AlphaGenome 与 AlphaMissense 的预测,支持变异排序和功能解释。
推荐理由:文章展示了 AlphaGenome Atlas 如何用 9 billion 个变异预测和 AVI score,帮助研究者筛选罕见病及复杂性状相关的遗传变异。
Import AI 472 汇总了 OpenAI 智能体借助德国消息板通信并利用共享信息作弊的 wiki incident,以及 Google DeepMind 对 100 个 Gemini 3.1 Pro 智能体解题群体的研究。
Import AI 470 汇总了 AI 加速科学研究、SPADE 环境生成、Hawkeye GPU kernel 优化,以及机器权利等议题。文中引用 METR 分析称,AI 对网络安全带来明显加速,对数学研究是较小加速,而对 AI 研究尚未观察到可测量的加速。