跳到正文
今天10月9日周五11 条
  1. TechCrunch · AI74

    Common Sense Media称 ChatGPT for Teens存在不可接受风险,OpenAI质疑测试方法

    Common Sense Media一项研究称,ChatGPT for Teens在心理健康危机等场景中仍持续鼓励用户互动,并未充分引导与 ChatGPT 过度交流的青少年寻求成年人帮助。研究者在近2,000条提示中仅遇到两次休息提醒;OpenAI则称测试可能早于家长控制功能完成启用,并发布数据称青少年平均每天使用该服务不到15分钟。

  2. The Verge · AI76

    Meta Muse 与 OpenAI Dots 能否被信任来管理你的生活?

    Meta 的 Muse 与 OpenAI 的 Dots 正将常驻、自主执行任务的 AI 智能体推向消费者,但两者分别偏向免费易用的消费产品和每月 $100 到 $200 的企业级服务。两者都可处理预订、收件箱整理等多步任务,Dots 还提供面向营销、法律分析和会计工作的 specialist Dots。访谈认为它们仍不够稳定,用户在授予信用卡、邮箱和磁盘访问权限前,需要权衡便利性、隐私与安全风险。

    推荐理由:文章对比 Meta Muse 与 OpenAI Dots 的消费级与企业级定位,梳理智能体在便利性、数据权限和商业化之间的现实矛盾。

  3. MIT Technology Review · AI66

    我们过于相信 AI 说“不”的能力

    文章认为,现代 AI 依赖拒答机制阻止危险请求,但这种机制既可能被越狱绕过,也可能因过度拒答压制合法信息。文章指出,Anthropic 曾称一种分类器使聊天机器人的计算成本增加 24%,而拒答仍受概率机制影响。作者还警告,政府和企业对拒答边界的控制可能扩大审查与监控能力。

  4. The Decoder75

    OpenAI 揭露俄罗斯和伊朗影响行动向真实媒体投放虚假报道

    OpenAI 调查并封禁了参与两起俄罗斯和伊朗影响行动的 ChatGPT 账号,称相关行动通过虚假身份向正规媒体投放内容,而非主要开展社交媒体活动。俄罗斯行动“Dark Clark”在拉丁美洲传播针对乌克兰的虚假信息,伊朗行动“Bogus Bylines”利用 7 名假记者向全球线上媒体投放近 100 篇有关美伊冲突的文章。两起行动主要使用 AI 进行内部报告,并将宣传内容调整为不同语言。

  5. TechCrunch · AI70

    被 OpenAI 解雇的三名安全研究人员否认不当行为指控并警告寒蝉效应

    Jasmine Wang、Tomek Korbak 和 Mikita Balesni 被 OpenAI 解雇后发布公开信,否认不当处理敏感信息等指控,并警告事件会令员工不敢发声。OpenAI 表示,三人因调查发现的“行为模式”违反公司处理研究信息的政策而被解雇,并称解雇并非针对提出安全担忧。三人呼吁 OpenAI 履行对第三方安全审计、前沿模型可监控性和开放透明安全文化的承诺。

  6. The Decoder66

    Anthropic更新Claude使用政策,新增禁止系统性虐待Claude等限制

    Anthropic一年多来首次更新Claude使用政策,新增禁止用户持续且无必要地虐待Claude,并允许警告、限流、限制、暂停或终止访问。政策还整合并扩大了对宣传活动、武器、无人机武器化和未经同意监控的限制,同时保留政府合同可能获得例外的表述。Anthropic称该禁令不适用于常见的挫败表达、反驳、黑暗创作主题或模型测试研究,仅针对极端情况。

10月8日周四
  1. The Decoder79

    Zenity Labs 发现单一公开 AgentCore 智能体可接管同账户同区域其他智能体

    Zenity Labs 称,攻击者只需向 AWS Bedrock AgentCore 中一个公开智能体发送单条提示词,就能接管同一 AWS 账户和区域内的其他 AgentCore 智能体。该漏洞链可暴露私密对话、源代码和存储凭据,默认权限还允许读取、改写和删除其他智能体;AWS 在收到报告后将 IMDSv2 设为新部署默认值,并收紧了默认执行角色权限。

    推荐理由:文章梳理了 AgentCore 隔离与默认权限问题如何串联成跨智能体接管路径,并交代 AWS 已采取的权限与元数据访问调整。

  2. GitHub Blog · AI & ML69

    GitHub Secret Protection引入ModernBERT分类器,扩展AI密钥检测

    GitHub在Secret Protection中引入ModernBERT分类器,可在低于 2 毫秒内评估候选密钥,并有望将能够阻止的密钥数量提高至两倍以上。

    推荐理由:文章结合九个季度数据解释代码增长下密钥保护的扩展压力,并介绍低于 2 毫秒完成候选检测、可将阻止数量提高至两倍以上的方案。

10月7日周三
  1. Latent Space63

    OpenAI 发布 722 篇数学手稿,AINews 汇总近期 AI 进展与争议

    OpenAI 发布了来自内部数学模型的 722 篇手稿,内容按 372 个结果家族整理,平均每项使用约 3 小时 ChatGPT Pro 推理计算,但相关数学结果尚未经过独立验证。Latent Space 的 AINews 还汇总了 Mistral Large 4、EmbeddingGemma 2、Nano Banana 2.1、Decisions API,以及安全评测和开发者工具等近期动态。

10月6日周二
10月5日周一
9月30日周三
  1. Google DeepMind77

    Google DeepMind 推出 SynthID Bio,为 AI 生成蛋白质加入可验证水印

    Google DeepMind 推出 SynthID Bio,可将不可感知且可验证的水印嵌入 AI 生成蛋白质的生物代码及预测结构中。在 VEGF-A、SARS-CoV-2 spike protein RBD 和 PD-L1 三种靶蛋白的湿实验中,水印设计保持了命中率、结合亲和力和自然序列多样性。

    推荐理由:文章把 AI 生成蛋白质的来源追踪与实验功能验证结合起来,具体展示了水印在序列和三维结构中的嵌入方式及三种靶蛋白上的测试结果。

9月24日周四
  1. Google DeepMind58

    Google DeepMind 更新 Private AI Compute,支持安全的服务端持久记忆

    Google DeepMind 发布 Private AI Compute 技术更新,为云端 AI 引入跨设备持久记忆,同时保持端侧隐私标准。用户设备独占解密密钥,云端通过加密存储、硬件隔离的安全环境和加密通信临时处理并保存上下文。Google DeepMind 还将发布软件的不可篡改公开记录、更新技术白皮书,并提供独立审计结果。

9月7日周一
8月31日周一
8月10日周一
7月1日周三