跳到正文
今天10月9日周五9 条
  1. MIT Technology Review · AI66

    我们过于相信 AI 说“不”的能力

    文章认为,现代 AI 依赖拒答机制阻止危险请求,但这种机制既可能被越狱绕过,也可能因过度拒答压制合法信息。文章指出,Anthropic 曾称一种分类器使聊天机器人的计算成本增加 24%,而拒答仍受概率机制影响。作者还警告,政府和企业对拒答边界的控制可能扩大审查与监控能力。

  2. The Decoder77

    Anthropic 为 Claude 推出 Dashboards 和 Motion 两项 Beta 功能

    Anthropic 为 Claude 推出两项 Beta 功能:Dashboards 可通过文本提示连接 BigQuery、Databricks、Snowflake 或 Salesforce,生成自动更新的实时仪表板;Motion 可从文本、图表和图片生成可编辑为代码并导出 MP4 的动画解释视频。

    推荐理由:文章集中说明 Dashboards 与 Motion 的输入方式、输出形式和套餐范围,便于判断这些功能能否接入现有数据分析与内容制作流程。

  3. The Decoder66

    Anthropic更新Claude使用政策,新增禁止系统性虐待Claude等限制

    Anthropic一年多来首次更新Claude使用政策,新增禁止用户持续且无必要地虐待Claude,并允许警告、限流、限制、暂停或终止访问。政策还整合并扩大了对宣传活动、武器、无人机武器化和未经同意监控的限制,同时保留政府合同可能获得例外的表述。Anthropic称该禁令不适用于常见的挫败表达、反驳、黑暗创作主题或模型测试研究,仅针对极端情况。

  4. The Verge · AI77

    Anthropic更新Claude使用政策,禁止持续且无必要的辱骂或残酷行为

    Anthropic更新Claude使用政策,禁止用户对模型进行“持续且无必要的辱骂或残酷行为”,并扩大对选举干预、武器相关软件和监控用途的限制。该公司称终止对话仍是主要执行机制;政策还限制误导性商业或政治活动,并要求连接到可能造成伤害的自主硬件时,必须有合格操作员能够观察并在需要时停止设备。

    推荐理由:Anthropic此次政策更新同时覆盖模型福利、选举干预、武器与监控用途,呈现出其对Claude使用边界和实体行动风险的具体划分。

10月8日周四
  1. The Decoder83

    Anthropic 发布 Claude Haiku 5.5,降价并提升基准表现

    Anthropic 发布 Claude Haiku 5.5,定位为面向高并发、成本敏感任务的快速小型模型,平均价格比 Haiku 4.5 低约75%,不超过100,000 tokens 的 prompts 价格最高下降90%。

    推荐理由:文章同时梳理 Claude Haiku 5.5 的价格、基准表现与 token 消耗,便于比较低成本模型在性能和资源使用上的取舍。

  2. Simon Willison78

    Anthropic 发布 Claude Haiku 5.5

    Anthropic 发布 Claude Haiku 5.5,定位为快速、低成本模型;其价格在 100,000 tokens 内为 $0.10/$0.50,超过后升至 $0.50/$2.50。

    推荐理由:文章把 Claude Haiku 5.5 与 GPT-6 Luna 的分段价格、token 消耗和推理级别测试放在一起,便于判断不同上下文长度与推理设置下的实际成本。

10月7日周三
  1. Latent Space63

    OpenAI 发布 722 篇数学手稿,AINews 汇总近期 AI 进展与争议

    OpenAI 发布了来自内部数学模型的 722 篇手稿,内容按 372 个结果家族整理,平均每项使用约 3 小时 ChatGPT Pro 推理计算,但相关数学结果尚未经过独立验证。Latent Space 的 AINews 还汇总了 Mistral Large 4、EmbeddingGemma 2、Nano Banana 2.1、Decisions API,以及安全评测和开发者工具等近期动态。

10月5日周一