跳到正文
今天10月9日周五1 条
10月8日周四
  1. The Decoder83

    Anthropic 发布 Claude Haiku 5.5,降价并提升基准表现

    Anthropic 发布 Claude Haiku 5.5,定位为面向高并发、成本敏感任务的快速小型模型,平均价格比 Haiku 4.5 低约75%,不超过100,000 tokens 的 prompts 价格最高下降90%。

    推荐理由:文章同时梳理 Claude Haiku 5.5 的价格、基准表现与 token 消耗,便于比较低成本模型在性能和资源使用上的取舍。

  2. Simon Willison78

    Anthropic 发布 Claude Haiku 5.5

    Anthropic 发布 Claude Haiku 5.5,定位为快速、低成本模型;其价格在 100,000 tokens 内为 $0.10/$0.50,超过后升至 $0.50/$2.50。

    推荐理由:文章把 Claude Haiku 5.5 与 GPT-6 Luna 的分段价格、token 消耗和推理级别测试放在一起,便于判断不同上下文长度与推理设置下的实际成本。

10月7日周三
  1. Latent Space63

    OpenAI 发布 722 篇数学手稿,AINews 汇总近期 AI 进展与争议

    OpenAI 发布了来自内部数学模型的 722 篇手稿,内容按 372 个结果家族整理,平均每项使用约 3 小时 ChatGPT Pro 推理计算,但相关数学结果尚未经过独立验证。Latent Space 的 AINews 还汇总了 Mistral Large 4、EmbeddingGemma 2、Nano Banana 2.1、Decisions API,以及安全评测和开发者工具等近期动态。

10月6日周二
10月2日周五
  1. NVIDIA Blog75

    NVIDIA GPUs 如何加速 OpenAI GPT-6 Astra Ultrafast

    OpenAI GPT-6 Astra Ultrafast 已在 NVIDIA Blackwell GPUs 上运行,并通过 OpenAI API 和面向符合条件的 ChatGPT Work、Codex 用户提供。

    推荐理由:文章把 GPT-6 Astra Ultrafast 的 8x token 生成提升与编码智能体的工具调用循环联系起来,并说明了 Blackwell 上的推理优化路径。

10月1日周四
  1. Google DeepMind80

    Google 发布 Gemini 4 Argon,支持 1M tokens 输出并将分阶段开放

    Google 发布新模型 Gemini 4 Argon,面向软件工程、企业知识工作和网络安全防御等复杂长流程任务,当前先向 Fairwind Program 的可信网络防御者开放。

    推荐理由:原文将 Gemini 4 Argon 的长程推理、企业工作流与网络安全能力放在同一发布框架中,并给出价格、评测成绩和分阶段开放计划。

9月16日周三
8月24日周一
7月1日周三
5月8日周五
  1. Berkeley AI Research54

    自适应并行推理:高效推理扩展的下一种范式

    Berkeley AI Research 发布一篇综述与观点文章,系统分析 Adaptive Parallel Reasoning 如何让模型在推理时动态决定串行或并行操作、线程数量与协调方式。文章比较了 Multiverse、ThreadWeaver 等方法在 KV cache 聚合和推理引擎改造上的不同路径,并讨论了关键路径效率奖励、训练稳定性与硬件感知并行等开放问题。

4月20日周一