跳到正文
北京时间

全部动态

今日 38 条
今天9月29日周二
  1. X:Thomas Wolf(Hugging Face 联创/CSO) (@Thom_Wolf)55

    Deven Pzak 以 39.9 秒刷新 NanoGPT 训练纪录

    @classiclarryd 通报 Deven Pzak 将 NanoGPT 训练纪录从 67.6 秒压缩至 39.9 秒,PR 为 KellerJordan/modded-nanogpt#360。核心思路是在单个 flop 层面按价值取舍而非只优化 matmul,包括采样 softmax(约 8 秒)、ngram 嵌入的稀疏更新与优化器状态、分片稀疏通信、手写 64 维 head 的 flash attention、最后 300 步 EMA 与新优化器 Anvil2(约 1 秒)等。稀疏嵌入参数扩到 65B,贡献该 PR 约 25% 的收益;Thomas Wolf 转发并称 impressive,附上与 Deven 访谈整理的技术复盘 https://hyperstition.cc/training-nanogpt-in-39-9-seconds。

  2. X:OpenRouter (@OpenRouter)25

    OpenRouter 上线 6 款决策模型

    两周前 TypeSafe 开创了这一品类,现在市场上已有 6 款决策模型,其中包括 2 款免费模型:https://openrouter.ai/models?output_modalities=decisions

  3. X:Elon Musk (@elonmusk, xAI)31

    Grok 4.7 xHigh 登顶网络安全指数

    不错 (引用推文核心要点:Grok 4.7 xHigh 在 Artificial Analysis Cyber Index 中排名第一,作为前沿模型在企业网络防御领域表现顶尖,超越 Fable 5.1 Max、Opus 5.5、Astra 6、GPT-6 等领先 AI 系统。)

  4. X:Claude Devs (@ClaudeDevs)80

    Claude Sonnet 5.5 发布,官方附上开发使用指南

    Claude Sonnet 5.5 发布,官方同步发布构建指南。指南涵盖在 Sonnet 5.5 与 Opus 5.5 之间做选择、从 Sonnet 5 迁移并调整 effort、以及在 Claude Code 中使用,详见 https://claude.dev/blog/building-with-claude-sonnet-5-5/。

  5. Every:最新文章(网页)50

    Vibe Check:Sonnet 5.5 在 Claude 家族中找到自己的位置

    Anthropic 于今日发布 Sonnet 5.5,定位为比 Sonnet 5 更强的协作模型,但需要用户保持掌控并在适当时机调用 Opus。该模型是 Claude 拥挤家族中的新成员,具体参数与基准数据尚未披露。

  6. X:SemiAnalysis (@SemiAnalysis_)30

    GLM5.3 稀疏注意力如何影响 HBM 内存占用

    GLM5.3 稀疏注意力如何影响 HBM 内存使用 GLM-5.3、KV Cache Offloading、HiSparse、AgentX TileRT、 InferenceX DeepSeek Sparse Attention、IndexShare、 Single-rollout Asynchronous Optimization、Cybersecurity https://newsletter.semianalysis.com/p/sparse-savings-persistent-demand-inside-glm53

  7. Artificial Analysis 完整文章(网页)80

    Claude Sonnet 5.5 达到 Artificial Analysis 智能指数第 2 名

    Artificial Analysis 发布对 Claude Sonnet 5.5 的评测:其智能指数得分 56,max effort 下比 Sonnet 5 高 18 分,升至第 2 名,仅落后 Opus 5.5 (max)。

    推荐理由:Artificial Analysis 实测指出 Sonnet 5.5 逼近 Opus 5.5 依赖约 193k 输出 token,成本细节对选型有直接参考价值。

  8. X:OpenRouter (@OpenRouter)57

    Claude Sonnet 5.5 上线 OpenRouter

    Anthropic 的 Claude Sonnet 5.5 上线 OpenRouter。原文称其明显比 Sonnet 5 更聪明、写作更清晰,且对多数工作负载快约 30%、便宜约 30%。

  9. X:Arena (@arena)69

    Claude Sonnet 5.5 上线 Arena 的 Agent Arena 与 Battle Mode 评测

    Arena 宣布 Anthropic 的 Claude Sonnet 5.5 已进入 Agent Arena,并开放投票。Agent Arena 基于全球用户数百万个真实的长程智能体任务评测模型,模型可使用 web search、filesystem 和 terminal 工具完成复杂工作流,榜单用因果追踪方法衡量模型相对平均模型的结果表现。

    推荐理由:Arena 介绍了其 Agent Arena 的评测方式,读者可以据此理解 Claude Sonnet 5.5 在真实智能体任务上的衡量口径。

  10. X:Anthropic (@AnthropicAI)79

    Anthropic 发布 Claude Sonnet 5.5

    Anthropic 官宣 Claude Sonnet 5.5 现已可用,这是 Claude 5.5 家族的第二个模型。官方称相比 Sonnet 5 是明显升级,速度快 30% 以上,多数工作成本最高降低 30%。

  11. TechCrunch:AI(RSS)71

    Anthropic 发布 Sonnet 5.5,称其比前代更快更便宜

    Anthropic 发布中端模型 Sonnet 5.5,官方称其比前代 Sonnet 5 快 30%,token 消耗明显更低。公司基准显示该模型在 agentic 编码上优于 Opus 5.5,并称其具备与 Opus 5 相当的网络安全能力,因此成为首个适用与 Fable 和 Opus 相同网络安全防护的 Sonnet 模型;公司还计划在未来几周发布新版本 Haiku。

  12. X:Testing Catalog (@testingcatalog)58

    Anthropic 开始在 Claude 和 API 上推出 Claude Sonnet 5.5

    Anthropic 开始在 Claude 和 API 上推出 Claude Sonnet 5.5。截图显示模型选择列表中 Sonnet 5.5 被标注为“Most efficient for simpler tasks”,同列表还包含 Opus 5.5、Sonnet 5 和需使用额度的 Fable 5.1。

  13. X:Testing Catalog (@testingcatalog)75

    Anthropic 正式发布 Claude Sonnet 5.5,速度提升 30% 且成本降低 30%

    Anthropic 官方发布 Claude Sonnet 5.5,为 Claude 5.5 家族第二款模型。官方称其较 Sonnet 5 快 30% 以上,多数任务成本降低最多 30%,接近 Opus 5.5 的性能,并称其为新的默认模型。附图显示 Artificial Analysis 在预发布部署上测得 Sonnet 5.5 与 Opus 5.5 在 AA-Briefcase v1.1 各努力档位的 Elo 表现接近。

  14. Claude:YouTube(RSS)67

    Anthropic 发布 Claude Sonnet 5.5,速度比 Sonnet 5 快超 30%

    Anthropic 发布 Claude Sonnet 5.5,运行速度比 Sonnet 5 快 30% 以上,写作更清晰,适合快速来回交互。定位上与为复杂判断工作打造的 Claude Opus 5.5 区分,Sonnet 5.5 擅长范围明确的日常任务、修复 bug 以及制作文档、幻灯片和表格。模型即日起全量可用,Claude Haiku 5.5 将在未来几周加入该系列。

  15. Claude:YouTube(RSS)65

    Anthropic 发布 Claude Sonnet 5.5,速度比 Sonnet 5 快逾 30%

    Anthropic 发布 Claude Sonnet 5.5,运行速度比 Sonnet 5 快超过 30%,写作更清晰,适合快速往复的日常任务。官方称其擅长修复 bug、制作文档、幻灯片和表格并有较强设计感,而 Claude Opus 5.5 面向需要谨慎判断的复杂工作;Sonnet 5.5 即日起全面可用,Claude Haiku 5.5 将在未来几周加入该系列。

  16. X:Arena (@arena)68

    Claude Opus 5.5 (High) 在 Agent Arena 排名第二并重塑 Pareto 前沿

    Arena 公布 Claude Opus 5.5 (High) 以 +12.15% 净提升分数进入 Agent Arena 第二名,仅低于 Claude Fable 5.1 (Max)。其每任务中位价格为 $1.31,比同水平低 64%,成本比 Opus 5 (High) 低 40%、比 Opus 5 (Max) 低 56%;分项信号中 Steerability 排名第一(+14.50%)。

9月28日周一
  1. IT之家(RSS)43

    Kimi K3.1 前端标识泄露:支持 1M tokens 上下文,预计近期发布

    月之暗面 API 后台模型注册表出现“kimi-k3-1”标识且接口可调用,官方开放平台同步出现 K3.1 预告,支持 1M tokens 上下文窗口。该模型提供 Low、High、Max 三档推理强度,可能引入 Agent 智能体模式、Swarm 多智能体协作及搜索、批处理任务模式,API 价格显示与现有 K3 相同。