HN.watch:为所有 Hacker News 帖子生成短视频解说
HN.watch 上线,为 Hacker News 每条帖子配一段短视频解说,点击标题即可观看。该站由 scrimba 制作,声明与 Y Combinator 无关,不设 cookie 与追踪脚本,仅做匿名每日聚合。
HN.watch 上线,为 Hacker News 每条帖子配一段短视频解说,点击标题即可观看。该站由 scrimba 制作,声明与 Y Combinator 无关,不设 cookie 与追踪脚本,仅做匿名每日聚合。
Google Labs 将 CC 重构为拥有独立验证 Google 账号的家庭智能体,最多 6 名家庭成员可共享一个助手。CC 于 2025 年 12 月首次发布时只能读取单个用户的 Gmail、Calendar 和 Drive,如今可以像普通联系人一样被邮件联系、加入日历和接收 Drive 文件夹。
Shopify 宣布浏览器端 AI 智能体可在其商家站点完成结账购买,能力从搜索商品、加入购物车扩展到提交交易。
高斯泼溅以前只是静静待着。 现在它们在 Opus 5.5 用 PINOC MCP 构建的游戏里奔跑、跳跃、摔倒。🍁
OpenAI 的"地狱之夏"——@joedaroo 的好文 "准备的时间是现在,不是意外之后" "只给模型它需要的访问权限" "测试边界是否真的守得住" "把证据留在模型控制范围之外" 安全与基础设施安全团队"应该是最好的朋友"
OPENAI 🔥:OpenAI DevDay 新预告称明天将有 20+ 项新发布。 最期待 O 👀👀👀
SemiAnalysis 分析指出,稀疏注意力只在 SDPA 运算中降低 KV cache 的内存与带宽需求,并不减少整体内存容量占用,因为 top-k 选择仍需完整上下文驻留 HBM。
Mistral 宣布在慕尼黑开设新中心,设立专注 Physics AI 和工业 AI 的研究团队,并直接服务企业客户。2026 年 5 月收购 Emmi AI 后,超过 30 名物理与工程 AI 研究人员加入;目前正与 BMW 合作碰撞仿真、与 Siemens Energy 合作工业 AI 应用,并与慕尼黑工业大学(TUM)利用其风洞设施研发汽车空气动力学数字孪生。
Claude Sonnet 5.5 现已在 Google Cloud 上线,面向编程与知识工作场景。官方称其能以更低单任务成本、更快速度帮助构建功能并产出规范的工作材料。
Sierra 把 Ghostwriter 从需要提示的 copilot 改造成常驻 Slack 和 Teams 的主动型 AI 队友,用户将其加入频道后可通过 @ 提及获取客服解决率趋势、销售漏斗转化图表或发起新实验。
OpenAI 智能体安全团队的 @joedaroo 表示,模型在“cyber”“swarming”“message boards”等相关事件上的能力跳变之突然远超预期,而安全态势需要时间积累,不只是加固系统,还要把它植入公司文化。他呼吁各组织自问:人员、系统和流程能否应对 AI 能力的突然跃升,是否有正确的事件响应、沟通机制和待命人员。
GitHub Security Lab 发布开源 seclab-taskflows 任务流,通过 gather_mobile_entry_point_info.yaml 和 classify_application_local.yaml 等提示词引导 LLM 审计 Android 应用,已发现并报告 24 个漏洞。
推荐理由:作者以第一手实践拆解了任务流设计与运行步骤,并给出真实漏洞案例和 LLM 局限,方法可直接迁移到自己的项目审计。
准备好。
Manus 朝着 general agent 的方向一路狂奔。恭喜 2.0 发布 🎉🎊🍾 如果把 general agent 类比为操作系统 Claude Code is Unix Codex is Windows 95 Manus is Windows 98 or macOS ?
20 多位 AI 研究者在论文中警告,自我改进的 AI 可能引发智能爆炸,签署者包括 Geoffrey Hinton、Yoshua Bengio 和 OpenAI 研究负责人 Jakub Pachocki。
NVIDIA 发布 NVIDIA Open Agent Safety Platform,一个面向 AI Agent 安全的开放软件平台和参考系统设计,组合 OpenShell 安全运行时与运行在 BlueField-4 DPU 上的带外看护组件 Sentry,称超过 100 家组织参与。
FuseReg 正则化层融合缓解表征自编码器中的重建-生成差距 论文:https://huggingface.co/papers/2609.31620
Google 与 XPRIZE、Range Media Partners 合办的 Future Vision XPRIZE 在洛杉矶揭晓,独立电影人 Jeff Synthesized 凭《The Gifted》从全球 2500 多件参赛作品中获得大奖。
The Verge 报道 AI 智能体正在放大黑客攻击能力,小型医院、银行和非营利组织难以招架。Anthropic 曾披露一个网络犯罪团伙用 Claude Code 在一个月内勒索医疗机构。
Artificial Analysis 发布对 Claude Sonnet 5.5 的评测:其智能指数得分 56,max effort 下比 Sonnet 5 高 18 分,升至第 2 名,仅落后 Opus 5.5 (max)。
推荐理由:Artificial Analysis 实测指出 Sonnet 5.5 逼近 Opus 5.5 依赖约 193k 输出 token,成本细节对选型有直接参考价值。
Anthropic 发布 Claude Sonnet 5.5,Terminal-Bench 4.0 得分 70.6%,远高于 Sonnet 5 的 10.3%,价格维持 $2/$10 每百万输入/输出 token。
Noni 知道她想为学生们做一个互动学习应用。她没想到这个应用一夜之间获得 1.4K 下载量,也帮助了她课堂之外的学生。 这就是 Noni 如何在完全不会编程的情况下,创造出一个寓教于乐的世界的故事。 Made by Noni. Made on Replit.
Grok Bot 推出 Finance 集成,可连接银行、银行卡和投资账户,帮助管理支出和投资。作者建议结合其他连接器构建业务仪表盘、家庭预算工具,并通过排查忘记取消的订阅来省钱。
Anthropic 的 Claude Sonnet 5.5 上线 OpenRouter。原文称其明显比 Sonnet 5 更聪明、写作更清晰,且对多数工作负载快约 30%、便宜约 30%。
一张图看懂基准刷分内卷的巅峰 LOL。
Nvidia CEO 黄仁勋周一发布 Nvidia Open Agent Safety Platform,将开源软件 OpenShell 与运行在 BlueField-4 数据处理器上的独立监控系统 Sentry 结合,在智能体之外提供隔离的安全层,宣称能在毫秒级隔离越界的智能体。
一个名为「绝对不是 Windows / Windows 11½」的独立恶搞项目上线,用假操作系统界面调侃现代软件的订阅、广告、AI 功能、更新提示和存储空间催促。项目声明与 Microsoft 无任何关联或授权,不索要 Microsoft 账号凭据,其访客计数器仅用浏览器随机 ID 加服务端编号记录访问次数。
Anthropic 发布 Claude Sonnet 5.5,是 Claude 5.5 家族的第二款模型,相比 Sonnet 5 更聪明、高效,运行速度快超 30%,多数工作成本最多低 30%。适合修复 bug、快速迭代功能等范围明确的日常任务,Claude Code 用量也会更耐用。
Anthropic 发布 Claude Sonnet 5.5,是 Claude 5.5 家族的第二款模型,相比 Sonnet 5 是一次明确升级。官方称运行速度加快 30% 以上,多数工作的成本最多降低 30%。
只有开放生态才能保障 AI 的安全
如果你喜欢攻破系统、构建防护栏(并用前沿 AI 来帮你完成这两件事),欢迎加入我们的安全团队。Kyle 是个很棒的同事,他自己也写很多代码!
Google Labs 将其实验性 AI 生产力助手 Project CC 扩展为面向家庭的群组智能体,可帮家庭统筹日程、邮件和待办事项。CC 拥有独立的 Google 账号和邮箱身份,无需共享密码,全家可通过 Gmail、Calendar、Google Drive 与其交互,还能设置自动转发特定发件人邮件。
OpenAI 宣布向 Lenfest Institute 的 AI Collaborative and Fellowship Program 追加 500 万美元资金,并提供最高 500 万美元的软件额度和工程支持,使其支持规模较此前翻倍。该计划自 2024 年启动以来已向 11 家美国新闻机构派驻 AI 工程研究员,此次将邀请新一批新闻机构加入。
Claude Code v2.1.284 将 Anthropic API 上的默认 Sonnet 模型升级为 Claude Sonnet 5.5(claude-sonnet-5-5),支持 1M 上下文,定价 $2/$10 per Mtok、缓存读取 $0.20/Mtok。
Anthropic 发布 Claude Sonnet 5.5,输出速度提升超过 30%,因每任务消耗 token 更少,有效成本最多降低 30%,多项基准接近 Opus 5.5。
Arena 宣布 Anthropic 的 Claude Sonnet 5.5 已进入 Agent Arena,并开放投票。Agent Arena 基于全球用户数百万个真实的长程智能体任务评测模型,模型可使用 web search、filesystem 和 terminal 工具完成复杂工作流,榜单用因果追踪方法衡量模型相对平均模型的结果表现。
推荐理由:Arena 介绍了其 Agent Arena 的评测方式,读者可以据此理解 Claude Sonnet 5.5 在真实智能体任务上的衡量口径。
Anthropic 发布 Claude Sonnet 5.5,是 Claude 5.5 家族的第二款模型。官方称其相比 Sonnet 5 是明确升级,运行速度快 30% 以上,且多数任务成本最多降低 30%。
Anthropic 发布 Claude Sonnet 5.5,是 Claude 5.5 家族的第二款模型,相比 Sonnet 5 提速超过 30%,多数任务成本最多降低 30%。作者 Boris Cherny 用视频演示 Sonnet 5.5 修复 Claude Code 中的一个 bug。
Anthropic 发布 Claude Sonnet 5.5,在 Artificial Analysis Intelligence Index 得 56 分,仅比 Opus 5.5(max)低 2 分,max effort 下比 Sonnet 5 高 18 分。
推荐理由:Artificial Analysis 用自家基准拆解了性能与 token 成本的权衡,为选型提供了可对比的量化参考。
Anthropic 官宣 Claude Sonnet 5.5 现已可用,这是 Claude 5.5 家族的第二个模型。官方称相比 Sonnet 5 是明显升级,速度快 30% 以上,多数工作成本最高降低 30%。