跳到正文
北京时间

全部动态

今日 95 条
6月18日周四
  1. The Decoder:AI News(RSS)72

    Adobe 为 Photoshop、Premiere 等多款 Creative Cloud 应用加入 AI 智能体

    Adobe 将其“创意智能体”扩展至 Photoshop、Premiere 等应用,以公开测试形式提供 AI Assistant。该智能体可自动完成多步骤常规任务,如 Premiere 分拣素材和粗剪、Photoshop 换背景、Illustrator 批量生成文件、InDesign 更新版式等。Firefly 新增面向个人创作者的品牌套件、产品图转短视频及 Quick Cut 自动剪辑功能。Adobe 工具已集成至 ChatGPT、Claude 及 Microsoft 365 Copilot,Google Gemini 和 Slack 集成即将推出。

    推荐理由:Adobe把AI助手直接塞进了Photoshop、Premiere这些上亿人用的创作工具,干的虽然是粗剪、排版一类的苦力活,但却是AI从生成器转向流程助手的关键一步,值得所有创意工作者上手试试。

  2. 公众号:月之暗面(Kimi)70

    Kimi Work 新增目标模式与插件中心,6月推出额度消耗5折福利

    月之暗面旗下 Kimi Work(Beta 版)新增「目标模式」,支持设定终点后由 Agent 自主循环推进任务,最长连续运行24小时,过程中人类可随时中断调整。同时上线「插件中心」,可选装百度网盘、Canva可画、钉钉、飞书、WPS、Notion、Cloudflare 等外部应用。6月限时福利期间,Kimi 电脑客户端 Work 模式所有任务会员额度消耗减半,即从0.02%降至0.01%。

    推荐理由:目标模式把 Kimi Work 从对话助手变成了能连续运行 24 小时的自主 Agent,配合插件中心打通办公软件,对需要长时间执行复杂任务的用户是实际可用性的大升级。

  3. 公众号:月之暗面(Kimi)72

    Kimi Work 上新:目标模式、插件中心和 6 月限时福利

    Kimi 电脑客户端为 Kimi Work(Beta 版)新增「目标模式」和「插件中心」两个特性。目标模式基于循环机制,可让 Agent 连续工作 24 小时自主推进长任务;插件中心支持连接百度网盘、钉钉、飞书、WPS、Canva可画等外部应用。6 月内使用 Work 模式所有任务额度消耗打 5 折,一个 token 当两个用。

    推荐理由:目标模式的价值在于把Agent的连续工作时长拉到24小时,人类只需定义终点,模型自主收敛策略,改变了长任务的处理方式。

  4. IT之家(RSS)72

    DeepSeek 识图模式正式上线 App 和网页端

    DeepSeek 识图模式于6月18日在网页和 App 端正式上线,与快速模式、专家模式并列。开启后用户可直接上传图片让 DeepSeek 识别图像,能力超越简单文字提取。目前 App 端仍显示“图片理解功能内测中”,网页端无此提示。该模式背后的多模态模型技术细节于今年4月公开,核心框架为“Thinking with Visual Primitives(以视觉原语思考)”。

    推荐理由:DeepSeek的识图模式终于从内测进了正式版,虽然是补课而非破圈,但对中文用户来说,让AI直接看图比打字描述常用太多,日常工作和内容处理都更顺手了。

  5. LMSYS:Blog(Chatbot Arena 团队)67

    MOSS-TTS-Local-Transformer-v1.5 在 SGLang-Omni 上:原生流式 48 kHz 语音服务

    MOSS-TTS-Local-Transformer-v1.5 是一款开源 TTS 模型,支持 48 kHz 立体声、零样本声音克隆、最长 10 分钟长文本合成、时长控制及 31 种语言。其核心采用 Qwen3-4B 骨干与约 2B 参数的 MOSS-Audio-Tokenizer-v2 音频编解码器,通过 12 个 RVQ 码本运行。SGLang-Omni 以三阶段流水线部署该模型。在 Seed-TTS-Eval 上词错误率 5.10%、语音相似度 69.23%,CV3-Eval 上 WER 7.48%、SIM 61.59%,MiniMax Multilingual 上 WER 6.37%、SIM 75.31%,X Voice 上 WER 20.48%、SIM 63.00%。

    推荐理由:SGLang-Omni 把 MOSS-TTS 的端到端服务拆成三阶段并做了大量底层优化,对想落地实时语音合成的团队是现成的技术方案,技术细节扎实,可以直接照着搭。

  6. Hacker News 热门(buzzing.cc 中文翻译)70

    cuTile Rust:安全无数据竞争的 GPU 内核系统

    cuTile Rust 是一个基于 tile 的 GPU 编程系统,允许用 Rust 编写内存安全、无数据竞争的内核。它通过 `#[cutile::module]` 宏将内核 AST 嵌入主机二进制,在运行时经 CUDA Tile IR JIT 编译为 GPU cubin。可变张量在启动前分割,不可变张量共享,启动器在 GPU 工作期间保持所有权。在 NVIDIA B200 上,逐元素操作达 7 TB/s(约 91% 峰值带宽),GEMM 达 2 PFlop/s(约 92% 密集 f16 峰值)。基于 cuTile Rust 构建的 Grout 推理引擎在 RTX 5090 上解码 Qwen3-4B 达 171 tokens/s,在 B200 上解码 Qwen3-32B 达 82 tokens/s。项目处于早期研究阶段。

    推荐理由:用Rust的所有权模型保证GPU内核无数据竞争,性能还能达到峰值的92%,这个方向可能是安全GPU编程的未来,系统编程和推理引擎开发者值得一试。

  7. X:Midjourney (@midjourney)71

    深入解析 Midjourney Scanner 技术内幕

    我们全新“Midjourney Scanner”的技术深潜。

    推荐理由:Midjourney 官方放出 Scanner 的技术深度解读,我觉得它把传统扫描和生成式 AI 结合的方式挺有启发,不只是一个滤镜,而是重构了图像输入流程,做图像产品的值得认真看看。

  8. IT之家(RSS)71

    苹果 Xcode 27 核心首次深度集成 AI 智能体:支持自然语言修 Bug、构建 App

    在 2026 年 WWDC 期间,苹果发布 Xcode 27,其核心组件首次整合 AI 智能体,能理解 Swift 语言并通过多轮自然语言对话辅助开发。AI 可跨多个文件修改整个代码库,也能根据提示与资源生成应用设计并独立构建完整应用,建成后仍可通过对话添加特效、动画等。Xcode 27 支持接入 Anthropic、OpenAI 和 Google 等第三方 AI 模型,同时引入 Core AI 框架提供现代 Swift API 调用端侧模型,并升级开源框架 MLX。

    推荐理由:Xcode 27 把 AI 智能体直接嵌进 IDE,支持多文件编辑和第三方模型,对苹果生态开发者是效率跃迁,非苹果开发者可以略过。

  9. Claude Code:GitHub Releases(RSS)57

    Claude Code v2.1.181 发布

    Claude Code v2.1.181 发布,新增 `/config key=value` 语法允许在提示中直接设置任意配置项,新增 `sandbox.allowAppleEvents` 选项使沙盒命令支持 Apple Events,新增 `CLAUDE_CLIENT_PRESENCE_FILE` 环境变量用于抑制移动端推送通知。内置 Bun 运行时升级至 1.4,改进了长段落流式输出(逐行显示)和 API 连接中断后自动重试。子 agent 面板优化:空闲 agent 30 秒自动隐藏、列表最多 5 行。修复了提示缓存读取、Write/Edit 在网络驱动器产生 0 字节文件、启动性能回归(约 120ms)、启动阻塞(最长 15 秒)、macOS TUI 冻结、子 agent 时长显示错误、API 重试指示器残留、AWS 凭证刷新等问题。

    推荐理由:一次工程师式的磨刀更新,修复了网络驱动器写入、macOS TUI 冻结等一批痛感明显的 bug,新增的 /config 快捷语法也顺手,但对非 Claude Code 用户来说就是一串技术细节。

  10. Claude:Blog(网页)65

    借助 Workload Identity Federation 安全访问 Claude Platform

    Workload Identity Federation (WIF) 已在 Claude Platform 上全面可用。WIF 兼容任何 OIDC 身份提供者,覆盖所有 Claude API 端点(包括第一方 SDK 和 Claude Code)。WIF 用短生命期凭证替代静态 API 密钥,并引入服务账户,每个工作负载拥有独立身份、角色和审计日志。Claude Console 提供引导设置流程,支持 Admin API 进行组织管理。API 密钥可并行使用以便逐步迁移。

    推荐理由:这个功能真正解决了企业在生产环境中用 Claude 的最大痛点,现在团队可以完全抛掉静态密钥,用现成的身份体系接入,安全审计也变得顺手。

  11. Claude:Blog(网页)70

    Claude Design 更新:跨项目保持品牌一致,与Claude Code协同

    6月17日,Claude Design 更新,支持跨项目使用统一设计系统,并与Claude Code同步工作流。用户可直接拖拽、对齐和缩放画布元素,编辑器稳定性大幅提升。设计系统可从GitHub、设计文件或原始上传导入,团队管理员可锁定标准系统防止篡改。新增桌面端侧边栏入口及独立网页端claude.ai/design。使用限制与聊天、Claude Cowork、Claude Code共享,每次任务消耗更少token,错误率下降。支持导出PDF、PPT,集成Adobe、Canva、Gamma等工具。发布首周用户超一百万。

    推荐理由:Claude Design 从原型工具升级为日常设计工作流,设计系统锁定和 Claude Code 同步打通了从想法到代码的管道,设计师和前端团队值得一试。

  12. GitHub Blog61

    GitHub 发布 CC0-1.0 开源多语言仓库级数据集,覆盖 README、Issue 和 PR

    GitHub 推出一个新的仓库级数据集,采用 CC0-1.0 许可证,旨在帮助研究人员和开发者发现跨 README、Issue 和 Pull Request 的多语言开发者内容,加速多语言 AI 开发。

    推荐理由:GitHub 发布了一个多语言开发者内容数据集,CC0 许可,对于训练跨语言代码模型和辅助翻译有直接价值,做多语言 Copilot 的团队应该会关注。

  13. X:Replit (@Replit)69

    Claude Design与Replit联动,设计变应用

    在Claude中设计。在Replit中构建。 你现在可以将Claude Design中的设计发送到Replit,将其变成一个可工作的应用。

    推荐理由:Replit 打通了 Claude 设计到部署的闭环,虽然算不上技术突破,但对不会写代码的人来说,这是把想法直接变成应用的最短路径,值得一试。

  14. MarkTechPost(RSS)77

    Vercel 发布开源 AI 智能体框架 Eve:每个智能体就是一个文件目录

    Vercel 发布开源 AI 智能体框架 Eve(npm 包,Apache-2.0 许可)。Eve 采用文件系统优先设计:每个智能体对应一个磁盘目录,目录结构直接映射模型、指令、工具、技能、连接、子智能体等能力,无需额外注册代码。内置六大生产级能力:持久执行(每步检查点,崩溃后可恢复)、沙箱计算、人机审批、安全连接(支持 MCP 和 OpenAPI)、多通道(Slack、Discord、Teams 等)以及追踪与评估(OpenTelemetry)。Vercel 内部运行了上百个智能体,包括数据分析工具 d0(月处理超3万查询)、自动销售代理 Lead Agent(年费约5000美元、回报32倍)和支持智能体 Vertex(自主解决92%工单)。

    推荐理由:Vercel 把自己跑了 100 多个 agent 的框架开源了,用目录即契约的方式把耐久执行、沙箱、审批等全打包,对想在生产环境跑 agent 的团队是今年最务实的发布之一。

  15. X:Midjourney (@midjourney)71

    Midjourney V8.1 发布大批次草稿模式

    我们发布了 V8.1 的新大批次草稿模式。该新模式可让你生成 24 张低分辨率图像,价格仅为标准分辨率四图 Midjourney 任务的一半。当你喜欢某张图像时,只需按下 "Vary" 即可获得全分辨率的新版本。尽情享受吧!

    推荐理由:Midjourney 这个批量草稿模式把试错成本砍半,对高频出图的设计师是个实在的提速,但不算能力升级,更像效率补丁。

  16. TechCrunch:AI(RSS)76

    Google发布99美元Gemini智能音箱

    Google推出首款专为Gemini打造的智能音箱Google Home Speaker,售价99.99美元。支持自然语言请求和多步指令,可在说话中途纠正,并具备连续对话功能。内置10种新声音。高级AI功能需订阅Google Home Premium(月费10美元或年费100美元),包括Gemini Live自由对话、Nest摄像头活动摘要等。即日起预售,本月发货。

    推荐理由:Google 终于把 Gemini 塞进了音箱,多步指令和自然纠错是亮点,但高级功能要订阅 Home Premium。普通用户会觉得方便,智能家居玩家可以观望,AI 从业者不会有多大惊喜。

6月17日周三
  1. X:Yuchen Jin (@Yuchenj_UW)77

    Omnigent开源:AI智能体团队元框架

    编程的未来不是单一智能体,而是一个完整的AI团队。 Omnigent让你在一个实时会话中运行一个智能体团队:Claude Code、Codex、Cursor、Pi,以及你自己的智能体。 它是一个面向AI智能体的元框架,基于我们内部的Databricks开发工具构建,现已开源给所有人。 由传奇人物@matei_zaharia和Databricks AI团队打造。没错,Matei仍然编写大量代码,包括Omnigent和我们产品的前端代码。

    推荐理由:Databricks 把内部用来协调多个 AI 编码代理的工具开源了,集合了 Claude Code、Cursor 等,做 agentic coding 的开发者值得上手试试,可能会改变我们组合使用 AI 工具的方式。

  2. IT之家(RSS)74

    阿里云发布HappyOyster 1.0:一句话生成可实时交互的数字世界

    6月17日,阿里云发布开放式世界模型HappyOyster 1.0(快乐生蚝)。该产品基于原生多模态架构,支持多模态输入与音视频联合生成,可在生成过程中持续接收用户指令并实时响应画面。它深度学习物理世界状态转移规律,保持人物和环境长程一致性。官网开放“实时导演”与“世界探索”两种玩法:前者可随时叫停改写故事、与虚拟男友实时互动等;后者支持自由漫游、滑板冲刺、翼装滑翔、骑马奔驰、攻击打怪等交互。该产品已于今年4月16日开放内测,即日起至7月17日官网不定期掉落体验积分。

    推荐理由:阿里把世界模型做成了可玩的交互产品,一句话生成能探索能互动的数字世界,实时导演模式直接替代了一部分短剧和互动内容创作,虽然还像噱头但至少是能玩的尝试。

  3. Hugging Face:Blog(RSS)66

    Strands Robots SDK:用单一智能体打通 Hugging Face Hub 到物理机器人

    AWS(Apache 2.0)开源的 Strands Robots SDK 将 LeRobot 栈封装为 AgentTools,构建统一智能体。默认用 MuJoCo 模拟(无需硬件),mode="real" 切换至真实机器人。可记录演示数据为 LeRobotDataset 并推送 Hugging Face Hub,运行 GR00T 或 LerobotLocal 策略推理,经 Zenoh mesh 广播命令到多台机器人。模拟与硬件代码完全一致,只需改一个关键字参数。示例可在笔记本(Python 3.12+,Linux/macOS)无硬件、无 GPU 运行。

    推荐理由:AWS 的 Strands Robots 把 LeRobot 仿真和硬件部署装进同一个 Agent 里,代码几乎不变就能从模拟切到物理机器人,对具身智能开发者是省掉胶水代码的实用工具。

  4. 公众号:火山引擎63

    Kickart 3.0发布,让广告视频创作更精准高效

    火山引擎一站式营销创作平台Kickart 3.0(原“创作Agent”)正式上线,升级为对话式视频生成模式,用户可通过多轮对话调整商品图、故事板等,用自然语言生成营销视频。新增“爆款裂变”能力,上传视频链接后自动拆解爆款逻辑并重构至新商品视频,支持抖音电商内容合规与质量预审核。平台开放SaaS、API及Skill等多种交付方式,并已接入Seedance 2.0 mini,助力降低广告营销成本。

    推荐理由:火山引擎为营销人带来的视频生成工具体验不错,对话式调整和爆款裂变能降低创作门槛,但对于关注AI技术进展的读者,这更像一次垂直行业产品迭代,亮点有限。

  5. Hacker News 热门(buzzing.cc 中文翻译)76

    Wolfram 语言和 Mathematica 15 版发布:内置 AI 助手、符号音乐等新功能

    在 Mathematica 诞生近 38 年后,Wolfram 语言与 Mathematica 发布 Version 15。每个笔记本内置 AI 助手,支持从 AI 环境中直接调用 Wolfram 技术。新增符号音乐系统、大规模时间序列与事件序列处理、分类数据计算、模型拟合超函数 ModelFit。笔记本支持千兆字节级大小与实时查找,首次引入侧边栏、视觉主题及弃用功能样式。强化了表格连接、多点可视化、图形刻度绘制与轨道运行计算等功能。DSolve 拐角处获得 AI 方法辅助,支持偏微分方程曲线坐标求解。扩充了矩阵分解、多元 zeta 函数与调和数、流线型部分分式分解。强化了 WebSocket 实时连接、Python 交互改进,支持 CUDA 内核作为外部函数,Wolfram Compute Services 新增 GPU 支持。

    推荐理由:Wolfram Language 15 把 AI 助手直接内嵌进笔记本,加上符号音乐和 ModelFit 超级函数,对用代码思考的人来说,这是今年最扎实的版本升级。

  6. OpenRouter:Announcements(RSS)67

    Subagent:让模型把琐碎任务委托出去

    OpenRouter 推出 openrouter:subagent 服务器工具,允许前沿模型在生成过程中将独立的琐碎任务(如文档总结、结构化数据提取、文本重格式化)委托给更小、更便宜、更快的 worker 模型执行,从而节省前沿模型的 token 消耗。

    推荐理由:这是 OpenRouter 对 agent 交互模式的一个小但实用的创新,让主模型自动将摘要、格式化等确定性子任务分派给更便宜的小模型,做多模型编排的开发者可以直接拿来用。

  7. LangChain:Blog(RSS)64

    LangChain 发布 Open SWE:开源异步编码智能体

    LangChain 推出 Open SWE,一个开源、云端托管的编码智能体,可自主处理 GitHub 任务,包括规划、编码、测试和提交 PR。该智能体采用异步架构,旨在提升开发效率。

    推荐理由:开源 coding agent 赛道又添一员,LangChain 的 Open SWE 主打异步处理 GitHub 任务,对想用 AI 自动提 PR 的团队多了一个云托管选项。

  8. xAI:News(网页)64

    Grok for PowerPoint 发布:在 Microsoft PowerPoint 内直接生成和编辑幻灯片

    xAI 于 6 月 16 日发布 Grok for PowerPoint,作为免费 Microsoft 365 插件上线。用户无需离开应用即可利用 Grok 将大纲转为完整幻灯片,进行内容研究、撰写、排版,并支持添加单张幻灯片、调整样式主题、重构章节。插件还能调用 Grok 连接器,从邮件或 SharePoint 中获取信息。该插件同样适用于 Word 和 Excel。

    推荐理由:Grok 进入 PowerPoint,让 Grok 用户可以在幻灯片里直接用,但功能跟微软 Copilot 高度重叠,属于跟进式覆盖,没带来新能力,不算重要。

  9. X:Satya Nadella (@satyanadella)70

    Copilot Cowork 全球正式可用,支持多模型

    Copilot Cowork 现已全球正式可用,并支持多模型! 每个组织都可以让长期运行的智能体处理复杂的多步骤任务,基于你组织的独特知识和专有技术。 https://www.microsoft.com/en-us/microsoft-365/blog/2026/06/16/copilot-cowork-is-now-generally-available/?v=15

    推荐理由:Copilot Cowork 的正式上线让多模型代理真正进入企业工作流,不再只是演示,团队今天就可以开始部署长期运行的复杂任务代理。

6月16日周二
  1. 公众号:小米 MiMo69

    小米 MiMo Claw 正式版发布:旗舰模型+金山办公,全新订阅服务上线

    小米推出云端轻量化 Claw 类产品 MiMo Claw 正式版,搭载与 OpenClaw 框架深度适配的 MiMo-V2.5-Pro 旗舰模型。该模型原生兼容 MCP 工具调用协议,内置百万级超长上下文,支持单会话千次以上连续工具调用;依托 MTP 三层解码架构,在 OpenClaw 标准 Agent 工作流中吞吐效率提升约 3 倍。ClawEval 测试中任务达标率(Pass³)达 63.8%,Token 消耗较同类产品降低 40%-60%。联动金山办公生态,提供 Word、Excel、PPT、PDF 等格式的 AI 生成、预览与在线编辑一站式服务。免费用户每日单次体验时长从1小时升级至4小时,面向高频用户推出 TokenPlan 分层订阅(Lite/Standard/Pro/Max),支持灵活叠加,限时定价14.9元/月、19.9元/月、233.8元/年。

    推荐理由:小米给普通人用的 Agent 工具正式上线,14.9 元月费很激进,但核心还是看实际任务完成率和办公集成靠不靠谱。

  2. 公众号:小米 MiMo61

    Xiaomi MiMo Claw 正式版发布:搭载 MiMo-V2.5-Pro 旗舰模型,联动金山办公上线订阅服务

    小米发布云端轻量化 Claw 类产品 MiMo Claw 正式版,搭载与 OpenClaw 框架深度适配的 MiMo-V2.5-Pro 旗舰模型,原生支持 MCP 协议与百万级超长上下文。

    推荐理由:正式版嵌入金山办公生态,把 Agent 能力从实验室工具转向按订阅交付的办公闭环,文档一站式生成-预览-编辑减少了多工具跳转。

  3. MarkTechPost(RSS)71

    Google Cloud 推出 OKF v0.1:供应商中立的 Markdown 规范,为 AI 智能体提供结构化上下文

    Google Cloud 发布 Open Knowledge Format (OKF) v0.1,一种供应商中立的 Markdown 规范,为 AI 智能体提供结构化上下文知识。OKF 将知识表示为带 YAML 前置元数据的 markdown 文件目录,每个概念对应一个文件,通过 `type`、`title`、`description` 等少量保留字段实现互操作。无需专有服务、SDK 或运行时,目录可托管在 GitHub、以 tarball 传输或挂载到任意文件系统。OKF 旨在解决组织内部知识碎片化问题——表结构、指标定义、runbook 等散落在不同 catalog 和 wiki 中,各厂商方案互不兼容。遵循最少意见原则,只强制 `type` 字段,生产者和消费者可独立实现。使用场景包括数据团队将 BigQuery 表定义导出为代码、为智能体存储 incident runbook、跨组织知识交换等。

    推荐理由:这是 Karpathy LLM Wiki 思想的首个工业级标准化尝试,把散落在各处的内部知识统一成 agent 可读的 markdown 规范,对构建 AI 应用的团队是切实的工程改进,值得加入设计检查清单。

  4. IT之家(RSS)70

    AI 版支付宝官宣开启邀测:右滑打开“阿宝”,官方放出 100 个邀请码

    支付宝今日开启 AI 版邀测,用户可右滑进入新版界面,在对话框或语音中输入指令,由“阿宝”助手代办事项。以查询公积金为例,阿宝自动匹配对应小程序和服务入口,用户点击确认即可完成,将多步跳转折叠为一句指令。所有涉及资金变动和支付的环节均需用户本人确认。首批放出 100 个邀请码。

    推荐理由:支付宝的AI版右滑唤起阿宝,把查公积金等繁琐流程压成一句话,是超级App从陈列式向对话式转型的实质性信号,做生活服务产品的都该盯一下。

  5. IT之家(RSS)73

    教育部“阳光志愿”信息服务系统全新升级上线:智能筛选志愿,数据权威可信

    教育部“阳光志愿”信息服务系统今日全新升级上线,依托招生、学籍、就业等海量官方数据,免费为考生和家长提供志愿填报服务。系统支持31个省区市本专科普通批次志愿筛选,输入高考成绩、位次及个性化条件即可快速生成合理参考方案。AI助手“智慧小招”24小时在线解答政策规则。平台数据由高校直接报送、官方核验,真实可靠。同时推出专业倾向测评和21项生涯测评工具,帮助学生认清特长、规划未来。

    推荐理由:教育部把AI助手“智慧小招”整合进官方志愿填报系统,数据权威是最大卖点,对考生和家长是实用的免费升级,但对AI行业来说,这只是一个典型的政府服务智能化案例。

  6. TechCrunch:AI(RSS)71

    Meta 在 Facebook 上线“AI Mode”,基于平台公开信息合成答案

    Meta 宣布在 Facebook 推出“AI Mode”搜索功能,利用 Meta AI 从公开帖子(含群组和 Reels)提取信息并合成答案,用户可用自然语言提问获得摘要。同时新增视频拼贴剪辑、过渡效果及 AI 照片预设(可更换服装、发型和配饰),体育迷可在 Stories 中点击“AI Edit”虚拟穿上队服。这些更新延续了此前动态头像、Marketplace 自动回复和创作者 AI 助手的部署节奏。此外,Meta 近期启动了 Facebook、Instagram 和 WhatsApp 的全球订阅计划(每月 3.99 美元起),更多 AI 订阅层级正在规划中。

    推荐理由:Facebook 的 AI 模式把社交搜索变成问答,想法不新但执行够快,对普通用户吸引力大,只是答案来自群聊,可靠性是个坑。配套的 AI 照片编辑也让玩梗更方便,Meta 在拼命给 Facebook 塞 AI 留住用户。

  7. X:OpenRouter (@OpenRouter)65

    OpenRouter新增免费模型gpt-oss-20b和Gemma4 26B

    OpenRouter 上新增免费容量,由 @eigenlabs 的 Darkbloom 提供:gpt-oss-20b 和 Gemma 4 26B。 今天就开始使用这些模型吧 ↓

    推荐理由:OpenRouter 免费层加了两个模型,其中一个名字暗示 Gemma 4,如果属实值得一看,否则就是一次普通的容量扩充,但对经常薅免费 API 的开发者来说多了选择。

  8. Google Cloud:Databases(RSS)61

    Google Cloud 发布多项 Data Agent 新工具,助力 AI 工作流

    Google Cloud 发布一系列 Data Agent 新工具,帮助开发者利用企业数据构建 AI 智能体。新功能包括 BigQuery 中 Conversational Analytics 的扩展支持、已正式上线的 Data Engineering Agent,以及预览版的 Database Observability Agent。

    推荐理由:Google Cloud 一口气发布多个数据代理,覆盖从运维到 BI 的全流程,自家生态的数据工程师应该看看,但对不依赖 GCP 的团队意义有限。

  9. xAI:News(网页)73

    Grok Build 推出 Agent Dashboard 管理多个编码会话

    xAI 为 Grok Build 推出 Agent Dashboard,提供单一屏幕管理多个编码会话。仪表板按状态分组(等待输入、工作中、空闲),每行显示状态标记、名称、分支、权限模式和当前操作。选中会话可打开 peek 面板查看最新输出并直接回复,等待输入的会话支持用箭头键或数字键选择选项。底部输入框用于分派新会话,支持设置模型、启动计划模式或自动批准编辑。通过 `grok dashboard`、`/dashboard` 或 `Ctrl+\` 打开,关闭后会话继续运行,重新打开即可恢复。

    推荐理由:xAI给Grok Build加了一个类似终端的仪表盘,可以并行管理多个编码代理,对重度用户来说能省下频繁切换窗口的心智负担。功能本身不颠覆,但标志着AI编程工具在往多会话编排走。

  10. Berkeley RDI:Blog(AI 安全与评测)68

    SageCTF:最强大CTF挑战AI智能体

    UC Santa Barbara与UC Berkeley团队基于OpenSage框架构建了CTF专用智能体SageCTF。在DEF CON CTF 2026资格赛中,SageCTF以单人玩家身份尝试15道挑战,成功攻克7道、恢复8个flag,总计1,743分,排名前5%,超越全部自评“不使用AI”或“低AI”的175支团队。在50道近期CTF挑战的对比测试中,SageCTF以Claude-Opus-4.6为主模型,在相同预算(每道$200/10小时)下解出39道,而Claude Code仅解出13道,且Claude Code的解出全部被SageCTF覆盖。技术核心包括AI自生成拓扑、多智能体通信、分层记忆及多模型协同编排。

    推荐理由:SageCTF 在 DEF CON CTF 排进前 5%,是 AI agent 在顶级安全竞赛中的首次重大突破。OpenSage 的自构建多智能体架构和十小时持续探索的能力,给做复杂推理工具的人提供了真参考。

6月15日周一
  1. 公众号:月之暗面(Kimi)69

    6倍速!Kimi K2.7 Code 高速版已上线

    Kimi K2.7 Code 高速版上线,与普通版为同一模型,输出速度约 5-6 倍,常规编程场景约 180 Token/s,短上下文可达 260 Token/s。API 定价为普通版 2 倍,模型 ID:kimi-k2.7-code-highspeed。Kimi Code Plan 用户可通过「抢先体验计划」使用,用量消耗为普通版 3 倍。使用须开启思考模式,关闭会报错或回退至 K2.6。庆祝发布,Kimi API 开放平台推出为期三周充赠活动,充值 500 元及以上享 20%-30% 代金券。相比 K2.6,K2.7 Code 在长上下文编程指令遵循、长程任务性能提升,平均 token 消耗减少 30%,内部基准测试显著提升。普通版输入 6.5 元/百万 token、输出 27 元,缓存输入 1.3 元。非编程任务推荐 K2.6。

    推荐理由:这不是 K2.7 的换代,而是给开发者开了条高速车道,180 token/s 让代码补全几乎无感,虽然贵但省时间,重度编程用户值得切。

  2. MarkTechPost(RSS)73

    Flash-KMeans:IO感知的精确K-Means,在GPU上比FAISS快200倍以上

    UC Berkeley与UT Austin团队开源Flash-KMeans(Apache 2.0,`pip install flash-kmeans`),精确实现标准Lloyd's k-Means,通过重构GPU数据流而非改变数学或近似来提速。在NVIDIA H200上,端到端速度比最佳基线快17.9×,比cuML快33×,比FAISS快200×以上。其FlashAssign核避免物化完整N×K距离矩阵,将IO复杂度从O(NK)降至O(Nd+Kd),单核加速最高21.2×;Sort-Inverse Update核通过排序聚类ID减少原子争用,单核加速最高6.3×。支持out-of-core处理,在1B数据点、K=32768时单次迭代仅41.4s。适用于向量搜索索引、稀疏注意力路由、KV缓存压缩等在线场景。

    推荐理由:Flash-KMeans 把 k-means 从离线预处理拉进了在线循环,200 倍加速不是纸面数字,而是让向量索引重建、稀疏注意力路由这些场景突然可行了。做大规模聚类的可以立刻换掉 FAISS。

6月14日周日
  1. X:Suno (@suno)70

    Suno 音轨分离:从零生成更纯净

    重大更新:Suno 的音轨分离刚刚大幅升级。🚀 我们现在从零重新生成音轨,而非仅仅隔离频率。结果如何?纯净无伪影的音轨,可直接拖入你的 DAW。

    推荐理由:Suno 把 stem 分离从滤波换成了重新生成,这对做音乐的人来说是个实质进步,artifacts 老问题被从根上解决,不再只是凑合能用。

  2. Hacker News 热门(buzzing.cc 中文翻译)74

    Paca:一款适用于人机协作的轻量级 Jira 替代方案

    Paca 是一款面向人类与 AI 智能体协作场景的轻量级项目管理工具,旨在替代 Jira。项目已开源并托管于 GitHub,支持团队通过直观界面协同管理任务,特别针对 AI 参与工作流进行了优化。

    推荐理由:Paca 的理念值得关注——让 AI 代理以正式成员身份加入 Scrum,而非作为外部自动化,但产品成熟度有限,适合早期尝鲜者。

  3. X:OpenRouter (@OpenRouter)70

    Fusion API:半价达Fable级智能

    推出Fusion API,市场上最智能的复合模型。 Fusion以一半的价格实现Fable级别的智能。 工作原理如下👇

    推荐理由:OpenRouter 的 Fusion API 说能以一半价格达到 Fable 级智能,对开发者选型是个新选项,但没给具体基准,我会先观望实测。