跳到正文
北京时间

全部动态

今日 92 条
5月30日周六
  1. X:OpenAI (@OpenAI)73

    Codex现已支持Windows端计算机使用功能

    Windows用户,这条消息是给你的。 计算机使用功能现已在Windows上可用,因此Codex可以在你的Windows电脑上执行操作。 通过ChatGPT移动应用中Codex的Windows支持,你可以在工作继续在Windows电脑上进行时,随时随地启动、审查和引导任务。 这是一项早期体验,但我们正在努力提供更多方式,让你的工作无论身在何处都能持续进行。

    推荐理由:Windows 用户终于等到 Codex 能直接操控电脑了,配合手机端协同一气呵成,虽然还早期,但已经把 AI 真正带进日常工作流里。

  2. OpenRouter:Announcements(RSS)77

    OpenRouter融合预算模型性能超越GPT-5.5与Claude Opus 4.7

    一组预算模型通过OpenRouter平台进行模型融合,在包含100个复杂研究任务的评估中,得分超过了GPT-5.5与Claude Opus 4.7。

    推荐理由:OpenRouter 的 Fusion 功能把模型融合做成了 API 调用,实测用便宜模型组合就能逼近 Fable 5 的性能,成本却只有一半,这对做复杂推理和深度研究的开发者来说是个很实用的新工具。

  3. X:Replit (@Replit)73

    Replit Canvas:对话式设计与原型生成工具

    你试过新的 Replit Canvas 了吗? - 探索多种设计方向 - 通过与设计框架对话来调整设计 - 设计 UI 原型并将其转换为应用 - 为社交媒体创建营销素材

    推荐理由:Replit 这次把设计到代码的链条打通了,虽然不是革命性突破,但对用 Replit 做产品的开发者来说,省掉了从 Figma 到代码的来回折腾,可以试试。

  4. X:OpenRouter (@OpenRouter)72

    OpenRouter支持模型生成文件补丁

    OpenRouter 现已支持 "apply_patch",这是一个服务器工具,允许任何模型通过 Responses API 使用 V4A diffs 提出文件编辑建议。 模型生成一个补丁(创建、更新或删除文件)。OpenRouter 在服务器端验证 diff 语法。

    推荐理由:OpenRouter 这个 apply_patch 解决了多模型文件编辑的碎片化,任何模型接上就能出 diff,做 coding agent 的可以少写一堆适配代码。

5月29日周五
  1. OpenRouter:Announcements(RSS)73

    OpenRouter 推出 Guardrails:保护你的 AI 智能体、数据与成本

    OpenRouter 发布 Guardrails 可配置安全与治理工具,支持预算执行、零数据保留、模型和提供商限制、提示词注入防御以及数据丢失防护,帮助用户保护 AI 智能体、数据与成本。

    推荐理由:OpenRouter 的 Guardrails 把预算、隐私、模型白名单和 prompt 注入检测打包成傻瓜式配置,做 agent 的团队终于不用自己拼积木了,生产环境多一层放心。

  2. OpenRouter:Announcements(RSS)70

    OpenRouter Guardrails 发布:可配置安全与治理工具,保护 AI 智能体、数据与成本

    OpenRouter 推出 Guardrails,一套可配置的安全与治理工具,支持预算执行、零数据保留、模型与提供商限制、提示词注入防御及数据丢失防护等策略,用于保护 AI 智能体、数据和成本。

    推荐理由:OpenRouter 这波补上了 API 代理的安全短板,提示注入防御和 DLP 直接堵住了企业用户最担心的两个口子,配置方式也足够灵活,做 agent 的团队值得立刻上。

  3. IT之家(RSS)70

    阿里云开源百炼 CLI,Agent 可调用全套模型和应用能力

    阿里云宣布百炼核心能力已 CLI 化,仅需一行命令即可让 Agent 接入百炼的 150 多款模型、十多款应用及知识库、记忆、联网搜索等能力。该 CLI 专为 Agent 设计,原生支持 Claude Code、Qoder 等主流框架,已在 GitHub 开源,支持多模态模型调用、Workflow 调用与结构化输出。

    推荐理由:阿里云把百炼的全套能力打包成 CLI,Agent 开发终于不用再一个个接 API 了,做企业智能助手的可以试试。

  4. Simon Willison 博客72

    llm-anthropic 0.25.1

    llm-anthropic 发布 0.25.1 版本。主要更新包括:新增 Claude Opus 4.8 (`claude-opus-4.8`) 模型;为账户启用了该功能的组织新增了 `-o fast 1` 选项以使用快速模式;调整了各模型的默认 `max_tokens` 值,使其直接使用模型的最大输出长度,而非固定的 8,192。

    推荐理由:Simon 的 llm 插件第一时间支持了 Claude Opus 4.8,如果你用他的 CLI 工具切换模型,这次更新能让你马上用到新模型和 fast mode。

  5. Claude Platform:开发者版本说明(RSS)63

    Claude Platform on AWS 新增 Managed Agents webhooks、多智能体编排与自托管沙箱

    Claude Platform on AWS 现已支持 Managed Agents webhooks、多智能体编排和自托管沙箱。新增了 IAM 操作及 `AnthropicSelfHostedEnvironmentAccess` 托管策略,用于在 AWS 上管理 Claude 智能体的触发、协作与安全执行环境。

    推荐理由:这次更新让 Claude 托管代理直接跑在 AWS 上,对已经在用 Claude Platform 的企业算是好消息,webhooks 和多代理编排能简化不少工作流,但并不会改变行业格局。

  6. X:OpenRouter (@OpenRouter)68

    别只看基准测试,要看全面表现

    不要只依赖基准测试;要看全面情况! 试试我们的新比较页面,它还能让你可视化模型性能:https://openrouter.ai/compare/openai/gpt-5.5/anthropic/claude-opus-4.7/anthropic/claude-opus-4.8

    推荐理由:OpenRouter 这个对比页把 GPT-5.5 和 Claude Opus 4.8 的胜负判断从 benchmark 拉到实际测试,对选型的人很有用。

  7. X:Replit (@Replit)74

    Replit Canvas:智能体设计工具发布

    最好的设计工作不会在聊天框里发生。你需要空间来探索想法、创建变体并进行迭代。 认识新的 Replit Canvas。 你的智能体设计工具,用于构建精美的网站、应用、营销资产等。

    推荐理由:Replit 终于在对话之外给了设计师一个能迭代的画布,把 Agent 直接塞进设计工具里,对用 AI 做 UI 的人来说比聊天框强太多了。

  8. X:MiniMax (@MiniMax_AI)76

    MiniMax M2.7 免费智能体编程限时开放

    在 @OpenHandsDev 上使用 MiniMax M2.7 进行免费智能体编程? 是的,请给我!限时提供 ⚡👀

    推荐理由:MiniMax把M2.7免费接到OpenHands里跑Agent编码,而且限时,这对个人开发者是实打实的免费用机会,不妨上去跑几个任务体验下性价比。

  9. Google Developers Blog(RSS)73

    使用 Google Pay & Wallet Developer MCP server 加速你的集成工作流

    Google 推出 Google Pay & Wallet Developer MCP server,这是一款开放标准工具,旨在将 AI 开发助手和 IDE 安全连接到实时的 API 与账户上下文。开发者无需离开开发环境,即可搜索官方文档、验证 Wallet pass 定义、检查集成状态以及管理商户账户。该集成旨在通过减少上下文切换并提供实时、可靠的 AI 支持来减少开发摩擦,从而加速开发工作流。

    推荐理由:这是 Google 为支付场景做的 MCP 服务器,把文档和账户操作直接塞进 IDE,减少上下文切换,做 Google Pay 集成的开发者可以试试看。

  10. Claude Code:GitHub Releases(RSS)73

    Claude Code v2.1.154 发布:新增 Opus 4.8 与动态工作流

    Claude Code 更新至 v2.1.154 版本,正式引入 Opus 4.8 模型。新功能包括“动态工作流”,可通过 `/workflows` 指令让 Claude 在后台编排数十到数百个 AI 智能体协同处理复杂任务。Opus 4.8 的快速模式现已可用,成本降低为 2 倍标准费率可实现 2.5 倍速度提升。其他更新有:精简系统提示词成为默认设置(除 Haiku、Sonnet 及 Opus 4.7 及更早版本外),优化多选题决策逻辑,简化 `/simplify` 命令。此次更新修复了包括后台会话管理、终端渲染在内的多个 bug,并增强了自动模式对数据外泄的检测能力。

    推荐理由:Claude Code 这版把多 agent 编排做成了产品功能,动态工作流让一个 prompt 能调度上百个 agent,再加上 Opus 4.8 快速模式只要 2 倍价格,做复杂任务的开发者可以试一下。

  11. Claude:Blog(网页)78

    在Claude Code中引入动态工作流

    Claude Code 推出“动态工作流”功能,使 Claude 能端到端处理复杂任务。该功能通过动态编写脚本,在单个会话中并行运行数十到数百个子智能体来完成工作,并会在结果呈现前进行验证。它适用于跨代码库的 bug 查找、大规模迁移(如将 Bun 从 Zig 移植到 Rust)等需要多角度分析的任务。该功能现已在研究预览阶段可用,支持 Claude Code CLI、桌面端、VS Code 扩展以及 API、Amazon Bedrock、Vertex AI 等平台,面向 Max、Team 及已启用的 Enterprise 计划用户。

    推荐理由:动态工作流第一次让 Claude Code 能独立搞定需要并行协调的大规模工程任务,Bun 从 Zig 到 Rust 只用了十一天,这对复杂代码库的维护和迁移是降维打击。

5月28日周四
  1. TechCrunch:AI(RSS)72

    Sesame,这家由Oculus创始人创办的对话式AI初创公司,发布其iOS应用

    由Oculus创始人创办的AI初创公司Sesame发布了其iOS应用,该应用将对话式AI智能体带给公众。应用提供更自然的来回交互体验,设计上区别于传统聊天机器人,旨在让用户感觉更像在和真人对话。

    推荐理由:Oculus创始人做的对话AI,交互设计大概率能看到一些VR时代的人机直觉。虽不是大模型层创新,但产品体验可能重新定义什么样的对话才叫自然。

  2. X:Perplexity (@perplexity_ai)77

    Perplexity Computer现已集成微软Office套件

    Perplexity Computer现已登陆Microsoft Excel、Word、PowerPoint和Outlook。 您可以在应用程序的侧边栏中直接使用Computer来协调工作,起草文档、建模、制作演示文稿并处理电子邮件。 现已推出:https://www.perplexity.ai/hub/products/integrations/microsoft

    推荐理由:Perplexity把Computer塞进Office全家桶,侧栏里就能写文档、做表格、理邮件。对每天跟Office打交道的人,这是个无需切换工作流的原地升级。

  3. Mistral AI:News(网页)63

    Mistral 发布开源 Search Toolkit 公开预览版,统一搜索管道的摄入、检索与评估

    Mistral AI 于 5 月 28 日发布 Search Toolkit 公开预览版,一个用于构建 AI 应用生产级搜索管道的开源组合式框架,把摄入、检索和评估纳入统一接口,可部署在云端、本地或边缘。

    推荐理由:原文完整列出框架的摄入、检索、评估三大模块与内置指标和企业案例,读者可据此判断能否替代自建检索管道。

  4. Mistral AI:News(网页)67

    Mistral 发布统一智能体 Vibe,含 Work 与 Code 双模式及 VS Code 扩展

    Mistral 将 Le Chat 升级为统一智能体 Vibe,一个许可覆盖工作与编码,上线 Work Mode 和 Code Mode,并发布新的 Mistral Vibe VS Code 扩展。

    推荐理由:原文给出 Vibe 双模式的具体能力、VS Code 扩展与各档定价,读者可据此判断它如何替换 Le Chat 和现有编码工作流。

  5. 公众号:面壁智能(MiniCPM)61

    PilotDeck 开源:以 WorkSpace 为核心的智能体操作系统

    清华大学 THUNLP 实验室、面壁智能、OpenBMB 与 AI9stars 联合研发并开源的智能体操作系统 PilotDeck,以 WorkSpace(工作舱)替代传统对话框,每个工作舱拥有独立文件系统、记忆和技能,实现项目隔离。三大核心能力:记忆白盒化,全链路可见可控,支持一键修改和回滚;智能路由,自动识别任务难度动态分配模型,开启后成本节省近 70%,复杂任务仅用 1/6 成本即可反超顶级模型方案;Always-on 常驻任务,AI 主动发现并持续推进工作。支持端云协同,可调用端侧模型作为子 Agent,自动部署 VoxCPM 等模型完成多语言播客等任务。

    推荐理由:PilotDeck把Agent从对话框解放进「工作舱」,记忆可见、成本锐减、能无人值守运行。已开源,值得所有被多任务折磨的开发者试试。

  6. Claude Code:GitHub Releases(RSS)67

    Claude Code v2.1.153 版本更新

    Claude Code 发布 v2.1.153 版本。主要新增 `skipLfs` 选项以跳过 Git LFS 下载;优化了 `claude agents` 的自动补全建议和 PR 列显示格式。本次更新修复了大量问题,包括:MCP 服务器的连接与重连、子代理的配置策略与严格模式行为、后台会话的管理与权限提示(如恢复、输入响应、临时文件处理),以及跨 macOS/Windows/VSCode 平台的稳定性。此外,还修复了 Windows 更新回滚、内存占用、会话恢复等多个具体问题。`/model` 命令现在会将选择设为新会话的默认模型。

    推荐理由:Claude Code 的一次日常小修小补,但修复了 OAuth 凭证泄露和内存泄漏这种真影响使用的 bug,且 /model 现在可以记住默认模型了,升级一下不亏。

  7. vLLM 官方博客(RSS)60

    vLLM 推出原生 RL 权重同步 API 并修复异步 RL 死锁

    vLLM 引入原生权重同步 API,将 RL 训练器到推理引擎的权重传输标准化为初始化、开始、更新、结束四阶段,采用可插拔 WeightTransferEngine 抽象,目前支持 NCCL 和 IPC 两种后端并支持 packed tensor 优化。

    推荐理由:vLLM 官方说明原生权重同步 API 的四阶段设计与 DPEP 死锁修复,对搭建在线 RL 训练流程的团队有直接参考价值。

  8. X:Gemini (@GeminiApp)77

    Gemini Omni轻松转换视频视觉风格

    使用 Gemini Omni 轻松将您的视频转换为新的视觉风格。 只需上传视频或照片,并要求 Gemini 为您的最终输出应用某种外观或风格。

    推荐理由:Gemini 终于把图像风格迁移做到视频上了,并且直接集成到 Omni 里,不需要任何剪辑软件,对短视频创作者是个小但实用的更新。

  9. X:Greg Brockman (@gdb)71

    OpenAI支持私有MCP服务器安全连接

    自带MCP服务器: 你的团队可以将MCP服务器保留在内部网络中,同时ChatGPT、Codex和Responses API通过仅出站的HTTPS进行连接。 🔗 https://developers.openai.com/api/docs/guides/secure-mcp-tunnels

    推荐理由:OpenAI终于把MCP接进自家产品了,而且是企业最关心的私有化部署,这步棋走得精,既补了工具调用生态又没动安全底线,做B端产品的可以认真看看链接。

  10. Midjourney:Updates(RSS)59

    Web 更新

    对话模式在文本和语音输入方面进行了改进。语音会话开始时,可访问用户的图像提示、风格参考、侧边栏设置和最近任务。图像提示功能现可从托盘和侧边栏直接使用。在语音提交过程中,托盘中的图像将保持不变,直至用户手动移除。

    推荐理由:Midjourney给语音模式补了一课——现在它能记住你正在用的图片参考和风格设置,语音创作不用反复翻找,用完即走的轻量用户可能无感。

  11. X:OpenAI Developers (@OpenAIDevs)70

    OpenAI产品支持私有MCP服务器安全连接

    您的团队可以在内部网络中保留MCP服务器,同时ChatGPT、Codex和Responses API通过仅出站HTTPS进行连接。

    推荐理由:OpenAI 终于给企业级 MCP 接上私有网络了,以前要连 ChatGPT 就得把 MCP 暴露公网,现在通过 outbound 隧道就能安全接入,做内部工具开发的可以开始动起来了。

  12. X:Sky Computing Lab (@haoailab)70

    开源FastVideo Dreamverse实时视频生成工具

    🚀仅需7秒即可生成30秒1080p视频! 我们开源了FastVideo Dreamverse:基于单张NVIDIA B200 GPU和LTX-2模型,实现实时视频生成的氛围引导工具。 Repo: https://github.com/hao-ai-lab/FastVideo/tree/main/apps/dreamverse Blog: https://haoailab.com/blogs/fastvideo-dreamverse-release/

    推荐理由:7秒钟出30秒1080p视频,而且完全开源,视频生成速度被拉到实时边缘,虽然B200不是人人有,但路线值得所有做视频产品的同行研究。

  13. Google Developers Blog(RSS)66

    Google Pay 最新更新

    Google Pay 正向"智能体商务"演进,推出了通用商务协议和新的 MCP 服务器,允许 AI 智能体管理集成与分析趋势。Android 平台更新引入了动态回调以支持快速结账,并通过 WebView 将支付功能扩展至社交媒体应用。此外,平台还推出了跨设备生物认证和新的交易信号,旨在帮助商家减少流程摩擦。

    推荐理由:Google Pay 往 agentic commerce 迈了一大步,新的通用协议和 MCP server 让 AI agent 能直接管支付和分析,做 agent 或支付的开发者都得看看。

  14. X:SpaceXAI (@SpaceXAI)69

    Grok编程智能体登陆Kilo IDE平台

    在 @kilocode 中使用您的 SuperGrok 或 X Premium+ 订阅。 尝试 grok-build-0.1,享受高速和智能体编程智能,可在 Kilo IDE 扩展或 CLI 中使用。 https://x.ai/news/grok-kilocode

    推荐理由:xAI 把 grok 的编码模型塞进 Kilo Code,如果你本来就用这两个工具,这次集成能省不少事,但算不上行业震动。

5月27日周三
  1. X:Perplexity (@perplexity_ai)68

    Perplexity开源Unigram分词器降低CPU占用

    我们开源了重新构建的Unigram分词器,可将CPU占用降低5-6倍。 小型重排序器和嵌入模型在GPU上运行时间仅为个位数毫秒,使得CPU分词成为总延迟的重要组成部分。 http://github.com/perplexityai/pplx-garden

    推荐理由:Perplexity 开源的这个 tokenizer 能把 CPU 利用率砍掉五六倍,做实时推理的团队值得立马试试,对延迟敏感的场景是实打实的优化。

  2. Runway:News(网页)73

    Runway 推出 Model Context Protocol 服务器

    Runway 正式推出 Runway MCP 服务器,允许任何兼容 MCP 的 AI 智能体(如 Claude、ChatGPT、Cursor)在对话界面中直接生成图像与视频,无需切换工作流。该服务器接入了 Runway 最新的多款 SOTA 模型,包括 Gen-4.5、Seedance 2.0、GPT Image 2、Kling 3.0 及 Nano Banana Pro。其应用场景涵盖为产品制作营销视频、批量生成网站视觉素材、创作角色广告以及在应用开发中集成视觉内容。用户设置简便,通过 runwayml.com/mcp 添加服务器并登录现有 Runway 账户即可使用,无需单独申请 API 密钥。

    推荐理由:Runway 把 Gen-4.5 和 Seedance 2.0 等模型接入了 MCP,以后做产品图、营销视频不用切窗口,这个集成对依赖视觉内容的 Agent 工作流是个 real upgrade。

  3. 公众号:面壁智能(MiniCPM)64

    AI 制造 AI:面壁智能发布并开源全球首个完全由 AI 编写的生产级训练框架 ForgeTrain

    面壁智能联合清华大学、OpenBMB发布ForgeTrain,全球首个完全由AI编写、零人类代码介入的生产级大模型训练框架。在英伟达H100上训练速度超越Megatron 10%,节省10%算力;在华为昇腾上完整跑通预训练,并训出MiniCPM5-1B模型,综合性能在AA榜单2B规模以下Top1。框架及Agent Harness工具链一并开源。

    推荐理由:面壁这波把 AI 写代码从玩具推进到了生产车间,ForgeTrain 跑得比英伟达 Megatron 还快 10%,而且直接在昇腾上训出了 MiniCPM5-1B,国产算力跟 AI 自举这两条线在这一刻交汇了,做训练的可以认真看看。

  4. Claude Code:GitHub Releases(RSS)71

    Claude Code v2.1.152 更新发布

    Claude Code 发布 v2.1.152 版本更新。核心改进包括:`/code-review --fix` 现在会将审查建议直接应用于工作目录;技能与斜杠命令支持通过 frontmatter 的 `disallowed-tools` 移除模型工具;新增 `/reload-skills` 命令可不重启会话重新扫描技能目录;`SessionStart` 钩子现可返回 `reloadSkills: true` 重新扫描技能,并可通过 `hookSpecificOutput.sessionTitle` 设置会话标题;新增 `MessageDisplay` 钩子事件以变换或隐藏助手消息。其他更新涉及插件市场管理、主模型不可用时自动切换至 `--fallback-model`、会话用量统计优化等。同时修复了终端样式退化、沙箱警告显示、思考摘要、MCP 服务器去重、远程会话连接及多种会话卡顿问题。

    推荐理由:Claude Code 这次更新把代码审查从'查问题'推进到'直接修',Skills 系统补上了热加载和工具限制,做工程自动化的团队应该立刻更新。

  5. Claude:Blog(网页)75

    Code w/ Claude 伦敦活动:重塑开发体验

    在Code w/ Claude 伦敦活动上,Anthropic 宣布了 Claude Managed Agents 的两项新能力:自托管沙箱(公开测试版)和 MCP 隧道(研究预览)。这两项功能使 AI 智能体的工具执行环境与企业私有网络内的 MCP 服务器连接均可运行在客户自有基础设施或指定托管服务商处。活动还介绍了如何通过 Claude Code、优化思维预算以及模型努力级别来提升开发体验。目前,包括 Spotify、Base44 和 Legora 在内的客户已在使用这些新功能。

    推荐理由:Claude 平台企业部署的最后一公里被补上了,自托管沙箱和 MCP 隧道让 agent 真正能进生产环境,做 2B 的企业级应用终于有了安全底座。

  6. X:Claude Devs (@ClaudeDevs)68

    Claude Code推出安全漏洞识别插件

    我们为Claude Code发布了一个安全指导插件,可在编写代码时帮助识别和修复漏洞。 所有Claude Code用户均可使用。从插件市场(/plugins)安装。

    推荐理由:给Claude Code装上安全扫描,边写代码边修漏洞,比事后用Snyk扫一圈要快。对已经All in Claude Code的团队是个小甜点,其他人可略过。

  7. 公众号:小米 MiMo62

    MiMo-V2.5 系列 API 永久降价,最高降幅 99%

    小米 MiMo-V2.5 系列 API 自北京时间 5 月 27 日 0 点起永久降价,相比原始定价最高降幅达 99%,且不再区分上下文窗口长度。Token Plan 计费体系同步优化,用量提升至原来的 5-8 倍,现有有效用户额度全量重置。降价背后是基于 SGLang HiCache 的 SWA 支持,将 KV Cache 数据搬运量降至优化前近 1/7,可缓存 token 数量提升近 5 倍。

    推荐理由:API 价格最高降 99% 且 Token Plan 额度提升 5-8 倍,原先因预算受限的长流程应用和批量实验具备重新启动的经济可能。

  8. LlamaIndex:产品、工程与评测61

    LlamaIndex 发布 LiteParse v2.0:Rust 重写,支持 Rust、Python、Node、WASM 与 edge 运行时

    LlamaIndex 发布 LiteParse v2.0,将这个不依赖 LLM 的 PDF 与办公文档解析工具用 Rust 重写,提供 Rust、Python、Node 和 WASM 四种包,可在浏览器和 edge 运行时本地运行。

    推荐理由:官方用 Rust 重写后给出跨语言包、浏览器与 edge 运行时支持和具体提速数字,读者可据此评估现有文档解析管线是否值得迁移。

  9. MiniMax:Blog(网页)75

    MiniMax Agent Team:为长期运行与持续演进而生

    MiniMax对其Agent Team进行了整体升级并更名为Mavis。本次更新的核心是推出Agent Teams功能,允许用户在MiniMax Agent桌面端并行运行多个不同角色的智能体,组成团队以协作处理单一智能体难以完成的复杂长时任务。同时,原有的TokenPlan与Agent Plan合并为统一订阅,整合了CLI、API及Agent对M2.7模型、音乐、视频和语音功能的访问,其信用额度可在智能体与API之间共享。此次升级旨在解决单智能体在执行长期任务时容易出现的停滞、判断模糊及质量衰退问题,通过主智能体快速响应、任务拆分并行执行与关键节点汇报的机制,提供更流畅的用户体验。

    推荐理由:MiniMax 把 Agent 从单兵作战升级成团队协作,解决了长任务里「Agent 变蠢」和「为什么没理我」两大痛点,做复杂任务的可以认真看看。

5月26日周二
  1. X:商汤 SenseTime (@SenseTime_AI)77

    开源多模态模型SenseNova-U1完整训练代码库

    商汤开源了SenseNova-U1(8B dense + A3B MoE)的完整训练代码库。这是一个统一的框架,支持文本到图像、图像编辑、交错生成、文本与视觉理解等多种多模态任务的训练。其设计注重实用性与大规模训练,采用混合并行、流式可恢复数据管道、环境变量配置、解耦模块化设计,并支持从1×8 GPU扩展到多节点集群的规模。代码库以Apache-2.0协议开源。

    推荐理由:商汤把 SenseNova-U1 的训练代码全量开源,支持多模态任务和 MoE,还给了完整的并行策略,做多模态训练的可以直接 fork 过去用,Apache-2.0 很友好。

5月24日周日
  1. X:Replit (@Replit)66

    Replit Agent与Squidler集成,实现全自动化AI质量保障

    Replit Agent与Squidler已完成集成,形成一套完整的AI驱动质量保障闭环。用户可通过自然语言描述应用功能,由Replit Agent负责构建。构建完成后,Squidler会像真实用户一样对线上应用进行自动化测试,无需编写任何测试脚本。测试中发现的问题会自动反馈给Replit Agent进行修复。该流程已通过Squidler加入Replit的MCP库正式上线,实现了从构建、测试到修复的全自动化,显著降低了应用测试与维护的门槛。

    推荐理由:Replit 把用户流测试塞进了 MCP 库,Squidler 不需要写测试脚本就能跑真实操作,然后 Agent 自动修 bug,这个 QA 闭环对不会写测试的独立开发者是个大加分。