跳到正文
北京时间

全部动态

今日 92 条
7月24日周五
  1. Runway:News(网页)69

    Runway 推出 Media Router,首个面向生成式媒体的偏好优化路由模型

    Runway 发布 Media Router,这是首个为生成式媒体模型设计的模型路由器,已集成至 Runway Dev 平台。该路由器可根据用户设定的成本、质量和延迟偏好,自动为每次视频、图像或音频生成请求选择最优模型,支持 Gen-4.5、Seedance、GPT Image 2 等第一方及第三方模型。用户只需配置一次偏好并调用单一端点,即可避免手动选型与持续更新代码的麻烦。

    推荐理由:Runway Dev 首次把智能路由引入生成媒体,开发者不用再手工选模型,跑量时成本与延迟优势明显,但这是平台内生态能力,对非 Runway 用户意义不大。

  2. Claude:Blog(网页)75

    Claude 语音模式现已支持 Opus、Sonnet 及连接工具与多语言

    即日起,Claude 语音模式在 Opus、Sonnet 和 Haiku 上运行,并支持连接 Gmail、Slack 等工具及更多语言。用户可在对话中切换模型,语音模式默认沿用上次文本聊天使用的模型。该功能面向所有用户开放 beta 测试,免费版可使用 Haiku 及一个连接工具,付费版可访问更多模型和全部连接工具。

    推荐理由:Claude 语音模式终于能调用最强模型了,深度思考不再受限于轻量版,加上工具集成和多语言,移动端从随口问答升级为实时脑力伙伴,值得立即上手。

  3. X:OpenAI (@OpenAI)79

    ChatGPT 桌面版上线语音控制多智能体

    ChatGPT 语音功能现已登陆桌面应用。 只需使用语音,即可控制你的电脑,并指挥在 ChatGPT Work 或 Codex 中运行的多个智能体。 该功能由 GPT-Live 驱动,因此它能够同时在该应用中说话、聆听并协调工作。 今日起,面向 macOS 和 Windows 平台的 Plus、Pro、Business、Edu 及 Enterprise 计划用户全球推送。

    推荐理由:ChatGPT 的语音助手正式上岸桌面,关键是能同时指挥多个代理干活,一边写代码一边查资料,全程动嘴就行。对重度用户来说,这可能比任何新模型都更直接影响工作流。

  4. X:Greg Brockman (@gdb)69

    ChatGPT 向美国用户推出健康功能

    OpenAI 宣布向美国用户推出 ChatGPT 健康功能,支持安全连接 Apple Health 及受支持的医疗记录。每周有 3 亿用户使用 ChatGPT 进行健康咨询,新功能可让 ChatGPT 理解个人健康上下文,追踪变化并提供更个性化的帮助。

    推荐理由:ChatGPT 正式接入医疗记录,300M 周活健康查询用户终于有了上下文,对产品人是高频场景的粘性升级,对行业则是平台化健康能力的信号。

7月23日周四
  1. Hacker News 热门(buzzing.cc 中文翻译)76

    GigaToken 发布:语言模型分词速度最高提升约 1000 倍,可无缝替代 HuggingFace Tokenizers

    GigaToken 是一款新的语言模型分词器,在 AMD EPYC 9565 双路 144 核 CPU 上对 GPT-2 分词速度达 24.53 GB/s,比 HuggingFace Tokenizers 快 989 倍、比 tiktoken 快 681 倍。

    推荐理由:GigaToken 把分词速度直接拉到 GB/s 级别,对处理大规模文本的团队是实打实的效率提升,数据集预处理不再是瓶颈。

  2. X:Microsoft Research (@MSFTResearch)73

    微软 MagenticLite 模型全面开源

    MagenticLite 的模型现已完全开源。 此前在 Microsoft Foundry 上提供的 MagenticBrain 和 Fara 1.5,现已在 Hugging Face 上开放权重。 该应用、测试工具以及堆栈中的每个模型现已全部开放。

    推荐理由:微软把这些模型全开源了,从 Foundry 搬到 Hugging Face,对不想被平台锁定的开发者是个好信号,但模型能力本身不算顶尖,更偏生态布局。

  3. Cursor Blog70

    Cursor 发布智能模型路由系统 Cursor Router

    Cursor 推出 Cursor Router,可自动将每个编码请求分配给最合适的模型。在线 A/B 测试显示,Auto Intelligence 模式在用户满意度接近 Fable 的同时,成本降低约 60%;Auto Balance 模式满意度超过 Opus 4.8,成本降低约 36%。

    推荐理由:Cursor Router 把模型路由从个人选择变成团队策略,实测成本降低 30-50% 且满意度不降,对管理 AI 预算的工程 Leader 来说是个值得立刻试点的新功能。

  4. Anthropic:Newsroom(网页)70

    Claude 新增 Anthropic Economic Index 连接器,可直接查询 AI 对经济与职业的影响数据

    Anthropic 为 Claude 推出 Anthropic Economic Index 连接器,用户可在 claude.ai 中直接向 Claude 提问“哪些职业使用 AI 最多”等问题,答案基于 Index 的真实数据。该连接器无需安装,适用于任何 Claude 模型,并会引导用户查看原始数据及其局限性。完整数据集仍免费开放。

    推荐理由:Anthropic把自家经济指数直接接入了Claude对话,用自然语言就能挖出AI影响就业的真实数据,对关注职业变化的研究者和产品人来说是个顺手的小工具。

7月22日周三
  1. NVIDIA Blog(RSS)60

    NVIDIA 开源首个 GPU 加速医疗物理仿真框架

    NVIDIA 宣布开源 Medical Physics Simulation 框架,这是 Isaac for Healthcare 中首个 GPU 加速的医疗物理仿真能力。该框架可并行运行 8,192 个机器人训练环境,将训练时间从超过 5 小时缩短至不到 2 分钟。CMR Surgical、Johnson & Johnson MedTech 等机构已在使用该框架。

    推荐理由:首个 GPU 加速的开源医疗物理仿真框架,能把数千个训练环境并行跑,把训练从五小时压到两分钟,做手术机器人的团队可以直接拿来用,但对通用 AI 从业者影响不大。

  2. 公众号:小红书技术(dots.llm)70

    小红书 dots infra 开源 BigMac:突破多模态大模型训练的帕累托前沿

    小红书开源 BigMac,一种面向原生多模态场景的流水并行训练新范式。它通过依赖安全的嵌套流水线,在不增加 LLM 流水线空泡、保持激活显存有界的同时,高效实现多模态流水训练。相比基线,BigMac 训练速度提升 1.08~1.9 倍,并在 global batch size 增大时保持稳定显存占用,目前已应用于 dots 多模态模型生产训练。

    推荐理由:通过在成熟的LLM流水线中嵌入依赖安全的编码器与生成器计算,BigMac让多模态大模型训练不再需要在速度和显存之间做非此即彼的选择,适合正在纠结训练策略的工程团队检查调度逻辑。

  3. HuggingFace Daily Papers(社区热门论文)71

    AgentDebugX:面向LLM智能体的开源故障调试框架

    AgentDebugX是一个开源调试框架,将LLM智能体调试组织为“检测-归因-恢复-重跑”闭环。其核心DeepDebug在Who&When基准上对qwen3.5-9b达到精确的智能体与步骤归因准确率,在GAIA上单次重跑即可修复失败任务。该工具提供Python库、CLI、Web控制台和可安装的智能体技能。

    推荐理由:这个框架把调试从单步检测变成归因-恢复的闭环,DeepDebug的多轮诊断在GAIA上修好了13个失败案例,我觉得做agent开发的都可以装一个试试。

  4. 公众号:数字生命卡兹克77

    腾讯设计Agent平台Miora全面开放

    腾讯设计Agent平台Miora今日全面开放,无需邀请码即可使用。该平台由WorkBuddy团队打造,提供品牌设计、影视创意等五大场景模式,支持自定义多模态模型和Agent推理深度,并内置Skill市场与记忆系统。

    推荐理由:腾讯用WorkBuddy的底子做了设计Agent,记忆系统和Skill市场让设计流程有了Agent的基因,设计师和产品人可以上手试试。

  5. X:OpenRouter (@OpenRouter)72

    OpenRouter 上线 Gemini 3.6 Flash 与 3.5 Flash-Lite

    今日在 OpenRouter 上线:Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite! 两者均为其模型系列的重大更新,具备高吞吐量(150+ tok/s),适用于智能体场景,从高效 token 的编码与知识工作,到低延迟、高并发的子智能体。 详情如下 🧵

    推荐理由:Google Gemini Flash 系列更新到 3.6,150+ tok/s 的吞吐量对 agent 场景是实际提升,OpenRouter 第一时间上线,开发者可以直接调。

  6. Hacker News 热门(buzzing.cc 中文翻译)77

    OpenAI 在 ChatGPT 中正式推出广告服务

    OpenAI 在 ChatGPT 中推出原生广告服务,允许广告主在用户探索选项、比较选择和做出决策时投放相关广告。广告在体验中明确标注并与回答区分,首批广告主包括 Best Buy、Lowe's 和 VistaPrint。广告主可通过 Ads Manager 创建广告系列、设置预算并优化效果。

    推荐理由:ChatGPT正式开放广告投放,这是AI助手从订阅制转向广告收入的标志性一步,对于广告行业是震撼弹,用户体验却可能面临考验。早期测试数据虽乐观,但真正考验在于广告与回答的边界能否守住。

  7. X:opencode (@opencode)56

    Laguna S 2.1 免费开源上线 OpenCode

    Laguna S 2.1 现已在 OpenCode 上免费提供 1M 上下文窗口 · 完全开源 Poolside 迄今为止最强大的模型

    推荐理由:OpenCode 免费上了 Poolside 的最强模型,1M 上下文且完全开源,对写长代码的开发者是实打实的顺手工具,可以省一笔算力开销。

  8. xAI:News(网页)63

    xAI 推出 Grok for Outlook 加载项

    xAI 今日推出 Grok for Outlook,一个 Microsoft 365 加载项,可将 Grok 智能体嵌入邮箱,用于总结长邮件线程、以用户风格起草回复并整理收件箱。该工具即日起对所有付费 X 和 SuperGrok 用户开放,可从 Microsoft Marketplace 添加。

    推荐理由:xAI 这次把 Grok 直接嵌进了 Outlook,读附件加联网搜索能让邮件处理少跳转几次应用,虽然类似功能很多助手都有,但紧贴收件箱的体验值得 Outlook 重度用户一试。

  9. X:Claude (@claudeai)71

    Claude Cowork 新增技能录制功能

    Claude Cowork 新功能:教 Claude 一项技能。 录制你执行任务时的屏幕操作,边做边讲解,Claude 会将其转化为可重复运行的技能。在 Claude 桌面应用的 + 菜单中找到“录制技能”即可使用。 适用于 Pro、Max 和 Team 套餐。

    推荐理由:Claude 现在能通过录屏学会你的操作流程,这是从「回答问题」到「执行任务」的关键步。如果你有重复性操作,把它教给 Claude 的成本几乎为零,Pro 用户值得立刻试试。

  10. Google Developers Blog(RSS)63

    Google 推出 Tunix:基于 JAX 的高吞吐智能体后训练库

    Google 发布 Tunix,一个基于 JAX 的原生后训练库,旨在消除多轮、使用工具的 LLM 推理智能体训练中的 TPU 闲置瓶颈。Tunix 通过高并发异步 rollout 与解耦的生产者-消费者流水线最大化硬件吞吐量,确保训练器持续获得数据。该库提供即插即用抽象和持续宏观级性能分析,便于集成自定义环境。

    推荐理由:Google 这个训练库直接解决 agent 训练中 TPU 空转的隐性成本,对做后训练的团队可能是基础设施级改进,值得跟进。

  11. Prime Intellect(网页)64

    Prime Intellect 整合 23 个任务集,提供超 365,000 个智能体 RL 环境

    Prime Intellect 发布 research-environments,通过 verifiers v1 的 taskset API 将 SWE、终端和搜索三类共 23 个任务集统一到一套运行时和沙箱钩子下,总计约 365,000 个任务,包括约 198,000 个软件工程任务、约 28,600 个终端任务和约 137,600 个搜索任务。

    推荐理由:原文给出 23 个任务集统一为一套 API 的整合方法,以及 gold patch 验证和 reward hack 防护的具体做法,可复用于 RL 环境搭建。

  12. Google Cloud:Databases(RSS)71

    AlloyDB 推出列式引擎加速 HNSW,pgvector 向量搜索 QPS 提升最高 4.9 倍

    Google Cloud 的 AlloyDB 在预览版中推出列式引擎加速的 HNSW 索引,使 pgvector 向量搜索的每秒查询数(QPS)相比标准 PostgreSQL HNSW 提升最高 4.9 倍,在固定 QPS 下召回率可提升 0.163。该加速通过将索引固定在列式引擎内存中、使用向量化内存布局并绕过标准 PostgreSQL 缓冲管理器开销实现,无需修改应用即可获得性能提升。

    推荐理由:AlloyDB 把 pgvector 的 HNSW 搜索提速 4 倍,不是靠 GPU 而是靠内存架构,对已经在 PostgreSQL 上跑 RAG 的团队可能是个省钱又提精度的实用升级,点开看看基准测试。

7月21日周二
  1. 公众号:腾讯混元64

    腾讯混元推出Hyra-1.0递归自我改进研究智能体

    腾讯混元推出Hyra-1.0,一个能递归自我改进的研究智能体,在NanoChat等三项任务上均超越Recursive公开结果。Hyra在55个数学开放问题中刷新29个历史最好结果,并设计出仅含15个可训练参数即可完成10位数加法的Transformer。所有产物已在GitHub开源。

    推荐理由:腾讯自己下场做递归自我改进的科研智能体,而且一口气在数学、量子、药物设计多个方向刷榜,这比发个单一模型更有想象空间。

  2. 公众号:腾讯混元70

    Hyra发布:一个简单有效的科学发现智能体

    腾讯混元推出 Hyra-1.0,一个能递归自我改进、专为性能导向研究与工程任务打造的智能体。其 Harness 采用双层循环架构,在 NanoChat、NanoGPT Speedrun、SOL-ExecBench 三项任务上均超过 Recursive 报告的结果,并在 55 个数学开放问题中的 29 个上刷新历史最好成绩。相关产物已在 Github Repo 开源。

    推荐理由:展示了同一套循环在AI研发、数学、量子计算和药物设计中的迁移能力,更关键的是通过双层循环将评估器与solution共进化,使模糊目标也能被纳入搜索。

  3. Modal 官方工程博客(RSS)61

    Modal 与 Cognition 推出 Devin Outposts,AI 工程师可在自有 Sandbox 中执行任务

    Cognition 推出 Devin Outposts,让 AI 软件工程师 Devin 的执行环境迁移到用户自控环境,推理仍留在 Cognition 云端;Modal 是启动合作伙伴,7 月 21 日起开放 alpha。

    推荐理由:官方发布方介绍了 Devin 执行环境迁入自有 Modal Sandbox 的方式,GPU 按需启动和会话快照是可对比的实际能力变化。

  4. Cursor Blog64

    Cursor 测试新型 AI 智能体集群:规划者+执行者分工,4小时通过80% SQL测试

    Cursor 测试了新型 AI 智能体集群,将任务分解为规划者(使用最强模型)和执行者(使用快速廉价模型)。使用 Grok 4.5 时,新集群在 4 小时内通过了 80% 的 SQL 测试套件,而旧集群在第二小时前失败。该系统已用于构建浏览器、修复漏洞和生成数十亿 token 合成训练数据。

    推荐理由:Cursor首次公开agent swarm的内部架构和协调失败模式,把835页规格文档变成可运行的SQLite数据库并开源,对做AI编程工具的团队和agent架构师来说,这些细节是金矿。

  5. X:Elon Musk (@elonmusk, xAI)67

    Grok for Excel 上线,支持金融建模与图表生成

    Grok for Excel 现已上线。

    推荐理由:Grok 进 Excel 这步看似浅,但对整天和表格打交道的人,能直接在应用里调用 Grok 4.5 建模画图,比开网页版方便太多,是用 AI 改造办公的一个务实信号,非 Excel 用户可略过。

  6. xAI:News(网页)69

    Grok for Excel 发布:在 Microsoft Excel 中用自然语言提问、写公式和运行场景

    xAI 将 Grok 引入 Microsoft Excel,推出免费 Microsoft 365 加载项。用户可在工作表中用自然语言提问、根据描述编写公式或运行场景,答案会引用具体单元格,图表可直接插入工作表。该加载项还支持连接 SharePoint 或 Google Drive 获取上下文,并已同步支持 Word 和 PowerPoint。

    推荐理由:Grok 终于杀进格子间了,这个插件把大模型嵌进 Excel,写公式、问数据直接对话,对天天做表的人是个实在的效率提升。

  7. X:Replit (@Replit)65

    Replit 新统一工具栏集成数据库与双因素认证

    需要数据库?双因素认证?SEO 扫描器? 你的项目所需的一切现在都可以通过我们新的统一工具栏触手可及。

    推荐理由:Replit 把数据库、2FA 和 SEO 扫描都塞进一个工具栏,对用它快速出活的开发者是实打实的效率提升,但也就是一次整齐的功能聚合,算不上行业事件。

7月20日周一
  1. Hacker News 热门(buzzing.cc 中文翻译)70

    LoRA Speedrun 公开排行榜:6分05秒微调Qwen2.5-1.5B达GSM8K 61.1%准确率

    LoRA Speedrun项目推出公开排行榜,在固定硬件(单张L40S)上比拼Qwen2.5-1.5B的微调运行时间。当前纪录由@Saivineeth147以6分05秒保持,采用序列打包与仅完成损失掩码技术,相比基线11分57秒提速约2倍且准确率更高(61.1%)。项目提供免费Modal沙箱验证,任何提交需经3次独立复现确认。

    推荐理由:LoRA 微调领域的 nanoGPT speedrun,在固定硬件和任务上比墙钟时间,公开透明且可复现,做微调的开发者可以下场试试。

  2. 公众号:小红书技术(dots.llm)68

    小红书与北大开源 UltraEP:面向大规模 MoE 训推的实时负载均衡方案

    小红书与北大提出 UltraEP,首次将基于精确路由信息的实时负载均衡引入生产系统,在每个 microbatch 和每一层动态复制热点专家。在 Qwen3-235B 等模型上,训练吞吐平均达到理想性能的 94.6%,相比 Megatron-LM 提升 42%;推理 prefill 吞吐相比 SGLang 提升 1.56 倍。

    推荐理由:MoE 训练推理的负载不均是个老痛点,UltraEP 用实时复制热专家的方式把 GPU 利用率拉到 94% 的理想线,代码和论文都开源了,做大规模分布式训练的团队可以直接参考。

  3. 公众号:小红书技术(dots.llm)76

    小红书、北大开源 UltraEP:面向大规模 MoE 训推的「最优」负载均衡方案

    小红书与北大开源 UltraEP,首次将基于精确路由信息的实时负载均衡引入生产系统,在每个 microbatch 和每一层动态复制热点专家,平均达到理想性能的 94.3%,相比业界 SOTA 训推框架提升 1.49 倍。该方案已在 288B 参数 MoE 模型的完整预训练中部署,保持不低于理想性能 92% 的水平。

    推荐理由:动态复制热点专家替代了基于历史窗口的重排,将MoE训推吞吐从理想的一半拉至90%以上,对自研大规模模型的团队而言,是一套可落地的负载均衡方案。

  4. 字节 Seed:Research Feed(网页内嵌数据)79

    字节跳动发布 Seed Audio 1.0 音频创作模型,统一建模人声与音效实现端到端影视级音频生成

    字节跳动 Seed 团队发布音频创作模型 Seed Audio 1.0,在统一框架下联合建模人声、音效和环境声,支持 100ms 间隔精度的时间控制、单次约 2 分钟音频的延展生成及 20+ 语种自然生成。该模型已在火山方舟体验中心上线,多数场景音频可用率达 90% 以上,多语言音频自然度 MOS 超 4 分。

    推荐理由:字节这次发布的 Seed Audio 1.0 不是又一个 TTS 模型,它把台词、音效、氛围统一编排,并支持百毫秒级时间线控制,对做视频和出海内容的团队是个立刻能用的创作升级。

7月19日周日
  1. X:Tibo (@thsottiaux)75

    ChatGPT Work 功能:建站、邮件、文档处理

    ChatGPT Work 适用于 ✅ 创建和托管网站 ✅ 为你管理电子邮件 ✅ 总结海量文档 ✅ 制作一流的文档、表格和幻灯片 已在你的移动应用或 http://chatgpt.com 上提供,包含在 Plus、Pro、Business 和 Enterprise 套餐中。

    推荐理由:OpenAI把AI代理能力直接做进了ChatGPT主产品,能托管网站管邮件做文档,这对普通用户和轻团队是个巨大的效率杠杆,但能否真正代替这些常用工具还有待观察。

  2. Hacker News 热门(buzzing.cc 中文翻译)78

    transcribe.cpp 发布:基于 ggml 的跨平台语音转录库,支持 16 个 ASR 模型族

    transcribe.cpp v0.1.0 发布,一个基于 ggml 的语音转录库,支持 16 个 ASR 模型族(60+ 模型),并通过 Vulkan、Metal、CUDA 和 TinyBLAS 实现 GPU 加速。

    推荐理由:本地语音转录一直缺一个好用的跨平台引擎,transcribe.cpp 不仅支持 60+ 模型、跑在 GPU 上,还带了 Python/JS/Rust/Swift 绑定,想把语音功能嵌进应用的开发者可以直接拿来用。

7月17日周五
  1. xAI:News(网页)85

    Grok 推出 Automations 功能:定时或邮件触发,自动执行任务并汇报结果

    xAI 为 Grok 引入 Automations 功能,用户可描述一次任务,让 Grok 按计划(一次/每日/工作日/每周/每月/每年)或邮件触发(按发件人、收件人或主题过滤)自动运行。每次执行都是一次完整对话,结果保存至运行历史,支持邮件或应用内通知。定时自动化对所有用户开放,邮件触发需 SuperGrok 订阅。

    推荐理由:xAI 把自动化做进了 Grok,定时和邮件触发让 AI 从被动问答变成主动干活,尤其是邮件触发可以直接处理收件箱,对于需要自动化工作流的用户来说,这是一次真正的实用性升级。

  2. Hacker News 热门(buzzing.cc 中文翻译)70

    Decoy 字体:用空间频率混淆让 AI 看不清你输入的文字

    Decoy Font 是一款 TTF 字体,通过在同一字符中叠加不同空间频率的图形(前景细轮廓与背景低频模糊块),使近距离观看时 AI 读到“诱饵”字母,而人眼远距离或眯眼时才能看到真实隐藏信息。

    推荐理由:这是一个用视错觉对抗 AI 文字抓取的巧妙工具,虽然不能保证绝对安全,但只需安装字体就能用,门槛极低,发私密消息可以试试。

  3. X:ChatGPT (@ChatGPT)68

    ChatGPT 工作区支持文档表格幻灯片编辑

    在 ChatGPT 工作区中创建和编辑精美的文档、电子表格和幻灯片。 @nickbaumann_ 为你演示操作。

    推荐理由:ChatGPT 终于内置文档、表格和幻灯片,不是插件而是原生工作区,对轻办公需求的人来说,可能直接替代掉打开 Google Docs 的习惯。

  4. LangChain:Blog(RSS)67

    LangChain Fleet 新增一键部署 AI 智能体到 Slack 功能

    LangChain Fleet 允许用户在无代码环境下构建自定义 AI 智能体,并一键部署到 Slack。这些智能体可设置自定义身份,在频道和线程中使用,让团队在现有协作平台上直接完成工作。

    推荐理由:LangSmith Fleet 把无代码构建 agent 和 Slack 打通了,内部工具和团队协作场景的 AI 落地门槛又降了一截,做自动化流程的可以直接试试。

  5. Google Blog:AI(RSS)60

    Google Vids 上线 Gemini Omni 与个人数字分身功能

    Google Vids 推出两项更新:Gemini Omni 支持用户通过自然语言提示词和图片参考生成、逐步编辑高质量视频片段;个人数字分身功能允许用户上传自拍和语音录制后,输入文字即可让数字分身出镜。两项功能面向 Google AI Pro 和 Ultra 订阅者及 Google Workspace 商业客户开放,所有生成内容均含不可见的 SynthID 数字水印。

    推荐理由:如果你已经在用 Google Workspace,这两个更新让 Vids 的可用性提升了一档,但对于外部的 AI 视频生成,没带来新变量。

7月16日周四
  1. Claude:Blog(网页)64

    在 Claude Cowork 中使用 Claude Fable 5

    Anthropic 发布最强通用模型 Claude Fable 5,专为长时间、多步骤的复杂异步工作设计,可在 Claude Cowork 中自主执行深度研究、尽职调查等任务。该模型需手动选择,默认模型为 Claude Sonnet 5。

    推荐理由:Anthropic 终于把最强大模型放进 Cowork,这篇指南不只是功能说明,更是一套'把 AI 当同事'的工作方法,开发者看完就能上手。

  2. X:面壁智能 OpenBMB (@OpenBMB)66

    面壁智能开源企业AI数字员工平台StaffDeck

    面壁智能联合多团队开源StaffDeck,一个用于构建与管理数字员工的企业平台。该平台旨在将专业知识、标准作业程序(SOP)和决策规则转化为持续工作、改进并保留组织知识的数字员工,而非传统聊天机器人。项目代码已发布于GitHub。

    推荐理由:OpenBMB 开源了一个把组织经验、SOP 和决策规则变成持续运行的「数字员工」平台,不是又一层聊天机器人皮,做企业 AI 落地的可以看看。