跳到正文
北京时间

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

985条精选相关主题模型发布行业动态AI 编码

最新精选

第 381–400 条 · 共 985 条
6月14日周日
  1. Hacker News 热门(buzzing.cc 中文翻译)74

    Paca:一款适用于人机协作的轻量级 Jira 替代方案

    Paca 是一款面向人类与 AI 智能体协作场景的轻量级项目管理工具,旨在替代 Jira。项目已开源并托管于 GitHub,支持团队通过直观界面协同管理任务,特别针对 AI 参与工作流进行了优化。

    推荐理由:Paca 的理念值得关注——让 AI 代理以正式成员身份加入 Scrum,而非作为外部自动化,但产品成熟度有限,适合早期尝鲜者。

6月13日周六
  1. GitHub Blog61

    GitHub Copilot CLI 在委托任务上变得更具选择性

    GitHub Copilot CLI 通过更好的编排实现了更少的任务交接和更快的进度,且没有新增任何配置选项。

    推荐理由:官方博客把子代理从默认操作变成了需要权衡的决策,23% 的工具失败减少和明显的等待时间下降,说明 AI 工具的体验升级不一定要加新按钮,改好调度逻辑一样有用。

  2. Greg Brockman71

    OpenAI 在开发者文档网站上线了新的文档智能体,可帮助查找产品相关信息并直接跳转到对应文档。Greg Brockman 表示这是一种强大且酷的网站导航方式,让交互更加直观。

    引用OpenAI Developers@OpenAIDevs

    问问我们的开发者文档。它们会为你指路 🔗http://developers.openai.com 上新的文档代理可帮助你找到关于 OpenAI 产品的答案,并直接带你前往相关文档。

    推荐理由:OpenAI 在开发者文档里嵌了个问答代理,能让开发者直接问文档,对常翻阅 API 的人挺实用。虽然不算大突破,但改善了开发体验,值得一试。

  3. Hugging Face:Blog(RSS)74

    olmo-eval:面向模型开发循环的评估工作台

    olmo-eval 是基于 OLMES 标准构建的评估工作台,专为 LLM 持续开发中的反复评测场景设计。相比 OLMES,它减少了新增评测的实现工作量,支持 agentic 和多轮评测作为一等用例,并允许根据基准需求选择轻量直接运行或容器化隔离运行。采用模块化架构,模型、工具、容器环境、辅助模型均可独立替换。评测结果同时报告分数、标准误差和最小可检测效应。与 Harbor 侧重于发布不同,olmo-eval 聚焦开发阶段快速迭代,可逐问题对比检查点输出以区分真实改进与噪声。

    推荐理由:做模型训练的人会感谢这个工具,它把评估从一次性打分变成能持续对比的流程,按题对比两个 checkpoint 的功能很实用,但如果你不训模型,这篇可以跳过。

6月12日周五
  1. IT之家(RSS)74

    字节豆包上线“任务模式”:支持定时执行与文件生成,“思考模式”升级为“专家模式”

    6月12日,字节跳动旗下AI应用豆包大范围上线“任务模式”,支持定时执行、零代码网页生成、一键PPT生成、数据可视化分析等全链路Agent执行。原“思考模式”升级为“专家模式”,调用豆包大模型2.0 Pro版本,强化深度推理能力。App顶部模式切换改为“快速、专家、任务”。基础功能免费,高阶服务付费,专业版三档:标准版68元/月或688元/年,加强版200元/月或2048元/年,专业版500元/月或5088元/年。

    推荐理由:豆包从对话助手转向能自主规划执行的任务模式,这是国产 AI 应用向 Agent 演进的一个明确信号,产品人该看看它如何用「快速、专家、任务」三种模式重塑用户预期。

  2. IT之家(RSS)75

    苹果 iOS 27 健康 App 大改:卡片布局、营养识别、围绝经期追踪

    苹果在 iOS 27 中优化健康 App,将列表改为卡片布局并增加导航栏。新增视觉智能营养识别,用户通过相机 Siri 模式拍摄食物可获取加工程度、蛋白质、含糖量等信息及营养价值评级,不提供精确卡路里,需 iPhone 15 Pro 及以上。经期追踪扩展支持围绝经期,可分析长期周期异常模式并推送提醒与指导。Fitness+ 新增围绝经期和绝经期课程。数据同步速度提升,GymKit 扩展至 iPhone,无需 Apple Watch 即可与健身设备配对同步数据。

    推荐理由:视觉智能营养识别不能给精确卡路里,但那个“深度加工食品”提醒对普通人很实用,健康App这次更新算得上近年最有用了。

  3. OpenAI70

    我们听说您希望能在自己方便的时候使用 Codex 速率限制重置。 从今天起,我们开始推出将速率限制重置保留到以后使用的功能。 我们从 Go、Plus、Pro 和 Business 用户开始,每人提供一次免费重置:

    推荐理由:OpenAI 给 Codex 加了个攒速率重置的小功能,没用完的可以存起来以后用,适合偶尔深夜冲刺的开发者。不算大更新,但挺实用。

  4. vLLM 官方博客(RSS)70

    vLLM 发布 MiniMax M3 Day-0 支持:1M 上下文多模态推理

    vLLM 宣布对 MiniMax M3 的 day-0 支持,覆盖 BF16 与 MXFP8 检查点,支持 1M-token 上下文、原生图像视频输入、minimax_m3 工具与推理解析器、EAGLE3 推测解码(草稿模型 Inferact/MiniMax-M3-EAGLE3)以及 TP/EP 部署和 Docker 镜像。

    推荐理由:官方团队拆解了 MSA 稀疏注意力、MXFP8 MoE 与 EAGLE3 在推理引擎中的落地细节,部署者可以照此选择 NVIDIA 或 AMD 配置并理解瓶颈所在。

  5. Replit ⠕68

    Replit 与 @databricks 集成刚刚升级了。 构建应用,让每个用户只看到他们应该看到的内容。你的 HR 分析师可以为 CEO 构建完整的组织视图,而无需访问底层数据。 公开预览已开放注册!了解更多 → https://replit.com/blog/databricksjune2026

    推荐理由:Replit 跟 Databricks 打通安全预览,能让非技术角色直接搭应用而不碰底层数据,对已经用这两家的团队是个实用更新,其余人可以等等正式版。

  6. OpenRouter:Announcements(RSS)69

    Advisor:让任何模型在生成过程中求助更强的模型

    OpenRouter 推出 advisor 服务器工具,允许快速、便宜的模型在生成过程中向更强模型咨询。用户可用 GPT-4o Mini 处理常规任务,在关键环节调用 Claude Fable 进行更高质量的推理。

    推荐理由:让 GPT-4o Mini 在关键时刻请教 Claude,用 1/10 的成本得到相近质量,这种跨模型顾问把“模型路由”做成了开箱即用的工具,做 agent 的值得试。

  7. Replit ⠕65

    AI 智能体很强大,但它们不记得你的偏好。 所以你总是重复指令——如何组织项目、你的品牌指南。 现在你可以通过自定义指令和技能让 Replit Agent 学会你的惯例。 它会在每个项目中自动将这些考虑进去。

    推荐理由:Replit Agent 终于学会记住你的偏好了,自定义指令能让它更像一个了解你工作习惯的同事,不用每次重复项目结构、品牌规范,做 side project 的效率会明显提升。

  8. Linear:Now(RSS)65

    Linear Agent 新增编码会话、自动分类与代码审查功能

    Linear Agent 推出编码会话、自动分类和 Diffs 代码审查,使智能体可直接从 issue 进入代码实现、自动调查并修复问题,并在 Linear 内完成代码审查与合并。编码会话基于 Claude Code 或 Codex 在云端运行,结果归组织所有。过去一个月,Linear Agent 已合并近 700 个 PR。

    推荐理由:Coding sessions 让 Linear Agent 直接从 issue 跳到实现,团队可以共享和介入,比单人编程 agent 有意义得多,是开发流程的进化。

  9. Perplexity77

    我们正在将 Deep Research 作为原生技能集成到 Computer 中。 它现在连接到驱动 Computer 的智能体框架,可访问搜索即代码生成、长运行沙箱、连接器、工具和授权数据。 Pro 和 Max 订阅者现已可用。

    推荐理由:Perplexity 把深度研究直接嵌进 Computer 的 agent 层,等于给自主代理加了个研究引擎,Pro 用户现在就能用,对需要大量调研的开发者或产品人来说是个效率飞轮。

  10. Cursor Blog74

    Cursor 推出 Auto-review 机制:用分类器智能体动态管控智能体自主权限

    Cursor 近日推出 Auto-review,通过一个专门的分类器智能体在工具调用前审查动作风险。该分类器根据上下文判断动作是否与用户意图一致,高风险时阻止并返回解释给父智能体,低风险时放行。分类器采用小模型,运行在智能体循环内以避免额外延迟,并能读取工作区文件辅助判断。测试基于约12小时内部开发会话生成的6122条标签数据,以及针对读取密钥、操作生产数据等危险场景的合成数据。设计目标是在不频繁阻断日常开发的前提下,拦截风险动作。

    推荐理由:Cursor把agent监管从"是/否"开关变成了可调节的刻度盘,一个专用小模型实时判断操作风险,高风险时给反馈让父agent换个安全方案,而非频繁打断用户。用Cursor的开发者都得了解这个逻辑。

  11. xAI70

    @MongoDB 插件已在 Grok Build 插件市场上线。 通过单个提示词,探索数据、优化数据库性能并构建高性能向量搜索系统。

    引用xAI@xai

    Grok Build 插件市场现已进入测试阶段。 直接从终端使用 MongoDB、Vercel、Sentry、Cloudflare 和 Chrome DevTools 插件进行构建。 了解更多 https://x.ai/news/grok-plugin-marketplace

    推荐理由:Grok 插件市场开始落地,MongoDB 插件让开发者可以用自然语言直接操作数据库,这是 Grok 从聊天工具转向开发助手的关键一步。

  12. OpenRouter66

    终于能一目了然地查看你的顶级人类与顶级 AI 智能体了。 附带一个 API,可随时间查询你所有的数据 📊

    引用OpenRouter@OpenRouter

    今天我们正式推出 OpenRouter 上的全新 Activity 探索器。 这是查看您和团队在每个模型上的支出、模型 token、缓存命中率、智能体以及趋势的最佳方式。所有数据实时更新。 看看我们的团队是如何使用 Fable 及其他模型的 👇

    推荐理由:如果你团队在用 OpenRouter 接各种模型,这个 Activity Explorer 终于让你能看清每个人和每个 Agent 分别花了多少 token、命中了多少缓存,费用透明了,对工程管理很有用。

  13. Hacker News 热门(buzzing.cc 中文翻译)75

    MiMo Code 现已发布并开源

    2026年6月11日,小米旗下 MiMo Code 项目正式发布并开源,相关代码已托管于 mimo.xiaomi.com 供社区访问。

    推荐理由:小米下场做 AI 编程工具,直接开源,121 个 HN 点赞说明社区有期待,对标 Cursor 还是自成一路,得看实际体验。