跳到正文
北京时间

全部动态

今日 151 条
9月29日周二
  1. 公众号:火山引擎30

    零跑汽车与火山引擎合作:TRAE 嵌入全域自研体系,落地本地研发环境

    零跑汽车与火山引擎合作,将 TRAE 嵌入其全域自研体系,在本地安全网络、车规级工程约束和多团队协同环境中落地 AI Coding。TRAE 采用企业专属域名与网络配置接入受限网络,明确代码仅用于当次推理、不用于模型训练,并通过 Spec/Plan、Rules、Skills 约束 Agent 行为。TRAE 企业版还提供可视化数据看板与灵活模型资源管理,支持按团队设置模型权限和用量配额。

  2. IT之家(RSS)33

    豆包将推个人助理产品:4 月已内测,曾用代号“Spell”

    豆包正在推进个人助理方向的产品规划,今年 4 月已内部内测该探索项目,代号为“Spell”,由豆包手机助手团队主导。知情人士称,在 Muse、Instinct 等海外个人助理产品获得关注后,豆包加速 personal agent 能力对外发布,计划将 Spell 项目与豆包产品更深度结合,由 Spell 项目与豆包对话团队共同负责,预期较快对外推出。

  3. X:Yuchen Jin (@Yuchenj_UW)56

    Databricks 登顶 NVIDIA SOL-ExecBench 内核榜单全部 4 个赛道

    Databricks 在 NVIDIA SOL-ExecBench 内核榜单全部 4 个赛道排名第一。团队将 GPT-6 Astra 和 Opus 5 放入自爬坡循环,智能体击败顶级 GPU 内核工程师,总 token 花费约 $70K;作者称这两个模型写 GPU 内核仍明显强于开源模型。

  4. elsewhere:文章(RSS)53

    Manus 2.0 发布并推出个人智能助理应用 Cue

    9 月 28 日 Manus 面向海外用户发布 2.0 版本,并推出面向个人生活场景的智能助理应用 Cue。Cue 中每个 Agent 可拥有自己的邮箱、电话号码、钱包和电脑,代表用户与现实服务交互,多 Agent 可进入同一群聊处理扫码点餐、排队取号等事宜。Manus 同时在开发面向国内市场的产品,与国产模型厂商及生态伙伴的合作稳步进行。

  5. Runway:News(网页)39

    Bonjour 用 Runway 将一份脚本生成所有广告风格

    法国适应原饮料品牌 Bonjour 的 15 人创意团队用 Runway 把一份脚本批量生成多种动画风格广告,从脚本到效果判定只需 4 到 5 天,成品动画批次 24 到 48 小时完成。团队已用 Runway 产出超过 500 个视频和图像变体,并称转向内部生成创意后省下逾 5 万欧元外部制作费用;改用 Runway 企业版后不再受 credits 限制,可继续加大测试投入。

  6. IT之家(RSS)39

    腾讯秘密内测 AI 游戏搭子“鹅次元”,主打数字人陪玩

    腾讯正在秘密内测 AI 游戏陪伴产品“鹅次元”,主打数字人 AI 搭子,提供语音对话、画面实时识别和游戏陪伴能力,内置多位人设各异的男女虚拟角色,选定后可闲聊或开启游戏陪伴模式,适配多款主流网游。该产品全部功能限时免费,界面已露出星币兑换能量的付费框架。

  7. X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas)49

    Perplexity Agent API 新增 Profiles、Skills 与连接器

    Perplexity 为 Agent API 加入 Profiles、Skills 和托管连接器。Profile 是可保存的智能体,把模型、指令、工具、连接器与运行设置统一到一个带版本的 ID 下。

  8. 公众号:数字生命卡兹克63

    数字生命卡兹克开源百万月活产品AIHOT 2.0

    卡兹克宣布将月活百万的AI热点资讯网站AIHOT正式开源,地址为 https://github.com/KKKKhazix/AIHOT。他在中秋假期用Codex(GPT-6 Astra)和Claude Fable 5.1把旧代码库蒸馏成功能文档与交接包,再由Claude Opus 5.5作为主力重写,2.0版本架构模块化、前端组件化并上线。

  9. X:Testing Catalog (@testingcatalog)30

    OpenAI 正在开发 Spaces 协作环境

    OpenAI 正在开发 "Spaces" 👀 近期新增了一则介绍 "Spaces" 的公告。 Spaces 可能是用户与智能体在生成的产物上协作的环境(推测)。 部分 DevDay 议程提到了 "Codex run that spent more than 1,000 hours" 和 "Multiplayer Codex" 话题,可能密切相关(推测)。 * 公告字符串已隐去

  10. X:Elon Musk (@elonmusk, xAI)53

    Musk 转发介绍 Team Bots,@Bot 现在能以团队方式协作

    Musk 转发并称 @Bot 现在可以作为一个团队工作。引用内容介绍 Team Bots,是随团队使用而学习的共享 AI 队友,可为它配置角色所需的技能、插件和凭证,然后在 Slack 或 Grok Bot 中与它协作。

  11. IT之家(RSS)24

    苹果 iOS 27.2 测试“通话上下文”:通话时在灵动岛整合生日等关联信息

    苹果在 iOS 27.2 测试版中为灵动岛引入“通话上下文”(Call Context)功能,可在通话期间展示与当前通话相关的信息卡片,例如生日动画或生日信息卡,点击“查看”可进入全屏通话界面查看更大的上下文卡片。该功能尚未公布发布时间、适配机型及完整使用范围,社交平台猜测其可能与 Apple Intelligence 或特定硬件能力相关,但未获苹果官方确认。

  12. X:Testing Catalog (@testingcatalog)40

    OpenAI DevDay 议程曝光:Codex 平台化与智能体架构

    OpenAI 即将举行的 DevDay 议程泄露,将围绕 Codex 构建平台能力,让用户直接在专属页面开发插件、智能体和应用。议程还包含一个在大型共享代码库中持续运行超 1000 小时、保持构建与测试通过的内部 Codex 智能体案例,以及从简单循环到多智能体协作的架构演进分享。

  13. IT之家(RSS)36

    谷歌宣布停用 Gemini 的 Gems 功能,将自动迁移为“技能”

    谷歌宣布停用 Gemini 的 Gems 功能,用户创建的 Gems 将于 2026 年 11 月 17 日起自动迁移为“技能(skills)”,无需手动转换,此前仍可正常使用。Gems 于 2024 年上线,用于搭建学习辅导、头脑风暴、编程搭档等自定义 AI 助手。迁移后用户需在对话线程输入“/”才能调用技能。

  14. X:Runway (@runwayml)41

    ElevenLabs v4 上线 Runway

    ElevenLabs v4 现已登陆 Runway。v4 模型擅长旁白和角色对话,表现力和语调自然度均超越以往。 即日起可用,与全球顶尖的图像和视频模型一同提供。点击下方链接立即体验。

  15. Fireworks AI(网页)62

    Fireworks AI 推出 FireRouter with Opus,编码任务成本降 57%

    Fireworks AI 发布 FireRouter with Opus,可在 Claude Opus 5.5、GLM 5.3 和 GLM 5.3 Flash 之间做缓存感知路由,并首次以独立路由模型形式作为 serverless 端点开放。

    推荐理由:官方给出了内部 A/B 测试的成本与准确率数据,可帮助团队评估用缓存感知路由替代单一 Opus 的可行性。

  16. X:Elvis Saravia (@omarsar0, DAIR.AI)45

    JevRAG 变体涌现引热议

    大量 JevRAG 变体正在涌现。 至少可以说很有意思。 这些范围有限的测试其实得不出什么结论,但它引发了讨论,也指向了在当前 RAG 和智能体系统中寻找优化方向的激动人心的路径。 我一直在测试自己做的 JevRAG,用于论文探索。 到目前为止,我在用 Jev 做重排序上取得了更多成功,也找到了一些非常有意思的论文搜索方式,把语义搜索和 Jev 结合起来。 更多内容很快分享。

  17. OpenAI:官网动态(RSS · 排除企业/客户案例)14

    OpenAI 征集 Codex Originals 用户故事

    OpenAI 启动 Codex Originals 项目征集,面向使用 Codex 的开发者、研究者和创作者收集真实故事与项目。参与者需提交个人背景、项目介绍及相关链接,入选者将参与该项目的下一阶段。

  18. X:Manus (@ManusAI)36

    Manus 2.0 可构建游戏

    Manus 2.0 现在可以构建游戏——而且非常简单。 查看该推文串,了解用 Manus 制作的数十款游戏、提示词和可玩 demo。

  19. xAI:News(网页)72

    xAI 发布 Team Bots:可与团队共同学习工作的 Grok 智能体

    xAI 推出 Team Bots,让团队共享的 Grok Bots 围绕角色或工作流构建,整合 Context、Plugins、Credentials 和 Memories 四类能力,并可在 Slack 中协作,个人对话仍保持私密。

    推荐理由:原文详细拆解了共享 Bot 的上下文、插件、凭证和记忆四要素,并给出内部多部门与客户实例,读者可对照搭建自己的团队工作流。

  20. X:Manus (@ManusAI)20

    Manus 推出个人智能体 Cue

    我们带来了一位朋友。我们觉得你们俩会合得来。 隆重介绍你的个人智能体,就在 Cue 上。

  21. X:Manus (@ManusAI)40

    Manus Studio 炼金模式一键生成视频

    一个提示词。一个精修视频。 Manus Studio 的炼金模式,感觉就像拥有一整支创意团队,在为你导演、编剧、分镜,并跟着音乐节奏剪辑每一个节拍。 视频、原始提示词和完整会话都在推文串里。

  22. X:Replit (@Replit)23

    Replit 直播探讨知识工作未来

    提个问题。拿回一张图表、一条 pipeline,或一个能用的自动化。 Just Ask Replit 深入探讨知识工作的未来:实时数据、可视化与自动化,全都在智能体对话里完成。 不用搭仪表盘。不用排工程队列。 周二上午 9 点 PT。在 YouTube、LinkedIn 和 X 上直播。 https://x.com/i/broadcasts/1AGRnZyVQLgGl

  23. X:Claude Devs (@ClaudeDevs)54

    Claude 现可协助构建评测并通过 hillclimb 持续优化

    Claude 现在可以帮助构建评测(evals)并基于评测进行 hillclimb 持续优化。Claude Devs 分享了评测设计指导及 Claude Code 可用来改进应用的相关 skills,详见 https://claude.dev/blog/automating-eval-design-and-hillclimbing/

  24. Hacker News:AI 热帖49

    MicroLLM Lab:在浏览器中试用 7 款微型 LLM

    MicroLLM Lab 上线,可在浏览器内直接试用 7 款微型 LLM,并支持用 JavaScript 编写基准测试。测试以正则或精确 token 做客观校验,不评判写作质量,135M 模型允许失败,这本身就是测量结果。运行会记录 tokens/s 持续解码速度与客观测试通过率,数据只留在本机,图表按每个模型的最新测试套件展示。

  25. X:Charlie Holtz(@charlieholtz)33

    Sonnet 5.5 上线 Conductor

    Sonnet 5.5 已在 @conductor_build 上线! 我有种感觉 Opus 5.5 仍会是我的默认选择,但这张图表确实令人意外……