KVCMAS:多智能体系统共享上下文的 KV cache 高效修正框架
KVCMAS 是一个面向多智能体系统的在线 KV cache 修正框架,用紧凑低秩状态表示跨智能体的缓存偏差,并沿智能体工作流链式修正,无需额外参考预填充。
KVCMAS 是一个面向多智能体系统的在线 KV cache 修正框架,用紧凑低秩状态表示跨智能体的缓存偏差,并沿智能体工作流链式修正,无需额外参考预填充。
论文提出 FlyBy,一个选择性查询框架,训练 4B 和 8B 小型推理模型先推理、诊断未解决问题,在知识瓶颈时查询参数知识更强的模型。研究发现自精炼主要把概率质量集中在当前状态已可达的解上,并区分出执行瓶颈与知识瓶颈两类失败机制。
豆包正在推进个人助理方向的产品规划,今年 4 月已内部内测该探索项目,代号为“Spell”,由豆包手机助手团队主导。知情人士称,在 Muse、Instinct 等海外个人助理产品获得关注后,豆包加速 personal agent 能力对外发布,计划将 Spell 项目与豆包产品更深度结合,由 Spell 项目与豆包对话团队共同负责,预期较快对外推出。
嘿,Claude:“我让早先的 Claude 从《西线无战事》中移除鱿鱼。现在你都能做电影什么的了。我需要你展示一下你进步了多少” & 我把下面这条推文粘贴了进去 有些巧妙的东西,模型现在真的有幽默感了
Anthropic 发布 Claude Sonnet 5.5,是 Claude 5.5 家族第二款模型,定位为 Opus 5.5 更快更省的补充,已在 Claude Platform、AWS、Google Cloud 和 Azure 上线。
MIT 教授 Sherry Turkle 的新书《Artificial Intimacy: Who We Become When We Talk to Machines》由 Little, Brown and Company 出版,基于访谈论述聊天机器人的伪共情正在削弱儿童发展与成人社交能力。
MIT 研究者 Brian Hedden 与 Manish Raghavan 系统评估了针对算法单一栽培的主要反对意见,发表于 Philosophical Perspectives。
开源项目 ESP32S3-LLM-Cluster 在 7 块 ESP32S3 上以分布式流水线方式运行 1.58-bit BitNet 量化模型,其中切片后的 0.5B 模型由 1 块主节点加 6 块计算节点分担。
岚图追光 S 量产车以原厂胎、标准胎压在水泥地面 1 分钟完成 12 圈定圆漂移,拿下"1 分钟内驾驶电动汽车定圆漂移圈数最多"吉尼斯世界纪录。该车今年 8 月上市,定位"全球首款科技 FUV",全系标配华为乾崑智驾四激光雷达方案,22.99 万元起售,此前还完成 360° 隧道大回环穿越。
微软面向 Edge 浏览器开发者推出系列新功能,新增“软导航”“交互内容绘制”等性能指标,帮助定位单页应用卡顿瓶颈,并引入 JS 自分析标记排查样式计算、布局、绘制与垃圾回收环节。
研究者提出 Physical Coding,将任务状态与执行表示为代码,并构建 HexaAnything 调用感知、规划与控制工具(含 VLA/WAM 策略),依据外部反馈在环决策。
PyroAdapt 用"预训练—检索—排序"框架让山火预测模型适应目标分布:在加州 666 个 0.25x0.25 网格上,选择性排序将日均精度从 21.62% 提升至 24.35–24.57%,Top5% 召回率从 18.70% 升至 22.11–22.79%。
IDC 报告显示,2026 上半年全球人形机器人出货量近 2.5 万台,同比增长 432.1%,市场规模超 7.4 亿美元;其中中国出货超 1.9 万台,同比增长 426.3%,占全球约 77.9%。IDC 预计 2030 年全球出货量将超 75 万台,较此前预测上调约 50%。
影石创新正在研发一款主打拍摄的智能眼镜,采用前镜框可换设计、功能集中在镜腿,优先满足内容创作者的免手持拍摄需求。知情人士称其AI能力大概率搭载阿里千问大模型,影石内部还计划把端侧生成模型直接部署到产品端。影石此前已获“可穿戴式眼镜”专利授权,采用电池与眼镜主体分离的分体设计以减轻头部负重。
LG Innotek 宣布与自动驾驶软件企业 Applied Intuition 合作,在韩国境内部署自动驾驶传感数据采集车辆,以首尔、仁川、京畿道为中心运营,到 2028 年部署 20 辆数据采集车和自动驾驶软件开发车,并将在美国、欧洲、日本投放。
Databricks 在 NVIDIA SOL-ExecBench 内核榜单全部 4 个赛道排名第一。团队将 GPT-6 Astra 和 Opus 5 放入自爬坡循环,智能体击败顶级 GPU 内核工程师,总 token 花费约 $70K;作者称这两个模型写 GPU 内核仍明显强于开源模型。
Jev 不好用?它是为可组合性而生的! 需要更多 Jev!
每一天,Jev 都在自动化新形式的现实世界任务,把🌎级⚡️快速智能带入排序、过滤、分类和路由等基础模块。 如果 AI 能解决新的数学问题,那么 AI 就能正确地路由一通客户支持电话!
SemiAnalysis 对 GPU 集群健康检查做最基本测试:看它在纸面上是否可能跑通,结果发现好几个根本不可能成立。在 Amazon HyperPod Slurm 上首次测试时,一个健康检查要求节点先健康才能运行,但该检查本身又是节点重新入池所必需的,形成死循环。SemiAnalysis 称测试中约有五到十个这类"健康检查从未有机会运行"的例子,并质疑这些方案交付客户前是否经过充分验证。
微软 CEO 萨蒂亚·纳德拉在 9 月 27 日发布的采访中称,整个 AI 行业“有点飘了”,AI 领导者更注重 AI 本身而忽略用户实际需求。他表示现实世界更关心这项技术能否带来利益、能否被掌控并改善经济前景,仅为了技术而庆祝技术行不通,构建 AI 必须赢得消费者和社区的信任。
世界杂耍联盟(WJF)创始人 Jason Garfield 用 Runway 为荷兰两日赛事的转播补全观众席:首日满座、次日侧机位空座,他用 Aleph 2.0 在原始素材中加入观众而不改动画面其他部分,仅一个极广角镜头退回 After Effects 处理。他还用 Runway 生成开场动画、选手资料卡、排行榜和舞台烟火,整档约一小时特别节目由他一人完成,单段生成时长上限约 15 秒。
ControlScope 对比了 LLM 智能体在同一公开执行状态下继续生成代码、编辑下一次工具调用的数据参数、以及替换未完成工作流三种修订方式,并区分可用修复与智能体实际选择的动作。
研究提出 δ-Vision,用轻量低秩适配器构建逐层视觉记忆,替代视觉 token 在 Transformer 中的重复演化,同时保留全部视觉 token 供文本检索。该方法发现视觉到文本的信息流集中在低维子空间,且轻量 MLP 能以高余弦相似度和低重建误差逼近各层视觉状态。在图像和视频基准上,δ-Vision 在相当或更低计算量下准确率超过视觉 token 剪枝基线,且不丢弃视觉 token。
我们的推特小哥太会整活了 🧑🍳
三星电子、三星物产、三星 SDS、三星 SDI、三星人寿保险、三星火灾海上保险宣布向 KKR 创立的 AI 基础设施公司 Helix 合计投资 10 亿美元(约合 67.22 亿元人民币),其中三星电子承担 5 亿美元。
两周前 TypeSafe 开创了这一品类,现在市场上已有 6 款决策模型,其中包括 2 款免费模型:https://openrouter.ai/models?output_modalities=decisions
Arena 于 9 月 26 日分析 Text Arena 高推理回复,发现 Claude Opus 5.5 相比 Opus 5 破折号使用量下降约 95%(每 1,000 个单词从 15.2 个降至 0.8 个),分号下降 73%(从 6.10 个降至 1.64 个)。
Latent Space 播客邀请 Anthropic 的 Thariq Shihipar 深入讨论 Claude Code 的现状与未来,涵盖 Ask User Question、artifacts、Claude Tag、Projects 和新推出的 Claude Mods 系统。
不错 (引用推文核心要点:Grok 4.7 xHigh 在 Artificial Analysis Cyber Index 中排名第一,作为前沿模型在企业网络防御领域表现顶尖,超越 Fable 5.1 Max、Opus 5.5、Astra 6、GPT-6 等领先 AI 系统。)
试试 Grok @Bot
截至 9 月 29 日,宁德时代巧克力换电全国累计建成换电站超 2520 座,覆盖 31 省 200 城,近 2 万块全新电池完成入仓部署。官方称一二线城市已全覆盖,中小城市占比超 80%,并计划 2026-2027 年落地 1000 座高速换电站,打造“11 纵 9 横”高速换电网络。9 月 30 日至 10 月 7 日将启动 99 秒“换”行神州免费换电活动。
澜起科技宣布型号为 CK01P 的新一代 DDR5 客户端时钟驱动器(CKD)已量产,最高支持 9200 MT/s 数据传输速率,符合 JEDEC DDR5CKD01 规范。该芯片面向 DDR5 CUDIMM、CSODIMM、CQDIMM、CAMM 等下一代客户端内存模组,支持单 PLL、双 PLL、PLL 旁路三种时钟驱动模式,并可通过关闭未使用时钟输出降低功耗。
路透审阅了 Anthropic 的 IPO 招股书。收入增长 12 倍至约 4.6B 美元,算力支出从 2024 年的 2.5B 近乎翻了三倍至 7.33B,经营亏损 8.06B 美元;约 42B 美元净亏损主要来自约 34B 的可转换融资重估,而非经营支出。
推荐理由:路透审阅的招股书披露了收入、算力支出与巨额亏损的构成,读者可以据此理解 Anthropic 上市估值超 2 万亿美元的依据。
别克君越第 150 万辆整车正式下线,全新君越同步亮相并将带来 50 项豪华升级,即将上市。新车车长超 5 米、轴距 2.9 米,配备凌空展翼前脸、羽翼循光 LED 大灯及全新“墨竹青”车色,四座支持加热、通风、按摩。作为对照,2026 款君越 28T 白金版一口价 15.99 万元,艾维亚一口价 18.99 万元。
2026 世界智能网联汽车大会将于 10 月 21 日至 23 日在北京亦庄北人亦创国际会展中心举办,由工业和信息化部、交通运输部、北京市人民政府联合主办。大会以“汇智聚能网联无限 —— 稳步迈进智能网联新时代”为主题,设置 3 场核心全会、3 场特色活动、6 场专题论坛和 6 场同期边会,并同期举办中国国际新能源和智能网联汽车展览会。国际嘉宾占比接近 50%。
科技媒体 WinFuture 曝光 2026 款亚马逊 Fire TV Stick 4K 宣传图,新品舍弃前代圆润曲线,改为更方正紧凑的盒状造型,仍直插电视 HDMI 端口,体积较前代略有缩小。
据路透社报道,Anthropic 计划在 IPO 招股书中提示先进 AI 可能带来灾难性乃至生存性风险,包括模型出现抗拒关机、隐瞒篡改信息甚至近似勒索等自我保护行为。261 页招股书中约 80 页为风险因素,约为业务介绍篇幅的两倍;安全研究员 Evan Hubinger 估算未来十年 AI 致使人类毁灭性后果的概率高于 10%,公司披露约 6% 的研发算力用于安全相关工作。
联想发布首款 Googlebook 笔记本电脑 Lenovo Googlebook15(Lenovo GB 15IPH12),搭载英特尔酷睿 Ultra 5 处理器 325,板载至多 32GB LPDDR5X-7467 内存,配备 15.3 英寸 2880×1800 120Hz OLED 触控屏。
既然大家都在聊图标……最初的经典是这个。
SK 海力士凭借在 CoWoS 2.5D 先进封装平台上的 HBM5 内存验证,获得台积电“3DFabric-HBM 集成”类别年度合作伙伴奖,连续第二年获此殊荣。