跳到正文
北京时间

开源生态

开源模型、框架与仓库动态:权重开放、社区项目爆火、开源与闭源的力量消长。

697条精选相关主题模型发布Hugging FaceAI 编码

最新精选

第 21–40 条 · 共 697 条
9月12日周六
  1. Hacker News:AI 热帖76

    Minitap 指控 Google Artemis 未署名使用其开源项目 mobile-use 代码

    Minitap 团队发文指认 Google 的移动设备自动化项目 Artemis 大量复用了其开源项目 mobile-use 的代码,包括完全一致的 Hopper agent 提示词和示例,却未在 README 中署名;更早的包文件曾列出三位作者,8 月一次 force push 将其替换为另一作者。

    推荐理由:Minitap 团队以代码比对和提交历史为据,指认 Google Artemis 移除了其 mobile-use 的作者署名,还给出 Apache 2.0 条款和排行榜争议细节。

9月10日周四
  1. MarkTechPost(RSS)87

    DeepSeek AI 发布 DeepSeek-V4.1-Flash:1M 上下文、FP4 KV 缓存与跨层注意力复用

    DeepSeek AI 发布多模态 MoE 模型 DeepSeek-V4.1-Flash,552B 主干加 196B Engram 参数,上下文窗口 1M,prefill 激活 8B 参数、decode 激活 16B,全局 KV 缓存降至每 token 890 字节,约为 DeepSeek-V4-Flash 的 1/4、DeepSeek-V1 的 1/437。

    推荐理由:文章拆解了 KV 缓存压缩和预精简架构的具体做法,读者可以对照其工程路径评估长上下文部署成本。

  2. Nathan Lambert85

    Nathan Lambert 评价 Nvidia 收购 HuggingFace,认为 HuggingFace 影响 AI 讨论方向的能力对 Nvidia 值得每年付出约 100 亿美元。他认为 Nvidia 比三大云厂商更适合做买方,HuggingFace 应摆脱盈利单位定位,去争取下一代 1 亿 AI 开发者;作者曾在 HuggingFace 工作并于去年预言过这一收购。

    引用Nathan Lambert@natolambert

    Nvidia 应该收购 Hugging Face,作为一种廉价的方式,在 CUDA 与开源生态系统之间建立更深入的集成。 几乎和自行训练领先的开源模型一样便宜,并且与 Nvidia 在 2025 年日益增强的开放态度相一致。

    推荐理由:曾在 HuggingFace 工作的作者分析了这起收购的软实力逻辑,指出其每年值约 100 亿美元的原因。

  3. Cohere 产品与研究博客(网页)66

    Cohere 发布开源权重翻译模型 North Small Translate,WMT26 得分 83.60 超越 DeepL 与 Google Translate

    Cohere 发布机器翻译模型 North Small Translate,为 MoE 架构,总参数 218B、激活 25B,支持 50+ 语言,WMT26 全语言得分为 83.60,高于 DeepL NextGen 的 81.37 和 Google Translate 的 68.20,Agentic 版本达 84.36。

    推荐理由:官方公布了 WMT26 各语言和分区域得分、吞吐与单任务成本数据,读者可据此评估其相对 DeepL 和开源模型的位置。

9月9日周三
  1. Together AI 研究与产品博客(RSS)68

    Together AI 深度解析开源模型 AI 编码栈 MIGHT

    Together AI 发布深度解析文章,介绍开发者从闭源模型转向开源模型所需的 AI 编码栈,提出由 Model、Inference、Gateways、Harness、Tools 组成的 MIGHT 框架。

    推荐理由:原文给出开放权重模型编码栈的分层框架,读者可据此按任务选模型、按价格选供应商并保持工作流稳定。

9月8日周二
  1. Berkeley RDI:Blog(AI 安全与评测)61

    Berkeley RDI 发布开源平台 CUA-Lite,面向计算机使用智能体

    Berkeley RDI 推出开源平台 CUA-Lite,为计算机使用智能体提供三个标准化抽象。其环境接口下运行 15+ 个覆盖桌面、浏览器和移动端的基准,并提供含 30k+ 可验证任务的免 VM 桌面沙箱;统一监督数据格式已转换 10+ 个公开 CUA 数据集;每模型一个 harness 在评测、SFT 和 RL 间共享,支持 14 个模型族。

    推荐理由:原文说明了平台的三项标准化抽象及覆盖规模,读者可以据此评估它在整合分散的计算机使用智能体资源上的可用性。

  2. Mistral AI:News(网页)73

    Mistral 完成 30 亿欧元 D 轮融资,估值超 210 亿欧元

    Mistral 宣布完成 30 亿欧元 D 轮融资,投后估值超过 210 亿欧元,公司称这是欧洲科技公司有史以来最大的股权融资,距其成立三年。

    推荐理由:融资公告由公司官方发布,给出了金额、估值、领投方和资金用途,读者可以据此了解欧洲主权 AI 阵营的资本动向。

  3. vLLM 官方博客(RSS)63

    vLLM x AgentX:面向真实世界智能体推理服务的全栈优化

    vLLM 团队发布针对智能体负载优化的博客,基于 SemiAnalysis 的公开 AgentX 基准展示成果:DeepSeek V4 Pro 在 GB300 上达到 83K total tokens/GPU-秒。

    推荐理由:vLLM 团队结合 AgentX 实测数据讲解智能体负载的全栈优化方法与失败教训,读者可以借此理解并行策略如何跟随模型架构调整。

9月5日周六
9月4日周五
  1. Unsloth AI71

    Unsloth 宣布通过优化解码和新增 MTP 支持,让 GLM-5.3-Flash 的本地 GGUF 推理提速 1.6 至 3.4 倍,长上下文下最高达 3.3 倍。

    引用Z.ai@Zai_org

    GLM-5.3-Flash 正式发布 - 以极具竞争力的价格提供领先性能 - 原生多模态,支持 1M token 上下文窗口 - 320B-A18B 参数模型,采用 MIT 许可证发布 - 此前以 Ox Alpha 名义预览,完全运行在中国 AI 芯片上 博客:http://z.ai/blog/glm-5.3-flash 现已在所有官方平台上线: 模型权重:http://huggingface.co/zai-org/GLM-5.3-Flash API:http://docs.z.ai/guides/llm/glm-5.3-flash 编程套餐:http://z.ai/subscribe ZCode:http://zcode.z.ai/en 对话:http://chat.z.ai AutoClaw:http://autoclaw.z.ai

    推荐理由:原文给出本地运行 GLM-5.3-Flash 的具体加速倍数、显存需求表和现成 GGUF 资源,方法可直接复用。

  2. Hacker News 热门(buzzing.cc 中文翻译)78

    IFM 发布 K2 Horizon 六款开源模型,覆盖 0.9B 到 375B-A23B 并开放完整训练生命周期

    IFM 发布 K2 Horizon 模型系列,共六个模型:375B-A23B、36B-A4B、32B、7B、3.7B 和 0.9B,均以 Apache 2.0 开源,其中 0.9B、3.7B 和 7B 宣称在其规模上达到 SOTA,36B-A4B 采用新提出的稀疏注意力架构 MoVA。

    推荐理由:原文在发布模型之外还放出从预训练到智能体后训练的全流程产物,研究者可以据此复现和改造整套训练方法。

  3. Google Research:Blog(网页)66

    Google 与 HHMI Janelia 发布完整雄性果蝇大脑连接组图谱

    Google Research 与 HHMI Janelia、MRC 分子生物学实验室及剑桥大学等合作,在 Cell 发表雄性果蝇大脑和中枢神经系统的完整连接组图谱,包含超过 166,000 个神经元和 1.25 亿个突触连接,是目前按神经元数量计最大的大脑图谱。

    推荐理由:官方团队亲述十年合作的成果与 AI 重建方法,读者可以了解连接组学如何从果蝇推进到脊椎动物。

  4. Artificial Intelligence News(网页)83

    NVIDIA 以 129.3 亿美元收购 Hugging Face

    NVIDIA 已同意以 129.3 亿美元收购 Hugging Face,以扩展该开源模型仓库的平台与基础设施。交易目标是平台增长和基础设施投资,旨在为全球企业开发者、软件工程师和研究机构扩大 AI 访问机会。Hugging Face 由 Clem Delangue、Julien Chaumond、Thomas Wolf 等人在过去十年间打造。

    推荐理由:原文报道 NVIDIA 收购 Hugging Face 的金额与用途,读者可以据此了解开源模型平台归属变化的方向。

9月3日周四
  1. NVIDIA Blog(RSS)91

    NVIDIA 宣布以 129.303 亿美元收购 Hugging Face

    NVIDIA 宣布已同意以 12,930,300,000 美元收购 Hugging Face,黄仁勋在官方博客公布了这一消息。Hugging Face 目前有超过 1800 万开发者,托管超过 300 万个模型、50 万个数据集和 100 万个应用,服务超过 20 万家企业。

    推荐理由:原文来自收购方本人,给出了收购金额和对平台开放性的具体承诺,读者可以据此评估对开源生态的影响。

  2. Hugging Face:Blog(RSS)72

    Hugging Face 发布开源工具 funes,为编码智能体提供可本地持有的记忆层

    Hugging Face 发布开源工具 funes,为 Claude Code、Codex、pi、Hermes 等编码智能体提供本地记忆层,把已有会话记录索引成 Lance 数据集,一条 funes add 命令即可让 Agent 自主召回原始出处(Agent、时间戳、会话、轮次)。

    推荐理由:原文给出本地记忆层的检索机制、跨 Agent 复用方式,以及召回比压缩和交接更省成本的基准数字,方法可直接复用。

  3. Hugging Face:Blog(RSS)63

    用 TRL 和 OpenEnv 训练编码模型画水彩:Hugging Face 全流程开源复现

    Hugging Face 博客作者基于 Surya Narreddi 的原始想法,用 TRL、OpenEnv 和 Qwen/Qwen3.5-35B-A3B 复现了让语言模型通过 p5.brush 写 JavaScript 画水彩的 RL 训练流程,所有数据集、环境、脚本和模型均开源在 Hub。

    推荐理由:作者用 TRL 和 OpenEnv 完整开源复现了让编码模型画水彩的 RL 配方,含数据池、环境和三组奖励对比,可整体迁移复用。

9月2日周三
  1. Unsloth AI66

    Unsloth 通过 MTP(Multi-Token Prediction)让 Qwen3.8-Flash-Next 本地推理提速约 1.3 至 1.7 倍且精度不变,GGUF 在单张 RTX PRO 6000 上可达 170 tokens/s(基线 100 tokens/s)。

    引用Unsloth AI@UnslothAI

    Qwen3.8-Flash 现在可以在本地运行了!🔥 这个 125B 的 MoE 模型表现超过了 Claude-Opus-4.6(Max)。 通过 Unsloth GGUF 在 75GB 内存上运行。 Qwen3.8-Flash-Next 让 CPU 内存 / 统一内存配置也能达到接近 VRAM 的速度。 指南:https://unsloth.ai/docs/models/qwen3.8-next GGUF:https://huggingface.co/unsloth/Qwen3.8-Flash-Next-GGUF

    推荐理由:原文给出了 MTP 加速的具体倍数、显存门槛和各量化档位内存需求,读者可以据此判断自己的设备能否跑通。

  2. Baseten 工程博客(网页)62

    Baseten 解析后训练最佳开源模型并按成本分档推荐

    Baseten 发文解析开源模型后训练的成本驱动因素,指出活跃参数量是 RL 后训练成本的最大来源,总参数和 KV cache 主要限制推理速度,并按成本档位推荐 DeepSeek-V4-Flash、GLM-5.2、Kimi K2.6、Kimi K2.7 Code、Nemotron-3-Super-120B 和 Qwen3 系列。选型建议关注库支持、基准表现和后训练循环成本三方面。

    推荐理由:原文把后训练成本拆解为活跃参数、总参数和 KV cache 三个因素,并按成本档位比较了多款开源模型,方法可直接迁移到选型。

  3. Meituan LongCat68

    LongCat-2.0 现已在 @cline 中免费试用!🐱 [引用 @cline]:LongCat-2.0 目前在 Cline 中免费使用。 这是一款来自 @Meituan_LongCat 的 1.6T 开源权重 MoE 模型,拥有 1M 上下文,得分与 Claude Opus 4.7 和 Gemini 3.1 Pro 相近。 立即尝试:npm i -g cline /model 在免费模型下选择 LongCat-2.0

    引用Cline@cline

    LongCat-2.0 现在在 Cline 中免费开放。 这是一个 1.6T 开放权重 MoE 模型,拥有 1M 上下文,来自 @Meituan_LongCat,得分与 Claude Opus 4.7 和 Gemini 3.1 Pro 相近。 立即试用: npm i -g cline /model 在免费模型下选择 LongCat-2.0

    推荐理由:官方宣布 LongCat-2.0 可在 Cline 免费试用,并给出安装命令和模型选择路径,读者可直接接入现有编码工作流。