跳到正文
北京时间

开源生态

开源模型、框架与仓库动态:权重开放、社区项目爆火、开源与闭源的力量消长。

697条精选相关主题模型发布Hugging FaceAI 编码

最新精选

第 481–500 条 · 共 697 条
5月17日周日
  1. Hacker News 热门(buzzing.cc 中文翻译)74

    Zerostack——一款采用纯Rust语言编写、受Unix启发的编程代理

    Zerostack是一款采用纯Rust语言编写、受Unix哲学启发的编程代理工具,已正式发布1.0.0版本并在Rust包管理平台crates.io上提供。该发布在技术社区Hacker News上获得115点关注,反映出开发者对其的高度兴趣。Rust语言以内存安全和性能见称,Unix设计强调简洁与模块化,Zerostack结合两者优势,旨在提升编程效率,为代码辅助领域带来新选择。

    推荐理由:不走 IDE 插件的老路,Zerostack 把编程代理做成命令行管道,Rust 纯血、Unix 哲学,适合喜欢拼接工具的开发者尝鲜。

  2. Ant Ling80

    又一次Day0协作,又一次社区胜利。感谢@vllm_project团队始终可靠的支持~ 🫡🫡

    引用vLLM@vllm_project

    恭喜 @AntLingAGI 的 Ring-2.6-1T 开源!🎉 Ling-2.6-1T 的思考版兄弟——万亿规模,专为智能体执行和复杂推理打造。 Day-0 vLLM 支持已就绪。 🤗 http://recipes.vllm.ai/inclusionAI/Ring-2.6-1T

    推荐理由:蚂蚁百灵把万亿参数的 thinking 模型开源,vLLM 第一天就能跑,想自己搭 agent 推理服务的可以直接动手了,开源生态的齿轮转得比想象中快。

  3. Ant Ling76

    蚂蚁集团发布万亿参数推理模型Ring-2.6-1T,专为现实世界智能体工作流构建。该模型采用MIT许可,上下文长度通过YaRN技术从128K扩展至256K,并采用Async RL与IcePop混合训练架构。其核心特点是具备双推理努力模式:“high”模式用于快速智能体循环,“xhigh”模式用于深度推理,旨在实现更好的成本与性能平衡。模型已开源,欢迎社区反馈。

    引用Adina Yakup@AdinaYakup

    蚂蚁集团刚刚发布了 Ring-2.6-1T 🔥 1T 推理模型,专为真实世界的 agent 工作流打造。 ✨ MIT 许可证 ✨ 128K >> 256K 上下文(YaRN) ✨ 异步 RL + IcePop 训练架构 ✨ 双推理强度:"high" 用于快速 agent 循环,"xhigh" 用于深度推理 = 更好的成本/性能权衡 👀

    推荐理由:蚂蚁把1T推理模型以MIT许可开源,还专门为Agent循环做了高低推理双模式,做开源Agent的团队直接多了一个强力基座可选。

5月16日周六
  1. Hacker News 热门(buzzing.cc 中文翻译)73

    SANA-WM:一个用于生成1分钟720p视频的26亿级开源世界模型

    NVIDIA研究团队发布了SANA-WM,这是一个参数规模达26亿的开源世界模型,专门用于生成长达1分钟、分辨率为720p的视频。该模型已在GitHub页面开源,旨在推动高质量长视频生成的研发。其在Hacker News社区获得了107点热度,显示出业界对该技术进展的关注。

    推荐理由:开源且能跑 1 分钟 720p,NVIDIA 这个 2.6B 世界模型在物理一致性上跨了一大步,做视频生成和物理仿真的同行该坐不住了。

  2. Hacker News 热门(buzzing.cc 中文翻译)73

    Show HN: 烧吧,宝贝,烧吧(那些代币)

    开发者发布了一个名为“烧吧,宝贝,烧吧”的开源项目,旨在通过销毁代币来应对加密货币领域的通胀问题。该项目提供了一个工具,允许用户主动销毁自己持有的代币,从而减少总供应量。此举可能提升剩余代币的稀缺性与潜在价值。项目已在GitHub上开源,并在Hacker News上获得了100点的社区热度。

    推荐理由:解决一个极小但真实的痛点,代码干净,有泄露令牌焦虑的开发者可以三分钟跑一下。

  3. xAI:News(网页)70

    将Grok接入Hermes智能体

    xAI宣布,用户现可将Grok订阅账户接入Nous Research的开源自改进智能体Hermes Agent。该集成对所有订阅层级开放,允许用户在Hermes环境中直接使用Grok 4.3进行文本对话与高级推理、调用其文本转语音功能生成语音回复,并利用Grok Imagine创建图像与视频。Hermes Agent可持久运行于电脑、沙盒或VPS,具备跨会话长期记忆能力,并能连接WhatsApp、Discord等通讯平台。用户通过安装Hermes Agent并选择Grok提供商即可完成配置。

    推荐理由:如果你已经在用或想尝试Nous Research的Hermes Agent,现在可以直接用Grok订阅,不必再多付一份模型API钱,而且Grok 4.3的推理和图像生成都能在agent里跑,对个人开发者挺友好。

5月15日周五
  1. Microsoft Research67

    微软研究院的新工具、模型、代码库和论文现已发布。 使用AI和智能体?值得关注: • MSR AI Frontiers的MagenticLite • 智能体化GitHub工作流 • 验证优先智能体 • 意义匹配微调 • AI转型与经济发展

    推荐理由:微软研究院这波把 agent 工具链摊开了,MagenticLite 轻量框架和 verification-first 思路值得跟,做智能体的可以去 GitHub 翻翻。

  2. Hacker News 热门(buzzing.cc 中文翻译)78

    Show HN: 根据基准测试排名,为您的硬件寻找最适合的本地 LLM

    一个名为“WhichLLM”的开源工具已在GitHub发布,可根据用户硬件配置推荐最适合的本地大语言模型。该工具通过基准测试对各类模型进行排名,帮助用户依据自身设备的性能指标选择最优模型。项目在Hacker News上获得116点热度,显示出社区对本地化AI部署效率工具的积极关注。

    推荐理由:选本地 LLM 不再靠猜,这个工具把基准测试和硬件匹配做得像查配置表,刚接触端侧的人也能立刻上手。

  3. Hacker News 热门(buzzing.cc 中文翻译)71

    克劳德(法律事务)

    Anthropic公司在GitHub上开源了专为法律领域优化的AI模型“Claude for Legal”。该模型能更准确地处理法律文本、合同及案例摘要,旨在提升法律从业者效率。此消息在Hacker News上获得105个投票点数,显示出技术社区对其在法律科技领域应用潜力的关注。

    推荐理由:Anthropic 把 Claude 在法律场景的提示和工具打包成仓库,对法律人来说比 API 文档更直接可用,垂直落地信号明显。

  4. 蚂蚁 inclusionAI:HuggingFace 新模型56

    蚂蚁集团提出 ARGenSeg-8B:基于自回归图像生成模型的图像分割框架

    蚂蚁集团推出 ARGenSeg-8B,一种将多模态理解与像素级感知统一的自回归图像生成分割框架。它利用多模态大语言模型(MLLM)输出视觉 token,并通过通用 VQ-VAE 解码为分割掩码,使分割完全依赖 MLLM 的像素级理解。采用 next-scale-prediction 策略并行生成视觉 token,降低推理延迟。在多个分割数据集上超越此前最优方法,推理速度显著提升。论文已被 NeurIPS 2025 接收,模型已发布在 HuggingFace。

    推荐理由:蚂蚁提出用自回归生成做分割,把理解和像素级感知统一到一个框架里,多个数据集SOTA且速度更快,做CV的值得看看。

  5. SenseTime70

    主推文赞扬了创新者在前沿领域的探索。引用的推文具体指出,SenseNova-U1在空间智能能力上取得进展,其关键基准测试表现超越了Qwen3.5等强劲基线。同时,团队开源了目前最大的空间问答数据集SenseNova-SI-8M,并邀请业界在CVPR会议进行线下交流。

    引用Zhongang Cai@caizhongang

    很高兴为 SenseNova-U1 的空间智能能力做出了贡献,在 VSI-Bench 等关键基准上超越了 Qwen3.5 等强劲基线。 我们也很激动地开源了 SenseNova-SI-8M,这是目前最大的空间问答数据集。 今年六月 CVPR 见,很乐意当面交流! SenseNova-SI-8M: https://huggingface.co/datasets/sensenova/SenseNova-SI-8M

    推荐理由:商汤的 SenseNova-U1 在空间智能基准上压过 Qwen3.5,还顺手开源了目前最大的空间 QA 数据集 SenseNova-SI-8M,搞具身智能和多模态的可以直接抱走数据。

  6. 公众号:蚂蚁百灵(Ling)80

    Ring-2.6-1T 正式开源:蚂蚁百灵发布万亿级思考模型

    蚂蚁百灵开源万亿级思考模型 Ring-2.6-1T,重点强化 Agent 执行能力,在 PinchBench 和 ClawEval 上达到开源 SOTA。模型支持 high 与 xhigh 两档推理强度,并采用异步 Async RL 架构结合升级版棒冰算法提升训练效率。权重已开源至 Hugging Face 和 ModelScope,Chat 体验现已开放。

    推荐理由:通过可调节推理强度,模型在 Agent 高频任务中减少不必要计算,复杂场景又能释放上限,为万亿参数模型的实际部署提供了更精细的资源控制方式。

  7. Hugging Face:Blog(RSS)60

    IBM 发布 Granite Embedding Multilingual R2 开源多语言嵌入模型

    IBM 发布两个 Apache 2.0 开源多语言嵌入模型:97M 参数的紧凑型(granite-embedding-97m-multilingual-r2)在 MTEB Multilingual Retrieval 上得 60.3 分,超越所有开放子 1 亿参数模型;311M 全尺寸模型(granite-embedding-311m-multilingual-r2)得 65.2 分,在 500M 以下开放模型中排第二,并支持 Matryoshka 维度。两者均基于 ModernBERT 架构,支持 200+ 种语言,针对 52 种语言和 9 种编程代码检索训练,上下文窗口达 32,768 tokens。可直接替换 sentence-transformers、LangChain、LlamaIndex 等框架中的默认模型,预置 ONNX 和 OpenVINO 权重以优化 CPU 推理。

    推荐理由:97M小模型在跨语言检索上打败很多300M级选手,32K上下文让长文档处理不再鸡肋,Apache 2.0开源意味着做多语言RAG的可以直接拿来当默认嵌入模型了。

5月14日周四
  1. 蚂蚁 inclusionAI:HuggingFace 新模型59

    蚂蚁 inclusionAI 推出万亿参数推理模型 Ring-2.6-1T

    蚂蚁 inclusionAI 发布旗舰推理模型 Ring-2.6-1T,参数规模达万亿,面向智能体工作流、工程开发、科研分析等复杂场景。模型从“能回答”升级至“能执行”,在多步任务与工具协作中表现更优;支持 high/xhigh 两档推理强度,可灵活平衡效果与成本;采用异步强化学习结合 IcePop 算法提升训练效率。基准测试中,high 模式 PinchBench 得 87.60、ClawEval 63.82、Tau2-Bench 电信场景 95.32;xhigh 模式 ARC-AGI-V2 得 66.18、AIME 26 达 95.83、GPQA Diamond 88.27。上下文长度支持 128K 扩展至 256K(YaRN),已通过 HuggingFace 和 ModelScope 开放下载。

    推荐理由:蚂蚁放出的万亿参数推理模型,Agent执行能力在PinchBench上超GPT-5.4,异步RL训练和可调推理强度对工程落地有参考价值,开源可试。

  2. SenseTime77

    由联合创始人兼首席科学家李沐博士领导的团队发布了SenseNova U1技术报告,详细阐述了其架构、训练方案与创新突破。此次开源同步发布了基于混合专家模型(MoE)的新权重,旨在推动AI领域的透明度、可复现性与进一步创新。团队希望通过开放共享促进整个社区的技术发展。

    引用Dahua Lin@lindahua

    自豪地宣布发布 SenseNova U1 技术报告——以及一套基于 MoE 的全新模型权重。 我们希望这次开源发布能促进透明度、可复现性以及整个 AI 社区的进一步创新。 非常感谢团队让这一切成为可能。🚀

    推荐理由:商汤这次把SenseNova U1的MoE权重和完整技术报告一起开源,比常规PR多了些诚意,做模型选型和微调的值得翻翻。

  3. IT之家(RSS)74

    “让 Token 消耗降低 61%”:腾讯开源 Agent Memory

    腾讯云开源了TencentDB Agent Memory,旨在解决Agent长任务中上下文窗口易满、Token成本高的问题。该方案采用“上下文卸载”与“Mermaid任务画布”两项核心技术,将完整信息卸载至外部存储,同时用结构化任务图保留关键状态与执行路径。实验显示,该方案在多任务连续会话中最高可降低61%的Token消耗,并提升任务成功率。项目已适配OpenClaw等主流框架,支持一键集成与本地SQLite存储。

    推荐理由:腾讯开源的这个 Agent Memory,用 Mermaid 画布加上下文卸载,把长任务 Token 省了 61%,而且所有中间信息都可追溯,做复杂 Agent 的开发者可以直接抄作业了。

  4. Xiaomi MiMo69

    MiMo V2.5 Pro 在 @DesignArena 上刚刚获得第三名!🎉 MiMo V2.5 Pro (Thinking) 在总排行榜上比 MiMo-V2.5 提升了 8 个名次,在前端编码任务中达到与 Claude Sonnet 4.6 相同的性能水平。 衷心祝贺 @XiaomiMiMo 团队取得这些进步!

    引用Design Arena@Designarena

    突发:MiMo V2.5 Pro (Thinking) 在 Design Arena 的开源权重模型中综合排名第 3。 MiMo V2.5 Pro (Thinking) 在综合排行榜上比 MiMo-V2.5 高出 8 个名次,在前端编码任务上与 Claude Sonnet 4.6 处于同一性能区间。 热烈祝贺 @XiaomiMiMo 团队取得这些进步!

    推荐理由:小米MiMo在Design Arena前端编码评测里直接杀进前三,跟Claude Sonnet 4.6平起平坐,这是国产开源模型在代码能力上第一次给我真正的压迫感,搞前端的可以盯一下。

  5. Together AI 研究与产品博客(RSS)65

    Together AI 开源视频翻译工具 Violin,集成 Whisper、DeepSeek V4 Pro 与 Sonic 3

    Together AI 发布全开源视频翻译工具 Violin,代码以 MIT 许可证开放在 github.com/shang-zhu/violin。流程分三步,用 Together 的 Whisper V3 做多语言转写,DeepSeek V4 Pro 做翻译,Together 托管的 Cartesia Sonic 3 合成多种母语语音,且不支持声音克隆。

    推荐理由:原文完整给出了 ASR、LLM 翻译、TTS 三段流水线所用模型和 MIT 开源仓库入口,读者可以照着部署或改造成自己的翻译流程。

5月13日周三
  1. SenseTime72

    SenseNova-U1 技术报告详尽披露了构建前沿原生多模态模型的方法,核心包括原生多模态统一建模、无损视觉接口、联合自回归与像素空间流匹配训练、以及原生混合专家骨干网络。报告提供了六阶段训练方案、强化学习后训练与蒸馏的完整实践指南。其开源版本 SenseNova-U1-A3B-MoT 基于混合专家架构,仅激活30亿参数,实现了高效快速的性能。相关资源已全面开放,涵盖技术报告、模型权重、代码和演示平台。

    推荐理由:商汤把原生多模态模型的训练细节全公开了,无视觉编码器、原生MoE架构,还开源了38B-A3B权重,做多模态模型的可以直接照着技术报告复现。

  2. Tencent Hy76

    Hy3 预览版现已登陆 @gmi_cloud。🙌

    引用GMI Cloud@gmi_cloud

    来自 @TencentHunyuan 的 Hy3 预览版现已在 GMI 上线 在 OpenRouter 的 LLM 排行榜上排名第 1,已开源,是 Hy 系列中最强的模型。 它擅长复杂推理和 STEM、编码和智能体工作流、长上下文任务(256K),以及自然、富有同理心的对话。 295B MoE · 21B 激活 · 开放权重。 立即试用 👇

    推荐理由:腾讯混元 Hy3 开源且登顶 OpenRouter 排行榜,295B MoE 架构在推理和代码上提升明显,不是小厂的刷榜产品,搞 agent 和 coding 的可以认真试试。