跳到正文
北京时间
原文
Hacker News 热门(buzzing.cc 中文翻译)· lucasfcosta·· 2026-06-15精选AI 评分72

里约热内卢市政府 AI 模型 Rio3.5 在基准测试中击败 Qwen3.7

里约热内卢市政府的模型Rio3.5在最近的基准测试中击败了Qwen3.7

AI 导读

里约热内卢市政府开发的 AI 模型 Rio3.5,在近期基准测试中超越了 Qwen3.7。该消息源自 Hacker News 上的一篇帖子,指出 Rio3.5 在多项评测中表现优于 Qwen3.7。目前尚未公开具体的测试细节或基准名称。

推荐理由

一个市政府 IT 部门训练的模型在基准测试中击败了 Qwen3.7,这让人重新审视谁在参与前沿模型竞争。如果结果可复现,可能是今年最意外的黑马。

正文 · 原文

@ZenMagnets:Alibaba Qwen3.7 slowly fading into irrelevance at the frontier due to proprietary stance. In it's place we have Minimax M3 and... checks notes Rio 3.5 397b, made by the municipal IT company of Rio de Janeiro's city government.

来源:Hacker News 热门(buzzing.cc 中文翻译) · twitter.com