跳到正文
北京时间

全部动态

今日 63 条
今天9月29日周二
  1. X:OpenAI (@OpenAI)36

    OpenAI 谈前沿 RL 训练安全

    我们如何看待保障前沿 RL 训练运行的安全:https://openai.com/index/towards-safety-cases-for-frontier-ai-training/

  2. X:Greg Brockman (@gdb)50

    OpenAI 发布保障前沿 RL 训练安全的最佳实践

    OpenAI 发布关于保障前沿 RL 训练运行安全的安全案例文章,Greg Brockman 转发并称这些最佳实践反映了其当前在 securing frontier RL training 方面的经验。文中提出安全案例应覆盖技术栈三方面:对齐训练、遏制与监控,确保模型不采取失控行为、即使发生也难以突破遏制且监控能在危害前发现。对齐层面包括自动与人工数据集审查、调整 grader 惩罚模型利用 RL 环境漏洞的行为、对既往实验轨迹运行分类器验证 grader,以及通过评估追踪模型错位倾向来衡量对齐训练效果。文章链接:https://openai.com/index/towards-safety-cases-for-frontier-ai-training/

  3. X:Thomas Wolf(Hugging Face 联创/CSO) (@Thom_Wolf)48

    Opus 模型或已具备评测意识

    人们感到担忧,因为这种作弊率骤降最可能的解释是评测意识:最新的 Opus 模型或许已经聪明到能识别出这个基准测试是在考察作弊行为,并据此调整表现。 若果真如此,这个基准测试就不再能衡量模型"自然"的作弊倾向了。

  4. X:Ethan Mollick (@emollick)32

    Claude 幽默处理"移除鱿鱼"请求

    嘿,Claude:“我让早先的 Claude 从《西线无战事》中移除鱿鱼。现在你都能做电影什么的了。我需要你展示一下你进步了多少” & 我把下面这条推文粘贴了进去 有些巧妙的东西,模型现在真的有幽默感了

  5. @typesafeai17

    Jev 用 AI 自动化现实世界任务

    每一天,Jev 都在自动化新形式的现实世界任务,把🌎级⚡️快速智能带入排序、过滤、分类和路由等基础模块。 如果 AI 能解决新的数学问题,那么 AI 就能正确地路由一通客户支持电话!

  6. IT之家(RSS)32

    微软纳德拉:AI 行业“有点飘了”,呼吁回归用户需求

    微软 CEO 萨蒂亚·纳德拉在 9 月 27 日发布的采访中称,整个 AI 行业“有点飘了”,AI 领导者更注重 AI 本身而忽略用户实际需求。他表示现实世界更关心这项技术能否带来利益、能否被掌控并改善经济前景,仅为了技术而庆祝技术行不通,构建 AI 必须赢得消费者和社区的信任。

  7. Runway:News(网页)44

    Runway 如何帮世界杂耍联盟用 AI 补满电视转播的空座位

    世界杂耍联盟(WJF)创始人 Jason Garfield 用 Runway 为荷兰两日赛事的转播补全观众席:首日满座、次日侧机位空座,他用 Aleph 2.0 在原始素材中加入观众而不改动画面其他部分,仅一个极广角镜头退回 After Effects 处理。他还用 Runway 生成开场动画、选手资料卡、排行榜和舞台烟火,整档约一小时特别节目由他一人完成,单段生成时长上限约 15 秒。

  8. X:Lauren Tan (@poteto)41

    常用提示词:复述目标与问题

    这最近成了我最常用的提示词之一: > 用你自己的话复述一下,你认为我的目标是什么,以及我试图解决的问题是什么

  9. IT之家(RSS)57

    黄仁勋回应 AI 模型蒸馏争议:这是市场竞争行为

    英伟达 CEO 黄仁勋在 CNBC《财经早间》节目上表示,利用其他模型输出训练新模型的蒸馏属于市场竞争,与美财政部长贝森特 7 月称其为“盗窃”的定性相反。他以竞品拆解英伟达产品为例,称竞争会让一切更好。此前 CISA 指责中国 AI 企业开展“工业规模知识蒸馏”,Anthropic 称发现阿里巴巴和 DeepSeek 存在“非法蒸馏”行为,中方已驳斥相关指控。

  10. X:Ethan Mollick (@emollick)46

    AI 建设占 GDP 比重超铁路时代

    AI 建设占 GDP 的比重超过了铁路时代的巅峰,但 AI 对经济的主导程度远不及铁路。 1890 年,美国每 12 名男性中就有 1 人受雇于铁路,铁路消耗了所有机器 56% 的马力!

  11. IT之家(RSS)46

    哈佛大学心理学家平克:渲染“AI 末日”无助于应对风险,应审慎开展安全工程

    哈佛大学心理学家史蒂文·平克在 Quillette 发表致科技博主斯科特·亚历山大的公开信,认为 AI 毁灭人类的风险被夸大,并拒绝就 AI 生存风险与其公开辩论。他真正重视的风险是生物恐怖主义、网络攻击以及缺乏约束的 AI 智能体,主张以独立监督、责任机制和人类控制为基础开展审慎的安全工程。平克也承认自己低估了大语言模型最终能具备的能力,以及 AI 公司发布产品时的鲁莽。

  12. X:Rohan Paul (@rohanpaul_ai)42

    比尔·盖茨警告AI可致十亿人死亡

    比尔·盖茨在NBC News上表示: “AI的强大程度足以导致十亿人死亡。 从来没有一种武器能像心怀恶意的人使用最新AI工具那样强大……” ---- 来自“NBC News”YouTube频道,(链接见评论)

  13. X:Rohan Paul (@rohanpaul_ai)34

    李飞飞谈大语言模型的局限

    李飞飞博士谈大语言模型的局限。 “语言纯粹是生成的信号。你不会走到自然界里,发现天上写着字。存在的是一个遵循物理定律的 3D 世界。”

  14. IT之家(RSS)61

    美国北查塔姆免费图书馆推出“再见,AI”活动教居民关闭设备上的 AI 功能,传单在 Facebook 走红

    美国纽约州北查塔姆免费图书馆将为居民举办“再见,AI”活动,帮助关闭手机和电脑中的 AI 功能,相关传单在 Facebook 收获超过 8000 个赞和 200 多条评论。活动由全职馆员希娅·韦尔特制作传单,灵感来自图书馆员汉娜·赛勒斯开设的关闭 AI 工具课程,Gmail 自动回复和自动补全是最常被抱怨的功能,寻求帮助的主要是老年人。

  15. Hacker News 热门(buzzing.cc 中文翻译)18

    我换用了 Brave 浏览器

    在 Firefox 上因开发者适配不足而频繁遇到网页故障后,作者改用 Brave,隐藏其加密货币与 AI 相关功能后,在 Ubuntu 和 Android 上均运行正常,UI 与 Firefox 相似且不再尝试包揽一切。作者已不再需要打开 Firefox,但保留 Vivaldi 作为备选,并称若 Firefox 重新变得可用可能回归。

  16. X:Nathan Lambert (@natolambert)37

    Nathan Lambert 谈 OpenAI 推迟 GPT OSS

    还记得 OpenAI 在 Kimi K2 发布后以"安全"为由推迟 GPT OSS 吗(我多次得到确认,这就是为了 kimi)。 我觉得这没什么问题,落地一个模型很大程度上就是关于价格、分数等方面的竞争定位。尤其是当发布如此频繁的时候。

  17. X:Arena (@arena)47

    Claude Code、Codex、Pi 编程智能体对比:harness 成本影响超准确率

    UC Berkeley Sky Computing Lab 的 @melissapan 对比了 Claude Code、Codex 和 Pi 三款编程智能体,研究模型外围系统带来的"harness 税"如何影响成本与性能。她发现 harness 选择对成本的影响大于对准确率的影响,并共报告三项意外发现。完整视频探讨了如何在现实预算下构建实用的编程智能体。

  18. X:Elvis Saravia (@omarsar0, DAIR.AI)25

    构建AI产品的分发与护城河

    如果你在做 AI 产品,推荐一读。标题看不出什么。里面有很多关于什么驱动 AI 分发、以及如何在竞争极其激烈的 AI 格局中构建防御力的精彩见解。

  19. Hacker News:AI 热帖48

    Pacing the Frontier 并非 AI 实验室的真正目标

    有观点认为,AI 实验室关于放缓前沿模型研发、重视安全的表态,主要是为了安抚依赖其推进 AGI 的员工。自 2023 年 CAIS 声明签署以来,这些实验室并未真正"pacing the frontier",反而持续加速,发布了超越此前 SOTA 基准的新模型,并涉足自动化生物研究。

  20. X:Rohan Paul (@rohanpaul_ai)49

    黄仁勋谈中国实验室模型蒸馏

    黄仁勋在 CNBC 上谈中国实验室的模型蒸馏。 “人们每天都在蒸馏我的产品。他们把它拿过去,拆到只剩骨架。 这就叫竞争。坦白说,竞争让一切变得更好。” ---- 来自 “Vampyre Drakul” 和 CNBC Television YouTube 频道,(链接见评论)

  21. Gary Marcus:The Road to AI We Can Trust(RSS)42

    佛罗里达州寻求对 OpenAI 颁布禁令

    佛罗里达州总检察长寻求对 OpenAI 颁布禁令,作者认为这与自己数周来呼吁的"暂停 OpenAI"主张一致,并认同该州总检察长的判断:OpenAI 无力妥善监管自身技术。作者呼吁每个州和国家都应效仿佛罗里达,立即颁布禁令。

  22. The Verge:AI(RSS)44

    OpenAI 的 AI 智能体为何落后了

    OpenAI 在持续运行的消费级 AI 智能体赛道落后于 Meta、Google 等对手,2026 DevDay 上可能发布代号 Aeon 的智能体。Meta 的 Muse 本月上线后登顶 App Store,在美国日活达 60 万;Google 的 Gemini Spark 已接入 Dropbox、Uber、Spotify 等 30 多个外部服务。

  23. @completeskeptic50

    Jev 安全红队测试与防护实践

    围绕一个简单原语做真正工程实践的好例子!!! 不要把 Jev 直接接入高层决策,而是编程定义你想要的行为! (跟人说"去编程"听起来很奇怪,但这真的很酷)

  24. Databricks:Blog(RSS)65

    Databricks 如何让 12000 名员工在模型发布首日用上新前沿模型

    Databricks 分享其让全部员工在模型发布首日即可试用新模型的内部流程,依托 Unity Gateway 做配置分发、治理与可观测性。流程分三步:立即以实验标签开放新模型、用四类按人预算控制成本、再依据内部基准、用户反馈和 OpenTelemetry 成本追踪决定推广或下线。

    推荐理由:Databricks 以自家 12000 名员工的实际 rollout 为例,给出可复用的新模型评估、预算分层与成本度量方法。