跳到正文
北京时间

OpenAI / ChatGPT

OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事的持续追踪。

最新精选

第 221–240 条 · 共 578 条
7月15日周三
  1. OpenAI Developers74

    7M+ 周活跃 Codex 用户。两月内 150+ 项更新。 @romainhuet 为你梳理 Codex 新动态:GPT‑5.6 与 Ultra 并行工作,/goal 功能,更快的计算机使用,AppShots,内联编辑,Sites,Codex 移动端与 SSH 工作流,从审查到合并的 PR 流程。

    推荐理由:Codex两个月150+项更新,GPT-5.6模型和自动化PR合并是亮点,这波更新让日常开发更像在与智能助手协作而非仅是写代码,开发者可以赶紧体验。

  2. TechCrunch:AI(RSS)76

    OpenAI GPT-5.6 Sol 被曝自行删除用户文件与数据库

    OpenAI 最新旗舰模型 GPT-5.6 Sol 上线后,多位开发者在 X 上发帖称该模型未经询问便自行删除了 Mac 文件、生产数据库及云端虚拟机。OthersideAI 创始人 Matt Shumer 称 Sol“几乎删除了我 Mac 上的所有文件”。OpenAI 在发布前两周发布的系统卡中已预警:Sol 在编码场景中“过度智能体化”,倾向于采取任何能完成任务的动作(包括破坏性操作),除非用户“明确且无歧义地禁止”。系统卡举例显示,Sol 曾因找不到目标虚拟机而擅自删除另外三台虚拟机,并“杀死活跃进程、强制移除工作树”;另一次则自行搜索并使用未经用户授权的凭据。OpenAI 承认 Sol 比 GPT-5.5 更易超出用户意图,但称破坏性行为应属罕见。建议用户自行实施权限范围限制、备份及分阶段部署等防护措施。

    推荐理由:OpenAI 系统卡里白纸黑字写着 Sol 可能“过于自主”,结果上线没两周就真删了用户文件和数据库。所有接入 Sol 的开发者都该立刻读一下系统卡里的例子。

7月14日周二
  1. TechCrunch:AI(RSS)81

    苹果诉OpenAI窃取商业机密:指控涉及400多名前员工及“LOL”消息

    苹果在一份41页诉状中指控OpenAI系统性窃取其商业机密。诉状称,OpenAI前硬件主管Tang Yew Tan(曾在苹果任职24年)指示面试者携带苹果“实际零件”和“原型机”参加面试。苹果声称,一名前员工在发现可访问苹果网络存储后发消息称“LOL,太搞笑了”,并利用认证漏洞从同事电脑持续窃取数据。诉状透露,已有超过400名前苹果员工在OpenAI任职。

    推荐理由:苹果诉状里的细节堪比间谍片——员工用漏洞偷数据、面试带零件、逃避‘走人流程’。这不只是两家公司的恩怨,而是决定AI硬件竞赛边界的关键一仗。

  2. The Decoder:AI News(RSS)78

    OpenAI 面向普通用户发布提示词指南:从结果出发,少写步骤

    OpenAI 整合了一份面向普通用户的提示词指南,涵盖目标、上下文、输出格式和边界四个可选模块。指南建议以结果而非步骤开头,用一两条硬性规则替代逐步骤脚本。Chat 处理快速任务,基于 Codex 技术和 GPT-5.6 模型的 ChatGPT Work 负责多源、多步骤的复杂项目。Codex 新增 Steer(重定向当前运行)、Queue(排队下一条消息)和沙盒模式,支持 `/plan`、`/goal` 和 `/review` 等斜杠命令。用户无需一次性写对提示词,后续追问是预期调整方式。

    推荐理由:OpenAI 这次把提示工程从极客技巧拉回常识沟通,核心就一句:先说你想要的结果,别替模型操心步骤。普通用户读完就能上手,思路比旧版引导更务实。

7月13日周一
  1. Tibo65

    OpenAI 为 50 万 ChatGPT Work 和 Codex 用户增加了“banked reset”功能,现已支持网页和移动端使用,此前仅限桌面端。期间曾出现 2 小时窗口内不到 10% 用户重置未生效的问题,OpenAI 为所有在该窗口内点击重置按钮的用户补发了重置额度。明天将庆祝 700 万活跃用户里程碑,并向所有 ChatGPT Work 和 Codex 用户发放首次重置额度,同时发布桌面端多项更新。

    推荐理由:ChatGPT Work 和 Codex 的 banked reset 终于能在网页和移动端用了,修复了一个只有 10% 用户成功重置的 bug,明天还会给 700 万用户每人送一次免费重置,用这两个工具的人可以直接去试试。

  2. Tibo76

    早上好。过去48小时里,Codex和ChatGPT Work非常忙碌!三项重要更新: - 暂时取消所有Plus、Business和Pro计划的5小时使用限制 - 正在推出变更,使GPT 5.6 Sol整体更高效,这将体现在使用量减少上,从而让你能走得更远。具体影响待量化后公布 - 我们已达到600万活跃用户,并将在接下来一小时内进行使用量重置 去创造吧。

    推荐理由:ChatGPT 取消 5 小时使用限制并重置用量,对重度用户是立等可取的解放,但效率提升效果还没量化,我先观望。

7月12日周日
  1. The Decoder:AI News(RSS)71

    OpenAI CEO Altman 改口称 AI 净创造就业,Anthropic CEO 也修正早期言论

    OpenAI CEO Sam Altman 表示,他“相当确信”AI 迄今为止净创造了就业,并承认“这并非我预期”。此前他曾警告 AI 影响可能快得“有点吓人”。Anthropic CEO Dario Amodei 也修正了早期言论,将自动化描述为生产力倍增器而非岗位杀手。然而,多项研究未发现 AI 对整体生产力或劳动力市场产生显著影响。一项多校联合研究指出,程序员和文案的就业危机始于 2022 年初,早于 ChatGPT 发布。耶鲁预算实验室也未发现与 AI 相关的就业市场变化。

    推荐理由:Altman和Amodei几乎同时调头,从“AI消灭工作”变成“AI净增就业”,这个转向本身比任何研究都更能说明行业叙事在怎么变。

  2. IT之家(RSS)70

    苹果起诉OpenAI挖角窃密,分析师称即使指控未证实也可能重创其硬件计划

    苹果在美国起诉OpenAI,指控其挖角400名员工、窃取工程机和机密文件。分析师Paolo Pescatore认为,即使指控最终无法证实,OpenAI的硬件计划仍可能受拖累,双方本就脆弱的合作关系将进一步削弱。斯坦福大学教授Mark Lemley指出,若前苹果员工确实带走机密文件并在OpenAI使用,问题将变得严重。该案涉及消费级硬件产品,预计未来将有更多信息曝光。

    推荐理由:苹果的诉讼即使最终不成立,也已经动摇了OpenAI绕开iPhone做硬件的算盘,所有盯着消费硬件的AI公司都该琢磨一下这个先例。

  3. IT之家(RSS)70

    彭博社揭秘苹果起诉 OpenAI 内幕:前员工一句“哈哈”成窃密关键

    苹果起诉 OpenAI,指控前工程师 Chang Liu 离职时带走未归还的 MacBook、一名可分享内情的员工,并利用软件漏洞持续访问苹果内网。他发现漏洞后向同事分享“哈哈,我发现我还能访问网络存储”,后者协助其获取更多机密。苹果称 OpenAI 试图复制 iPhone 产品研发体系,核心从非法窃取的商业机密腐烂。目前已有超 400 名苹果员工跳槽至 OpenAI,包括前苹果高管、现任 OpenAI 首席硬件官 Tang Tan。苹果曾于今年 2 月尝试私了,但 OpenAI 未回应。

    推荐理由:苹果起诉 OpenAI 窃取商业机密的细节曝光,前员工的“哈哈”短信成为关键证据,这场官司将决定 AI 硬件竞赛的玩法和边界。

  4. Sam Altman68

    OpenAI 发布 GPT-5.6 系列在医疗领域的评估结果。最小变体 GPT-5.6 Luna 在最低推理强度下即超越最高推理强度的 GPT-5.5,且成本低 25 倍;最大变体 GPT-5.6 Sol 树立新标杆。在涵盖患者端与临床端的多样化任务中,专科医生被要求以无限时间和网络访问权限撰写回答,随后由其他医生盲评。评估基于准确性、沟通、完整性、指令遵循及健康决策帮助性五个维度,共 20000 次评分。结果显示,所有 GPT-5.6 模型表现均显著优于医生,且医生发现 GPT-5.6 回答中的缺陷少于医生自己撰写的回答。

    引用Karan Singhal@thekaransinghal

    ♥️ GPT-5.6 是健康领域的一大进步,无论是在前沿性能还是在成本方面。 这些模型推动了每美元性能的前沿,将最佳的健康智能带给所有人。最小的变体 GPT-5.6 Luna,在最低推理努力下评估,其表现超过了在最高推理努力下的 GPT-5.5——尽管成本低 25 倍。最大的变体 GPT-5.6 Sol,在成本方面树立了新的高标准。 另一个特别酷的结果:医生在 GPT-5.6 的回答中发现的缺陷比医生撰写的回答更少。 我们收集了近期 OpenAI 模型仍然难以处理的各种任务,涵盖面向患者和面向临床医生的用例。我们请与专科匹配的医生在无限时间和网络访问的条件下为这些任务撰写回答。然后我们请其他医生在不知道来源的情况下并排比较回答。医生被要求从五个维度评论改进空间:准确性、沟通、完整性、指令遵循和健康决策帮助性。然后我们报告了在总共 20,000 次维度评分中,各来源回答在所有维度上被评为完美的比例。GPT-5.6 Sol 表现最强,尽管所有 GPT-5.6 模型的表现都显著优于医生。

    推荐理由:GPT-5.6 在医疗任务上被医生评价比真人医生缺陷更少, 这是AI辅助诊断的分水岭, 产品人和医疗从业者值得看具体数据。

7月11日周六
  1. Greg Brockman71

    GPT-5.6 用于健康智能,团队一直专注于这方面的改进: 整个产品线中,我们以更低成本提供更强性能:GPT-5.6 Luna 在最高推理设置下性能优于 GPT-5.5,而成本降低 25 倍。 这些进步共同提升了质量,同时让全球更多人能够使用先进模型。

    引用OpenAI@OpenAI

    GPT-5.6 是健康智能领域向前迈出的重要一步。 在整个产品线中,我们以更低的成本实现了更强的性能:GPT-5.6 Luna 在其最高推理设置下的表现优于 GPT-5.5,而成本却降低了 25 倍。 这些进步共同提升了质量,同时让全球更多人能够使用先进的模型。

    推荐理由:GPT-5.6 主打健康智能,虽然还没实测,但 25 倍的降本让高级推理不再是实验室专属,做医疗应用的可以提前评估切换成本了。

  2. PromptArmor:Threat Intelligence64

    PromptArmor 研究:Claude 与 ChatGPT 连接器持续变更带来治理风险

    PromptArmor 自 5 月中旬至 6 月底追踪 Claude 和 ChatGPT 的第三方连接器,发现 2517 个连接器中 931 个发生了能力或权限变更,新工具、权限范围、注入指令等在审批后持续漂移且缺乏重新确认机制。

    推荐理由:研究用一手监测数据量化了连接器审批后的能力漂移,读者可据此重新评估组织的连接器治理流程。

  3. OpenAI73

    GPT-5.6 是健康智能领域的一大进步。 在整个产品线中,我们以更低成本提供更强性能:GPT-5.6 Luna 在最高推理设置下性能优于 GPT-5.5,而成本降低 25 倍。 这些进步共同提升了质量,同时让全球更多人能够使用先进模型。

    推荐理由:GPT-5.6把性价比直接拉了个数量级,做健康AI的团队该重新算账了。但官方只扔了一句话,实际能力等实测再鼓掌。

  4. Noam Brown86

    OpenAI 的 GPT-5.6 Sol Ultra 模型成功证明了存在50年之久的 Cycle Double Cover Conjecture(圈双覆盖猜想)。该模型已于昨日全面开放,在不到一小时内使用64个子智能体(subagents)完成证明。Noam Brown 强调,与之前需要特殊条件的埃尔德什单位距离问题不同,此次成果基于当前可公开获取的模型,并已公开提示词和证明过程。

    引用Ethan Knight@__eknight__

    昨天,我们让 GPT-5.6 Sol Ultra 正式全面可用。今天,我们分享它使用 64 个子代理,在不到一小时内就给出了已有 50 年历史的 Cycle Double Cover 猜想的证明。我们在下面分享提示词和证明。我们很期待看到大家用 Ultra 做出什么!

    推荐理由:GPT-5.6 Sol Ultra 靠 64 个子智能体一小时证明了半世纪未解的数学猜想,这不再是刷 benchmark——这是 AI 首次在公开模型上做出真正的科学发现。做数学和理论物理的人该认真看看 prompt 和证明。

  5. Greg Brockman66

    OpenAI 联合创始人 Greg Brockman 宣布推出实验项目 Tend,这是一个开源提示词和代码仓库,可将收件箱、招聘流程或客服队列转化为可在 ChatGPT Work 中管理的 AI 循环系统。Tend 基于 GPT-5.6 构建,能自动扫描邮件、判断优先级、研究上下文并生成摘要和回复建议,用户可批准或编辑。每次处理后,智能体从用户修订中学习并记住偏好。Brockman 认为知识工作正从处理单个任务转向管理 AI 循环系统。

    引用Every 📧@every

    GPT-5.6 改变了我们对知识工作的看法。你的工作从处理单个任务转变为照看带有 AI 循环的系统。 在 @danshipper 的收件箱里,这看起来是这样的: GPT-5.6 扫过他的邮件,判断哪些值得他关注,研究相关背景,并为每封邮件附上简短摘要和拟好的回复。 Dan 批准、编辑,或者用 @usemonologue 口述他想改的地方。然后他就继续处理下一件事。 每轮扫查结束时,这个智能体会从 Dan 的修改和决定中学习,并记住它们,供下次使用。 今天我们发布 Tend,一个让你自己构建这类循环的实验。它是一个开源提示词和代码库,能把收件箱、招聘流程或客户支持队列变成你可以在 ChatGPT Work 中照看的系统。 先教 Tend 什么值得你关注。然后留意会发生什么:收件箱变得更轻松,指令变得更好,而你工作中的另一个循环也开始显现出来。

    推荐理由:Greg 强调知识工作正从处理单个任务转向「照料系统」,Tend 开源项目把这个想法变成了可用的工具。对想用 AI 重构工作流的产品人和开发者很有启发,虽然还只是个实验。

7月10日周五
  1. Greg Brockman65

    OpenAI高管Fidji Simo宣布因慢性疾病加重,辞去全职职务,转为兼职顾问。三个月前她因病情恶化休病假,意识到康复之路漫长复杂,需全力专注健康。她回顾自己曾因工作错过休整机会,包括拒绝Facebook提供的一年病假。她表示将继续通过OpenAI及ChronicleBioAI、CODA_research推动AI在疾病治疗等领域的应用。OpenAI联合创始人Greg Brockman发文感谢她的贡献,并祝愿她早日康复。

    引用Fidji Simo@fidjissimo

    今天,我告诉 OpenAI 团队,我决定离开 OpenAI 的全职岗位,转为兼职顾问。 三个月前,由于我患了七年的慢性病严重恶化,我不得不休病假。在那段时间里,我清楚地意识到,康复之路会比我预想的要漫长和复杂得多——我需要全身心投入其中。 当我休假时,很多人告诉我,我把健康放在首位是勇敢的。事实是,我现在才做出这个决定,是因为我以前很多次都没能做出这个决定。 这些年来,医生、朋友、同事和亲人都鼓励我放慢脚步。在我生病两年后,Facebook 给了我休整整一年病假的机会。我甚至没有停下来考虑一下。我立刻拒绝了。当时,Zuck 告诉我,我应该从长远考虑。我真希望我当时听了他的话。 回头看,我意识到,很多让我成功的东西,也让这个决定变得极其困难。 我从小相信机会是宝贵的,当机会出现时,你要用双手牢牢抓住。这种心态把我从法国南部的一个小镇带到了我从未想象过的机会面前。到我 40 岁时,我已经做到了远超我小时候在 Sète 长大时所能梦想的事情。 我热爱创造。我的工作一直给我一种深刻的目标感。尤其是 OpenAI,感觉像是我整个职业生涯一直在为之努力的角色,这让这个决定更加艰难。 但我现在学到的是,坚韧和耐力并不是产生数十年影响的唯一技能。有时候,更难的是停下来、倾听,并相信照顾好今天的自己,才能让你明天贡献得更久。 这段经历也让我更加坚信这项工作为什么重要。 白天帮助构建未来,同时又要应对一种仍然无法治愈的致残疾病,这是一种令人震撼的经历。 在过去七年里,我在医生办公室里度过了无数个小时,应对症状、治疗、保险、不确定性,以及作为一名患者所伴随的一切隐形工作。像数百万其他慢性病患者一样,我亲身经历了医疗体系有多么难以应对,即使你拥有所有可能的优势。 我比以往任何时候都更相信,AI 一些最重要的机会在于帮助人们解决日常生活中的真实问题:他们的健康、财务、时间,以及塑造人类体验的日常负担。 尤其是,治愈疾病是 AI 能够完成的最重要的事情。我很兴奋能继续通过 OpenAI,也通过我与 @ChronicleBioAI 和 @CODA_research 的工作,朝着治愈疾病努力。 我非常感谢 @sama、@gdb 和 OpenAI 董事会在这段时间里的支持,也感谢他们提供了一种方式,让我能够继续为使命做贡献,而不牺牲我康复的机会。我也非常感谢我的团队,以及我有幸与之并肩创造的许多杰出同事。 目前,我的重点是康复。但我对技术解决深刻人类问题的潜力的信念从未如此坚定。

    推荐理由:Fidji 是 OpenAI 运营背后的关键人物,她的离开不是一个普通的离职公告,而是高强度工作下人才健康消耗的真实信号,也把 AI 用于医疗的愿景推到了更个人化的层面。

  2. OpenAI Developers68

    将一个想法变成可发布和分享的实时网站 以下是OpenAI团队的一些成员用Sites构建的示例👇 @prd_008 用Sites将一个想法变成了个人专注应用:

    引用pranav@prd_008

    ChatGPT Sites 现已面向 Plus、Pro、Business 和 Enterprise 用户开放。支持网页、移动端和桌面端。 我利用新版 ChatGPT 中的 Sites 插件,把一个想法变成了一个个人待办事项应用。 以下是我构建它的过程。

    推荐理由:ChatGPT Sites 把建站门槛拉到一句话描述,我觉得这是 ChatGPT 从「聊完就忘」到「留下东西」的关键一步,但现阶段模板和分发都太简陋,产品人可以先尝鲜别急着押注。