跳到正文
北京时间

全部动态

今日 154 条
1月21日周二
  1. Modal 官方工程博客(RSS)65

    Modal Sandboxes 正式可用,为不可信代码提供安全执行环境

    Modal 宣布 Sandboxes 正式可用,这是安全运行 LLM、用户或第三方来源不可信代码的隔离执行环境。它提供 exec API,可在运行时用与 Functions 相同的 Image API 动态配置任意语言依赖,支持文件系统快照以持久化和多 Sandbox 扇出,并复用 Functions 基础设施带来快速冷启动、GPU 和全球区域选择。

    推荐理由:Modal 官方宣布 Sandboxes 正式可用,给出 exec API、动态镜像和 SWE-bench 7 分钟跑完 Verified 等实测数字,可据此评估智能体代码执行方案。

12月10日周二
  1. Cognition 模型 / Devin 博客(网页)73

    Cognition 宣布 Devin 正式全面开放使用

    Cognition 宣布 Devin 正式全面可用,无席位限制,所有工程团队可在 app.devin.ai 开始使用,并提供 Slack 集成、IDE 扩展(VSCode 及分支,Beta)和 API,以及 Cognition 工程团队的 onboarding 支持。

    推荐理由:官方宣布 Devin 全面开放并给出适用任务、使用建议和多个开源 PR 实例,读者可据此评估如何把 Devin 接入自己的工程流程。

7月25日周四
  1. DeepSeek:API 更新日志62

    DeepSeek API 更新:/chat/completions 新增 JSON 输出、Function 调用与 8K 最长输出(Beta)

    DeepSeek 更新 /chat/completions 接口,新增 JSON 输出、Function 调用、对话前缀续写(Beta)及 8K 最长输出(Beta)。同时新增 /completions 接口,支持 FIM 补全(Beta)。

    推荐理由:DeepSeek API 这次更新补上了 Function calling 和 JSON 模式,加上 FIM 补全,让开发者的工具调用和代码补全场景有了更完整的方案,虽然都是 Beta 但方向很对。

7月3日周三
  1. 通义 QwenAudio:原创语音项目61

    SenseVoice 开源语音理解模型仓库:支持 ASR、情感识别与音频事件检测

    SenseVoice 是一个语音理解基础模型,支持 ASR、语种识别、语音情感识别和音频事件检测。发布的 SenseVoiceSmall 检查点支持普通话、粤语、英语、日语和韩语,并输出情感与事件标签;采用非自回归端到端架构,同参数量级下推理速度比 Whisper-Small 快 5 倍以上、比 Whisper-Large 快 15 倍以上。

    推荐理由:官方仓库文档同时给出基准对比、部署路径和微调方案,读者可以据此评估 SenseVoice 在中英文语音识别场景的可用性。

6月12日周三
  1. Suno:Blog(网页)55

    Audio Inputs——通过 Mikey Shulman(联合创始人兼 CEO)发布·2024 年 6 月 12 日,用任何声音创作一首歌 产品更新

    Suno 发布 Audio Inputs 功能,所有 Pro 和 Premier 用户可上传或录制 6-60 秒的音频片段,通过“Extend”模式选择起始时间戳、设定风格,并可添加歌词来创作歌曲。社区创作者已用其提供自定义音频引子来设定氛围、节奏和乐器灵感。该功能会阻止受版权保护作品的上传,且所有包含人声的输入将保持私密并不可搜索。

    推荐理由:Suno 把上传录音做歌的门槛降到极低,对音乐创作者和普通用户都友好,只是这已经是前年的更新,之后的同类功能可能更完善。

8月9日周三
  1. LangChain:Blog(RSS)61

    LangChain 与 Airbyte 集成:让数据摄取达到生产级就绪

    LangChain 与 Airbyte 的集成方案旨在将检索应用扩展至生产环境。该方案通过调度、文本拆分和 50 多种嵌入模型实现数据摄取自动化,帮助开发者构建可规模化的生产级数据管道。

    推荐理由:Airbyte 目标端把调度、切分与嵌入选项接入 LangChain,让数据源到 RAG 索引的更新由手动脚本转为可配置流程。