
模型发布/更新
阿里发布 Qwen-UI-Agent,主打让模型真正“会用”每一块屏幕
阿里巴巴正式推出 Qwen-UI-Agent,一个以真实世界为中心的 GUI 智能体基座模型,覆盖移动端、电脑端、网页端及深度搜索(DeepSearch)环境。
🔗 阅读详情
Hugging Face 发布 LFM2.5 系列 DSpark 草稿模型,推理速度最高提升 3.18 倍
Hugging Face 发布 LFM2.5 系列三款模型的 DSpark 草稿模型检查点,通过投机解码在不改变输出质量的前提下,GPU 吞吐最高提升 3.18 倍,端侧最高 2.87 倍。草稿模型约 300M 参数,LFM2.5-2.6B 函数调用延迟平均降低 57%,已开源支持 llama.cpp 和 SGLang。
🔗 阅读详情
产品发布/更新
Mistral 推出 Agentic Search:多步检索提升 AI 系统复杂文档查询准确率
Mistral 发布 Agentic Search,通过 search、open、navigate、read、grep 五工具的多步检索循环,让模型在长文档与多来源中查找、定位并验证信息。
🔗 阅读详情
AlloyDB ScaNN 如何将向量搜索扩展到 100 亿向量
AlloyDB 的 ScaNN 索引现已支持超过 100 亿向量的规模,通过全新的四层树架构(预览版)实现,将查询复杂度从 O(N^1/2) 降至 O(N^1/4)。内部测试中,该架构在 100 亿向量规模下可实现 p95 延迟不超过 51 毫秒、召回率达 95%。
🔗 阅读详情
Claude Platform 正式上线 Computer Use、Skills API 与 Files API,新增浏览器操作工具
Anthropic 宣布 Computer Use、Skills API 与 Files API 在 Claude Platform 全面可用,并新增浏览器操作工具,让智能体可操作软件、调用团队技能并返程成品文件。
🔗 阅读详情
Anthropic 如何开展 AI 教学
Anthropic 发布 Claude Academy,为全球数百万用户提供 AI 教学资源,帮助其安全、有效地使用 AI。该学院课程借鉴其内部员工培训方法,包括 4D AI Fluency Framework 及“ever-boarding”持续学习项目,并强调以问题为中心、培养持久思维模式而非特定操作行为。
🔗 阅读详情
Mooncake 如何为 Miles 强化学习系统实现高效批量 Rollout 数据传输
大规模 LLM 强化学习采用解耦架构后,rollout 数据从推理侧到训练侧的传输成为瓶颈。Mooncake 针对 Miles 系统中异构、碎片化的 rollout 数据,通过批量 I/O 优化实现高效传输。
🔗 阅读详情
Claude Code v2.1.238 发布:新增 readline 键位、插件市场 headersHelper 与多项 Remote Control 修复
Claude Code v2.1.238 发布,新增 keybindingFlavor 设置(可设为 readline 使 Ctrl+W 删除至前一个空白符),并为插件市场引入 headersHelper 以生成 HTTP 头。
🔗 阅读详情
Claude Code v2.1.237 发布:修复 LLM 网关提示词缓存,新增“简洁”输出风格
Claude Code v2.1.237 修复了使用 LLM 网关或自定义 base URL 的会话中的提示词缓存问题,并新增内置“简洁”输出风格。该风格下 Claude 直接给出结果,跳过开场白和叙述,但工作完成度不变。
🔗 阅读详情
LangSmith 预构建:如何在合并前测试智能体变更
LangSmith 预构建让团队在合并智能体变更前,于临时的、类生产环境的部署中测试拉取请求分支。该功能旨在降低变更上线风险,使智能体改动验证更贴近真实运行条件。
🔗 阅读详情
行业动态
消息称 OpenAI 首席财务官告知员工:公司最迟将于 2027 年上市
OpenAI 首席财务官萨拉·弗里亚尔在全员大会上告知员工,公司最迟将于 2027 年完成上市,若业务持续向好也可能更早。OpenAI 已于 6 月秘密提交 IPO 招股书,本季度整体年化营收增长 35%,企业级业务年化营收增长 50%,AI 编程与办公产品周活跃用户突破 2000 万。
🔗 阅读详情
论文研究
数据受限下的多语言知识迁移:Apple 提出基于词干预的新方法
Apple 研究团队提出一种基于词干预的多语言知识迁移方法,旨在解决低资源语言训练数据不足时,模型难以从高资源语言获取科学推理、常识推理和世界知识的问题。该方法无需大量平行语料、翻译系统或辅助模型。
🔗 阅读详情
数据约束下的混合预训练缩放定律
苹果机器学习研究团队通过 2000 余次语言模型训练实验,系统研究了稀缺目标数据与通用数据混合预训练中的权衡问题。研究发现,目标数据占比过低会导致模型对目标领域暴露不足,而占比过高则因重复样本过多引发收益递减乃至过拟合。
🔗 阅读详情
技巧与观点
Claude Code 初创公司指南:五大规则与创始人洞见
Anthropic 发布面向初创公司的 Claude Code 使用指南,基于对十余家高增长公司的调研,总结出“人人皆可交付、自动化繁琐工作、信任但验证、为重构而构建、原型-自用-产品化”五大规则。
🔗 阅读详情
OpenAI 推出 AI Futures 博客,探讨自由社会如何应对变革性 AI
OpenAI 新设 Strategic Futures 团队并推出博客 AI Futures,核心问题是自由社会应如何重构以在变革性 AI 出现时保障个人权利与自主权。团队认为,自主系统和机器智能的进步可能使国家无需依赖人力即可投射力量、征收税款并自动化官僚体系。
🔗 阅读详情
Leopold 的愚:一个年轻人如何象征一个时代
作者以“空头支票”式骗局为类比,指出生成式 AI 行业存在类似循环融资的投机成分。文章认为这些债务能否偿付高度不确定,可能最终带来数万亿美元利润,也可能落空。
🔗 阅读详情
共和党因与大型科技公司关系陷入恐慌
共和党正因与大型科技公司的关系而陷入恐慌,原因是他们意识到大型AI议程在美国民众中极不受欢迎。特朗普已从反对AI监管转向强烈鼓励对前沿AI模型进行自愿预检测试。
🔗 阅读详情