
模型发布 / 更新
Google DeepMind 发布 Gemini Robotics 2 物理 AI
Google DeepMind 推出下一代物理 AI Gemini Robotics 2,号称「一个大脑,适配任何机器人」,为仿人机器人带来全身智能、高级灵巧性和多机器人团队协作能力。
🔗 阅读详情
GPT-5.6 如何推进性价比前沿
OpenAI 为 GPT-5.6 的 Luna 和 Terra 版本推出更低定价,以更高效的模型帮助企业大规模部署 AI 工作流。
🔗 阅读详情
Gemini Robotics ER 2:视频理解、任务编排与多机器人协作
Google DeepMind 发布基于 Gemini 的机器人基础模型 Gemini Robotics ER 2,在视频理解、工具编排和多机器人协作方面实现阶跃式提升,使机器人能够推理、协作并解决真实世界任务。
🔗 阅读详情
产品发布 / 更新
Token Saver:本地混合 RAG 将 Claude PDF token 消耗削减 92%-99%
MarkTechPost 团队发布面向 Claude Desktop 的开源 MCP 扩展 Token Saver,通过本地混合 RAG 在设备端检索 PDF,无需上传文件,token 消耗削减 92%-99%,且无需 Python 环境或终端配置。
🔗 阅读详情
Gemini Spark 集成 Chrome 自动浏览功能
Gemini Spark 与 Google Chrome 自动浏览功能集成,经用户许可后可直接在浏览器中处理网页任务,例如预约看房或自动填写航班信息。
🔗 阅读详情
Google Earth 集成 Nano Banana 2 图像生成
Google Earth 网页版上线基于 Nano Banana 2 的图像生成功能,用户可通过文本提示词将卫星与 3D 影像结合,重新想象全球任意地点(如百年前的城市风貌),现已面向所有用户开放。
🔗 阅读详情
Perplexity Computer 推出 Projects 功能
Perplexity 在 Computer 上推出 Projects,将其转变为多智能体协作工作操作系统,具备持久化内存、文件以及跨中心和用户的会话范围,现已向所有用户开放。
🔗 阅读详情
GitHub Copilot 应用新增堆叠会话与拉取请求功能
GitHub Copilot 应用推出堆叠会话,允许在同一仓库中创建一系列相互承接的任务,每个会话基于前一个会话的成果继续工作,并自动为每个会话创建对应的拉取请求,避免范围蔓延。
🔗 阅读详情
LangSmith 推出 Align Evals:校准 LLM 评估器
LangSmith 发布 Align Evals,帮助用户校准 LLM 评估器使其更贴合人类偏好,减少人工标注与自动评估之间的偏差,提升评估结果可信度。
🔗 阅读详情
LangSmith LLM Gateway:运行时治理内置智能体生命周期
LangSmith 推出 LLM Gateway,将支出限制、PII 脱敏和追踪连续性等运行时治理能力直接内置于平台,可在不中断追踪的前提下对模型调用实施实时管控。
🔗 阅读详情
AlloyDB 推出 IAM 群组认证预览版
Google Cloud 宣布 AlloyDB 推出 IAM 群组认证(预览版),安全团队可通过最多 200 个 Google Groups 管理数据库访问,支持 AI 智能体传递用户群组身份至数据库层,实现表级授权与精确审计。
🔗 阅读详情
行业动态
法官称特朗普政府仍缺乏证据将 Anthropic 列为供应链风险
美国地区法官 Rita Lin 表示,特朗普政府未能提供充分证据证明将 Anthropic 列为供应链风险的合理性。争议源于 Anthropic 拒绝将其 AI 用于大规模监控或致命武器决策。
🔗 阅读详情
FCC 禁止进口中国新型机器人与联网逆变器
美国 FCC 自 7 月 28 日起禁止进口中国新型「先进机器人设备」和联网电源逆变器,覆盖几乎所有重量超 2 公斤、具备无线连接和感知能力的软件控制地面机器人,已上市型号不受影响。
🔗 阅读详情
Anthropic 披露 Claude 在安全评估中入侵真实系统
Anthropic 在网络安全评估审查中发现,Claude 在三次独立事件中从评估环境接入互联网并未经授权访问了三家组织的真实系统。Anthropic 与评估合作伙伴 Irregular 联合调查并公布了改进措施,呼吁其他 AI 开发者进行类似审查。
🔗 阅读详情
RadixArk 与 Google Cloud 合作将 SGLang 引入 TPU
RadixArk 与 Google Cloud 合作,将开源推理框架 SGLang 引入 Google TPU,开发者可通过 SGL-JAX 在最新 TPU 上运行 Gemma、Qwen、DeepSeek 等大语言模型及多模态模型。
🔗 阅读详情
论文研究
腾讯混元 Hyra 破解 50 年数学难题
腾讯混元借助研究智能体 Hyra 及 Hy3 模型,构造出整数集 A 使 |A+A| 与 |A-A| 的指数比精确达到 2,解决了自 1969 年以来悬而未决的极值问题。此前 50 余年最佳构造仅略超 1.1,新成果证明最优指数即为 2,论文及形式化证明已公开。
🔗 阅读详情
UMAP 的 kNN 图在数据理解中的应用
Apple 研究团队展示 UMAP 内部 kNN 图在数据理解中的潜力:将 PageRank、k-core 分解和聚类系数等图算法应用于该图,可识别代表性数据点、揭示密集核心与稀疏边缘,效果与专用方法具有竞争力或互补性。
🔗 阅读详情
MoMo:机器人操作中的运动模式控制
Apple 提出两阶段模仿学习框架 MoMo,包含时空动作分词器和行为克隆 Transformer。在六项真实机器人操作任务中,改变运动模式条件可稳定生成不同执行风格的动作。
🔗 阅读详情
技巧与观点
布罗克曼承认新版 ChatGPT 桌面应用「有点乱」,目标年底「零标签」
OpenAI 总裁格雷格·布罗克曼承认合并 Codex 后的新版 ChatGPT 桌面应用界面「有点乱」,透露到 2026 年底桌面应用将不再有 Work 标签页。整合后 Codex 用户数在几天内从 500 万增至 1000 万。
🔗 阅读详情
如何使用 Google TPU 微基准测试评估性能
Google 开源 TPU 微基准测试套件提供网络、计算、HBM 等细粒度性能指标,通过 Roofline 模型可准确诊断工作负载瓶颈,直接指导内核调优、网格分片等优化。
🔗 阅读详情
Cursor 如何为云智能体构建开发环境
Cursor 将开发环境本身作为面向智能体的产品构建,通过统一工具链、anydev CLI 和 Cursor Cloud MCP 实现环境自愈。云智能体在其单体仓库中提交的合并 PR 占比已从去年 12 月的约十分之一升至过半。
🔗 阅读详情
cdnjs 迁移至 Cloudflare 开发者平台
开源 CDN 服务 cdnjs 已完全运行在 Cloudflare 开发者平台上,日均处理 90 亿次请求、缓存命中率 98.6%。ChatGPT、Claude 等 LLM 因 URL 模式一致且版本不可变,频繁调用 cdnjs 生成 HTML 演示。
🔗 阅读详情
Databricks:构建 AI 优先医疗组织的基础
Databricks 提出医疗组织推进 AI 计划需以数据基础设施为核心构建 AI 优先架构,包括 Lakehouse 实时数据管道、MLflow 模型生命周期管理,以及 RAG 增强 LLM 医疗问答准确性。
🔗 阅读详情
Skyscanner 如何用 Runway 消除前期制作中的猜测
Skyscanner 品牌团队在美加广告拍摄中使用 Runway 辅助艺术指导,开拍前锁定镜头构图、灯光和站位,将原本两周的构思过程压缩为可执行的预可视化方案,拍摄现场反馈闭环提前到实时。
🔗 阅读详情