跳到正文
FunCoding

搜索

搜索文档、Skill 和 MCP

AI 周报 · 2026 年第 34 周 · 8月17日 – 8月23日

AI 基础设施与安全并进

17 条

推理基础设施整合与算力扩张

OpenRouter 与 Stripe 合并,每日处理超 10 万亿 token,成为 AI 推理分发的重要枢纽。NVIDIA 与 SB Energy 合作锁定电力容量,为 OpenAI 等提供算力支持,凸显能源在 AI 扩张中的关键作用。同时,LMSYS 等团队优化推理性能,降低服务成本。

  • OpenRouter 宣布加入 Stripe

    OpenRouter 宣布与 Stripe 合并,以加速推动全球经济增长。OpenRouter 目前每日处理来自 400 多个 AI 模型的 10+ 万亿 token,服务超 1000 万开发者与公司,自成立以来推理量每年至少增长 10 倍。合并后 OpenRouter 将继续以原名、原使命独立运营,产品与路线图不变,路由决策仍以用户利益为先,交易预计在未来数周内完成。

    OpenRouter:Announcements(RSS)

  • NVIDIA 与 SB Energy 合作锁定俄亥俄州 PORTS-Pike 园区电力容量,OpenAI 将入驻

    NVIDIA 宣布与 SB Energy 合作,锁定俄亥俄州 PORTS-Pike 科技园区的电力容量(LPS)以独家部署 NVIDIA 算力,OpenAI 将成为租户。

    NVIDIA Blog(RSS)

  • 突破 DeepSeek-V4-Pro 服务极限:H20 上的多场景优化方法

    LMSYS 团队针对 1.6 万亿参数的 MoE 模型 DeepSeek-V4-Pro,在 H20 GPU 上通过场景化服务配置逼近 B300 性能。单节点 H20-141GB 参考实现达 271 output tokens/s,与 B300 的 383.7 tokens/s 性能差距缩小至 1.42×。

    LMSYS Blog

开源模型性能逼近闭源旗舰

GLM-5.3 与 Qwen3.8-27B 等开源模型在性能上逼近甚至超越闭源旗舰,同时成本更低。GLM-5.3 在 AA 智能指数中与闭源旗舰同级,Qwen3.8-27B 登顶智能指数。开源生态的繁荣得益于 NVIDIA 等公司的资助,但基础模型训练门槛升高,社区兴趣转向微调。

  • GLM-5.3 上线:AA 智能指数 60 分并列开源第一,成本更低

    GLM-5.3 API 即日上线,擅长复杂编码、防御性网络安全与长程任务,在 AA 综合智能指数中取得 60 分,与 Claude Fable 5、GPT-5.6 Sol 等闭源旗舰同级,并与 Kimi K3 并列开源模型第一。该模型以更小参数规模和更低调用成本降低前沿智能门槛,单任务成本为旗舰模型中最低。API 定价与 GLM-5.2 持平,模型权重将于下周五开源。

    公众号:智谱(GLM)

  • 笔记本模型也能媲美云端前沿模型:Qwen3.8-27B 登顶智能指数

    作者将 Qwen3.8-27B 装入智能体后表现优异,该模型在 Artificial Analysis 智能指数中排名 135 款模型之首,得分 52,超过 Z.ai 的 753B 参数开源模型 GLM-5.2(51 分)。

    Tomasz Tunguz 博客(VC 分析)

  • 开源模型生态的未来:Nvidia 押注“教所有人炼 token”

    开源模型生态正日益依赖 Nvidia 的资助,其已投入 260 亿美元推动近乎开源的模型开发,以扩大推理芯片需求。若此路径不奏效,开源模型将转向效率、可修改性等长尾场景,与闭源模型分化。同时,基础模型训练门槛升高,开源社区兴趣正从全量训练转向对 DeepSeek V4 Flash、GLM 5.X 等模型的微调。

    Nathan Lambert:Interconnects(RSS)

AI 安全与治理成为焦点

  • OpenAI 在“关键网络能力”时代放缓模型开发节奏

    OpenAI 因 OpenAI-Hugging Face 事件及即将推出的 Astra 模型可能达到《预备框架》下的“关键网络安全能力”阈值,暂时放缓了模型扩展速度,包括暂停最新部署模型的强化学习训练两周,并搁置最大规模前沿 RL 运行。公司已加强研究环境安全,要求对 Astra 及网络相关负载实施最严格防护,并扩展思维链监控,采用多阶段激活分类器检测机制。

    OpenAI:官网动态(RSS · 排除企业/客户案例)

  • OpenAI 启动新计划,强化国家安全领域 AI 的民主监督

    OpenAI 启动新计划,帮助民主监督机构发展专业能力与工具,以理解和监督政府将 AI 用于国家安全。未来一年,OpenAI 将提供 500 万美元用于培训、技术支持和 OpenAI 积分,并与监督机构试点工具,帮助授权审查员检查 AI 辅助政府决策的相关记录。OpenAI 强调 AI 应增强而非取代人类判断,且不承担对政府的监督角色。

    OpenAI:官网动态(RSS · 排除企业/客户案例)

  • OpenAI 推出 ChatGPT for Teens:面向青少年的学习体验与更强安全保护

    OpenAI 发布 ChatGPT for Teens,为 13-17 岁用户自动启用,内置更强安全保护与家长控制。新增 Study Mode、负责任作业提醒、测验与学习可视化,以及可设定默认开启时段的 Study Hours,引导青少年分步解题而非直接给答案。OpenAI 同时宣布与 CodeAI 合作,帮助青少年理解、质疑并创造性地使用 AI。

    OpenAI:官网动态(RSS · 排除企业/客户案例)

AI 应用深入垂直领域

AI 在科学、设计、教育等垂直领域加速落地。Claude 在蛋白质设计中表现优异,Google 推出 PhotoScan 用于健康评估,Runway 辅助体育场馆设计,Google 搜索推出 AI 学习工具。这些应用展示了 AI 从通用对话向专业任务的延伸。

  • Claude 如何加速蛋白质设计与分析化学研究

    Anthropic 公布两项实验:Claude(Mythos Preview 和 Opus 4.8)针对 15 个靶点设计蛋白质结合剂,成功 14 个,命中率达 22.6%-35.1%。

    Anthropic:Research(发表成果 · 网页)

  • PhotoScan:用智能手机照片估算胰岛素抵抗,精度接近 DXA

    Google Research 推出 PhotoScan,一种从智能手机 2D 照片直接估算三维身体成分的深度学习框架,可预测胰岛素抵抗,在临床研究中精度接近 DXA 扫描。

    Google Research:Blog(网页)

  • Populous 如何用 Runway 呈现全球标志性场馆设计

    全球设计公司 Populous 高级建筑师 Georgina Myers 介绍团队用 Runway 辅助体育场馆概念设计:过去完整视频需外部渲染团队至少三周,且提交前两周须冻结设计模型;如今 Runway 能生成传达尺度感的完整渲染和航拍图,将视觉制作时间缩短,让设计师把时间还给设计本身。该工具已用于利雅得 MBS 体育场等中东项目,支持 9 种不同活动模式的场景迭代。

    Runway:News(网页)

  • Google 搜索推出 5 项 AI 学习工具

    Google 在搜索中推出 5 项 AI 学习工具。AI Mode 的生成式 UI 已全球上线英文版,支持交互式可视化与自定义模拟;练习测验现已在 AI Overviews 和 AI Mode 中免费提供英文版,覆盖 ACT、SAT 等标准化考试。

    Google Blog:AI(RSS)

智能体开发与工具链成熟

智能体开发工具链日益成熟,从支付、监控到安全框架均有新进展。AgentCore 提供支付中间件,OpenRouter 推出 Activity 仪表盘,Google 开源零信任智能体示例。企业应用案例显示智能体已进入生产环境,如 ABC Legal 部署 50 多个智能体。

数据来自 AIHOT,标题和摘要由 AI 根据原文生成,细节以原文为准。