AI 快讯 编译自 aws_ml_blog #模型发布#政府云#数据合规

AWS GovCloud 上线 NVIDIA Nemotron 和 OpenAI GPT OSS 开源模型,满足美国政府数据驻留与合规需求

AWS 宣布在 GovCloud (US) 区域推出 NVIDIA Nemotron 和 OpenAI GPT OSS 系列开源模型,支持 1M token 上下文窗口和零操作员访问推理架构,满足 FedRAMP High、ITAR 等合规要求。本文详解模型能力、推理选项及如何上手。

编译发布 2026/07/01 原文发布 2026/07/01

一句话看懂

AWS 在 GovCloud (US) 区域上线 NVIDIA Nemotron 和 OpenAI GPT OSS 开源模型,为美国政府机构提供符合数据驻留和合规要求的生成式 AI 推理能力。

详细发生了什么

AWS 宣布在 AWS GovCloud (US) 区域推出两款新的开源权重模型系列:NVIDIA Nemotron 和 OpenAI GPT OSS。这些模型通过 Amazon Bedrock 托管服务提供,推理完全运行在 AWS 运营的基础设施上,位于美国境内并由美国公民管理。

NVIDIA Nemotron 系列包括:Nemotron 3 Super 120B(1200 亿参数,混合专家架构,每 token 仅激活 12B 参数,支持 1M token 上下文窗口)和 Nemotron 3 Nano 30B(300 亿参数,每 token 激活约 3B 参数,同样支持 1M token 上下文窗口)。OpenAI GPT OSS 系列提供 gpt-oss-120b(1200 亿参数)和 gpt-oss-20b(200 亿参数)两个模型,均支持 128K token 上下文窗口和最多 16K 输出 token。

这些模型可用于智能分析、任务规划、合同审查、安全日志分析和合规自动化等场景。推理支持 In-Region(us-gov-west-1)和 Geographic Cross-Region 两种选项,确保数据留在美国境内。

中文圈视角

虽然 AWS GovCloud (US) 主要面向美国政府机构,但对中文圈用户仍有参考价值:

  1. 国产替代对比:国内云厂商如阿里云、华为云也提供类似合规区域(如政务云),但模型生态相对封闭。AWS 此次引入 OpenAI 和 NVIDIA 的开源模型,展示了在严格合规环境下如何平衡模型能力与数据安全。国内政务 AI 部署可借鉴其“零操作员访问”架构和模型透明性要求。

  2. 对中文用户的实际影响:对于有跨境业务的中国企业(如出海游戏、金融科技),若需处理美国用户数据或满足当地合规,可参考此方案。但注意,GovCloud 区域不对非美国政府实体开放,普通中文用户无法直接使用。

  3. 盲点:中文社区较少讨论政府云场景下的开源模型部署。此次发布强调了开源权重的透明性(允许组织独立评估模型架构),这对国内信创环境下的模型选型有启发意义。

几条值得记住的细节

  • NVIDIA Nemotron 3 Super 120B 采用 MoE 架构,每 token 仅激活 12B 参数,吞吐量是上一代的 5 倍。
  • OpenAI GPT OSS 模型提供 128K token 上下文窗口,输出最多 16K token。
  • 推理引擎采用零操作员访问设计,AWS、客户或模型提供商均无法访问推理提示或补全。
  • In-Region 推理仅在 us-gov-west-1 可用,Cross-Region 推理覆盖整个 GovCloud 区域。
  • 可通过 OpenAI 兼容的 bedrock-mantle 端点或 AWS SDK 的 bedrock-runtime 端点调用模型。

一句话总结

如果你需要在美国合规环境下部署生成式 AI,AWS GovCloud 上的 Nemotron 和 GPT OSS 模型提供了兼顾性能与安全的选择。