亚马逊AWS官方博客
宣布推出由 NVIDIA RTX PRO 4500 Blackwell 服务器版 GPU 加速的 Amazon EC2 G7 实例
今天,我们宣布 Amazon Elastic Compute Cloud(Amazon EC2) G7 实例正 […]
Amazon ECS 引入新的高分辨率指标,以实现服务快速自动扩缩
Amazon Elastic Container Service(Amazon ECS)服务自动扩缩可通过全面的扩展策略自动调整任务数量来满足工作负载需求,这些策略包括针对周期性流量的预测性扩展、针对计划活动的计划扩展,以及基于实时指标动态扩展的目标跟踪。
750B MoE 模型从自建 RoCE 集群迁移至 AWS EFA:Prefill-Decode 分离推理的通信架构验证
客户在自建机房使用基于 ConnectX 系列网卡的 RoCE 集群运行 GLM-5.1-FP8(750B MoE)模型推理服务,采用 Prefill-Decode (PD) 分离架构:2 台 Prefill 节点 + 2 台 Decode 节点,每台 8×H200 GPU。期望利用 AWS 弹性算力扩展本地 GPU 计算资源,同时获得更快的硬件迭代能力,从而降低硬件采购和折旧风险。AWS EFA 能否在这种极端复杂的通信负载下,达到 ConnectX 系列 + RoCE 方案的性能水平?我们基于客户的实际部署需求进行了完整的理论分析和实际验证
2026 年纽约 AWS Summit 的热门公告
今天在纽约市 AWS Summit 上,AWS 代理式人工智能副总裁 Swami Sivasubramanian 发表了当天的主题演讲。
基于 Serverless 构建 Kiro 企业用量费用分摊与自动化报告方案
利用 AWS Serverless架构实现 Kiro 费用的自动化采集、用户级分摊、CSV 报告生成,并通过飞书 Webhook 推送可视化摘要卡片。
Bedrock Claude + LiteLLM WebSearch Interception 配置指南
WebSearch Interception 是 LiteLLM 的一个功能,允许不原生支持 web search 的 LLM provider(如 AWS Bedrock、Azure、Vertex AI)通过 LiteLLM 代理自动执行网页搜索并返回带有实时信息的回答。
推出 Amazon Bedrock Managed Knowledge Base,助力企业人工智能应用程序更快速、更准确
今日,我们正式推出 Amazon Bedrock Managed Knowledge Base,这套拥有全新功能的产品可让开发人员在数分钟内,依托企业自己的专有数据搭建企业级生成式人工智能应用程序。构建代理式人工智能应用程序的组织需要安全、可靠且最新的企业级数据访问,以交付准确、快速且可信的结果。Managed Knowledge Base 简化构建、管理检索增强生成(RAG)管道的复杂流程,让开发人员可专注业务成果落地,无需投入精力管理基础设施。
发布 Amazon Bedrock AgentCore Web 搜索功能:为人工智能代理提供实时、准确的网络知识支撑
今日,我们正式宣布 Amazon Bedrock AgentCore Web 搜索功能全面可用。这是一款完全托管的工具,使代理能够在客户安全的 AWS 环境中零数据输出的情况下,根据当前引用的 Web 知识进行响应。
通过 AWS Transform 持续现代化(预览版)自动主动减少技术债务
今日,我们正式推出 AWS Transform 持续现代化(预览版),这是 AWS Transform 的全新功能,可大规模、自动化、持续开展技术债务分析和修复工作。AWS Transform 现已助力企业完成数据中心迁出、大型机与 Windows 应用程序现代化改造,同时处理各类标准化软件维护工作:升级 Java 版本、替换已废弃框架、在 AWS Lambda 运行时生命周期结束前完成更新。此次全新体验在此基础上进一步扩展。客户可全面查看数千个存储库的代码库现状、按优先级排序的调查发现,以及用于完成修复的拉取请求。
AWS Security Agent 增加威胁建模、Kiro 能力包、Claude Code 插件及更多功能
自预览版本发布以来,我们已推出按需渗透测试和完整存储库代码审核的预览版,可对整个代码库执行深入、具备上下文感知的安全分析。如今,我们基于客户反馈推出更多功能:代码审核更新(预览版)、威胁建模(预览版),Kiro 能力包、Claude Code 插件和 MCP 集成





