Accessing OpenAI models on Amazon Bedrock from Australia with global cross-Region inference
澳大利亚团队现在可以访问 Amazon Bedrock 上的 OpenAI GPT-5.6 Sol、Terra 和 Luna 模型,并通过亚太地区(悉尼)和亚太地区(墨尔本)进行全球跨区域推理。本文展示了如何调用模型、使用提示缓存、使用 OpenID Connect 身份验证设置 Codex 以及使用 Amazon CloudWatch 监控使用情况。
How an AWS team detects dashboard content failures at scale using Amazon Bedrock
即使每个基础设施监视器都报告运行状况良好,商业智能仪表板也可能会悄无声息地发生故障,显示空白、过时或错误的数据。了解 AWS 团队如何在 Amazon Bedrock 上构建由 AI 驱动的自动化内容验证解决方案,该解决方案可扫描数百个仪表板并向所有者发出警报,从而将平均检测时间从几天缩短到一个小时以内。
How t54 built a trust layer with Amazon Bedrock AgentCore payments
t54 构建了 x402-secure,这是 Amazon Bedrock AgentCore 支付上的信任层,可在自主代理付款之前对每个端点进行评分。了解会话预算、凭证隔离和确定性信任门如何在无人参与的情况下管理超过 2000 万个代理发起的交易。
How ZS democratized secure ad-hoc analytics with Amazon SageMaker
了解 ZS 如何构建安全强化的 Amazon SageMaker 平台,在开发人员敏捷性与医疗保健级治理之间取得平衡,为 200 多个 SageMaker 域中的 1,000 多名日常活跃用户提供服务。
Securing Amazon Quick from POC to production: Agents, Flows, and Spaces
当安全团队审查生产计划时,Amazon 快速概念验证项目通常会陷入停滞。这篇文章将介绍如何设计仪表板、空间、知识库、代理和流程,以及在扩展时保持安全控制的流程:数据集整形、代理隔离、文档分类和审批门。
Connect an AgentCore Runtime hosted MCP server to Amazon Quick
在本文中,您将了解如何在 AgentCore Runtime 中部署和托管 MCP 服务器并将其与 Amazon Quick 集成以及先决条件。通过这种模式,您可以提高 AI 工具的可重用性并避免重复,因此客户端可以重用通过 MCP 服务器公开的常用工具和代理,而不是再次从头开始编写它们。您的客户可以在 Amazon Quick(聊天代理和工作流程)中使用您的产品,而无需为每个用例构建自定义连接器。
本文在 Amazon Bedrock 托管知识库和 Amazon Bedrock AgentCore 上构建了企业代理检索解决方案。代理进行推理、跨多个知识库进行路由并返回引用的答案,具有七层可观察性以及按需和持续评估,所有这些都通过单个 AWS CloudFormation 链进行部署。
Reduce ASR inference costs by 75% with NVIDIA MPS on Amazon EC2
当每个请求仅使用 GPU 的一小部分时,大规模提供自动语音识别 (ASR) 模型的成本高昂。了解 Amazon EC2 GPU 实例上的 NVIDIA CUDA 多进程服务 (MPS) 与 NVIDIA Triton 推理服务器如何将 GPU 基础设施削减 75%,同时将亚秒级延迟保持在每个 GPU 每秒 92.1 个请求。
Batch write and discover records in Amazon SageMaker Feature Store
Amazon SageMaker Feature Store 现在支持两个新 API:BatchWriteRecord 在一次调用中跨多个功能组写入最多 25 条记录,ListRecords 枚举功能组内的记录标识符。在这篇文章中,我们将通过可用于入门的代码示例来介绍每个 API。
Build agentic creative workflows with Amazon Quick and fal
创意团队生产的资产比以往任何时候都多,但分散的工具和手动上下文传输会减慢生产速度。本文展示了如何使用 Amazon Quick 和 fal 构建可重复使用的代理工具,并通过模型上下文协议 (MCP) 连接,并使用两个实践工作流程:八面板故事板和音乐视频概念原型。
Deepgram deepens Amazon SageMaker AI observability with Enhanced Metrics
自托管语音 AI 需要进行可观察性权衡:驱动容量规划和成本管理的数字被锁定在供应商容器内。 Deepgram 通过两项功能缩小了 Amazon SageMaker AI 的这一差距,这些功能可将计费、使用情况和每个 GPU 指标直接存入您自己的 Amazon CloudWatch 账户中。
Natera’s intelligent appointment scheduling with Amazon Bedrock AgentCore
了解Natera如何在Amazon Bedrock AgentCore上构建自动语音代理,让患者通过自然对话预约移动抽血服务。文章涵盖了双WebSocket桥接、事件驱动延迟掩蔽和渐进信任机制。
How GoDaddy transformed its analytics with Amazon Quick
在这篇文章中,您将了解GoDaddy如何从传统的商业智能(BI)工具迁移到Amazon Quick。这是一项为期两年的转型,在业务的各个方面都取得了成果:每年节省15,000小时,减少50%
Connect Amazon Bedrock AgentCore to cross-account knowledge bases
了解Amazon Bedrock AgentCore代理如何从一个账户中从另一个账户由Amazon Redshift Serverless支持的Amazon Bedrock知识库生成答案,而无需复制源数据。本文涵盖架构、安全边界……
Governed reports with Amazon Quick Desktop and Amazon FSx for NetApp ONTAP
使用Amazon Quick Desktop和Amazon FSx for NetApp ONTAP构建受治理的每周报告工作流。Amazon S3接入点将批准文件夹暴露给Quick知识库,自定义技能生成带引用的每周报告和Slack摘要。
Introducing cross-Region inference for OpenAI GPT-5.6 models on Amazon Bedrock
Amazon Bedrock 现已在超过 25 个 AWS 区域提供具有跨区域推理功能的 OpenAI GPT-5.6 模型(Sol、Terra 和 Luna)。了解美国地理和全球推理配置文件如何路由更高吞吐量的请求、如何使用 OpenAI 和 Converse API 调用模型,以及如何配置 IAM、配额和监控。
医疗保健、零售和生命科学团队在 Snowflake 中存储大量运营数据,但将其转化为预测非常困难。在本系列的第 1 部分中,您将使用 Amazon SageMaker Canvas 设置 AWS 账户和 Snowflake 环境以实现无代码 ML 工作流程,为无需编写代码即可构建欺诈检测模型奠定基础。