推理关键词检索结果

通过全球跨区域推理访问澳大利亚 Amazon Bedrock 上的 OpenAI 模型

Accessing OpenAI models on Amazon Bedrock from Australia with global cross-Region inference

澳大利亚团队现在可以访问 Amazon Bedrock 上的 OpenAI GPT-5.6 Sol、Terra 和 Luna 模型,并通过亚太地区(悉尼)和亚太地区(墨尔本)进行全球跨区域推理。本文展示了如何调用模型、使用提示缓存、使用 OpenID Connect 身份验证设置 Codex 以及使用 Amazon CloudWatch 监控使用情况。

通过 DSpark 推测解码加速 LLM 推理

Speed Up LLM Inference with DSpark Speculative Decoding

了解 DSpark 推测解码如何使用相同的 GPU、Qwen3-8B、llama.cpp 和 CUDA 来提高本地 LLM 生成速度。

利用 Amazon EC2 上的 NVIDIA MPS 将 ASR 推理成本降低 75%

Reduce ASR inference costs by 75% with NVIDIA MPS on Amazon EC2

当每个请求仅使用 GPU 的一小部分时,大规模提供自动语音识别 (ASR) 模型的成本高昂。了解 Amazon EC2 GPU 实例上的 NVIDIA CUDA 多进程服务 (MPS) 与 NVIDIA Triton 推理服务器如何将 GPU 基础设施削减 75%,同时将亚秒级延迟保持在每个 GPU 每秒 92.1 个请求。

新型 AI 使用全新的推理方法 — 研究人员表示,其运行成本比领先的 OpenAI 模型低 11 倍

New kind of AI uses a fresh approach to reasoning —‬ researchers say it costs up to 11 times less to run than a leading OpenAI model

科学家表示,一种新的基于矢量的认知方法比标准方法便宜得多,这标志着人工智能模型“后变形金刚”时代的开始。

超越视觉CoT:面向主动视频推理的内化视觉思维

Beyond Visual CoT: Internalized Visual Thinking for Proactive Video Reasoning

多模态大语言模型越来越多地使用视觉思维链 (Visual CoT) 来推理空间、时间和具体环境。通过生成中间推理图像,Visual CoT 为视觉预见提供了直观的机制,但引入了大量的推理开销,这对于主动视频推理来说尤其成问题。我们询问模型是否可以在训练过程中学会视觉思考,同时在推理时直接进行推理。我们引入内部化视觉思维(IVT),这是一种联合优化文本预测和……的训练后框架。

引入 Amazon Bedrock 上 OpenAI GPT-5.6 模型的跨区域推理

Introducing cross-Region inference for OpenAI GPT-5.6 models on Amazon Bedrock

Amazon Bedrock 现已在超过 25 个 AWS 区域提供具有跨区域推理功能的 OpenAI GPT-5.6 模型(Sol、Terra 和 Luna)。了解美国地理和全球推理配置文件如何路由更高吞吐量的请求、如何使用 OpenAI 和 Converse API 调用模型,以及如何配置 IAM、配额和监控。

AMD 打算加速并降低推理成本

В AMD намерены ускорить и удешевить логические выводы

已签署收购加拿大专用人工智能芯片开发商 Taalas 的最终协议。

科学人工智能需要推理,而不仅仅是数据

AI for science needs reasoning, not just data

每隔几十年,就会有人宣布科学已经走到了尽头。 1903 年,受人尊敬的物理学家阿尔伯特·迈克尔逊 (Albert Michelson) 写道,“物理科学的事实都已被发现”。 20世纪80年代,史蒂芬·霍金预言理论物理学可能会在本世纪末完成。随着人工智能的爆炸性到来,......

从头开始​​构建推理法学硕士:GRPO、RoPE 和预训练的完整指南。

Build a Reasoning LLM from Scratch: A Complete Guide to GRPO, RoPE & Pretraining.

使用 GRPO、RoPE 和现代变压器构建推理法学硕士。帖子从头开始构建推理法学硕士:GRPO、RoPE 和预训练的完整指南。首先出现在Spritle软件上。

Amazon Bedrock 中自动推理策略的代理技能

Agent Skills for Automated Reasoning policies in Amazon Bedrock

了解如何从编码代理运行完整的 Amazon Bedrock Automated Reasoning 策略生命周期。一套开源代理技能套件可以端到端地构建、审查、测试、调试、部署和验证自定义策略,将专门的控制台任务转变为可重复的工程工作流程。

套利:通过优势感知投机进行有效推理

Arbitrage: Efficient Reasoning via Advantage-Aware Speculation

Error 500 (Server Error)!!1500.That’s an error.There was an error. Please try again later.That’s all we know.

减少 LLM 工作流程中推理延迟的 7 种方法

7 Approaches to Reduce Inference Latency in Your LLM Workflows

从量化到推测解码,这里有七种工程策略,可以在生产中交付更快、响应更灵敏的生成式 AI 应用程序。

2027 年到来的这一群人不会像你面前的那群人那样推理。大学准备好了吗?

The cohort arriving in 2027 will not reason like the one in front of you. Are universities ready?

加入 HEPI,参加 2026 年招生轮次之前于 2026 年 8 月 11 日 11:00-12:00 举办的“对话”网络研讨会,由 UCAS 首席执行官 Jo Saxton CBE 博士主讲。在与 Nick Hillman OBE 的讨论中,随后进行现场问答,会议将探讨影响今年招生周期的关键问题以及它们对 […]这篇文章的意义。 2027 年入学的学生不会像你面前的学生那样推理。大学准备好了吗?首先出现在 HEPI 上。

Amazon Bedrock 中的自动推理策略细化

Automated Reasoning policy refinement in Amazon Bedrock

内曼与费舍尔的因果推理

Neyman vs Fisher on causal inference

每天,您都会看到诸如新药显示没有效应器研究发现政策没有效果的证据之类的头条新闻。他们听起来很有结论。它们听起来很科学。但令人不安的现实是,科学家们甚至没有就“没有影响”的实际含义达成一致。这并不是一场关于统计公式的晦涩争议。这是统计学史上最有影响力的两位人物——罗纳德·费舍尔爵士和杰西·内曼之间深刻的哲学分歧。他们的[...]

系统帮助人类预测自动驾驶汽车何时会犯错误

System helps humans predict when self-driving cars will make mistakes

一种名为 CW-Net 的新方法将自动驾驶汽车人工智能系统的推理过程转化为可理解的概念来解释其行为。

主流经济学并不难。是垃圾!

Mainstream economics is not difficult. It is garbage!

具有“分析性”和“逻辑性”是大多数人认为值得称赞的品质。这些话带有积极的含义。人们认为科学家比大多数人思考得更深入,因为他们采用“逻辑”和“分析”方法。字典通常将逻辑定义为“根据严格的有效性原则进行或评估的推理”,将“分析”定义为涉及“打破[...]

机器能变得真正有意识吗?

Could a Machine Ever Become Truly Conscious?

机器能感受到疼痛、享受音乐或拥有自己对世界的私人体验吗?随着人工智能在对话、推理和解决问题方面变得越来越出色,曾经仅限于科幻小说的问题正在引起科学界的严肃关注。这一挑战始于一个基本谜团:科学家仍然不知道人类为何有意识。 […]这篇文章机器能变得真正有意识吗?首先出现在 Knowridge 科学报告上。