模型关键词检索结果

单个神经元足以绕过大型语言模型中的安全对齐

A Single Neuron Is Sufficient to Bypass Safety Alignment in Large Language Models

语言模型中的安全对齐通过两个机制上不同的系统进行操作:拒绝神经元(控制是否表达有害知识)和概念神经元(编码有害知识本身)。通过针对每个系统中的单个神经元,我们在跨越两个系列和 1.7B 到 70B 参数的七个模型中展示了两个方向的失败——通过抑制绕过对明确有害请求的安全性,并通过放大从无辜提示中诱导有害内容,而无需任何训练或提示工程。我们的研究结果表明安全调整......

Google 的新 AI 模型生成整个文本,而不是逐字生成

Новая ИИ-модель Google генерирует текст целиком, а не слово за словом

DiffusionGemma 将整个段落创建为“噪声”,并依次产生所需的外观,其工作方式与图像生成系统类似。

信息论和集成模型

Information Theory and Ensemble Models

我们应该如何更好地集成时间序列预测?《信息论和集成模型》一文首先出现在《走向数据科学》上。

测量计量经济模型的结构稳定性

Measuring Structure Stability of Econometric Models

时间序列预测最简单最重要的想法计量经济模型的结构稳定性后测量首先出现在走向数据科学上。

NVIDIA 和 Hugging Face 为乐机器人打造开放机器人社区带来新模型和框架

NVIDIA and Hugging Face Bring New Models and Frameworks to LeRobot for the Open Robotics Community

新的 LeRobot 集成使开发人员可以开放访问 NVIDIA Isaac GR00T 1.7、Isaac Teleop、数据集和机器人工作流程,而 NVIDIA Cosmos 3 集成计划将前沿世界模型引入开放式机器人开发。

NVIDIA 和 Hugging Face 为乐机器人打造开放机器人社区带来新模型和框架

NVIDIA and Hugging Face Bring New Models and Frameworks to LeRobot for the Open Robotics Community

开源 AI 展示了当模型、数据和工具共享时,开发人员可以多么快速地进行创新。机器人技术也有同样的机会,但物理人工智能开发的进步仍然受到昂贵且分散的资源的限制,从大型数据集和机器人基础模型到模拟、计算和验证工具。 NVIDIA 和 Hugging Face 是 [...]

独立宏观经济共识预测如何增强您的 IFRS 9 ECL 模型

How Independent Macroeconomic Consensus Forecasts Strengthen Your IFRS 9 ECL Model

IFRS 9 生效后,它从根本上改变了金融机构对信用损失的看法。旧模型是向后看的:你为已经发生的损失准备了准备金。 IFRS 9 引入了前瞻性要求。机构现在必须根据经济发展方向来估计预期信用损失,而不仅仅是经济发展方向。《独立宏观经济共识预测如何加强您的 IFRS 9 ECL 模型》一文首先出现在 FocusEconomics 上。

气候模型显示厄尔尼诺现象正在迅速加强

Climate Models Show El Niño Is Rapidly Strengthening

世界气象组织表示,强烈的厄尔尼诺现象可能会导致许多地区出现极端天气。

比较雨滴形成的机器学习模型

Comparing Machine Learning Models of Raindrop Formation

The simplest model, based on polynomials, yields the best performance.

长上下文与短上下文模型:长上下文模型何时获胜?

Long Context vs. Short Context Model: When Does a Long Context Model Win?

平衡上下文能力与成本、速度和数据后篇《长上下文与短上下文模型:长上下文模型何时获胜?首先出现在《走向数据科学》上。

用 Estes Liberty Star 模型火箭庆祝美国成立 250 周年

Celebrate 250 years of America with the Estes Liberty Star model rocket

模型火箭主打产品 Estes 为庆祝独立日 250 周年设计了一款限量版模型火箭,以红、白、蓝三色装饰。适合展示或发射。

神话传说的寓言:美国特设的人工智能模型控制可以帮助中国

Fable of the Mythos saga: Ad hoc US AI model controls could help China

自 COVID-19 以来,出口管制、进口禁令的激增和关键零部件的短缺使供应链弹性成为企业和政府的首要战略关注点。两个组织都花费了数十亿美元来确定供应链薄弱环节、储备投入并使供应商多样化,以便价值数万美元的汽车不再因为缺少微芯片而半成品。正是考虑到这些担忧和内心的瓶颈记忆,高管和政府官员正在努力解决他们可以在多大程度上依赖人工智能的问题(……

残余上下文扩散语言模型

Residual Context Diffusion Language Models

扩散大型语言模型 (dLLM) 已成为纯自回归语言模型的有前途的替代方案,因为它们可以并行解码多个标记。然而,最先进的分块 dLLM 依赖于“重新屏蔽”机制,该机制仅解码最有信心的令牌并丢弃其余令牌,从而有效地浪费了计算。我们证明,从丢弃的令牌中回收计算是有益的,因为这些令牌保留了对后续解码迭代有用的上下文信息。有鉴于此,我们提出了残余上下文扩散(RCD),该模块......

学习扩散语言模型的揭露策略

Learning Unmasking Policies for Diffusion Language Models

扩散(大型)语言模型 (dLLM) 现在在许多任务上与自回归模型的下游性能相匹配,同时有望在推理过程中提高效率。 dLLM 的一个关键设计方面是采样程序,该程序选择在每个扩散步骤中揭开哪些标记。事实上,最近的工作发现,与随机揭露相比,置信度阈值等启发式策略可以提高样本质量和令牌吞吐量。然而,这种启发式方法也有缺点:它们需要手动调整,而且我们观察到它们的性能......

在 AWS GovCloud(美国)的 Amazon Bedrock 上运行 NVIDIA Nemotron 和 OpenAI GPT OSS 模型

Run NVIDIA Nemotron and OpenAI GPT OSS models on Amazon Bedrock in AWS GovCloud (US)

我们很高兴在 AWS GovCloud(美国)中引入基于美国的前沿开放权重模型。通过此版本,Amazon Bedrock 现在支持 OpenAI 的开放权重 GPT OSS 模型(120B 和 20B)和 NVIDIA Nemotron(Nano 9B v2、Nano 12B v2、Nano 30B、Super 120B)模型。在这篇文章中,我们将介绍这些模型及其功能、数据驻留的推理选项、可用的服务层以及如何开始。

GenAI.mil 拥有近 170 万用户,计划添加新模型

GenAI.mil records almost 1.7M users, plans new model additions

“对于该部门的生成式人工智能来说,这是一个非常激动人心的时刻,”五角大楼首席人工智能官说。

BorderPlus 通过培训优先的医疗保健移动模型规划全球扩张

BorderPlus maps out global expansion with training-first healthcare mobility model

由 upGrad 联合创始人 Mayank Kumar 联合创立的 BorderPlus 正在扩大其在德国、海湾合作委员会和日本的业务,其长期目标市场包括英国、美国、加拿大、澳大利亚、新西兰、意大利、法国和韩国。BorderPlus 规划了以培训为先的医疗保健移动模式的全球扩张计划,该文章首先出现在 The PIE News 上。

人工智能加速了宇宙替代模型的测试......但有一个“但是”

ИИ ускорил проверку альтернативных моделей Вселенной... но есть одно «но»

研究人员发现,迁移学习可以显着降低宇宙学模拟的成本,但也带来了一定的风险。