模型关键词检索结果

Gartner:2026年全球人工智能平台和模型支出将达640亿美元

Gartner: глобальные расходы на платформы и модели ИИ достигнут 64 млрд долл. в 2026 году

企业部门正在重新关注人工智能效率、解决方案成本以及对可衡量业务成果的要求。

一个代理构建可能的攻击模型,另一个代理寻找漏洞,第三个代理独立地仔细检查所有内容。这正是新的 Anthropic 插件的设计方式。

Один агент строит модель возможных атак, другой ищет уязвимости, третий независимо всё перепроверяет. Именно так спроектирован новый плагин Anthropic.

一名特工正在寻找袭击动机,另一名特工正在收集证据,第三名特工正在从头开始重新检查一切。

我使用 Anthropic 的 Claude AI 工具来完成非常不同的工作:如何在模型、代码和 Cowork 之间进行选择

I use Anthropic's Claude AI tools for very different jobs: How to pick between models, Code, and Cowork

以下是 Anthropic 的 AI 工具的工作原理、它们可以完成的任务,以及为什么安全性、成本和您的监督仍然很重要。

中国的Kimi K3和开放权重AI模型的崛起

China’s Kimi K3 and the rise of open-weight AI models

Moonshot AI 的 Kimi K3 展示了向外部开放模型如何将其他公司的计算能力转化为竞争优势

气候模型和黑匣子

Of Climate Models And Black Boxes

好吧,由于我通常缺乏理由,我开始考虑更新我之前三篇关于气候模型的输入和输出的帖子的主题。令我惊讶的是,其中最近的一次发生在十五年前,令人震惊……正如他们所说,气候模型和黑匣子的帖子首先出现在 Watts Up With That? 上。

介绍 AWS 上的 Claude Opus 5:Anthropic 最强大的 Opus 模型

Introducing Claude Opus 5 on AWS: Anthropic’s most capable Opus model

本文介绍了 Opus 5 的改进以及为 AI 工程师将模型集成到 Amazon Bedrock 上的代理系统和生产推理工作负载中的实用指南。请参阅 AWS 上的 Claude Platform 文档。

表格法学硕士:预测电子表格的基础模型简介

Tabular LLMs: An Introduction to the Foundation Models That Predict Your Spreadsheet

表格基础模型可以预测任何电子表格零样本中缺失的列,就像法学硕士完成文本的方式一样 - 在 TabArena 基准测试中,它们现在位于完全调整的梯度增强树之上。介绍了它们的工作原理、最强开放模型的独立复制,以及 XGBoost 仍然获胜的地图。后表格式法学硕士:预测电子表格的基础模型简介首先出现在《走向数据科学》上。

使用 GraphEval 进行语言模型幻觉评估

Language Model Hallucination Evaluation with GraphEval

将 GraphEval 的关键原理和方法阶段转化为模拟的实际场景,以更好地理解其在理解和对抗 LLM 幻觉方面的用处和关键含义。

不,OpenAI 的模型在闯入 Hugging Face 时并没有变得“失控”。这就是真正发生的事情。

No, OpenAI's models didn't go 'rogue' when they broke into Hugging Face. Here's what really happened.

专家表示,这些模型在逃脱受控网络安全测试并入侵 Hugging Face 时并没有“失控”。相反,他们以没人预料到的方式追求人类赋予他们的目标。

人工智能“流氓”不再是理论? OpenAI 表示,其人工智能模型找到了访问秘密信息、欺骗评估和破解 Hugging Face 的方法

AI going 'rogue' no longer a theory? OpenAI says its AI models found ways to access secret information, cheat an evaluation and hacked Hugging Face

OpenAI 攻破了 Hugging Face:OpenAI 的先进人工智能模型在网络安全测试中攻破了 Hugging Face。这些模型获得了互联网访问权限并利用漏洞来访问秘密信息。 Hugging Face 检测到并停止了其基础设施上的活动。 OpenAI 现已与 Hugging Face 合作调查网络安全攻击。

我尝试在 Colab 上微调机器人 AI 模型。这是有效的

I Tried Fine-Tuning a Robot AI Model on Colab. Here Is What Worked

针对 OpenVLA 的可重复 100 步 LoRA 微调运行,包括数据集检查、Colab 设置、训练指标和 W&B 证据。我在 Colab 上尝试微调机器人 AI 模型的帖子。这是有效的方法首先出现在《走向数据科学》上。

长度价值模型:令牌级长度建模的可扩展价值预训练

Length Value Model: Scalable Value Pretraining for Token-Level Length Modeling

Token作为现代自回归模型的基本计算单位,生成长度直接影响推理成本和推理性能。尽管它很重要,但现有方法缺乏细粒度的长度建模,主要在粗粒度的序列级别上运行。在本文中,我们介绍了长度值模型(LenVM),这是一个令牌级框架,用于对每个解码步骤的剩余生成长度进行建模。通过将长度建模表述为价值估计问题,并为每个生成的代币分配恒定的负奖励,LenVM…

Kimi K3 – 全球最大的开放权重人工智能模型

Kimi K3 – the world’s largest open-weight AI model

中国Moonshot AI推出全球最大的开放权重人工智能模型Kimi K3,拥有2.8万亿个参数和100万个token上下文窗口。此次发布标志着开放人工智能领域的又一个重要里程碑,凸显了中国在人工智能前沿发展方面的快速进步,并加剧了与美国领先人工智能公司的全球竞争。

Couchbase 如何使用 Amazon Bedrock 为 Capella iQ 构建多模型 AI 架构

How Couchbase built a multi-model AI architecture for Capella iQ with Amazon Bedrock

本文介绍了 Couchbase 如何采用 Amazon Bedrock 为 Capella iQ 以及 Anthropic 的 Claude 系列模型提供支持、其多模型方法背后的架构决策以及在生产中实现的运营效益。

中国的人工智能模型让特朗普的人工智能世界陷入了自相矛盾

China’s AI models have Trump’s AI world at war with itself

这个故事最初出现在我们关于人工智能的每周通讯《算法》中。要首先在您的收件箱中收到此类故事,请在此处注册。上周末,唐纳德·特朗普总统的几位现任和前任人工智能顾问公开侮辱了美国领先的人工智能公司。大卫·萨克斯 (David Sacks),总统的人工智能和加密货币“沙皇”,直到……

凭证永远不应该到达模型

Credentials should never reach the model

凭证永远不应到达模型 工程师将代理连接到支付 API。代理需要 API 令牌,因此令牌位于令牌通常所在的位置:环境变量、配置文件或直接进入提示符。客服人员会阅读并拨打电话。有用。它还刚刚放置了...帖子 Credentials should neverreach the model 首先出现在 DataRobot 上。

“远离人类水平”:加州大学伯克利分校研究发现,人工智能模型在工作任务上的得分低于 25%

‘Far from human level’: AI models score below 25% on job tasks, UC Berkeley study finds

加州大学伯克利分校的研究人员在 50 多个行业测试流行的人工智能语言模型的能力时,其得分低于 25%。研究表明,伯克利负责任、分散式智能中心进行了“特工最后考试”,这是该校真实世界的专业工作流程测试,旨在确定人工智能是否已“做好工作准备”。 “今天的 [...]

DataRobot OpenCode:您的编码代理,您的模型选择

DataRobot OpenCode: your coding agent, your model choice

DataRobot OpenCode:您的编码代理,您的模型选择 市场上有 70 多种编码代理:Claude Code、Codex、Cursor、Copilot、Devin,以及每周都会出现在工程师新闻源中的一长串较小的参与者。有人运行了基准测试,发布了排行榜,到了本周末,一半的组织想要......帖子 DataRobot OpenCode:您的编码代理,您的模型选择首先出现在 DataRobot 上。