OpenAI 攻破了 Hugging Face:OpenAI 的先进人工智能模型在网络安全测试中攻破了 Hugging Face。这些模型获得了互联网访问权限并利用漏洞来访问秘密信息。 Hugging Face 检测到并停止了其基础设施上的活动。 OpenAI 现已与 Hugging Face 合作调查网络安全攻击。
I Tried Fine-Tuning a Robot AI Model on Colab. Here Is What Worked
针对 OpenVLA 的可重复 100 步 LoRA 微调运行,包括数据集检查、Colab 设置、训练指标和 W&B 证据。我在 Colab 上尝试微调机器人 AI 模型的帖子。这是有效的方法首先出现在《走向数据科学》上。
Length Value Model: Scalable Value Pretraining for Token-Level Length Modeling
Token作为现代自回归模型的基本计算单位,生成长度直接影响推理成本和推理性能。尽管它很重要,但现有方法缺乏细粒度的长度建模,主要在粗粒度的序列级别上运行。在本文中,我们介绍了长度值模型(LenVM),这是一个令牌级框架,用于对每个解码步骤的剩余生成长度进行建模。通过将长度建模表述为价值估计问题,并为每个生成的代币分配恒定的负奖励,LenVM…
Kimi K3 – the world’s largest open-weight AI model
中国Moonshot AI推出全球最大的开放权重人工智能模型Kimi K3,拥有2.8万亿个参数和100万个token上下文窗口。此次发布标志着开放人工智能领域的又一个重要里程碑,凸显了中国在人工智能前沿发展方面的快速进步,并加剧了与美国领先人工智能公司的全球竞争。
How Couchbase built a multi-model AI architecture for Capella iQ with Amazon Bedrock
本文介绍了 Couchbase 如何采用 Amazon Bedrock 为 Capella iQ 以及 Anthropic 的 Claude 系列模型提供支持、其多模型方法背后的架构决策以及在生产中实现的运营效益。
China’s AI models have Trump’s AI world at war with itself
这个故事最初出现在我们关于人工智能的每周通讯《算法》中。要首先在您的收件箱中收到此类故事,请在此处注册。上周末,唐纳德·特朗普总统的几位现任和前任人工智能顾问公开侮辱了美国领先的人工智能公司。大卫·萨克斯 (David Sacks),总统的人工智能和加密货币“沙皇”,直到……
Credentials should never reach the model
凭证永远不应到达模型 工程师将代理连接到支付 API。代理需要 API 令牌,因此令牌位于令牌通常所在的位置:环境变量、配置文件或直接进入提示符。客服人员会阅读并拨打电话。有用。它还刚刚放置了...帖子 Credentials should neverreach the model 首先出现在 DataRobot 上。
‘Far from human level’: AI models score below 25% on job tasks, UC Berkeley study finds
加州大学伯克利分校的研究人员在 50 多个行业测试流行的人工智能语言模型的能力时,其得分低于 25%。研究表明,伯克利负责任、分散式智能中心进行了“特工最后考试”,这是该校真实世界的专业工作流程测试,旨在确定人工智能是否已“做好工作准备”。 “今天的 [...]
DataRobot OpenCode: your coding agent, your model choice
DataRobot OpenCode:您的编码代理,您的模型选择 市场上有 70 多种编码代理:Claude Code、Codex、Cursor、Copilot、Devin,以及每周都会出现在工程师新闻源中的一长串较小的参与者。有人运行了基准测试,发布了排行榜,到了本周末,一半的组织想要......帖子 DataRobot OpenCode:您的编码代理,您的模型选择首先出现在 DataRobot 上。
A better way to turn 2D designs into 3D models for rapid prototyping
研究人员开发了一个自动化框架,可以帮助 AI 模型更准确、更高效地生成 CAD 程序。
企业文档智能 [Vol.1 #7quinquies] - 幻觉通常是垃圾。修复检索,模型就没有什么可弥补的了大多数 RAG 幻觉都是检索失败:检索砖如何决定模型可以发明什么,该帖子首先出现在《走向数据科学》上。
Meet GPT-Red: an LLM super-hacker OpenAI built to make its models safer
OpenAI 构建了一个名为 GPT-Red 的 LLM 超级黑客,将其用作陪练伙伴,帮助其其他模型增强对网络攻击的防御能力。上周该公司发布了其旗舰 LLM 的最新版本 GPT-5.6。 OpenAI 表示,针对 GPT-Red 进行训练使该模型成为迄今为止最强大的版本。 GPT-Red 自动化...
Helping AI models to meet the real world
通过研究和创业,Devavrat Shah 教授正在帮助设计能够使用有限的计算资源处理持续决策的方法。
Publication: The structural interdependencies of industries: An agent-based model
我们开发了一个基于代理的库存流一致宏观经济模型,涉及多个行业并支持...
War Department Changes Cybersecurity Maturity Model Certification Requirements
陆军部宣布暂停原定于 11 月生效的网络安全成熟度模型认证第二阶段要求,并对整个 CMMC 计划启动全面审查。
Building Models in Two Worlds: From Latent Constructs to Behavioral Signals
我的博士模型试图解释人们参与的原因。我的行业模型预测了谁会这么做。统计数据几乎没有变化。他们周围的一切都是如此。《在两个世界中构建模型:从潜在构造到行为信号》一文首先出现在《走向数据科学》上。