GRPO Beyond English: A Large-Scale Study of GRPO in Non-English and Multilingual Settings
带可验证奖励的强化学习 (RLVR) 通常通过组相对策略优化 (GRPO) 进行优化,已成为提高预训练语言模型推理能力的核心方法,但目前的研究仍然主要以英语为中心。我们对多语言和非英语 GRPO 进行了大规模的实证研究,涉及广泛的基础模型、训练语言和不同的推理语言奖励。我们发现,母语推理训练通常与英语推理训练差距很小。我们进一步观察到强...
When AI art has no author: Study finds generated images often can’t be traced to training data
一种从模型中彻底删除训练示例的新方法表明,随着数据集的增长,模型学习内容与其生成内容之间的联系消失。
Turns Out, AI Has a Herd Instinct. It’s Even More Pronounced in Stronger AIs
人工智能代理会自发地遵循多数(群体)意见——并且更智能的模型会更强烈地做到这一点。
NVIDIA Nemotron 3.5 Lightning now available in Amazon SageMaker JumpStart
NVIDIA Nemotron 3.5 Lightning 是一种专为大容量代理工作负载而构建的开放模型,现已在 Amazon SageMaker JumpStart 中提供。本文介绍了如何部署 30B 专家混合模型(3B 主动),该模型可为始终在线的代理提供高达 4 倍的吞吐量和高达 30% 的任务完成速度。
What’s an Orchestrator—and Why Does Software Need One?
以下文章最初发表在 Medium 上,经作者许可在此重新发布。每个人都在谈论开发商的死亡。我得到它。负责编写样板或支架 CRUD 应用程序的开发人员已经完成了,模型可以在几秒钟内完成此任务,并且该开发人员不会回来。但是 [...]
Serve Launches Robot Delivery with Wonder, Adding Grubhub to Its Growing Delivery Network
- 扩展到圣何塞和华盛顿特区,迈阿密的创新微型仓库,为商家提供的新硬件产品,以及新的广告服务,所有这些都提高了车队利用率 - 新型医院机器人 Moxi 2.0,处理能力提高了 15 倍,标志着新机器人世界模型的推出
Diligent Robotics, a Serve Robotics Company, Begins Rolling Out Moxi 2.0
下一代硬件和人工智能可提供更快、更可靠的医院物流,并标志着新机器人世界模型的推出
Feeding our books into generative AI risks creating a cultural void
当我们将文学、游戏和电影放入人工智能模型时,我们面临着用自动生成的作品的大杂烩取代我们的文化历史的风险。专栏作家安娜莉·纽维茨 (Annalee Newitz) 表示,我们迫切需要保护人类文字
NVIDIA opens Alpamayo 2 Super for commercial use
NVIDIA 刚刚免费提供了最强大的自动驾驶 AI,供任何人使用。 Alpamayo 2 Super 将多模态感知、推理、轨迹规划和动作生成结合在一个模型中,同时还生成可用于训练和评估其他自动驾驶系统的数据。
Потребление китайских LLM в России выросло более чем в 11 раз
MWS云分析了俄罗斯企业对中国大语言模型的消费情况。 2026年上半年的消费量比2025年全年高出11倍多。
Building agentic workflows with SageMaker AI and Bedrock AgentCore
了解如何将 Amazon SageMaker AI 上与 OpenAI 兼容的终端节点与 Amazon Bedrock AgentCore 运行时相结合,以构建多代理工作流程,其中每个专业代理都使用最适合其工作的模型。这篇文章还展示了如何从 Strands Agent 默认情况下不检测的 SageMaker 端点获取令牌级别的可观测性。
Custom reward functions for multi-turn reinforcement learning with Amazon Nova Forge
在多轮强化学习中,您的自定义奖励函数决定模型实际学习的内容。这篇文章展示了如何为 Amazon Nova Forge 设计复合多轮奖励,在其中安全地执行模型生成的代码,并检测每个组件以捕获悄悄崩溃奖励的陷阱。
在一场具有里程碑意义的拍卖中,法拉利首款电动汽车 2026 款 Ferrari Luce 拍出了惊人的 4000 万美元成交价,开创了慈善拍卖的新先例。这款独特的模型被认为是首款量产底盘,远远超出了预期,并将有助于法拉利基金会的举措。幸运的买家将在返回马拉内罗后等待 2027 年初交付,这标志着法拉利电动之旅的关键篇章。
滚动报道最新经济新闻,美国以 2001 年以来最高的借贷成本出售 30 年期债券 安迪·伯纳姆 (Andy Burnham) 计划削减新的电动汽车销售目标 保险公司 Aviva 表示,它正在帮助受西米德兰兹斯托布里奇 (Stourbridge) 附近野火影响的客户,但据我的同事乔安娜·帕特里奇 (Joanna Partridge) 报道,火灾对公司来说“并不重要”。 Aviva 首席执行官阿曼达·布兰克 (Amanda Blanc) 告诉记者,公司一直在与客户保持联系“以确保他们有替代住宿”,他补充道:“对于那些房屋被火灾摧毁的客户来说,这绝对是可怕的。”“从长远来看,我们总是在关注风险管理的
问:马蒂,我看到在线消息来源 - 视频、评论和人工智能表示,“苏格拉底模型预测纸质衍生品市场将崩溃,并明确警告投资者,随着实物短缺加剧和主权债务危机升级,交易所的纸质现货价格将与实物金属现实完全脱节。”我订阅了苏格拉底并观看了你所有的采访并[...]
Learning analytics won’t close awarding gaps. Better teaching will.
作者:David Mather 大学在了解奖励差距方面投入了大量资金。我们比以往任何时候都更了解学生群体之间的差异结果。我们拥有先进的学习分析平台、越来越准确的预测模型,并且对我们识别能力的信心不断增强……继续阅读 →
Bringing an AI Fluency Program to Kids Globally with Dr. Taniya Mishra, CEO @ SureStart
我们如何超越基线人工智能素养,为下一代提供真正的人工智能流畅性、能动性和自我效能?在本期《教育趋势》中,主持人 Mike Palmer 与 SureStart 创始人兼首席执行官 Taniya Mishra 博士坐下来探讨导师主导的人工智能教育如何帮助全球年轻人从被动用户转变为自信的创造者。 Mishra 博士凭借其 12 多年的工业人工智能研究员经验,分享了 SureStart 如何通过同行指导、模块化课程和分层的人工智能学习方法(从中学词汇到氛围编码和构建小语言模型)来揭开技术的神秘面纱。关键见解和讨论要点💡 SureStart 的核心 — 近同伴指导:如何将中/高中生与近同伴导师(研究生
Rogue hacking AIs have changed the cybersecurity landscape
没有技术技能的攻击者现在可以使用人工智能模型快速查找和利用漏洞,并且可以大规模部署这些漏洞,这引发了人们的担忧,即没有大量网络防御预算的组织将更容易受到攻击