高质量的关键词检索结果

从偏好到原则:基于量规的基础知识答案对齐

From Preferences to Principles: Rubric-Based Alignment for Grounded Knowledge Answers

为开放域问答设计有效的奖励信号具有挑战性,因为高质量的响应必须同时满足答案质量的多个方面,而这些方面很难用整体标量目标来捕获。我们引入了一个基于评分标准的奖励框架,该框架根据检索到的证据生成特定于查询的评分标准,并分解为多个质量维度,从而在训练后提供细粒度的监督。对三个评估轴(构图、基础和遵循指令)进行平均,我们的方法改进了......

埃及瞄准印度高质量投资,以扩大工业、出口和区域贸易

Egypt Targets High-Quality Indian Investment to Expand Industry, Exports and Regional Trade

埃及瞄准印度的高质量投资,以扩大工业、出口和区域贸易随着北非国家加大力度扩大制造业、增加出口、创造就业机会并加强其作为区域生产中心的地位,埃及正在寻求吸引印度对其工业部门进行更多长期和高质量的投资。埃及部长的文章《埃及瞄准印度高质量投资以扩大工业、出口和区域贸易》首先出现在 Aviationghana 上。

“艺术的复兴”:新保守派文学季刊将创作置于批评之上

‘Renewal in the arts’: New conservative literary quarterly prioritizes creation over critique

备受尊敬的保守派宗教杂志《First Things》推出了新的文学季刊,旨在在当今高度政治化的气候下探索和推广美、文学和艺术。 Portico 将发表“关于具有艺术和文学意义的主题的最高质量的作品,以促进艺术的复兴”,[...]

通过校准的稀疏注意力加速文本到视频的生成

Accelerating Text-to-Video Generation with Calibrated Sparse Attention

最近的扩散模型可以生成高质量的视频,但运行时间很慢。这些模型中使用的基于变压器的大型骨干网受到时空注意力的瓶颈。在本文中,我们发现很大一部分令牌到令牌连接在各种输入中始终产生可以忽略不计的分数,并且它们的模式经常在查询中重复。因此,在这些情况下,注意力计算可以被跳过,对结果几乎没有影响。对于本地令牌块之间的连接,这一观察结果仍然成立。受此激励,我们...

为 API 调用代理生成无环境的综合数据

Environment-free Synthetic Data Generation for API-Calling Agents

训练调用 API 的大型语言模型 (LLM) 代理需要大量高质量的轨迹。然而,大规模收集此类数据通常需要具有可执行 API 和现实的、预先填充的后端数据库的完全实施的环境,从而造成可扩展性的主要瓶颈。为了克服这个问题,我们提出了一种无环境的合成数据生成方法,利用法学硕士作为动态数字世界模型。仅给定 API 规范,我们的方法就会生成模仿代理和有状态环境之间交互的轨迹。具体来说......

2026年德国MotoGP成绩:Marc Marquez强势亮相,重振冠军争夺战

Hasil MotoGP Jerman 2026: Marc Marquez Tampil Perkasa dan Menghidupkan Persaingan Gelar Juara

2026 年德国 MotoGP 比赛的结果是本赛季赛车日历中最有趣的讨论之一。萨克森环赛道上的比赛从起跑灯亮起一直到终点旗子升起,竞争激烈,策略成熟,相互施压。自比赛周开始以来,球迷们就预测本系列赛将呈现高质量的对决。然而,比赛的进程[...]