“Make Way for Grandparents!” Greg Brown’s Flying Carpet Podcast #45
与著名飞行员、作家兼摄影师格雷格·布朗 (Greg Brown) 一起乘坐他的轻型飞机“飞毯”,在云层后面寻找真正的美国,沿途经历无数的空中冒险。听听“为祖父母让路!”格雷格·布朗的飞毯播客#45,在这里或您最喜欢的播客目录中。飞行里程和 [...]
Build a Reasoning LLM from Scratch: A Complete Guide to GRPO, RoPE & Pretraining.
使用 GRPO、RoPE 和现代变压器构建推理法学硕士。帖子从头开始构建推理法学硕士:GRPO、RoPE 和预训练的完整指南。首先出现在Spritle软件上。
NIST Researchers Correct Common Error Confounding Nanotech Measurements
科学家们提供了一种实用的解决方案,该解决方案依赖于在测试材料或开发产品之前考虑测量误差。
EU capital requirements on megabanks: The low road or the high road
本政策简报重点关注当前欧盟更广泛的银行业改革政策议程中对最大银行或大型银行的资本要求。作者发现,到 2024 年底,对美国大型银行的要求普遍比对欧盟大型银行的要求更严格,这与美国的长期做法一致。一年后,在特朗普第二届政府的领导下,美国对大型银行的要求不再明显比欧盟的要求更严格,但实际上也没有削弱它们。因此,欧盟没有合理的理由放松......
Scripps announces digital restructure and layoffs
简报 ☀️ 周四快乐!简报是您了解新闻和信息世界的指南。在这里注册!在今天的电子邮件中: 🔥 专题报道 E.W. Scripps 是一家拥有数十家当地附属公司的广播公司,该公司将裁员 268 名员工,以围绕数字优先的新闻制作和流媒体重组其当地电视业务。该公司计划集中一些[...]
Most Americans Favor the Death Penalty for Those Convicted of Murder
虽然 68% 的人认为对谋杀犯判处死刑在道义上是合理的,但 59% 的人表示死刑并不能阻止严重犯罪 — — 而且在这两个问题上都存在巨大的党派分歧。
美国趋势小组调查方法概述 本报告中的数据来自美国趋势小组 (ATP) 第 196 波,该小组是皮尤研究中心随机选择的美国成年人的全国代表性小组。该调查于 2026 年 7 月 6 日至 7 月 12 日进行。在 4,173 名样本中,共有 3,554 名小组成员做出了回应,[...]
本报告是基于以下个人的意见和分析的协作成果:研究团队 Jocelyn Kiley,政治研究主任 Steven Shepard,政治研究副主任Hannah Hartig,高级研究员Baxter Oliphant,高级研究员Gabe Borelli,研究员Andrew Daniller,研究员Andy Cerda,研究分析师 Shanay Gracia,研究分析师Ted Van Green,研究分析师通讯和社论 Nida [...]
Most U.S. senators appointed since 1990 have run to keep their seat – and most have won
自 1990 年以来,美国参议院已任命了 43 名议员,其中 27 名(63%)通过竞选保住席位。
Trump’s job approval rating is low by historical standards
特朗普的工作支持率为 34%,低于历任总统的同等水平,党派差距达 78 个百分点。
How confident are Americans in the midterm elections’ fairness and accuracy?
超过一半的美国人相信 2026 年中期选举将是公平的。
Locking Pretrained Weights via Deep Low-Rank Residual Distillation
近年来,开放权重语言模型的质量有了显着提高。共享权重可以在不同的硬件和软件平台上使用,从而极大地促进了模型的采用。它们还允许更开放的研究和测试,用户可以将它们用作检查点,根据自己的需求对其进行微调,并可能重新分发它们。然而,在某些情况下,对修改这些权重以防止未经授权的使用的担忧可能超过给予用户这种自由的好处。防御这种适应并非易事:因为适应性......
Dimensionality Reduction Meets Network Science: Sensemaking on UMAP’s kNN Graph
虽然 UMAP 广泛用于探索高维数据,但典型的工作流程侧重于其低维嵌入,很大程度上忽略了 UMAP 内部构造的丰富的 k 最近邻 (kNN) 图。在 UMAP 的 2D 投影引入失真之前,该图将数据流形编码在其原始高维空间中。我们展示了这种内部表示的未开发潜力,展示了应用于该图的标准图算法如何增强数据意义:(1) PageRank 识别代表性数据点,(2) k 核分解揭示密集......
DeepAmbigQA: Ambiguous Multi-hop Questions for Benchmarking LLM Answer Completeness
具有集成搜索工具的大型语言模型 (LLM) 在开放域问答 (QA) 方面显示出强大的前景,但它们常常难以为复杂问题提供完整的答案,例如“电影《热火》中的哪位演员至少赢得了一项奥斯卡奖?”,这需要 (1) 区分多部具有相同标题的电影,以及 (2) 对大量演员进行推理以收集和整合证据。现有的质量保证基准很少联合评估这两个挑战。为了解决这个问题,我们引入了 DEEPAMBIGQAGEN,一个自动数据生成管道,用于构建 QA...
Taming Outlier Tokens in Diffusion Transformers
我们研究用于图像生成的扩散变压器 (DiT) 中的异常标记。先前的工作表明,视觉变压器(ViT)可以产生少量高规范令牌,这些令牌在携带有限的本地信息的同时吸引了过多的注意力,但它们在生成模型中的作用仍未得到充分探索。我们证明这种现象出现在现代表示自动编码器(RAE)-DiT 管道的编码器和降噪器中:预训练的 ViT 编码器可以产生离群表示,而 DiT 本身可以开发内部离群标记,尤其是在中间层......
MoMo: Dial Motion Mode in Robot Manipulation with Spatiotemporal Action Tokenization
为了在不同的环境中有效运行,机器人不仅必须准确地执行操作任务,而且还要根据任务、对象和交互设置调整其行为的展开方式。我们询问这种执行级别的变化是否可以作为跨任务共享的可重用行为因素来学习。我们提出了 MoMo,一个两阶段的模仿学习框架,由时空动作标记器和行为克隆转换器组成,该转换器将任务和连续运动模式条件作为输入。在六个真实的机器人操作任务中,改变这种条件会产生稳定的……
Understanding Alignment in Multimodal LLMs: A Comprehensive Study
偏好对齐已成为提高大型语言模型 (LLM) 性能的关键组成部分,但其对多模态大型语言模型 (MLLM) 的影响仍相对未得到充分研究。与语言模型类似,用于图像理解任务的 MLLM 也会遇到幻觉等挑战。在 MLLM 中,幻觉不仅可以通过陈述不正确的事实而发生,还可以通过产生与图像内容不一致的响应而发生。 MLLM 对齐的主要目标是鼓励这些模型将响应与图像信息更紧密地对齐。最近...