IDEA Prune: An Integrated Enlarge-and-Prune Pipeline in Generative Language Model Pretraining
大型语言模型的最新进展加剧了在有限推理预算内对高效可部署模型的需求。与从头开始训练目标规模模型相比,结构化剪枝管道在令牌效率方面显示出潜力。
STARFlow2: Bridging Language Models and Normalizing Flows for Unified Multimodal Generation
能够理解、推理和生成交错文本-图像序列的统一多模态模型在结构上仍然分散:现有方法要么通过离散标记化牺牲视觉保真度,要么通过组合不同的模态施加结构不对称性。
Your Aging Brain May Protect Language Better Than Other Skills
衰老对每种心智能力的影响并不相同。虽然记住信息几秒钟或快速解决新问题可能变得更难,但理解语言的能力可能仍然惊人地强大。许多老年人也比年轻人知道更多的单词。
Can an LLM Forget the Right Things?
大多数 LLM 推理运行时不知道存在物理截止日期。这个拒绝入场而不是错过 33 毫秒的机器人控制周期,通过意义而不是年龄驱逐 KV 缓存,并且完全用手写 CUDA 编写 - 没有 cuBLAS,没有 libtorch。 帖子 Can an LLM Forget the Right Things? 帖子 Can an LLM Forget the Right Things?首先出现在《走向数据科学》上。
How to Leverage Local Small Language Models for Your Projects
在您自己的硬件上运行紧凑、保护隐私的语言模型的实用指南,以实现更快、更便宜且更可控的人工智能应用程序。
TR Launches Thomson 1.0 – Its Own LLM
经过几个月的工作,TR 推出了 Thomson 1.0,它自己的法学硕士,根据自己的数据进行训练 - 它显示出...
Multilingual Knowledge Transfer under Data Constraints via Lexical Interventions
跨语言知识迁移对于为训练数据不足的语言构建高性能的多语言语言模型至关重要。当目标语言数据稀缺时,涉及科学推理、常识推理和世界知识等许多下游任务所需的知识必须主要从高资源语言获取,因此有效的知识迁移至关重要。改进这种跨语言知识转移的现有方法需要大量并行数据、翻译系统、辅助模型或额外的训练阶段……
Authoring Dogwood policies from natural language in Amazon Bedrock AgentCore
AI 代理可能会采取与您组织的策略不相符的操作。 Amazon Bedrock AgentCore 中的策略允许团队跨代理实施控制,现在包括基于时间的约束。这篇文章通过有效的示例和最佳实践展示了策略编写如何将自然语言策略文档转变为正确的山茱萸策略。
One Language - What happens the moment every machine on the floor speaks the same one
在工厂车间,原因是平淡而具体的。模型不是瓶颈。它们下面的数据层从来都不是为机器读取而构建的。
Act Would Support World Languages & International Education
7月底,众议员 Deborah Ross (NC-02)、Valerie Foushee (NC-04) 和 Jimmy Panetta (CA-19) 提出了《推进国际和外语教育法案》,通过重新授权《高等教育法案》第六章——富布赖特-海斯项目来支持学院和大学的外语和国际教育项目。具体来说,《推进国际和外语[…]支持世界语言和国际教育的后法案》首先出现在语言杂志上。
Apparently, Data Driven Learning Related To Language Learning Doesn’t Mean What You Think It Does
我从来都不热衷于教育中的“数据驱动”(请参阅展示为什么我们需要“数据知情”而不是“数据驱动”的最佳资源)。然而,当我得知“数据驱动学习”一词在语言学习圈中显然意味着完全不同的东西时,想象一下我的惊讶。我看到了一项名为“影响”的研究 [...]
Scientists Discover a Surprising Link Between Human Genes and Language
人类迁徙和隔离似乎以相反的方式塑造遗传和语言多样性。这一发现乍一看似乎有悖常理。由移民和人口混合形成的地区通常具有更高的遗传多样性,因此他们的语言也更加多样化似乎是合乎逻辑的。相反,研究发现了相反的模式。 “我们[...]
GRPO Beyond English: A Large-Scale Study of GRPO in Non-English and Multilingual Settings
带可验证奖励的强化学习 (RLVR) 通常通过组相对策略优化 (GRPO) 进行优化,已成为提高预训练语言模型推理能力的核心方法,但目前的研究仍然主要以英语为中心。我们对多语言和非英语 GRPO 进行了大规模的实证研究,涉及广泛的基础模型、训练语言和不同的推理语言奖励。我们发现,母语推理训练通常与英语推理训练差距很小。我们进一步观察到强...
JUST IN: Large Language Models Lack Utility for Military Missions, DARPA Official Says
美国国防高级研究计划局的一位官员 8 月 18 日表示,关于大型语言模型等人工智能功能有很多讨论,但如果不将它们与建模和仿真工具相结合,这项技术就不会达到宣传的效果。
What Can I Actually Do with a Small Language Model?
但是,通过牢记这些限制并对其进行规划,我们可以有效地将这些小型本地模型用于以下广泛的操作场景。
A Common Sense Approach to Demystify Universal Reading Screening with Multilingual Students
揭开多语言学生普遍阅读筛查神秘面纱的常识性方法 0vpthomas2026 年 7 月 23 日我们的客座作者是莉莲·杜兰 (Lillian Durán),她是俄勒冈大学特殊教育和临床科学系的教授。她制定了英语和西班牙语的语言和读写能力筛查措施,并就多语言学习者评估的最佳实践在全国范围内进行咨询。孩子们学习他们在日常生活中接触到的语言,但孩子们通过正式教学获得用某种语言阅读的能力。意识到语言和读写能力发展之间的这种根本差异是在筛选多语言学生的阅读问题方面做出常识性决策的核心。目前,美国 49 个州强制或建议对小学早期的阅读发展问题(包括阅读障碍)进行普遍筛查,这自然需要对所有儿童进行测试,并假
Canada’s language students fall 13%
由于移民政策导致学生人数又一年下降,加拿大语言部门已经陷入“危机状态”。加拿大语言学生人数下降 13% 的消息首先出现在 The PIE News 上。
Most kids miss recommended screening for autism, speech delays
纽约州锡拉丘兹——在儿子出生的第一年半期间,瓦莱丽·格雷戈里竭尽全力帮助他茁壮成长:她读书给他听,与他交谈,参加健康检查,并尽可能带他参加每周一次的游戏小组,母子俩都有机会进行社交活动……大多数孩子都错过了建议的自闭症筛查,言语迟缓首先出现在《赫钦格报告》上。