India and Japan opt for indigenous bullet trains
“这是印度和日本的旗舰项目。两国正在努力实现 2027 年商业运营的共同目标,”一位高级官员告诉《经济时报》,并补充说日本专家将从 2021 年施工一开始就开始监督工作。
SERBIA: ‘We Are Becoming an Electoral Autocracy, a System Where the Government Cannot Lose’
CIVICUS 与研究、透明度和问责中心的项目主任 Rasa Nedeljkov 讨论了塞尔维亚选举的前景。Rasa Nedeljkov 是一个监督塞尔维亚选举进程和法治的民间社会组织。阅读全文,“塞尔维亚:‘我们正在成为一个选举专制国家,一个政府不能失败的制度’”,位于 globalissues.org →
Why are so many kindergartners chronically absent?
科罗拉多州拉夫兰——就在纳马夸小学的前门外,经过一面写着“出勤很重要——每个上学日都很重要”的横幅,一只戴着墨镜的毛绒野猫坐在大厅里,观察着学生的来来往往。学校吉祥物叫怀亚特,学生们被告知他负责监督出勤情况。 […]帖子 为什么这么多幼儿园的孩子长期缺勤?首先出现在《赫金格报告》上。
Boeing secures FAA approval to issue airworthiness certificates for new 737s and 787s
非订阅者免费 作者:霍华德·哈迪 (Howard Hardee),2026 年 7 月 17 日,© Leeham News:多年来,FAA 对波音新生产的喷气式飞机的适航认证流程加强了监督,监管机构已恢复了机身制造商颁发自己的适航证书的能力……阅读更多波音获得 FAA 批准为新型 737 和 787 颁发适航证书的帖子首先出现在 Leeham News and Analysis 上。
Embarrassingly Simple Self-Distillation Improves Code Generation
大型语言模型 (LLM) 能否在没有验证器、教师模型或强化学习的情况下仅使用其自己的原始输出来改进代码生成?我们通过简单自蒸馏(SSD)给出肯定的答案:从具有特定温度和截断配置的模型中抽取样本解决方案,然后使用标准监督微调对这些样本进行微调。 SSD 在 LiveCodeBench v6 上将 Qwen3-30B-Instruct 从 42.4% 提高到 55.3% pass@1,收益主要集中在更难的问题上,并且它在 4B、8B 和 30B 规模的 Qwen 和 Llama 模型上进行了推广,包括......
New ‘Drone Czar’ Must Prioritize Warfighters, Analysts Say
由于战争部长皮特·赫格斯 (Pete Hegseth) 希望提高无人机能力并加快采购,五角大楼的一个新职位将负责监督国防部几乎所有与自主相关的工作和资金渠道。
GAO 发现美国联邦航空管理局 (FAA) 和运输安全管理局 (TSA) 共同努力确保国家空域系统 (NAS) 中运行的互连系统的网络安全。美国联邦航空局定义了负责实现该机构相关目标的实体的角色和职责。相比之下,TSA 却没有。 TSA 在其 2018 年网络安全路线图中定义了优先考虑机构内部和运输系统部门网络安全的目的和目标。然而,该路线图已经过时,不再与最新的国土安全部网络安全战略保持一致。该路线图也没有确定负责实施该路线图的办公室,也没有定义该机构在监督机场和飞机运营商安全计划方面与网络安全相关的角色和职责。在 TSA 更新其网络安全路线图以明确其航空网络安全角色和职责之前,该机构无法完
Science & Tech Spotlight: AI for Medical Notes and Coding
为什么这很重要美国临床医生平均每周工作 57 小时,其中包括 7 小时的行政工作。花在起草患者就诊记录或审查账单文件等任务上的时间可能会导致临床医生倦怠。新的人工智能工具可以提高效率并减少患者就诊期间和之后的管理负担。要点一些医疗保健提供者正在采用人工智能工具来协助做笔记和医疗编码,这可能会节省时间并减少倦怠。这些工具的准确性可能难以验证,对医疗保健支出的总体影响也不确定。政策制定者需要更多有关这些工具性能的信息,以确定所需的适当监督级别,以帮助最大限度地减少错误并确保正确计费。该技术是什么?准确的文档和计费是医疗保健中至关重要的管理任务。医疗保健提供者正在采用人工智能工具来自动化这些任务。人
Air Force conducts live-fire test for Collaborative Combat Aircraft program
空军部成功对 YFQ-44A 协作战斗机进行了实弹测试,使用 AIM-120 武器向数字目标发射。该测试展示了计划的成熟度和操作验证,同时强调保留对武器释放的人力监督。
MBDA to replace CEO with Airbus executive
在 MBDA 任职期间,Éric Béranger 负责监督公司的主要工业发展。
AI agent governance at scale: from 5 agents to a 500-agent workforce
治理5个代理是一个审查过程。管理 500 个代理是一个基础设施问题。当少数代理可见并受到密切监视时,手动审核和团队级批准就可以发挥作用。一旦代理遍布各个业务部门、工具和环境,这种监督就会崩溃。企业需要一个人工智能代理治理模型,其中包括集中身份、可重用……大规模的后人工智能代理治理:从 5 个代理到 500 名代理劳动力首先出现在 DataRobot 上。
Role reset as AI rises, managers emerge as new change agents
随着人工智能技术不断渗透到工作场所,管理者已成为其成功整合的关键参与者。他们的角色已经从仅仅监督任务演变为培育学习和适应环境。组织正在优先通过持续教育培养人工智能就绪的团队,并由管理人员指导其团队有效地理解和利用新技术。
No role of Ajay, Ashish Mishra in Lakhimpur Kheri intimidation case: UP to SC
北方邦警方通知最高法院,阿贾伊·米什拉和他的儿子没有受到起诉。该决定涉及与 Lakhimpur Kheri 有关的所谓证人恐吓案件。在这起具体事件中,只有阿曼迪普·辛格 (Amandeep Singh) 受到警方指控。最高法院目前正在监督正在进行的审判程序。该意见书是在首席大法官领导的三人法官席上提交的。
Priority Open Recommendations: General Services Administration
GAO 的发现2025 年 5 月,GAO 为总务管理局 (GSA) 确定了八项优先建议。此后,GSA 实施了两项建议,并取消了一项建议中的优先级指定。 2026 年 6 月,GAO 确定了另外 6 项优先建议,使总数达到 11 项。 GAO 强调了以下三个值得及时重点关注的领域:管理联邦不动产、改善机构共享服务以及改善联邦奖励的监督。解决 GAO 在这些领域的建议将提高 GSA 管理联邦政府持有的大量不动产的能力,帮助联邦机构他们采用共享服务战略,并帮助联邦获奖者和审计员识别或解决与每年数亿美元联邦支出相关的调查结果。采取行动实施 GAO 的所有开放优先建议将有助于提高整个 GSA 运营的效
VA Disability Benefits: Opportunities and Challenges to Modernizing Technology and Adopting AI
GAO 发现退伍军人事务部 (VA) 正在努力实现 IT 系统现代化,以提高伤残赔偿索赔处理的效率和准确性。然而,政府问责局过去的报告发现,退伍军人事务部在管理其残疾补偿计划和实施创新技术方面面临着长期挑战。例如,GAO 发现 VA 对签约医疗服务提供者提供的检查质量的监督以及索赔处理人员培训的管理存在缺陷。此外,2009 年,退伍军人管理局开始开发一种电子无纸化系统,称为退伍军人福利管理系统。 GAO 发现,这项工作并不是由稳健的规划推动的,也没有包括系统响应时间和用户满意度的目标,因此很难衡量提高用户对系统满意度的努力进展。人工智能在改善政府运营方面有着巨大的前景,VA 正在探索人工智能在
This Week in AI: Chips, Checks, and Changing Jobs
本周,数据和人工智能传播者克里斯蒂娜·斯塔索普洛斯 (Christina Stathopoulos) 回来参加个人新闻发布会。克里斯蒂娜没有深入探讨一两个主题,而是将本周的头条新闻整理成几条线索:满足人工智能需求的物理硬件的进步、政府对前沿模型公司的监督范围扩大,以及 [...]
Pre-training isn’t bitter enough
理查德·萨顿 (Richard Sutton) 的“惨痛教训”通常被解读为对人工智能系统构建过多人类知识的警告。从长远来看,获胜的方法不是那些最直接编码我们聪明直觉的方法,而是那些可扩展的方法:搜索、学习和其他可以吸收更多计算和数据的通用方法。乍一看,现代基础模型预训练看起来就像是该课程的胜利。我们采用通用架构,将其暴露给海量数据,并以简单的自我监督目标对其进行训练。语言模型预测下一个标记。视觉模型重建遮罩斑块、对齐视图或匹配教师表示。该配方简单且可扩展。但有一个问题。预训练可能会遵循“痛苦的教训”来训练模型,但不会选择模型应该训练的内容。目标仍然是在训练循环之外选择的。我们进行大规模的预训练
Unmasking On-Policy Distillation: Where It Helps, Where It Hurts, and Why
在策略蒸馏为训练推理模型提供密集的、按令牌的监督;然而,目前尚不清楚该信号在哪些条件下有益,在哪些条件下有害。应该采用哪种教师模式,在自我蒸馏的情况下,应该以哪种具体情境作为监督信号?不同代币的最佳选择是否有所不同?目前,解决这些问题通常需要昂贵的训练运行,其总体性能指标掩盖了单个代币级别的动态。我们推出了免培训...