Metric-Dependent Annotation Saturation for Learning from Label Distributions
当注释者对某个标签存在分歧时,分歧本身就带有信号,而捕获该信号所需的注释者数量取决于评估指标。我们根据从 ChaosNLI(一个为每个项目提供 100 个独立注释器判断的数据集)二次采样的标签分布来微调 NLI 模型,并识别与度量相关的饱和度。在我们的 3 类 NLI 设置中,熵相关性(模型是否识别哪些项目引起分歧)需要 N ≈ 20-50 个注释器才能收敛,而分布匹配(KL 散度)则达到 N ≈ 10 饱和(五个模型的改进为 87-95%……
度量衡办公室 (OWM) 很高兴欢迎 Dominick Mendez 和 Yoon Thwel 担任 2026 年夏季本科生研究奖学金 (SURF) 项目研究员,开展科学、技术、工程和数学研究
New NIST Special Publication 2200 on Cannabis Scale Suitability
过去几年,大麻产品的销售和使用已在美国多个州合法化。随着这种合法化的到来,对大麻产品销售的法律控制,包括度量衡监管
IEEE Transactions on Fuzzy Systems, Volume 34, Issue 7, July 2026
1) 视觉情感识别中无源域适应的模糊感知损失作者:Y. Cheng,Y. 张,Y. Wang,L. -P。 ChauPages: 2077 - 20892) Multiview Fuzzy Clustering With Anchor Graph作者:C. Liu, F. Nie, M. Chang, R. Wang, X. LiPages: 2090 - 21033) Partial Multilabel Feature Selection via Fuzzy Two-Stage Disambiguation and Weighted Pure Relevance作者:C. Huang, D
3 NLTK Tricks for Advanced Text Preprocessing & Linguistic Analysis
在本文中,我们将介绍三个基本的 NLTK 技巧来提升文本预处理:使用 MWETokenizer 保持短语完整性、使用词性映射进行上下文感知词形还原以及使用关联度量进行统计搭配提取。
Rethinking the long leading indicators
- 作者:新政民主党人 20 多年来,我一直在撰写有关经济的文章并运用预测模型。在整个时期内,许多其他人都写下了末日的预兆。我变得更加谨慎,自 2008 年以来只进行过两次“经济衰退观察”:2019 年和 2022 年末。我从未参与过“经济衰退警告”。从那时起,这与经济大体同步。自2009年6月以来,新冠疫情爆发后仅两个月的时间,经济就陷入衰退,社会几乎陷入停滞。在接下来的 200 多个月里,它一直在扩张。我们永远不知道,如果没有新冠疫情,2020 年是否会出现经济衰退,尽管当时我相信我们会差点错过它。但到了 2022 年,广泛的警告信号很明显,但无论如何都没有发生衰退。因此,20 年后,我认
Invaluable New Geopolitical Risk Indexes: AI-GPR, GPR-Oil, and More
Econbrowser 的读者知道,我非常强调使用高频的不确定性和风险度量来解释最近发生的事件。这些指数之一是 Caldara-Iacoviello 地缘政治风险指数 (GPR),我的很多帖子都引用了该指数。 Matteo Iacoviello 和他的合著者 Jonathan Tong 开展了一个新项目 [...]