Top 7 Coding Models You Can Run Locally in 2026
探索用于私有 AI 编码、快速 GGUF 推理、代理工作流程、多模式开发以及在您自己的 GPU 上运行强大的开放模型的最佳本地编码模型。
Anthropic’s Export Control Crackdown Leaves South Korea Caught in Washington’s AI Crossfire
Anthropic 最先进的人工智能模型的暂停暴露了硅谷游说如何以牺牲盟国经济体为代价来塑造美国出口政策。
Nine Judges, Two Effective Votes: Correlated Errors Undermine LLM Evaluation Panels
法学硕士评委小组汇总来自多个模型的投票,期望不同的模型能产生更可靠的评估。我们开发了一个框架来衡量此类小组的真实信息价值,并量化其可靠性与独立投票理想的差距有多大。在三个自然语言推理数据集(每个项目有 100 个人类注释)上测试来自 7 个模型系列的 9 名前沿法学硕士小组,我们发现 9 名评委实际上只提供了大约 2 个独立投票的信息。大约四分之三的专家组名义上的独立性......
Metric-Dependent Annotation Saturation for Learning from Label Distributions
当注释者对某个标签存在分歧时,分歧本身就带有信号,而捕获该信号所需的注释者数量取决于评估指标。我们根据从 ChaosNLI(一个为每个项目提供 100 个独立注释器判断的数据集)二次采样的标签分布来微调 NLI 模型,并识别与度量相关的饱和度。在我们的 3 类 NLI 设置中,熵相关性(模型是否识别哪些项目引起分歧)需要 N ≈ 20-50 个注释器才能收敛,而分布匹配(KL 散度)则达到 N ≈ 10 饱和(五个模型的改进为 87-95%……
5 Essential Approaches to Robust Outlier Detection
异常值很容易破坏您构建的任何预测分析模型的性能:稳健地检测和处理它们对于任何数据项目都至关重要。本文列出并比较了检测它们的五种基本方法。
Русский спам и мат заполонили AUR-ресурс Arch Linux
对存储库的攻击影响了使用 Python 和 Llama 语言模型的脚本。
A Decade-Long Physics Mystery May Finally Be Solved
研究人员精确测量了质子的尺寸,解决了质子半径难题,增强了对粒子物理标准模型的信心。氢是宇宙中最简单的元素,也是元素周期表中的第一个元素。每个氢原子的原子核中仅包含一个质子和一个绕其运行的电子。因为 [...]
Countries Are Pushing Borders Outward to Expand Deterrence and Protection Alike
以前招募伙伴国家来帮助管理非正常移民的小众战略已成为主流。多个移民接收国的政府已与其他国家合作筛选、拘留、驱逐或以其他方式将移民转移到其他地方,实际上是将边境向外推。虽然一些外化方法受到了批评,但模型的范围比通常理解的更加微妙。
EU、Metaに対する暫定措置-第三者AIへの排除行為を差し止め
■摘要 欧盟委员会初步决定,应恢复并维持 WhatsApp 上竞争生成的人工智能助手对 Meta 的免费访问,直至竞争法调查结束。虽然 WhatsApp 作为欧洲对话应用程序占据主导地位,但 Meta 表示,它已优先考虑自己生成的人工智能助手,并淘汰了竞争性生成的人工智能助手。日本公平贸易委员会的报告还指出,此类案件可能违反反垄断法。 2026 年 6 月 9 日,欧盟委员会(下称“委员会”)命令 Meta 恢复竞争性生成 AI 助手对 WhatsApp 的免费访问,并维持至委员会竞争法调查结束(下称“决定”)。其目的是防止 Meta 的行为乍一看违反了欧盟竞争法,从而对不断增长的市场中的竞争
Prophetモデルを用いた人流データの時系列予測分析~コロナ禍・万博を経た大阪主要スポットの人流の特徴と来訪者数の将来予測~
■摘要 近年来,通过智能手机等设备获取的“人流数据”,因其能够直观、准确地了解人流活动和停留的实际状态,越来越多地应用于城市规划、旅游推广等广泛领域。了解人流数据的特征对于了解房地产需求和城市结构也很重要。因此,本文利用Location AI Co., Ltd.提供的人流数据,利用Prophet模型进行时间序列分析,掌握大阪市主要景点的游客特征,预测未来的人流趋势。分析表明,大阪主要景点的游客量不仅受到季节变化和天气条件的强烈影响,而且还受到传染病传播和大阪关西世博会等外部事件的影响,并且影响程度根据每个景点的用途和位置特征而存在很大差异。特别是,对大阪站周边地区的分析表明,近年来的大规模开发
CISA now has full Mythos Preview access, people familiar say
网络防御机构大约一周前获得了该模型的访问权限,但仍没有得到白宫的明确指导。
A startup claims it broke through a bottleneck that’s holding back LLMs
总部位于迈阿密的人工智能初创公司 Subquadratic 上个月走出了隐秘模式,带来了巨大的收益。它宣布它已经解决了近十年来阻碍大型语言模型的数学瓶颈。细节很薄弱,很多人不相信。但 Subquadratic 已经开始带来收据,分享......
在上限边缘没有繁荣的持久性:范围扩展蜘蛛中的海拔、微生境缓冲和生物压力摘要嗜热节肢动物的海拔上限反映了对种群持久性的限制,而不是简单的存在。我们利用假设驱动的综合方法,对中欧收集的站点水平和茧水平数据进行了假设驱动的综合,研究了海拔结构如何影响中欧蜘蛛 Cheiracanthium punctorium 的出现、丰度、繁殖行为和生物压力。 4 年。随着海拔的升高,出现率和丰度都急剧下降,海拔高度约 850 m 以上时,占有率明显下降,表明存在明确的上限边界。生殖行为沿着梯度系统性地变化,因为雌性将卵茧放置在海拔较高的植被上较低的位置,与植被高度无关,这与对日益不利的小气候条件的行为调整是一致的
Willis Eschenbach 的客座帖子(@WEschenbach at X,我自己的博客在这里。)我想花点时间讨论一下我的同行评审论文对我的实现的一些影响……有效模型的帖子首先出现在 Watts Up With That? 上。
Inside the start-up aiming for a giant leap in robot intelligence
物理智能正在利用大型语言模型的广泛知识来帮助机器人理解指令并学习独立执行任何任务