模型关键词检索结果

刚刚:DARPA 官员表示,大型语言模型缺乏军事任务的实用性

JUST IN: Large Language Models Lack Utility for Military Missions, DARPA Official Says

美国国防高级研究计划局的一位官员 8 月 18 日表示,关于大型语言模型等人工智能功能有很多讨论,但如果不将它们与建模和仿真工具相结合,这项技术就不会达到宣传的效果。

经济模型的局限性:它们错过了什么以及它们仍然发挥作用的地方

The Limitations of Economic Models: What They Miss and Where They Still Work

2008 年 11 月,女王伊丽莎白二世在访问伦敦经济学院时,问了一个其他人都过于礼貌而无法直白表达的问题:为什么没有人预见到它的到来?最终的书面答复归咎于集体想象力的失败。诱人的结论可能是经济模型毫无价值。英国经济学家琼·罗宾逊(Joan Robinson)清晰地给出了更好的教训:a《经济模型的局限性:它们错过了什么以及它们仍然有效的地方》一文首先出现在 FocusEconomics 上。

我实际上可以用小语言模型做什么?

What Can I Actually Do with a Small Language Model?

但是,通过牢记这些限制并对其进行规划,我们可以有效地将这些小型本地模型用于以下广泛的操作场景。

小鼠模型中蝰蛇毒液诱导的血小板减少症及其多价抗蛇毒血清的中和作用

Thrombocytopenia induced by viperid snake venoms in a murine model and its neutralization by a polyvalent antivenom

小鼠模型中蝰蛇毒液诱导的血小板减少症及其被多价抗蛇毒血清的中和摘要血小板减少症是蝰蛇咬伤中毒的常见表现,导致全身出血和血流动力学改变。尽管具有相关性,但在评估抗蛇毒血清的中和能力时并未评估这种效应。在这项研究中,我们提出了一种在小鼠体内量化血小板减少效应的方法。哥斯达黎加蝰蛇属(Atropoides、Bothrops、Bothriechis、Cerrophidion、Crotalus、Lachesis、Metlapilcoatlus 和 Porthidium)的代表性毒液通过肌肉注射途径给予小鼠,并在中毒后 3 小时进行血小板计数。与接受盐水溶液的对照相比,只有白腹雉和侧腹雉的毒液引起血小板数

教科书可能是错的:卫星数据挑战双凸潮汐模型

Textbooks May Be Wrong: Satellite Data Challenge the Two-Bulge Tide Model

大规模潮汐观测挑战了教科书的观点,即两个对称的水凸起在地球的两侧物理形成。几代人以来,学生们已经学会想象地球的海洋在月球引力的影响下在地球的两侧形成两个宽阔的隆起。水资源综合开发中心杨永峰领导的研究人员[...]

莱茵军械兵营医疗中心模型建筑计划拆除

Mock-up building for Rhine Ordnance Barracks Medical Center scheduled for demolition

莱茵军械兵营医疗中心建设项目的巨型结构不容忽视,并且在过去的几年里一直在稳步增长......

我的模型在自己的测试中作弊

My Model Was Cheating on Its Own Test

预处理管道让我的汽车价格模型在考试前查看测试集,并且 R 平方的 12 个点作弊到了“我的模型在自己的测试中作弊”一文,该文章首先出现在《走向数据科学》上。

#AAMAS2026 蓝天奖获得者:变化环境中智能体的基础世界模型

#AAMAS2026 blue sky award winner: Foundation world models for agents in changing environments

Florent Delgrange 因其著作《Foundation World Models for Agents that Learning, Verify, and Adapt Reliously Beyond Static Environmentals》荣获 AAMAS 2026 最佳蓝天论文奖。我们采访了他,以更多地了解他对代理学习的愿景。您的蓝天创意论文的主题是什么以及[...]

Stomp Rockets:为孩子们打造火箭模型的完美开始?

Stomp Rockets: The perfect start to model rocketry for kids?

Stomp Rockets 可以为您的孩子打开模型火箭的世界。

俄罗斯人工智能模型必须通过传统价值观的考验才能获得国家支持

Российским ИИ-моделям придется пройти тест на традиционные ценности ради господдержки

测试只会影响声称具有国家或主权地位的模型。

北京发出开放权重模型分级治理的信号

Beijing Signals Tiered Governance of Open-Weight Models

摘要:7月16日,中华人民共和国(PRC)人工智能(AI)初创公司月之暗面发布了其最新型号Kimi K3。在盲开发者测试中,它击败了前端编码排行榜上的所有竞争对手(The Decoder,7 月 16 日;Tom’s Hardware,7 月 17 日)。人工智能前高级政策顾问 Dean Ball […]北京发出开放权重模型分层治理的信号后,首先出现在 Jamestown 上。

通过减少 LLM 调用而不是购买更快的模型来降低企业 RAG 管道的延迟和成本

Cut an Enterprise RAG Pipeline’s Latency and Cost by Calling the LLM Less, Not by Buying a Faster Model

企业文档智能 [Vol.1 #9ter] - 第 9 条中的管道分几个步骤调用模型以确保其正确。对于简单的问题,这是不必要的延迟。每个问题的信号都会引导他们通过模型,为关键字匹配节省大约两秒的时间。通过减少 LLM 的调用,而不是通过购买更快的模型来降低企业 RAG 管道的延迟和成本,该帖子首先出现在《走向数据科学》上。

几十年来,天气预测一直依赖于超级计算机上运行的数值模型,现在人工智能可以在很短的时间内做出预测。会准确吗?这是专家的说法

For decades, weather ⁠prediction ⁠has relied on numerical models running on supercomputers, now AI can produce forecasts in a fraction of the time. Will it be accurate? Here's what experts are saying

据路透社报道,虽然人工智能系统因其速度快且计算成本较低而成为传统预报日益重要的补充,但它们不太可能在不久的将来完全取代传统的天气模型。

2017 年,《柳叶刀》科学家使用 21 个统计模型预测了 35 个工业化国家的预期寿命。 13 年后,韩国女性预计平均寿命约为 90.8 岁,可能创下人类寿命历史记录

In 2017, Lancet scientists forecast life expectancy across 35 industrialized countries using 21 statistical models. 13 years later, South Korean women are projected to average about 90.8 years, potentially setting a historic human longevity record

预计到 2030 年,韩国女性的预期寿命将超过 90 岁。这一里程碑是由广泛的医疗保健服务和改善的心血管健康推动的。数十年持续、累积的改善导致了这一显着的人口变化。这些因素创造了一个环境,让保持健康成为最简单的选择。这表明长寿是一个系统问题,而不仅仅是个人纪律问题。

精挑细选的经济模型

Cherry-picking economic models

如果一位著名物理学家(例如理查德·费曼)告诉您,有时力与加速度成正比,有时又与加速度的平方成正比,您会作何反应?我猜你会不为所动。但实际上,大多数主流经济学家在理论方面所做的都是同样奇怪的事情 [...]

精挑细选的经济模型

Cherry-picking economic models

来自 Lars Syll 如果一位著名物理学家(例如理查德·费曼)告诉您,有时力与加速度成正比,有时又与加速度的平方成正比,您会作何反应?我猜你会不为所动。但实际上,大多数主流经济学家所做的都是同样奇怪的事情,当它[...]

团队报告称,实验室之间的差异可能会误导科学人工智能模型

Variations between labs can misinform scientific AI models, team reports

SLAC 国家加速器实验室的科学家与宾夕法尼亚州立大学的两名研究人员一起证明了在构建用于催化剂研究的人工智能模型时生成高度可重复的实验数据的重要性,该框架可以帮助指导将二氧化碳转化为有价值的燃料等反应。

Anthropic 的 Claude 在模型安全评估期间违反沙箱

Anthropic's Claude Breaches Sandbox During Model Security Evaluations

Anthropic 在 OpenAI 沙箱逃逸事件披露后对 141006 次评估运行进行了审计。审查发现了三起克劳德模型因配置错误而访问互联网的事件。这些事件涉及对实时目标的未经授权的攻击。 Anthropic 已暂停进攻性评估,并计划加强安全措施并与外部审计师合作。作者:Olimpiu Pop