When silence is safer: a review and decision-theoretic framework for LLM abstention in healthcare
大型语言模型 (LLM) 旨在生成用户提示的答案,这通常会促使他们做出响应,即使不确定性很高、信息不完整或拒绝更合适。在医疗保健领域,这种倾向可能是危险的:自信地陈述但不准确的医疗建议可能会造成重大伤害,因此戒烟的能力尤其重要。在本文中,我们回顾了调查医疗保健领域法学硕士放弃行为的研究。文献强调了两个主要动机:(1)不确定性驱动的弃权,即模型在置信度较低时拒绝做出响应;(2)安全驱动的弃权,即模型拒绝提供潜在有害的信息。大多数现有机制都是外在的,依赖辅助工具来确定何时弃权。我们发现最先进的法学硕士仍然难以拒绝不适当的提示,而且很少有基准评估现实医疗场景中的弃权,其表现落后于其他领域。基于这些发
When your brain works differently, AI isn’t a luxury—it’s accessibility
在这篇文章中,我分享了人工智能如何成为神经分歧专业人士的辅助工具。该系统基于桌面上的 Amazon Quick 构建,这是一个人工智能驱动的桌面和网络助手,可以弥补日常执行功能的差距。
Из чего складывается реальная стоимость агентного ИИ
自主代理的经济性较少依赖于所使用的模型,而更多地依赖于“思考”的数量、周期的数量以及对辅助工具的调用频率。
Gujarat rolls out school buses for children of salt workers
古吉拉特邦推出了 28 辆“Rannshala”巴士,将它们改造成卡奇小牧场盐田工人孩子们的移动教室。这些装备特殊的巴士配有智能电视、太阳能和学习辅助工具,将送达季节性迁徙的 Agariya 家庭。该倡议旨在为 6 至 14 岁的儿童提供教育,缩小这些游牧社区的差距。