Helping the Workforce Lean into AI with Monica Marquez, Co-Founder of FlipWork
主持人迈克·帕尔默 (Mike Palmer) 与 FlipWork 创始人兼 UNT 达拉斯分校 TIDE 中心创始主任莫妮卡·马尔克斯 (Monica Marquez) 进行了交流,探讨人类如何应对人工智能在工作场所的快速颠覆。 Monica 借鉴了她在高盛、谷歌和美国银行等行业巨头在人力资本、多样性和领导力发展方面的深厚背景,为人工智能革命带来了一种以人为本的方法。Mike 和 Monica 跳过了标准的人工智能炒作,讨论了为什么仅仅推出人工智能工具不足以推动真正的采用。他们深入探讨了人工智能集成的心理学,解开了莫妮卡所说的“身份瓶颈”——工人从“努力等于成功”的传统思维转变为“影
当 NASA 于 1977 年发射航行者号时,该航天器的设计工作时间约为四年。近 50 年后,它仍在运行,距离地球超过 150 亿英里,是有史以来飞行过的最远的人造物体。最奇怪的是它仍然如何与我们交谈。它的发射器输出功率约为 20 瓦,比冰箱灯泡的功率还低,但信号可以穿越星际空间到达地球。现在,一条单向消息几乎需要一整天的时间,因此工程师要等待长达 48 小时才能确认命令已发送。 Voyager 的核发电机每年衰减约 4 瓦,迫使 NASA 逐个关闭仪器,这是为了保持 1970 年代机器的运转而进行的缓慢谈判。
When Unlearning Is Free: Leveraging Low Influence Points to Reduce Computational Costs
随着对机器学习中数据隐私的担忧不断增加,从训练模型中遗忘或删除特定数据点的能力变得越来越重要。尽管最先进的遗忘方法已经出现,但它们通常平等地对待遗忘集中的所有点。在这项工作中,我们通过询问来挑战这种方法:是否需要删除对模型学习影响可忽略不计的点?通过对语言和视觉任务的影响函数进行比较分析,我们确定了对模型输出影响可以忽略不计的训练数据子集……
Embarrassingly Simple Self-Distillation Improves Code Generation
大型语言模型 (LLM) 能否在没有验证器、教师模型或强化学习的情况下仅使用其自己的原始输出来改进代码生成?我们通过简单自蒸馏(SSD)给出肯定的答案:从具有特定温度和截断配置的模型中抽取样本解决方案,然后使用标准监督微调对这些样本进行微调。 SSD 在 LiveCodeBench v6 上将 Qwen3-30B-Instruct 从 42.4% 提高到 55.3% pass@1,收益主要集中在更难的问题上,并且它在 4B、8B 和 30B 规模的 Qwen 和 Llama 模型上进行了推广,包括......