Ranked: Countries With the Biggest Declines in Academic Freedom
来自视觉资本家:学术自由反映了大学和学者在不受政治干预的情况下研究、教学、出版和交流思想的能力。该图表使用 V-Dem 研究所通过“我们的数据世界”提供的数据,根据 2015 年至 2025 年学术自由指数得分的百分比变化对各国进行了排名。主要发现:尼加拉瓜、缅甸和 [...]
How to Make an Invisible Drone
有很多词我永远不会用来描述无人机。隐秘的。微妙的。不管讨厌的反面是什么。这在很大程度上是因为无人机往往会发出巨大而愤怒的蜜蜂声音,但这也是它们在飞行中的样子:凭借令人难以置信的线性运动和更不精明的完美静止悬停能力,它们往往会被视为对自然的侮辱。本周在悉尼举行的 RSS 2026 大会上发表的一篇论文中,来自伊利诺伊州埃文斯顿西北大学的机器人专家展示了一种名为 Phantom Twist 的无人机,它对人类来说基本上是看不见的,是一种在飞行中比典型的四旋翼飞行器更难看到星等。他们借助计算设计实现了这一目标,虽然我认为,由此产生的硬件比典型的四旋翼飞行器对自然的侮辱要大一个数量级,但它的工作效果却
The Surprising Reason Women May Seem Better at Multitasking
男性和女性在大多数多任务处理指标上的表现相似,但对话参与度的差异可能会影响人们对他们整体能力的看法。一个人可以继续做饭、搜索信息和跟踪视觉任务,而不会显得不知所措。但如果他们在谈话中停止回应,其他人可能很快就会认为他们失去了控制。 [...]
Rare Iridescent Optical Effect Discovered in a Famous Australian Frog
一种濒临灭绝的澳大利亚青蛙在众目睽睽之下隐藏着非凡的视觉技巧。纽卡斯尔大学的研究人员发现,绿色和金色的钟蛙(Ranoidea aurea)的大腿内侧有虹彩皮肤。当青蛙或观察者移动时,通常为蓝色的区域会显示为绿色,从而形成最清晰的区域之一 [...]
Harcledo toyoshiaoae Kodama, Watabe, Nakaguchi & Wakabayashi, 2026「オオメダマヨコエビ」 DOI: doi.org/10.1080/14772000.2026.2659885摘要深海视觉环境在光线中呈现出极端的梯度强度,导致眼睛形态的差异。在片脚亚目的中,这种特化在远洋的 Hyperiideans 中已有记载,而深海的 Eusiridae 仍然鲜为人知。在日本的一次深海调查中,我们收集了一种眼睛明显放大的eusirid片脚类动物。使用形态学和四个 DNA 条形码区域的综合分类法表明,它代表了单型 Harcledo Barnard
Visual Inspection Cell: Photo Window, Part Posture, And Recheck Loop
通过在报价前检查照片窗口、零件姿态、照明、机器人访问、重新检查路由和异常处理来规划视觉检查单元。视觉检查单元:照片窗口、零件姿态和重新检查循环首先出现在EVST中。
Precision approach lighting system aids smoother landing on Mangaluru’s tabletop runway
精密进场照明系统在着陆进场期间为飞行员提供清晰的视觉参考,特别是在低能见度条件下
BjPro-7a,一种来自白腹蛇毒液的富含脯氨酸的肽,可逆转 MPP⁺ 引起的运动缺陷并挽救帕金森病斑马鱼模型中的线粒体、氧化还原和突触蛋白质组通路摘要帕金森病 (PD) 和相关帕金森病涉及线粒体稳态、氧化还原的进行性破坏平衡、突触功能和蛋白质稳态。现有的疗法仍然主要针对症状,这促使人们寻找跨应激敏感途径发挥作用的多靶点化合物。 BjPro-7a (pEDGPIPP) 是一种来自白腹蛇毒液的富含脯氨酸的寡肽,在氧化应激下发挥细胞保护作用,但其在体内帕金森病样模型中的活性尚不清楚。在这里,我们研究了 BjPro-7a 是否可以减轻 1-甲基-4-苯基吡啶鎓 (MPP+) 在斑马鱼幼虫中引起的行为
Pre-training isn’t bitter enough
理查德·萨顿 (Richard Sutton) 的“惨痛教训”通常被解读为对人工智能系统构建过多人类知识的警告。从长远来看,获胜的方法不是那些最直接编码我们聪明直觉的方法,而是那些可扩展的方法:搜索、学习和其他可以吸收更多计算和数据的通用方法。乍一看,现代基础模型预训练看起来就像是该课程的胜利。我们采用通用架构,将其暴露给海量数据,并以简单的自我监督目标对其进行训练。语言模型预测下一个标记。视觉模型重建遮罩斑块、对齐视图或匹配教师表示。该配方简单且可扩展。但有一个问题。预训练可能会遵循“痛苦的教训”来训练模型,但不会选择模型应该训练的内容。目标仍然是在训练循环之外选择的。我们进行大规模的预训练
Incentivizing Temporal-Awareness in Egocentric Video Understanding Models
多模态大语言模型 (MLLM) 最近在视觉理解方面表现出了强大的性能,但它们往往缺乏时间意识,特别是在以自我为中心的环境中,其中推理取决于事件的正确排序和演变。这种缺陷部分源于训练目标未能明确奖励时间推理,而是依赖于帧级空间快捷方式。为了解决这个限制,我们提出了时态全局策略优化(TGPO),这是一种具有可验证奖励的强化学习(RLVR)算法,旨在激励时态……
IEEE Transactions on Neural Networks and Learning Systems, Volume 37, Issue 7, July 2026
1) 视频异常检测的深度学习:综述作者:P. Wu, C. Pan, Y. Yan, G. Pang, Q. Yan, P. Wang, Y. ZhangPages: 3010 - 30302) A Survey on Vision--Language--Action Models for Embodied AI 作者:Y. Ma, Z. Song, Y. Zhuang, J.hao, I. KingPages: 3031 - 30513) Graph Transformers: A Survey 作者:A. Shehzad, F. Xia, S. Abid, C. Peng, S. Yu,
How Robotiq Built the TSF-85 Tactile Sensor to the Spec of the Human Hand
阅读 Jennifer Kwiatkowski 在 Tech Brief 上发表的完整技术文章。对于构建富含接触操作的团队来说,触觉传感正在从有用的补充转变为合理的要求。仅视觉操纵已经碰壁,触觉增强策略在接触丰富的任务上优于仅视觉基线,并且更好的感知在成本上击败了强力数据规模。到目前为止,联系数据属于培训渠道的原因已经明确。
ANN's Daily Aero-Term (07.07.26): Clutter
杂波 在雷达操作中,杂波是指由降水、箔条、地形、大量飞机目标或其他现象引起的雷达回波的接收和视觉显示。此类回报可能会限制或阻止 ATC 提供基于雷达的服务。
Automatically redact PII in images with Amazon Nova
在这篇文章中,我们介绍了一个由 Amazon Nova 指导的多步骤管道,该管道使用其上下文视觉推理来协调互补工具,包括部署在 Amazon SageMaker AI 上用于像素级分割的 Meta 开源 Segment Anything Model (SAM 3) 和用于光学字符识别 (OCR) 的 Amazon Textract。该管道旨在提供全面且合规的 PII 编辑,即使是具有挑战性的边缘情况,例如任意方向的指纹、身份证或车牌。
视觉单词卡只有一项工作。这本来应该很简单。我忍住了这个词。学生看了看。我们实践了它。我们说过了。我们拼写了它。我们为之鼓掌。我们对它的关注可能比一些名人走上红地毯还要多。然后,两天后,[……]帖子“先于视觉”首先出现在“教育者室”上。
Weblica: Scalable and Reproducible Training Environments for Visual Web Agents
网络复杂、开放且不断变化,这使得扩展可视网络代理的训练数据变得具有挑战性。现有的数据收集尝试仍然仅限于用于监督微调的离线轨迹或用于 RL 训练的少数模拟环境,因此无法捕获网络多样性。我们提出了Weblica(Web Replica),一个用于构建可复制和可扩展的Web环境的框架。我们的框架利用 1) HTTP 级缓存来捕获和重播稳定的视觉状态,同时保留交互行为,以及 2) 基于 LLM 的环境合成......