获取独家产品信息,尽享促销优惠!立即订阅,不容错过
* 限···时··优惠
Beyond Next-Token Prediction: A Performance Characterization of Diffusion versus Autoregressive Language Models
大型语言模型 (LLM) 在广泛的自然语言处理 (NLP) 任务(包括文档处理和代码生成)上取得了最先进的性能。自回归语言模型(ARM)根据所有先前的标记顺序生成标记,一直是法学硕士的主要范例。虽然这些模型在一系列下游任务中实现了高精度,但由于下一个令牌预测中固有的顺序依赖性,它们表现出较低的算术强度。最近,扩散语言模型 (DLM) 已成为一种有前途的......