第二篇关键词检索结果

为监督微调准备数据 第2部分:高级数据策略

Preparing data for supervised fine-tuning Part 2: Advanced data strategies

监督微调数据准备的高级方面。本两篇系列的第二篇涵盖使用学习曲线评估数据就绪性、选择高价值数据子集、使用合成和蒸馏样本增强数据以及混合数据源。

扩展代理 AI:无需供应商锁定的企业模式

Scaling agentic AI: Enterprise patterns without vendor lock-in

在整个企业范围内扩展代理 AI 需要能够保持灵活性同时避免供应商锁定的模式。在多智能体系列的第二篇文章中,我们研究了机器学习团队如何在框架、模型和提供者的多元环境中操作许多智能体人工智能系统,以及让这些系统一起扩展的原则。

后训练的两大支柱:强化学习和监督微调

The Two Pillars of Post-training: Reinforcement Learning and Supervised Fine-Tuning

这是Sharon Zhou培训后系列的第二篇文章。请在此处阅读第 1 部分。在本系列的第一篇文章中,您了解了培训后如何通过使法学硕士以某种方式表现来缩小其可用性的根本差距。在这篇文章中,您将探索可用于更改模型的 [...]

随着俄罗斯战争的拖延,乌克兰的胜利理念变得多样化和扩大

Ukrainian Ideas of Victory Diversify and Expand as Russia’s War Drags On

本文是系列文章中的第二篇文章,该系列文章基于 2026 年 4 月 13 日至 24 日在乌克兰基辅对公民、人道主义和政治专家进行的 16 次采访收集的数据。该项目的目标是准确、最新地了解构成现代乌克兰的众多现实。这篇文章探讨了胜利意味着什么……随着俄罗斯战争的拖延,后乌克兰人的胜利理念多样化并扩大,首先出现在詹姆斯敦。