跳到正文
千机 API

数据与训练

训练侧的门道:数据集构建、合成数据、预训练与后训练方法、算力与训练成本。

最新精选

第 1–2 条 · 共 2 条
10月2日周五
  1. Hugging Face Blog

    Ai2 开源科研报告生成模型 AstaBrief 8B

    Ai2 开源 AstaBrief 8B,这是一款将研究问题和检索到的文献片段生成带引用报告的模型,也已作为 Asta 的 Fast mode 上线。Asta 全流程中,Fast mode 平均每份报告耗时 51.1 秒,Thinking mode 为 178.5 秒,约快 3.5 倍;模型从 Qwen3-8B 开始训练,并采用 SFT 和 DPO。

    AstaBrief通过真实科研查询、引用质量筛选和偏好数据训练,展示了小型开放权重模型在科研报告生成中的一种提速路径。

  2. Hugging Face Blog

    ServiceNow CoreAI 介绍 AutoSynthData 企业智能体训练数据生成流程

    ServiceNow CoreAI 构建了 AutoSynthData,将目标模型在企业环境中的失败转化为新的训练任务,并通过执行、验证和修复筛选样本。文章在 EnterpriseOps Gym 的 Hybrid 和 ITSM 环境中测试了该流程,使用合成数据进行 SFT 后,Hybrid 的 mean Pass@1 提升 7.2 个百分点,ITSM 从 18.77% 提升至 27.18%。

    文章详述了 AutoSynthData 如何从目标模型的失败中构造并验证训练任务,并用 EnterpriseOps Gym 的两个领域展示微调后的指标变化。