跳到正文
千机 API

全部动态

今日 0 条
10月2日周五
  1. Hugging Face Blog

    Ai2 开源科研报告生成模型 AstaBrief 8B

    Ai2 开源 AstaBrief 8B,这是一款将研究问题和检索到的文献片段生成带引用报告的模型,也已作为 Asta 的 Fast mode 上线。Asta 全流程中,Fast mode 平均每份报告耗时 51.1 秒,Thinking mode 为 178.5 秒,约快 3.5 倍;模型从 Qwen3-8B 开始训练,并采用 SFT 和 DPO。

    AstaBrief通过真实科研查询、引用质量筛选和偏好数据训练,展示了小型开放权重模型在科研报告生成中的一种提速路径。

  2. GitHub Blog · AI & ML

    AI 正在改变开发者工作方式:GitHub 分享三项值得加强的技能

    GitHub 提出,开发者应加强三项技能:指挥 AI 智能体完成任务、审查 AI 输出而非轻信首个答案,以及利用节省的实现时间解决更大的问题。文章以 GitHub Copilot 内置的 Rubber Duck 智能体为例,说明其会用第二个模型审查计划、代码和测试;开发者仍需负责判断技术取舍与方案质量。

  3. Hugging Face Blog

    ServiceNow CoreAI 介绍 AutoSynthData 企业智能体训练数据生成流程

    ServiceNow CoreAI 构建了 AutoSynthData,将目标模型在企业环境中的失败转化为新的训练任务,并通过执行、验证和修复筛选样本。文章在 EnterpriseOps Gym 的 Hybrid 和 ITSM 环境中测试了该流程,使用合成数据进行 SFT 后,Hybrid 的 mean Pass@1 提升 7.2 个百分点,ITSM 从 18.77% 提升至 27.18%。

    文章详述了 AutoSynthData 如何从目标模型的失败中构造并验证训练任务,并用 EnterpriseOps Gym 的两个领域展示微调后的指标变化。

  4. NVIDIA Blog

    NVIDIA GPU 加速 OpenAI GPT-6 Astra Ultrafast,最高提升 8x token 生成速度

    GPT-6 Astra Ultrafast 现已通过 OpenAI API 向开发者开放,并提供给符合条件的 ChatGPT Work 和 Codex 用户;运行于 NVIDIA Blackwell GPU,token 生成速度最高可达 Astra Standard 模式的 8x。

    材料将最高 8x 的 token 生成速度提升与编程智能体的编辑、测试和调试循环联系起来,也说明了该模式的可用渠道。

10月1日周四
  1. Google DeepMind

    Google DeepMind发布Gemini 4 Argon,面向复杂工作流与网络防御

    Google DeepMind宣布推出前沿模型Gemini 4 Argon,称其可处理软件工程、企业知识工作和网络安全防御等复杂工作流。模型输出上限从64K提升至1M tokens,并在DeepSWE v1.1取得77.9%,在AutomationBench取得51.3%。

    Argon把长程推理、软件工程和网络防御能力放在同一模型发布中,并披露了内部案例与评测结果,呈现其面向复杂工作流的应用方向。