跳到正文
千机 API

#推理

今日 1 条
今天10月3日周六
10月2日周五
  1. Hugging Face Blog

    Ai2 开源科研报告生成模型 AstaBrief 8B

    Ai2 开源 AstaBrief 8B,这是一款将研究问题和检索到的文献片段生成带引用报告的模型,也已作为 Asta 的 Fast mode 上线。Asta 全流程中,Fast mode 平均每份报告耗时 51.1 秒,Thinking mode 为 178.5 秒,约快 3.5 倍;模型从 Qwen3-8B 开始训练,并采用 SFT 和 DPO。

    AstaBrief通过真实科研查询、引用质量筛选和偏好数据训练,展示了小型开放权重模型在科研报告生成中的一种提速路径。

  2. NVIDIA Blog

    NVIDIA GPU 加速 OpenAI GPT-6 Astra Ultrafast,最高提升 8x token 生成速度

    GPT-6 Astra Ultrafast 现已通过 OpenAI API 向开发者开放,并提供给符合条件的 ChatGPT Work 和 Codex 用户;运行于 NVIDIA Blackwell GPU,token 生成速度最高可达 Astra Standard 模式的 8x。

    材料将最高 8x 的 token 生成速度提升与编程智能体的编辑、测试和调试循环联系起来,也说明了该模式的可用渠道。

10月1日周四
  1. Google DeepMind

    Google DeepMind发布Gemini 4 Argon,面向复杂工作流与网络防御

    Google DeepMind宣布推出前沿模型Gemini 4 Argon,称其可处理软件工程、企业知识工作和网络安全防御等复杂工作流。模型输出上限从64K提升至1M tokens,并在DeepSWE v1.1取得77.9%,在AutomationBench取得51.3%。

    Argon把长程推理、软件工程和网络防御能力放在同一模型发布中,并披露了内部案例与评测结果,呈现其面向复杂工作流的应用方向。

9月28日周一
9月16日周三
9月10日周四
  1. DeepSeek API 更新

    DeepSeek 发布 DeepSeek-V4.1-Flash,支持原生多模态视觉理解

    DeepSeek 正式发布 DeepSeek-V4.1-Flash,这是其新架构系列中最小的模型,具备原生多模态视觉理解能力。模型已在 DeepSeek API 上线,调用最新版本需使用模型名 `deepseek-flash`;上一代 V4 Flash 和 V4 Flash Vision Exp 已退役,旧模型名暂时路由至 V4.1 Flash,API 价格也已相应下调。

    这次更新同时涉及模型能力、API 调用名称、旧版路由和价格调整,便于开发者梳理升级时的兼容性与成本变化。

9月3日周四
8月13日周四