NVIDIA DGX Spark 推出 64GB 配置,支持双机集群扩展本地 AI
NVIDIA DGX Spark 将推出 64GB 配置,搭载 DGX OS 和 NVIDIA AI 软件栈,支持在设备上运行最多 100-billion-parameter 模型。
文章对比了单台与双台 DGX Spark 64GB 的内存容量、模型规模支持和测试性能,呈现本地工作负载扩展的具体路径。
NVIDIA DGX Spark 将推出 64GB 配置,搭载 DGX OS 和 NVIDIA AI 软件栈,支持在设备上运行最多 100-billion-parameter 模型。
文章对比了单台与双台 DGX Spark 64GB 的内存容量、模型规模支持和测试性能,呈现本地工作负载扩展的具体路径。
ServiceNow CoreAI 构建了 AutoSynthData,将目标模型在企业环境中的失败转化为新的训练任务,并通过执行、验证和修复筛选样本。文章在 EnterpriseOps Gym 的 Hybrid 和 ITSM 环境中测试了该流程,使用合成数据进行 SFT 后,Hybrid 的 mean Pass@1 提升 7.2 个百分点,ITSM 从 18.77% 提升至 27.18%。
文章详述了 AutoSynthData 如何从目标模型的失败中构造并验证训练任务,并用 EnterpriseOps Gym 的两个领域展示微调后的指标变化。
Anthropic 启动 Claude Frontier Academy,承诺投入 $100 million,计划在 2027 年底前培训 10,000 名 Frontier Deployed Engineers。
GPT-6 Astra Ultrafast 现已通过 OpenAI API 向开发者开放,并提供给符合条件的 ChatGPT Work 和 Codex 用户;运行于 NVIDIA Blackwell GPU,token 生成速度最高可达 Astra Standard 模式的 8x。
材料将最高 8x 的 token 生成速度提升与编程智能体的编辑、测试和调试循环联系起来,也说明了该模式的可用渠道。
Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 中推出智能体视频理解功能,可通过 Gemini API 分析上传视频和 YouTube 视频。该功能动态搜索和检查视频画面、音频及转录内容,在标准视频分析基准中最多减少 88% 的 token 消耗、降低 66% 的成本,并将准确率提升最多 7%。
该功能通过动态检索视频片段、音频和转录内容处理长视频,并公布了 token 消耗、成本与准确率变化,呈现了效率和质量之间的量化比较。