AI 正在改变开发者工作方式:GitHub 分享三项值得加强的技能
GitHub 提出,开发者应加强三项技能:指挥 AI 智能体完成任务、审查 AI 输出而非轻信首个答案,以及利用节省的实现时间解决更大的问题。文章以 GitHub Copilot 内置的 Rubber Duck 智能体为例,说明其会用第二个模型审查计划、代码和测试;开发者仍需负责判断技术取舍与方案质量。
GitHub 提出,开发者应加强三项技能:指挥 AI 智能体完成任务、审查 AI 输出而非轻信首个答案,以及利用节省的实现时间解决更大的问题。文章以 GitHub Copilot 内置的 Rubber Duck 智能体为例,说明其会用第二个模型审查计划、代码和测试;开发者仍需负责判断技术取舍与方案质量。
GPT-6 Astra Ultrafast 现已通过 OpenAI API 向开发者开放,并提供给符合条件的 ChatGPT Work 和 Codex 用户;运行于 NVIDIA Blackwell GPU,token 生成速度最高可达 Astra Standard 模式的 8x。
材料将最高 8x 的 token 生成速度提升与编程智能体的编辑、测试和调试循环联系起来,也说明了该模式的可用渠道。
Google DeepMind宣布推出前沿模型Gemini 4 Argon,称其可处理软件工程、企业知识工作和网络安全防御等复杂工作流。模型输出上限从64K提升至1M tokens,并在DeepSWE v1.1取得77.9%,在AutomationBench取得51.3%。
Argon把长程推理、软件工程和网络防御能力放在同一模型发布中,并披露了内部案例与评测结果,呈现其面向复杂工作流的应用方向。
Anthropic 发布 Claude Sonnet 5.5,这是 Claude 5.5 家族的第二款模型,较 Sonnet 5 生成速度提升 30% 以上,单项任务成本最高降低 30%。
文章将 Sonnet 5.5 与前代及 Opus 5.5 的评测、任务成本和速度并列呈现,帮助读者了解其定位及不同工作负载下的取舍。
Google DeepMind 发布 Gemini 3.8 Flash 和 Gemini 3.8 Flash Cyber,两者由相同基础智能驱动,面向智能体工作流与网络安全任务。
文章并列呈现通用版与网络安全版的定位、基准表现和接入范围,便于比较两种模型在长程编码与防御任务中的取舍。