Anthropic 为 Claude Code 推出 Mods 系统,支持从内部定制 AI 编码工具
Anthropic 为 Claude Code 发布 Mods 系统,这是一个基于 JavaScript 或 TypeScript 的插件系统,允许开发者通过事件钩子自定义界面、拦截工具调用或添加新命令。
Anthropic 为 Claude Code 发布 Mods 系统,这是一个基于 JavaScript 或 TypeScript 的插件系统,允许开发者通过事件钩子自定义界面、拦截工具调用或添加新命令。
GitHub指出AI正在重塑开发者工作流程,建议强化三项核心技能:学会定义问题并协调多个AI智能体协作;不盲目信任AI首个答案,用第二模型或自身判断进行验证;利用AI处理实现工作,腾出时间专注于需求理解、权衡评估和技术决策。GitHub Copilot已内置Rubber Duck智能体,用第二模型批判性检查计划、代码和测试。
Airbnb CTO Ahmad Al-Dahle(曾主导 Meta 的 Llama 系列开源模型)提出「由内而外」的 AI 转型方法:先用 AI 加速内部产品开发,再将能力输出至用户体验。
Google DeepMind 发布前沿模型 Gemini 4 Argon,输出 token 限制扩展至 1M,支持复杂长周期工作流。模型已赋能 Google 内部编码和知识工作,在 CWE-bench v1 漏洞修复中达 68%、Vals Finance Agent v2 多步金融研究中领先、视频理解基准 LVBench 达 91.7%。
推荐理由:模型在复杂工作流中的具体表现有数字支撑(1M token 输出、CWE-bench 68%、2.7x 加速等),便于读者判断其对实际工作的价值。
OpenAI 在 DevDay 2026 上发布了 Dots(由 GPT-6 Astra 驱动的常驻智能体,连接 4000+ 应用)、GPT-6.1 Sol(定价 $2/$10/M token。
GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,据 OpenAI 介绍它在编码、计算机操作和专业工作场景中提供接近 Astra 的推理能力。
推荐理由:原文给出了性能对比数字(DeepSWE v1.1 成本降为五分之一、超越 GPT-6 Sol 6.4 个百分点)和 Codex 的集成路径,读者可以据此判断它是否值得替换现有 Agent 工作流。
Simon Willison 用 GPT-6 Astra 构建了 Photo Scrubber,可自动识别照片中的人脸并模糊处理,完全在本地运行不依赖云端。该工具基于 Google MediaPipe C++ 库(编译为 WebAssembly)+ BlazeFace 人脸检测模型,支持批量处理并移除 EXIF 等元数据。
Anthropic 于 9 月 28 日发布 Claude Sonnet 5.5,官方称其速度提升 30% 以上,多数任务成本降低 30%,定价与 Sonnet 5 相同但各项基准测试均有提升。
Simon Willison 反思认为,花越多时间使用 coding agents,越确信它们让软件工程变得更难;虽然可以用这些工具实现惊人的成果,但充分发挥其潜力需要极高的纪律性和知识储备。开发者不应低估掌握 AI 工具的复杂度。
AI 并未消除代码审查的必要性,而是将风险重新分布到不同环节——关键在于判断哪些代码需要深入检查。RAG 并未消亡,它通过缩小搜索空间帮助模型更接近答案;Skills 与 MCP 解决的是不同层次的问题,前者提供上下文和最佳实践,后者提供标准化工具接入,二者可共存于同一工作流。GitHub 建议开发者用具体情境测试热点观点,而非陷入非此即彼的立场之争。
GitHub Copilot agent runtime 从 TypeScript/Node.js 迁移至纯 Rust,作者记录了历时约 14.5 周、完成 128 个 pull request、最终交付 832,378 行生产 Rust 代码的全过程。
推荐理由:作者作为主要执行人记录了超过 80 万行 TypeScript 迁移至 Rust 的完整过程,包含具体策略、工具调用数据和团队协作方法,读者可据此评估大规模 AI 辅助代码迁移的实际可行路径。
GitHub Copilot 应用新增 diff、terminal 和 browser 三个内置面板,用户可在单一应用内完成代码审查、运行和预览,无需切换窗口。