GPT 6.1 Sol:五分之一价格,接近 Astra 的智能水平
GPT 6.1 Sol 发布,智能水平接近 Astra,价格仅为后者的五分之一。Simon Willison 于 9 月 29 日发布月度简报,追踪 LLM 领域重大进展。
GPT 6.1 Sol 发布,智能水平接近 Astra,价格仅为后者的五分之一。Simon Willison 于 9 月 29 日发布月度简报,追踪 LLM 领域重大进展。
OpenAI 推出 GPT-6.1 Sol,定位为接近 Astra 智能水平的模型,专注于编码、计算机操作和专业工作,API 输入和输出 token 价格降至 Astra 标准价格的三分之一。
Harvey 集成 GPT-6 Astra,提升法律文档的结构化程度和上下文相关性。GPT-6 Astra 可生成更精准的法律草稿,使律师从撰写工作中解放,专注于战略决策。
Anthropic 与 OpenAI 于 9 月 22 日同日发布新模型,Claude Opus 5.5 定价下调 20% 至 $4/M(输入)/ $20/M(输出),而 OpenAI 将 GPT-6 Sol 和 GPT-6 Luna 定价为 GPT-5.6 系列的半价,GPT-6 Luna 最低至 $0.10/M(输入)/ $0.50/M(输出),引发了新一轮价格战。
OpenAI 发布 GPT-6 Sol 和 Luna 两个模型,旨在将前沿智能带入日常工作场景,两个版本在能力和成本上提供不同平衡。具体参数、价格及可用性尚未公布。
OpenAI 推出 GPT-6 Astra,称其为面向企业推出的最强模型。GPT-6 Astra 具备高级推理能力和计算机操作能力,并增强了写作与设计判断力。
OpenAI 推出 GPT-6 Astra,定位为“最智能、最对齐”的模型,在 computer use、coding、cybersecurity、science 领域具备 SOTA 能力。GPT-6 Astra 代表该公司新一代智能方向,尚未公布具体参数与上线时间。
GPT-6 Astra 是 OpenAI 迄今能力最强且部署最广泛的大语言模型,也是首款在 Preparedness Framework 下达到网络安全 Critical 级别的模型。
推荐理由:原文给出了该模型在 Preparedness Framework 下达到 Critical 级别的具体安全评估结论,读者可据此了解当前前沿模型的安全能力边界。
Astra 是 OpenAI 首个达到 Preparedness Framework 下关键网络安全能力阈值的模型,附带更强的发布安全防护措施。
推荐理由:原文给出了该模型的具体能力定位(达关键网络安全阈值)和安全保障层级( Preparedness Framework + 更强防护),读者可据此判断其适用场景与风险边界。
OpenAI 发布 GPT-5.6,宣称每 token 智能更强、每美元性能更优,并支持按需调用以应对高难度工作。
OpenAI 在 2026 Gartner Magic Quadrant 企业 AI 编码智能体评估中被评为领导者,Codex 因创新性和企业级部署能力获得认可。Gartner 报告指出 OpenAI 在愿景完整性与执行能力两个维度均处于领先地位。
Databricks 将 GPT-5.5 集成至企业 AI 智能体工作流。该模型此前在 OfficeQA Pro 基准测试中创下 SOTA,为企业场景提供了更强的任务处理能力。此次合作瞄准大规模企业数据场景下的智能体应用需求。
GPT-5.5 Instant 更新了 ChatGPT 的默认模型,带来更智能、更准确的回答,幻觉减少,并改进了个性化控制选项。
推荐理由:原文给出了 GPT-5.5 Instant 的主要改进方向,读者可据此判断这次默认模型更新对日常对话体验的具体影响。
GPT-5.5 发布,专为 coding、research、data analysis 等复杂任务构建,支持跨工具推理。定位区别于 GPT-5o 的日常对话场景,聚焦多工具协同的专业工作流。
OpenAI 发布 GPT-5.4,定位为其最强大且高效的前沿模型,专为专业工作设计,具备前沿的编码、计算机使用、工具搜索能力和 1M-token 上下文窗口。
推荐理由:原文给出了具体能力变化(编码、计算机使用、工具搜索、1M-token 上下文),读者可以据此判断它对专业工作流的影响。
OpenAI 发布 GPT-4.5 研究预览版本,号称是其迄今为止最大、最博学的模型。