AI大模型
GPT-6 Astra发布:从会回答到直接交付工作
GPT-6 Astra已正式发布,但尚未向所有用户开放。它的核心变化不是单纯提升聊天和跑分,而是能够操作电脑、调用专业软件、执行多步骤任务并交付结果。本文梳理其能力、测试、成本与安全边界,并讨论“AGI时代”是否已有充分事实依据。
AI大语言模型 (Large Language Model),最新发布的大模型资讯,大模型天梯排行榜,大模型评测,大模型应用。
AI大模型
GPT-6 Astra已正式发布,但尚未向所有用户开放。它的核心变化不是单纯提升聊天和跑分,而是能够操作电脑、调用专业软件、执行多步骤任务并交付结果。本文梳理其能力、测试、成本与安全边界,并讨论“AGI时代”是否已有充分事实依据。
AI大模型
Anthropic 于 2026 年 9 月 1 日发布 Claude Fable 5.1 与 Mythos 5.1。两者采用相同基础模型,但面向不同安全边界;Fable 5.1 的能力提升集中在长程智能体任务,实际降本主要来自缓存读取价格下降。
AI大模型
Qwen3.8-27B的本地部署,关键不只是显卡能否装下模型,还要看量化格式、MTP加速和实际任务类型。本文对比RTX 3090、4090与5090的显存门槛、生成速度和使用体验。
AI大模型
DeepSeek V4 Pro正式版接入API,重点升级Agent、代码工程、工具调用与长上下文能力。本文结合接口规格、工程实测、价格结构和接入细节,分析百万Token上下文如何落地,以及Pro与Flash该怎么选。
AI大模型
Kimi K3开放2.8万亿参数模型权重与关键训练Infra,带来长上下文、多模态和Agent能力,也把超大模型部署成本摆到台前。
AI大模型
Claude Opus 5 以 Opus 4.8 相同价格上线,能力逼近 Fable 5。它不只是在跑分上提升,更把复杂工程、Agent、科研和企业自动化任务的可用门槛往下拉了一截。
AI大模型
月之暗面正式发布Kimi K3,官方确认2.8万亿参数、100万token上下文、原生多模态理解,主打软件工程与深度推理。本文梳理其架构细节、实测案例、评测数据、全渠道定价与开放计划,并给出K3与K2.7 Code、K2.6如何搭配使用的选型建议。
AI大模型
OpenAI上周五一次性推出Sol、Terra、Luna三款GPT-5.6模型,同时把Codex并入ChatGPT桌面版,衍生出Work新模式。本文梳理三款模型的定位与价格、跑分与安全表现、产品架构变化,以及官方演示与民间实测之间的落差,帮不同用户判断该怎么用。
AI大模型
2026年7月3日,阿里巴巴突然宣布全面禁用Claude系列产品。几个月前,公司还在为员工报销每周数百美元的Claude使用费。这场180度转变的背后,是Anthropic的蒸馏攻击指控、Claude Code被曝植入隐蔽标记系统,以及中美AI技术博弈下企业数据安全与供应链风险的全面爆发。
AI大模型
2026年6月30日,美团发布LongCat-2.0,总参数1.6万亿、激活参数约480亿,号称首个在五万卡国产算力集群完成全流程训练与推理的AI Agent模型,聚焦代码生成与长上下文。
AI大模型
2026年6月27日,OpenAI 突袭发布 GPT-5.6:Sol、Terra、Luna 登场。旗舰 Sol 跑分创新高却陷作弊争议,更关键的是美国介入下仅限预览,访问资格比性能更稀缺。
AI大模型
2026年6月27日,DeepSeek联合北大发布并开源DSpark推理加速框架,已用于DeepSeek-V4生产引擎,单用户生成速度提升60%-85%,高并发吞吐最高提升661%。