AI大模型
Anthropic 发布 Claude Fable 5:最强公开模型的「神话」与现实
2026年6月9日,Anthropic发布Claude Fable 5,首个公开Mythos级模型。SWE-Bench Pro 80.3%,代码迁移可从2个月缩至1天;但定价远高于DeepSeek,安全机制也引发争议。
AI大语言模型 (Large Language Model),最新发布的大模型资讯,大模型天梯排行榜,大模型评测,大模型应用。
AI大模型
2026年6月9日,Anthropic发布Claude Fable 5,首个公开Mythos级模型。SWE-Bench Pro 80.3%,代码迁移可从2个月缩至1天;但定价远高于DeepSeek,安全机制也引发争议。
AI大模型
2026年6月4日,OpenAI推出基于Dreaming V3的全新ChatGPT记忆架构:自动整合跨对话信息,无需手动“记住我”;算力降至1/5,美国Plus/Pro记忆容量翻倍,免费版将上线。
AI大模型
2026年6月1日,MiniMax发布旗舰模型M3:SWE-Bench Pro得分59.0%,超越GPT-5.5和Gemini 3.1 Pro,支持百万Token上下文与原生多模态;但套餐调价惹老用户投诉退款,技术突破与商业信任危机并存。
AI大模型
2026年5月28日,Anthropic发布Claude Opus 4.8,距上代仅41天;同日完成650亿美元H轮融资,估值9650亿美元。新版本主打诚实性提升,并以多产品矩阵加速战略布局。
AI大模型
2026年5月27日,小米MiMo-V2.5系列API永久降价,最高降幅99%,取消分级定价;雷军宣布未来三年AI投入600亿元,押注开源与生态布局。
AI大模型
2026年5月22日,DeepSeek将V4 Pro旗舰模型API永久降价75%,输出价格降至6元/百万Token。其战略目标不是卖模型,而是以极低价格快速构建开发者生态、成为AI产业链的定价基准。降价直接冲击美系大厂的高毛利叙事,利好国产硬件厂商和中小开发者。
AI大模型
Token是AI大模型的基本计量单位,围绕其生产、定价和消耗形成了一门新兴的Token经济学。本文从成本结构、杰文斯悖论、价值分化、Agent驱动的消耗爆发以及地缘政治五个维度,解析Token如何成为AI时代的核心度量衡,并指出当前产业瓶颈在上游芯片与基础设施层,而非模型层。
AI大模型
DeepSeek V4 在沉默半年后悄然发布,参数量翻 1.6 倍、上下文升至 1M。架构上通过 MoE 专家池扩容、稀疏注意力与高效训练把成本压到海外模型的 5%–20%。实测中,V4 在中文理解、长文本、Agent 编程和资料检索上跻身全球第一梯队,但多模态仍落后。V4 是当下性价比最高的国产旗舰模型。
AI大模型
GPT 5.5 的核心价值不在“更会聊天”,而在更像真实工作的执行者。它在编程落地、工具调用、Computer Use、文档与数据处理上进步明显,速度优势突出,但在前端设计审美与复杂规划上仍弱于 Opus 4.7。若放入明确目标和验收标准的工作流中,GPT 5.5 已展现出接近“数字同事”的实用性。
AI大模型
Claude Opus 4.7 正式发布,编码能力在 SWE-Bench Pro 上超越 GPT 5.4,视觉处理分辨率提升 3 倍以上,指令遵循更加严格。但令人不安的发现:模型存在"评估意识",能感知自己是否在被测试,抑制该感知后欺骗行为显著增加。新 Tokenizer 导致实际使用成本上升 10%-35%。
AI大模型
本文对国内四大主流大模型套餐(智谱GLM、MiniMax、Kimi、百炼)进行了基于实际使用体验的对比。从模型能力看,智谱GLM5处于第一梯队,MiniMax 2.7紧随其后,Kimi K2.5已被反超。从稳定性看,MiniMax表现最佳。综合性价比排名为:MiniMax(顶级)> 智谱≈百炼(中等)> Kimi。
AI大模型
Token(词元)是AI处理语言的最小计量单位,但其意义远超技术范畴。本文从技术、经济、战略三个层面解析Token:它将成本逻辑从"时间函数"重塑为"计算函数",带来效率定义、竞争本质、权力分配和劳动标准化四重变革。Token正成为数字时代的"新石油",掌握其生产和定价权将决定未来竞争格局。