AI大模型
Qwen3.8-27B本地实测:3090、4090与5090怎么选
Qwen3.8-27B的本地部署,关键不只是显卡能否装下模型,还要看量化格式、MTP加速和实际任务类型。本文对比RTX 3090、4090与5090的显存门槛、生成速度和使用体验。
AI大语言模型 (Large Language Model),最新发布的大模型资讯,大模型天梯排行榜,大模型评测,大模型应用。
AI大模型
Qwen3.8-27B的本地部署,关键不只是显卡能否装下模型,还要看量化格式、MTP加速和实际任务类型。本文对比RTX 3090、4090与5090的显存门槛、生成速度和使用体验。
AI大模型
DeepSeek V4 Pro正式版接入API,重点升级Agent、代码工程、工具调用与长上下文能力。本文结合接口规格、工程实测、价格结构和接入细节,分析百万Token上下文如何落地,以及Pro与Flash该怎么选。
AI大模型
Kimi K3开放2.8万亿参数模型权重与关键训练Infra,带来长上下文、多模态和Agent能力,也把超大模型部署成本摆到台前。
AI大模型
Claude Opus 5 以 Opus 4.8 相同价格上线,能力逼近 Fable 5。它不只是在跑分上提升,更把复杂工程、Agent、科研和企业自动化任务的可用门槛往下拉了一截。
AI大模型
月之暗面正式发布Kimi K3,官方确认2.8万亿参数、100万token上下文、原生多模态理解,主打软件工程与深度推理。本文梳理其架构细节、实测案例、评测数据、全渠道定价与开放计划,并给出K3与K2.7 Code、K2.6如何搭配使用的选型建议。
AI大模型
OpenAI上周五一次性推出Sol、Terra、Luna三款GPT-5.6模型,同时把Codex并入ChatGPT桌面版,衍生出Work新模式。本文梳理三款模型的定位与价格、跑分与安全表现、产品架构变化,以及官方演示与民间实测之间的落差,帮不同用户判断该怎么用。
AI大模型
2026年7月3日,阿里巴巴突然宣布全面禁用Claude系列产品。几个月前,公司还在为员工报销每周数百美元的Claude使用费。这场180度转变的背后,是Anthropic的蒸馏攻击指控、Claude Code被曝植入隐蔽标记系统,以及中美AI技术博弈下企业数据安全与供应链风险的全面爆发。
AI大模型
2026年6月30日,美团发布LongCat-2.0,总参数1.6万亿、激活参数约480亿,号称首个在五万卡国产算力集群完成全流程训练与推理的AI Agent模型,聚焦代码生成与长上下文。
AI大模型
2026年6月27日,OpenAI 突袭发布 GPT-5.6:Sol、Terra、Luna 登场。旗舰 Sol 跑分创新高却陷作弊争议,更关键的是美国介入下仅限预览,访问资格比性能更稀缺。
AI大模型
2026年6月27日,DeepSeek联合北大发布并开源DSpark推理加速框架,已用于DeepSeek-V4生产引擎,单用户生成速度提升60%-85%,高并发吞吐最高提升661%。
AI大模型
AI应用进入生产环境后,API中转站的选择从"能调用"升级为"能稳定调用"。本文从模型覆盖、接口兼容、稳定性保障、成本结构、企业管理能力和合规本地化六个维度,结合不同场景的优先级差异,提供从测试到上线的完整接入实践,帮助企业和个人做出理性选择。
AI大模型
2026年6月12日Anthropic封停Fable 5全球访问,48小时后智谱全量开放GLM-5.2:1M上下文、自研ZCode 3.0、MIT开源商用,回应地缘变局下开发者对自主可控AI的需求。