
2B模型杀进端侧Agent第一梯队:MiniCPM5-2B开源,真正值钱的是整套训练配方
25.2亿参数、131K上下文、Apache 2.0许可:跑分会随榜单版本变化,但模型、数据、RL框架和训练Recipe一起开放,才是这次发布最重的一部分。
OpenBMB开源MiniCPM5-2B:约25.2亿参数、131K上下文、Apache 2.0许可,支持推理…
暂无菜单项
开放权重、代码、数据或训练资源的大语言模型发布、评测与应用资讯。

25.2亿参数、131K上下文、Apache 2.0许可:跑分会随榜单版本变化,但模型、数据、RL框架和训练Recipe一起开放,才是这次发布最重的一部分。
OpenBMB开源MiniCPM5-2B:约25.2亿参数、131K上下文、Apache 2.0许可,支持推理…

从 2.7T 参数传闻到 API 商业化,MiniMax 这次真正值得关注的不是数字本身。
MiniMax 被曝正在研发 2.7 万亿参数 M3 Pro,并计划开源。真正值得关注的,不只是参数规模,而是…

770B总参数、1M长上下文与真实生产力Agent,腾讯混元Hy4 Preview到底进步在哪?
腾讯混元Hy4 Preview拥有770B总参数、49B激活参数和1M长上下文。本文结合代码、3D游戏、办公、…

27B本地模型开始挑战顶级Agent:能力上限很高,但默认xhigh推理和真实长任务仍需降温评估
Qwen3.8-27B以27B Dense、多模态、262K上下文和Agent能力进入24GB显存可尝试范围。…

从混合注意力、视觉自验证到国产芯片服务栈,拆解智谱如何用更少计算换取更强Agent与专业生产力
智谱GLM-5.3-Flash采用320B总参数、18B激活的原生多模态架构。本文详解混合注意力、视觉自验证、…

GLM-5.2 的重点不是写几段代码,而是把长上下文和 Agent 工作流带进真实工程任务。
智谱 GLM-5.2 面向长程 Coding Agent 场景,支持 1M 上下文,适合大型工程、自动化开发和…
