OpenBMB · 让大模型飞入千家万户
OpenBMB 开源大模型社区,致力于让大模型飞入千家万户。MiniCPM、AgentCPM、VoxCPM、UltraRAG 全系开源模型,云端到端侧高效运行。
开源模型
最新动态
- FlagOS X MiniCPM 模型推理吞吐性能优化挑战赛开启!双芯片同台,万元奖金等你来战:FlagOS 开放计算全球大赛(赛季二)赛道二:MiniCPM 模型推理吞吐性能优化,正式开启全球报名!
- 社区集结|首批MiniCPM全球大使来报到!:「让大模型飞入千家万户」,这不仅是 OpenBMB 的社区愿景,也是每一位开源共建者前行的方向。
- 省显存、省算力、省成本,小模型还能这么玩!:通过模型选型、调用策略、端云协同、 推理与部署优化等工程手段,在满足业务效果和体验要求的前提下, 实现成本与性能的更优平衡。
- MiniCPM5-1B 正式发布:AA-Index 评测结果与开放数据集:在 AA-Index V4.0 中,MiniCPM5-1B 得分为 17.9;本页列出的 2B 以下对照模型及分数见评测表。
- MiniCPM-V 4.6 正式开源:1.3B 参数及多项基准评测结:支持 4× 和 16× 视觉 Token 压缩;与 Qwen3.5-0.8B 在标准图像输入对比测试下,视觉编码 FLOPs 降低超过 50%,token 吞吐量约为 Qwen3.5-0.8B 的 1.5 倍。
- MiniCPM-o 4.5 技术报告发布:全双工全模态 API 开放,RTX5070 即可实时运行:MiniCPM-o 4.5 采用端到端全双工全模态架构;在 NVIDIA RTX 5070 采用 4bit 量化(GGUF Q4_K_M)环境下,测试显存占用最低为 12 GB。
- 治理体系 + 数据上新!UltraData 数据分级治理体系发布,以科学治理赋能 AGI:面壁智能联合清华发布 L0-L4 数据分级治理体系与 UltraData-Math;其 L3 精炼层包含 88B tokens、8,140 万份文档。
- DeepResearch 终于本地化了!8B 端侧写作智能体 AgentCPM-Report 开源!:8B 端侧写作智能体 AgentCPM-Report 开源,让 DeepResearch 能力本地化运行。
- VoxCPM2 部署与微调指南:声音设计、声音克隆与音频续写:VoxCPM2 部署与微调指南:声音设计、声音克隆与音频续写。