排序
百度开源 Unlimited OCR 模型:基于 DeepSeek OCR,解析文档告别 AI 越生成越慢
百度于 6 月 22 日开源推出 Unlimited OCR 模型,总参数量 30 亿,推理时仅激活 5 亿参数,目标解决在解析长文档时,端到端 OCR 模型越生成越慢的问题。
让大模型从“一问一答”走向“边看边说”,京东开源实时视频视觉语言交互模型 JoyAI-VL-Interaction
JoyAI-VL-Interaction 支持摄像头、直播流、监控流等多种视频输入,也支持语音输入输出、可视化界面、长期记忆、后台模型接口和 vLLM 部署方案。
大晓机器人开源 ACE-Ego 具身操作 VLA 模型,能稳定完成塑料袋打包、鞋子装入鞋盒等操作
大晓机器人今日宣布,联合香港中文大学多媒体实验室正式发布全新“一脑多型”具身操作 VLA 模型 ACE-Ego,并向行业开源。
商汤开源 SenseNova U1 图文交错生成增强版模型:支持多页连续创作,角色风格不“跑偏”
该模型面向图文交错创作与生成(Interleaved Generation)场景进行了专项强化,更好地支持绘本、故事书、多页 PPT、图文教程等连续内容创作。
摩尔线程开源 MusaCoder:首个基于国产全功能 GPU 全栈训练的代码大模型
这是业内首个基于国产 GPU 算力底座完成全链路训练与验证的开源代码大模型,其完整后训练流程均在基于 MTT S5000 构建的夸娥智算集群上完成。
AI 制造 AI:面壁智能开源全球首个完全由 AI 编写的生产级训练框架 ForgeTrain
面壁智能今日联合清华大学、OpenBMB 开源社区正式发布 ForgeTrain—— 全球首个完全由 AI 编写、零人类代码介入的生产级大模型训练框架。
面壁智能开源 MiniCPM5-1B:在 AA-Index 上超越所有 2B 参数以下模型,能跑在手机、浏览器上
面壁智能今日联合清华大学、 OpenBMB 开源社区正式发布并开源最新一代端侧文本基座大模型 ——MiniCPM5-1B。
“让 Token 消耗降低 61%”:腾讯开源 Agent Memory
通过“上下文卸载”和“Mermaid 任务画布”技术,将长任务中的大量中间信息压缩存储,使 AI Agent 能保持轻量上下文,同时支持原始信息追溯。实验显示最高可降低 61% Token 消耗,并提升任务成...










