OpenCompass 大模型评测
下一代多模态大模型能力演进的度量分析
MinerU:高效精准的文档解析技术攻坚
书生科学大模型Intern-S2-Preview开源!
从开源视角看,当前 OCR 工业级工具链或范式还有哪些关键缺失?如果不考虑商业化,最想推动或实现的 OCR 方向是什么?
1. PyTorch 模型部署基础知识
基于多模态大模型的图像评价及应用探索
1. MMDetection3D 介绍及安装配置
1T MoE 科学多模态大模型Intern-S1-Pro来啦!
OCR 模型是否还有必要加入推理能力吗?主要会用于什么样的场景,会用怎样的形式出现?
数据驱动的大模型长度泛化推理新范式
NewtonBench:在“平行宇宙”中评估大模型科学发现能力
从“一人盯一机”到“两人十二机”:HELP发布,提升大规模机器人后训练人效
Github八万star,开源计算机视觉神器OpenMMLab
多模态简述
Label Studio x Segment Anything Model 半自动化标注
极致端侧推理、结构还原与语义泛化三者之间存在天然的张力,在设计模型架构或训练策略时,如何权衡这三者之间的 trade-off 的?
清华大学导师亲授!3D目标检测超硬核课程新鲜出炉~
能否分享最近关注、但本次尚未提及的 OCR 前沿工作?对于希望参与贡献开源项目的开发者,有哪些建议?
Sim-CoT 驱动高效隐式思考