ARTICLE · INTELLIGENCE

战地情报 · 详情页

来自尧图项目组的一线实战观察与深度解析

Paper-Notes CV方向全景图:图像生成、3D视觉、自动驾驶2000+篇论文笔记终极导读

Paper-Notes CV方向全景图:图像生成、3D视觉、自动驾驶2000+篇论文笔记终极导读 Paper-Notes CV方向全景图图像生成、3D视觉、自动驾驶2000篇论文笔记终极导读【免费下载链接】Paper-Notes 数千篇 AI、LLM、NLP、CV 顶会论文解读每篇 5 分钟读懂核心思想。项目地址: https://gitcode.com/gh_mirrors/papernotes5/Paper-NotesPaper-Notes 是一个开源的顶会论文笔记仓库收录 23000 篇 AI、CV、NLP 论文解读覆盖图像生成、3D视觉、自动驾驶等 40 研究方向每篇笔记 5 分钟读懂论文核心思想。本文带你沿「图像生成 · 3D视觉 · 自动驾驶」三大 CV 方向快速定位 4700 篇论文笔记并掌握最高效的论文检索方式。️ 项目概览12 个会议、23000 篇笔记Paper-Notes 按「会议 → 研究领域 → 单篇笔记」三级组织目前覆盖 CV 相关会议会议笔记数说明CVPR 20264,065CV 旗舰会议图像生成/3D视觉笔记最全CVPR 20251,821含 365 篇 3D 视觉笔记ICCV 20251,316计算机视觉老牌顶会ECCV 2026424欧洲顶会ECCV 20248703D 视觉笔记 182 篇ICLR 20265,319图像生成/3D视觉前沿方法密集NeurIPS 20252,531理论方法与应用并重ICML 2025/20261,064 / 1,846机器学习理论视角AAAI 20261,382综合性 AI 会议完整目录结构说明见 README.md全站笔记入口在 docs/index.md。 CV 方向全景13 个核心方向一目了然三大主角之外仓库还覆盖了完整的 CV 技术栈各方向跨会议笔记总量如下方向笔记数典型主题 图像生成2,080扩散模型、流匹配、图像编辑、个性化生成 3D 视觉2,0683DGS、点云、深度估计、场景重建 多模态 VLM1,475VLM 推理、视觉问答、多模态对齐 模型压缩1,032量化、蒸馏、高效推理 具身智能598机器人操作、导航、视觉-动作模型 自动驾驶595BEV 感知、端到端规划、世界模型 医学图像611分割、配准、影像生成 视频生成530文生视频、视频编辑、世界模型 视频理解518长视频推理、动作识别✂️ 语义分割498全景分割、零样本分割 人体理解433姿态估计、人体重建 目标检测3203D 检测、开放词汇检测 自监督学习340表征学习、预训练策略 图像生成2080 篇笔记的最大方向图像生成是仓库中体量最大的 CV 方向CVPR 2026 单会议就有 491 篇。主题涵盖扩散模型加速、流匹配、图像编辑、概念擦除、个性化定制等例如PixelDiT: Pixel Diffusion Transformers for Image Generation —— 像素空间扩散 TransformerPixelRush: 一步扩散超快高清图像生成 —— 免训练的高分辨率生成各会议入口CVPR2026 图像生成 · ICLR2026 图像生成 · NeurIPS2025 图像生成 3D 视觉2068 篇笔记看 3DGS 演进3D 视觉方向横跨 12 个会议从 ECCV 2024 到 CVPR 2026 形成完整时间线3D Gaussian Splatting3DGS是贯穿始终的热点3DGS at Arbitrary Resolutions with Compact Proxy AnchorsCVPR 2026—— 任意分辨率下的紧凑代理锚点Gaussian Blending: Rethinking Alpha Blending in 3DGSAAAI 2026—— 解决多尺度渲染伪影按会议回溯技术演进ECCV2024 3D视觉 → CVPR2025 3D视觉 → ICCV2025 3D视觉 → ECCV2026 3D视觉 → CVPR2026 3D视觉751 篇· ICLR2026 3D视觉 自动驾驶595 篇笔记覆盖感知-预测-规划自动驾驶方向聚焦 BEV 感知、多模态融合、端到端规划与世界模型CVPR 2026 贡献了最多的 158 篇例如CausalVAD: 因果干预去混淆端到端自动驾驶DLWM: 双隐空间世界模型的高斯中心预训练各会议入口CVPR2026 自动驾驶 · NeurIPS2025 自动驾驶 相邻方向同样值得关注除了三大主角以下方向构成完整的 CV 学习路径CVPR2026 视频生成182 篇含世界模型、长视频生成、视频理解518 篇、医学图像611 篇、具身智能/机器人598 篇。如果你做端到端系统还可以搭配模型压缩1,032 篇与多模态 VLM1,475 篇一起看。 5 分钟读法单篇笔记的固定结构每篇笔记都是标准化模板按顺序读即可抓住论文骨架一句话总结—— 先建立整体印象研究背景与动机—— 领域现状、现有痛点、核心矛盾方法详解—— 整体框架 关键设计 损失函数实验关键数据—— 主实验、消融实验、关键发现亮点与洞察—— 这篇论文最值得借鉴的点局限与展望—— 客观评价边界评分与相关论文—— 延伸阅读线索以 Gaussian Blending 笔记 为例从「一句话总结」到「PSNR 31.59→35.80 的实验数据」全程 5 分钟读完。 CV 论文笔记快速导航搜索 三级索引全站搜索docs/search.md 提供全文搜索页直接搜关键词如 3D Gaussian、world model定位笔记三级索引总索引 docs/index.md → 会议索引如 docs/CVPR2026/autonomous_driving/index.md→ 单篇笔记逐级下钻 两种获取方式在线阅读克隆仓库后用 MkDocs Material 渲染配置见 mkdocs.yml支持暗色模式与即时导航本地克隆git clone https://gitcode.com/gh_mirrors/papernotes5/Paper-Notes 社区交流项目持续更新中路线图NeurIPS 2026、AAAI 2027、CVPR 2027欢迎加入交流【免费下载链接】Paper-Notes 数千篇 AI、LLM、NLP、CV 顶会论文解读每篇 5 分钟读懂核心思想。项目地址: https://gitcode.com/gh_mirrors/papernotes5/Paper-Notes创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
RELATED READING

延伸阅读

更多一线实战笔记与深度复盘,助您持续精进