跳转至

阅读路径指南

初版路线图。正式论文收录后持续更新。

路径 A:多模态 / VLM

  1. 先整理 legacy/dated_research/260312_vlm_detail_comparison_data/
  2. 建立数据集与任务类型 taxonomy:spot-the-difference、missing patch、puzzle reassembly、abstract reasoning matrix。
  3. 再补代表论文、benchmark 和主流 VLM 的 failure mode。

路径 B:Agent / Coding Agent

  1. 先整理 legacy/dated_research/260410_coding_agent_research/
  2. 拆成四类:benchmarks、commercial systems、academic agents、key techniques。
  3. 优先补 SWE-bench、SWE-agent、browser/computer use、multi-agent engineering。

路径 C:评测与 Benchmark

  1. 先整理 legacy/dated_research/260326_llm_benchmark_research/
  2. 区分能力评测、偏好评测、arena、coding benchmark、数据污染与评测工程。
  3. 建立 benchmark 设计原则与失败模式文档。

路径 D:数据、训练、推理、系统

这些方向当前历史材料较少,等用户指定具体主题后再建候选论文池。

单篇论文阅读产物

每篇正式收录论文先在 papers_md/<id>/note.md 写完整精读分析;再把跨论文比较、主题脉络和综合结论写入对应主题目录。