阅读路径指南¶
初版路线图。正式论文收录后持续更新。
路径 A:多模态 / VLM¶
- 先整理
legacy/dated_research/260312_vlm_detail_comparison_data/。 - 建立数据集与任务类型 taxonomy:spot-the-difference、missing patch、puzzle reassembly、abstract reasoning matrix。
- 再补代表论文、benchmark 和主流 VLM 的 failure mode。
路径 B:Agent / Coding Agent¶
- 先整理
legacy/dated_research/260410_coding_agent_research/。 - 拆成四类:benchmarks、commercial systems、academic agents、key techniques。
- 优先补 SWE-bench、SWE-agent、browser/computer use、multi-agent engineering。
路径 C:评测与 Benchmark¶
- 先整理
legacy/dated_research/260326_llm_benchmark_research/。 - 区分能力评测、偏好评测、arena、coding benchmark、数据污染与评测工程。
- 建立 benchmark 设计原则与失败模式文档。
路径 D:数据、训练、推理、系统¶
这些方向当前历史材料较少,等用户指定具体主题后再建候选论文池。
单篇论文阅读产物¶
每篇正式收录论文先在 papers_md/<id>/note.md 写完整精读分析;再把跨论文比较、主题脉络和综合结论写入对应主题目录。