This commit is contained in:
2026-07-20 16:00:43 +08:00
parent 5629342035
commit 561612bb3f
2 changed files with 103 additions and 4 deletions

View File

@@ -34,9 +34,17 @@
- 状态:确认
- 适用范围:科研选题、问题定义、方法设计与研究方向判断
- 规则:先识别真正值得解决的问题,再从具体任务中抽象共性结构,并尽量设计对一类问题有普遍意义的解决方案;具体任务更适合作为理解共性问题的窗口,而不是研究的终点。
- 证据:[vibe coding 时代的科研品味](learnings/2026-07-18-001-research-taste-in-vibe-coding.md)[赵霞研究与系统文章清单](learnings/2026-07-18-004-zhaoxia-research-systems-reading-list.md)[把奖项看作分布的一次抽样](learnings/2026-07-19-001-how-to-win-a-best-paper-award.md)
- 证据:[vibe coding 时代的科研品味](learnings/2026-07-18-001-research-taste-in-vibe-coding.md)[赵霞研究与系统文章清单](learnings/2026-07-18-004-zhaoxia-research-systems-reading-list.md)[把奖项看作分布的一次抽样](learnings/2026-07-19-001-how-to-win-a-best-paper-award.md)[从真实摩擦提炼缺失语义的研究推进法](learnings/2026-07-20-002-semantics-first-research-progression.md)
- 边界这是用户当前、明确但仍开放修正的工作定义“好发文章”“可工业落地”“热门”、venue 或奖项都不能单独充当标准答案,抽象也必须有真实理解和科学价值支撑。外部认可可以提供反馈,但受时机、评审偏好和学术权力结构影响。
### 系统研究 / 从跨场景摩擦提炼缺失语义
- 状态:确认
- 适用范围系统研究选题、问题归纳、抽象设计、scope 界定、实现定位与 evaluation 设计
- 规则:从多个场景反复出现的真实摩擦中提炼最小 capability set明确现有系统缺失的 semantics再定义可独立复用的系统抽象及早声明 non-goal以现有机制实现也可以但必须产生可解释的新语义并让每项 design requirement 对应可回答它的 metric 与 baseline。
- 证据:[从真实摩擦提炼缺失语义的研究推进法](learnings/2026-07-20-002-semantics-first-research-progression.md)
- 边界:跨场景相似性必须落实为同一个可检验的语义缺口,不能用新命名包装普通工具集成;概念优先不削弱实现、正确性和实验证据的要求。不同研究可有不同 non-goalrequirement 与 metric 也不必机械一一对应,但必须可追踪且足以支撑 claim。
### 科研表达 / 用问题—窗口—方法—证据组织故事
- 状态:确认
@@ -111,10 +119,10 @@
### 实验评测 / 自我比较不能代替独立基线
- 状态:暂定
- 状态:确认
- 适用范围:系统性能评测、论文 evaluation、baseline 选择、性能 claim 审计
- 规则:与自己的旧版本或内部变体比较,只能回答“这次改动对自己是否有帮助”;要证明结果的重要性、竞争力或实际价值,还必须选择与 claim 匹配的独立参照,例如公认标准、当前 SOTA、未扰动系统、理论最优值或硬件极限
- 证据:[不要只和自己做 benchmark](learnings/2026-07-18-002-do-not-benchmark-against-yourself.md)
- 规则:与自己的旧版本或内部变体比较,只能回答“这次改动对自己是否有帮助”;要证明结果的重要性、竞争力或实际价值,还必须选择与 claim 匹配的独立参照,并明确每个 baseline 回答哪个研究问题,不能把不同角色都混成一个 speedup
- 证据:[不要只和自己做 benchmark](learnings/2026-07-18-002-do-not-benchmark-against-yourself.md)[从真实摩擦提炼缺失语义的研究推进法](learnings/2026-07-20-002-semantics-first-research-progression.md)
- 边界:自我比较对 regression、ablation、组件优化和开发过程仍然有价值如果 claim 明确只描述内部增量,它可以是充分证据。需要外部基线时,基线类型必须由问题和 claim 决定,不能机械地一律要求同一种 competitor。
### 模型评测 / 不允许同一组假设闭环自证