learn
This commit is contained in:
16
TASTE.md
16
TASTE.md
@@ -34,9 +34,17 @@
|
||||
- 状态:确认
|
||||
- 适用范围:科研选题、问题定义、方法设计与研究方向判断
|
||||
- 规则:先识别真正值得解决的问题,再从具体任务中抽象共性结构,并尽量设计对一类问题有普遍意义的解决方案;具体任务更适合作为理解共性问题的窗口,而不是研究的终点。
|
||||
- 证据:[vibe coding 时代的科研品味](learnings/2026-07-18-001-research-taste-in-vibe-coding.md),[赵霞研究与系统文章清单](learnings/2026-07-18-004-zhaoxia-research-systems-reading-list.md),[把奖项看作分布的一次抽样](learnings/2026-07-19-001-how-to-win-a-best-paper-award.md)
|
||||
- 证据:[vibe coding 时代的科研品味](learnings/2026-07-18-001-research-taste-in-vibe-coding.md),[赵霞研究与系统文章清单](learnings/2026-07-18-004-zhaoxia-research-systems-reading-list.md),[把奖项看作分布的一次抽样](learnings/2026-07-19-001-how-to-win-a-best-paper-award.md),[从真实摩擦提炼缺失语义的研究推进法](learnings/2026-07-20-002-semantics-first-research-progression.md)
|
||||
- 边界:这是用户当前、明确但仍开放修正的工作定义;“好发文章”“可工业落地”“热门”、venue 或奖项都不能单独充当标准答案,抽象也必须有真实理解和科学价值支撑。外部认可可以提供反馈,但受时机、评审偏好和学术权力结构影响。
|
||||
|
||||
### 系统研究 / 从跨场景摩擦提炼缺失语义
|
||||
|
||||
- 状态:确认
|
||||
- 适用范围:系统研究选题、问题归纳、抽象设计、scope 界定、实现定位与 evaluation 设计
|
||||
- 规则:从多个场景反复出现的真实摩擦中提炼最小 capability set,明确现有系统缺失的 semantics,再定义可独立复用的系统抽象;及早声明 non-goal,以现有机制实现也可以,但必须产生可解释的新语义,并让每项 design requirement 对应可回答它的 metric 与 baseline。
|
||||
- 证据:[从真实摩擦提炼缺失语义的研究推进法](learnings/2026-07-20-002-semantics-first-research-progression.md)
|
||||
- 边界:跨场景相似性必须落实为同一个可检验的语义缺口,不能用新命名包装普通工具集成;概念优先不削弱实现、正确性和实验证据的要求。不同研究可有不同 non-goal,requirement 与 metric 也不必机械一一对应,但必须可追踪且足以支撑 claim。
|
||||
|
||||
### 科研表达 / 用问题—窗口—方法—证据组织故事
|
||||
|
||||
- 状态:确认
|
||||
@@ -111,10 +119,10 @@
|
||||
|
||||
### 实验评测 / 自我比较不能代替独立基线
|
||||
|
||||
- 状态:暂定
|
||||
- 状态:确认
|
||||
- 适用范围:系统性能评测、论文 evaluation、baseline 选择、性能 claim 审计
|
||||
- 规则:与自己的旧版本或内部变体比较,只能回答“这次改动对自己是否有帮助”;要证明结果的重要性、竞争力或实际价值,还必须选择与 claim 匹配的独立参照,例如公认标准、当前 SOTA、未扰动系统、理论最优值或硬件极限。
|
||||
- 证据:[不要只和自己做 benchmark](learnings/2026-07-18-002-do-not-benchmark-against-yourself.md)
|
||||
- 规则:与自己的旧版本或内部变体比较,只能回答“这次改动对自己是否有帮助”;要证明结果的重要性、竞争力或实际价值,还必须选择与 claim 匹配的独立参照,并明确每个 baseline 回答哪个研究问题,不能把不同角色都混成一个 speedup。
|
||||
- 证据:[不要只和自己做 benchmark](learnings/2026-07-18-002-do-not-benchmark-against-yourself.md),[从真实摩擦提炼缺失语义的研究推进法](learnings/2026-07-20-002-semantics-first-research-progression.md)
|
||||
- 边界:自我比较对 regression、ablation、组件优化和开发过程仍然有价值;如果 claim 明确只描述内部增量,它可以是充分证据。需要外部基线时,基线类型必须由问题和 claim 决定,不能机械地一律要求同一种 competitor。
|
||||
|
||||
### 模型评测 / 不允许同一组假设闭环自证
|
||||
|
||||
Reference in New Issue
Block a user