推杠之前

05 / 方法与边界

这些结论是怎么来的

一个知识整理站的可信度,不取决于它看起来多专业,而取决于它敢不敢交代自己的材料来源、处理方式和已知缺陷。 这一页就是把这三件事全部公开。

一、用了什么材料

四份,全部注明出处与处理方式。

论文
《健身房场景内运动损伤分析与预防对策研究》马靖尧、姜涛(新疆师范大学体育学院),2025 年第 2 期,156–158 页
CNKI 导出 PDF · 文本层可提取 6,077 字符(非扫描件)· 10 条参考文献完整读出
视频
《Bodybuilding 科学健身系列 · 肩部》B站 BV1B5HNesEgn p3,16 分 07 秒,960×720
抽帧 967 张 → OCR 识别 436 段硬字幕(覆盖约 811 秒 = 84% 时长)· 音轨另转写 360 段
课程
《NASM 个人健身训练 · 课1-章3 健康与健身评估简介》B站 BV1e2V66gEZJ p3,14 分 11 秒
英文原声 → Whisper large-v3 转写 178 段,速度 14.7× 实时
检索
PubMed 官方接口(5 组检索式)+ 机构官网逐条 HTTP 核验
核验 10 个机构/工具链接 · 检索并整理 23 篇文献(部分为论文自身引用)

二、已知缺陷

下面每一条都会降低本站结论的可信度,所以放在这里,而不是藏在脚注里。

中文配音是机器翻译 · 该视频的中文音轨由机器翻译生成,术语并不可靠:blueprint 被译成“蓝色的印刷”,三角肌的“前束/中束/后束”被读作“前头部/中头部/后头部”。本站的所有解剖学名词都已按标准译名重新校正,不与配音用词保持一致。
硬字幕 OCR 只有约七成可读 · 视频硬字幕为烧录在画面上的文字,识别结果中含少量乱码。凡 OCR 不可靠的位置,本站不以该字幕作为唯一依据,改用音轨转写或文献核对。
单次处理,未做交叉复核 · 所有转写与识别由单次流程产出,没有第二人复核。数字类结论(如 26.75%、83.8%)均指向论文原文,建议以原文为准。
文献为检索所得,不是系统评价 · 本站的文献清单来自关键词检索,存在选择性偏差,不能等同于系统评价或指南。证据等级按研究类型粗略标注,供参考而非定级。

三、技术说明

顺带交代一下这个站本身是怎么做的。

零依赖的静态站

全站没有框架、没有 CDN、没有外部请求:样式表约 12KB,脚本约 3KB,自己写的。 解剖图是手写 SVG 线稿,不是图片——任何屏幕分辨率下都清晰,也方便改。

HTML + CSS + 原生 JS

内容与排版分离

39 条结论、13 个解剖结构、23 条文献 先整理成一份结构化数据,再生成 6 个页面。校订内容时只改数据,不动版式。

Python 生成静态页

可以自己验证

卡片里的出处不是装饰:视频 09:08 指向那条 B站视频的具体时刻, PMID 指向 PubMed 条目,论文 2.3 节 指向期刊原文的小节号。

所有外链均为可公开访问的原始来源

四、更新日志

  • 首版上线:13 个解剖结构、39 条结论卡、23 篇文献、6 个页面。
  • 校正视频配音中的错误术语(前头部 → 前束)。