日语

真实日语视频 · 实时字幕 · 每天精听一段

⚠️ 本地预览版 · 尚未部署上线

用真实日语视频,练一双能听懂日语的耳朵

「精聴日语」把 Wikimedia Commons 上知识共享(CC)授权、可以公开使用的 真实日语视频,用本地语音识别自动生成同步字幕,做成 「左边看真实视频、右边跟实时字幕」 的精聴短片——不是教材配音,是日本人真实说话的语速和用词。

素材来源可公开核实、字幕自动生成、每天更新一条,供你逐句精听、跟读、记生词。

1
已真实产出成片
8
正在排队制作
700+
Commons上可用的CC授权日语视频
CC BY
当前素材授权类型

精选短片

点击卡片播放已经生成好的成片;灰色卡片是排队中、还没轮到的素材。

精聴学习法

「精聴」= 精细的聴解——不是泛听背景音,而是一句一句抠着听懂。

  1. ① 点开一条短片点击上方卡片,弹出播放窗口。
  2. ② 左边看画面,右边跟字幕画面左侧是原始日语视频,右侧字幕面板会跟着语音实时显示日文原文——字幕是本地语音识别自动生成的,不是官方字幕,可能有听错的地方(下面「素材与版权」有真实例子)。
  3. ③ 反复拖动进度条精听遇到没听清的地方倒回去多听几遍,跟着字幕小声跟读,比一遍带过记得牢。
  4. ④ 记下生词/说法字幕面板里出现的口语说法、俗语,挑自己用得上的抄下来,不用整段背。
  5. ⑤ 转载请保留出处视频用的是 CC BY 授权,转载/二次使用时请保留卡片上标注的作者与协议信息。

素材与版权

素材从哪来

Wikimedia Commons「Videos in Japanese」分类下,目前已核实约 700 条知识共享(CC) 授权的日语视频;主力使用其中 Suit(YouTuber) 的旅行/日常 vlog 系列(约 201 条, CC BY 3.0,语速自然、话题是日常生活,适合精聴练习)。每条视频使用前都会调用 Commons 官方 API 重新核对一次授权类型,只放行 CC0 / CC BY / CC BY-SA 三种。

字幕可能有识别错误,这是真实存在的限制

字幕不是视频官方自带的,是本地语音识别(faster-whisper)自动转写生成的, 没有经过人工逐句校对,会出现听错字的情况。比如下面这条短片里,「博多 (はかた)」被自动识别成了「墓多」——这类错误目前会原样保留在字幕里, 精聴时请自己判断,不要把字幕当作绝对正确的官方文本。
识别结果原句:「福岡墓多のラーメンだけが…」 → 实际应为「福岡博多のラーメンだけが…」

关于本页(如实说明)

  • 这是什么:一版本地静态演示页面(纯 HTML/CSS/JS,不需要后端),还没有部署上线,域名/服务器怎么安排需要你后续决定。
  • 现在谁能看到:目前只能在生成它的这台电脑上本地打开,外部访客访问不到。
  • 视频是怎么播的:页面直接引用了本地 output/ 文件夹里的真实成片文件(单条约200MB),部署上线前需要重新规划视频存储和加载方式(比如切片压缩、放对象存储/CDN),不能直接把这版本地路径原样搬上线。
  • 内容是怎么来的:卡片数据(标题、时长、授权、字幕段数)目前是手工整理进这个页面的,不是自动从 queue.json/output/ 生成的,以后素材多了可以再加一个小脚本自动生成。
  • 不做自动上传:这个页面只是「展示」,PJ69 项目本身也不做小红书自动发布——查证过小红书没有面向个人创作者的官方发布API,生成好之后仍需要人工手动发布,见项目 CLAUDE.md
  • 还没做竖屏版式:现在成片是固定的 1920×1080 横版布局,小红书更常见的竖屏排版这次没做。
  • 没有定时调度:视频不是每天自动生成的,目前需要手动跑一次 pipeline.py