安装前的常见问题
kamishibai 适合谁?
适合想用自己挑选的材料学语言,并愿意坚持几个月乃至几年的人。你从书籍、字幕、课堂或日常对话中选词,kamishibai 把它们做成卡片。它不能代替课程,也不会替你决定学习主题和顺序。
复习由 Anki 安排,采用的是 间隔重复:记得熟的卡片会隔更久再出现,忘记的则会更早回来。每天学多少张新卡片、复习数量的上限,都可以在 Anki 中设置。
为什么是漫画?
我相信,有了新一代 AI 智能体,我们可以像过去写博客一样轻松地创作带有个人风格的软件,把自己的经验变成别人也能轻松运用的方法。Kamishibai 就是我对这个想法的一次尝试。首先,它是我自己每天都在用的工具,我也根据日常使用的经验不断改进它。
漫画家亲自把故事、画面和人物塑造融为一体,创作出完整的作品。我很认同这种创作方式。这也是 kamishibai 采用漫画视觉风格的原因:我喜欢一个项目有自己的想法,并且从构思到视觉呈现,都能让人感受到它。
可以在 kamishibai 中添加什么?
在基本模式中,可以输入想学的单词或短语清单。不必先整理成词典里的原形:kamishibai 会尝试识别输入内容,并提供词义供你选择。每个选中的词义都会生成一张带例句的卡片。
如果例句不合适,可以说明希望怎样修改,再重新生成。如果已经准备好了卡片文字,也可以用 cards JSON 格式提交,下面有专门的说明。
Anki 和 kamishibai 分别做什么?
Kamishibai 负责准备材料:生成例句、解释、音频和插图,再打包成 .apkg 文件,也就是可以在 Anki 中打开的牌组。
Anki 负责安排复习:显示卡片,记录你对回答的评分,并安排下次复习的日期。
Kamishibai 也会生成用于制作纸质卡片的 PDF。不想看屏幕时,可以打印出来,剪成卡片学习。
需要会编程吗?
不需要。安装后,在终端这个以文字为主的窗口里启动 kamishibai,程序会一步步引导你添加单词、选择词义、检查卡片,最后生成牌组。整个过程不需要写代码。
程序还提供返回 JSON 数据的命令,供脚本和 AI 智能体自动操作。日常使用不需要这些命令。
谁决定卡片上放什么?
你选择单词和词义,AI 模型按 kamishibai 中设定的规则生成材料。这些规则规定了卡片的结构,以及例句、解释、音频和插图的要求。
生成前可以选择句子的难度和类型:陈述句、疑问句、对话,或混合使用。生成后可以检查结果,说明修改要求,再让程序重新生成。
支持哪些语言?
支持 22 种语言:英语、中文、西班牙语、日语、法语、德语、韩语、俄语、意大利语、葡萄牙语、印地语、阿拉伯语、土耳其语、波兰语、乌克兰语、印度尼西亚语、越南语、泰语、希腊语、希伯来语、荷兰语和捷克语。
每个牌组选择一组语言配对:一种用于学习,另一种用于翻译和解释。可以从列表中任意选择两种语言。材料质量取决于模型对这组语言的处理能力。
如果需要其他语言,可以在 GitHub 提交请求,我们看看能做什么。
开始前需要准备什么?
制作卡片需要:
- 一台运行 macOS、Linux 或 Windows 的电脑。
- 互联网连接:文字、音频和插图都通过 Gemini API 生成。
- 你自己的 Gemini API 密钥。在 Google AI Studio 创建密钥 →
复习请安装 Anki →
如果所选语言需要在本地检查图片中的文字,程序还会在首次生成插图时下载文字识别(OCR)模型。
kamishibai 支持哪些系统?
macOS、Linux 和 Windows 都有可直接使用的版本。
- macOS 和 Linux:通过 Homebrew 或安装脚本安装。
- Windows:在 Git Bash、MSYS 或 Cygwin 中运行安装脚本。
命令和脚本链接见安装部分。
要花多少钱?
Kamishibai 免费且开源。通过你的 API 密钥调用 Gemini 产生的费用另行支付。
作为参考,生成 100 张包含文字、音频和插图的卡片大约需要 $15。这只是估算,实际费用取决于材料的多少、重新生成的次数和模型的定价。程序已选好模型,开始使用前无需自行配置。
每天学习四张新卡片,一百张就够学 25 天;学过的句子之后仍要继续复习。所以我会选择真正想用的词,也更看重卡片质量,而不是把生成费用压到最低。
单词会发送到哪里,密钥存在哪里?
设置、会话、缓存和生成的文件都保存在你的电脑上。Kamishibai 没有专门用于制作卡片的自有服务器。
生成和检查材料时,程序使用你的 API 密钥,将单词、句子和待检查的插图发送给 Gemini。如果通过 Anki 同步,完成的牌组和媒体文件也会上传到 AnkiWeb。
保存的密钥放在本地设置文件中,不在系统密码管理器里。不要把这个文件发给别人,也不要提交到公开的代码仓库。
卡片会有错误吗?
会。不过以我的使用经验来看,这一代模型的表现已经比较稳定,我也一直花很多精力改进最终的卡片质量。
目前音频最稳定,听起来也接近自然说话。句子难度的把握稍差一些:模型会尽量贴合所选级别,但有时还是会生成偏简单或偏难的句子。
插图最容易出错:AI 仍然可能给人画出第三条胳膊。因此,程序中还有专门负责评估成图的 AI 模型。图片未通过检查,就会重新生成。
自动检查不能保证所有材料都正确。遇到不确定的句子,最好查词典或请教老师,必要时重新生成卡片。
Agent Ready 具体是什么意思?
意思是 Claude Code 等 AI 智能体可以操作 kamishibai。你描述任务,它通过程序命令完成。例如,你可以让它:
- 按主题或从你的文本中挑选单词。
- 选择需要的词义并生成卡片。
- 检查结果,在导入 Anki 前重新生成不合适的卡片。
程序为此提供了 JSON CLI:这些命令返回 JSON 数据,不需要在终端中逐步回答提示。智能体可以在后台生成卡片,同时处理多个会话。
把 llms.txt 的链接交给智能体即可。里面说明了如何安装或更新 kamishibai,以及如何获取当前安装版本的内置说明。智能体本身的运行和额外的卡片生成可能增加费用。
什么时候适合用 JSON 提交自己的卡片?
当你想保留现成的措辞时,例如课堂中的句子或简短对话。此时可以用 cards JSON 文件提交卡片内容,而不是输入单词清单。这是一种有规定结构的文本文件。
文件必须包含卡片的所有必填字段,只有句子是不够的。可以自己准备,也可以交给 AI 智能体处理。文件中的措辞会原样保留。Kamishibai 会添加音频和插图,再生成 APKG 格式的 Anki 牌组和可打印的 PDF。
可以在手机上复习卡片吗?
可以。Kamishibai 在电脑上制作卡片,复习则可以使用 Anki 的手机应用。
- 在电脑上的 Anki 中打开生成的
.apkg文件。如果双击没有开始导入,请选择文件 → 导入。 - 通过 AnkiWeb 同步集合。
- 在手机应用中登录同一个账号,开始同步,下载卡片、图片和音频。
想离开屏幕学习,可以打印 PDF,剪开后折成卡片。纸质卡片没有音频,也不会自动安排复习。
文字、音频和插图是谁生成的?
文字、音频和插图由 Gemini 系列模型生成。Kamishibai 向模型提供指令,检查部分结果,再把材料组合成卡片。
音频由模型合成,不是真人录音。开始学习前,请把音频和其他内容一起检查一遍。
想不起答案时怎么办?
如果想不起句子的意思或关键词,点击“重来”。Anki 会更早安排这张卡片再次出现。新卡片如此,已经记了几个月的卡片也一样。
评分要多严格,取决于你当前在练什么。刚开始时,只要想起了句意和关键词,我会允许自己在冠词或介词上有小错。等句子熟悉后,再要求自己把这些细节也说准确。
如果一张卡片总是难以记住,检查一下句子本身:情境是否清楚,陌生内容是否太多。有时简化或换个例句,比反复硬记原来的句子更有用。
什么时候能看到效果?
没有确定的时间。效果取决于起点、所选的句子、复习是否规律,以及你是否在 Anki 之外使用这门语言。
学扎实前 50 个句子后,可以做一次自我检查:熟悉的表达是否更容易想起?在新文本中能认出来吗?交谈时能用出来吗?这不意味着跨过 50 句就一定会有“语感”。关注自己现在能做到什么,而不只是卡片数量。