编码面试助手 / 语音面试助手 / 在线考试助手 / 笔试助手
面试和笔试的隐身 AI 助手:屏幕上的题,截图就解;面试官的问题,说完就有提示。
版本说明:v3 起新增对话模式,此后只维护 v3(
main分支)。只有截图解题的 v2 版本保留在v2分支,不再更新,安装包见 v2.1.0。
两种模式
- 截图模式:按下快捷键截取屏幕,视觉模型实时分析屏幕上的题目,流式给出解答;可以追加截图、追问,保持上下文连续
- 对话模式:实时识别面试官说的话,对方说完一句就给出简短的回答提示——一句能直接说出口的开场,加上几个要点
| 截图模式 | 对话模式 | |
|---|---|---|
| 解决什么 | 屏幕上的题:算法题、笔试、机试、测评 | 面试官嘴里的问题:技术面、HR 面、英文面 |
| 怎么触发 | 按快捷键截图 | 对方说完一句自动出提示,也可以按快捷键 |
| 适合的模型 | 能识图的模型 | 关闭思考的快模型,越快越好 |
| 额外需要 | 无 | 阿里云百炼 API Key(语音识别) |
两种模式各自选用 AI 配置和提示词,一场面试里可以随时切换:先聊项目用对话模式,面试官一共享题目,按快捷键切到截图模式就能解题。
为什么选它
- 两种模式一体:看屏幕和听对话在同一个窗口里,各自选模型、各自配提示词
- 适配国内生态:中文界面;硅基流动、DeepSeek 等国内平台开箱即用,支持支付宝付款;语音识别用阿里云百炼
- 屏幕分享隐身:即使被要求共享屏幕,对方也看不到本助手的窗口
- 不打扰做题:窗口置顶半透明,做题页面不会失焦;支持鼠标穿透,快捷键冲突时还可以用悬浮工具条点按钮操作
- 开源、自带 Key、没有订阅费:直接调用你自己的 AI 平台,花多少钱看得见
- 追求快:可以关闭模型思考;对话模式不等停顿结束就出提示,对方没说完会自动重写
适用场景
| 场景 | 用法 |
|---|---|
| 算法笔试 / 在线编程题 | 截图模式「解算法题」:给出思路和完整代码,题目长就追加截图,代码可自动复制或保存 |
| 技术面试(视频 / 语音) | 对话模式「技术面试」;面试官共享编程题时,切到截图模式「解算法题」 |
| HR 面 / 主管面 | 对话模式「行为面试」:按 STAR 给出经历类问题的回答要点 |
| 英文面试 | 对话模式「英文面试」:给出英文回答要点,并用中文说明对方问的是什么 |
| 英语机试 | 截图模式「英语考试」,听力题可以配合语音转录 |
| 能力测评 / 行测 | 截图模式「能力测评」:逻辑、图形、数字推理,直接给出选项和关键依据 |
| 其他在线考试 | 截图模式「通用问答」:单选、多选、解答等通用题型 |
| 以上都不是 | 在设置里新增自定义场景,写自己的提示词 |
截图模式的编程题默认用 TypeScript 作答,题目指定了语言时按题目要求。
快速开始
1. 下载安装
到 Releases 下载安装包:Windows 用 setup.exe,macOS 用 .dmg(目前只提供 Apple 芯片版本,Intel 芯片的 Mac 请从源码运行)。安装和首次打开的注意事项见 Wiki 教程。
2. 配置 AI
首次打开会提示填写 API Base URL 和 API Key。任何兼容 OpenAI API 的平台都可以,如国内的 硅基流动、DeepSeek,国外的 OpenRouter,或 OpenAI 官方(只填 API Key 即可)。
在「设置 → AI 模型」里可以保存多套配置,再到「截图模式」「对话模式」两组里分别选用:
- 截图模式要发截图给模型,需要能识图的模型,设置里会标出不能识图的模型
- 对话模式只发文字,建议选一个打开「关闭思考」的快模型,出提示更快
部分平台或网关除了 API Key 还要求额外的请求头(如 Azure 的
api-key、Cloudflare AI Gateway 的cf-aig-authorization),可以在配置的「高级 → 自定义请求头」里每行填一个名称: 值。
3. 开始使用
- 截图模式:按
⌥ Enter(Windows 为Ctrl+Enter)截图解题 - 对话模式:
- 在百炼平台控制台创建 API Key,填到「设置 → 语音」
- 点窗口顶部的「对话」切换过去(或按
⌥⇧M/Ctrl+Shift+M) - 按
⌥ T(Windows 为Ctrl+T)开始监听,对方说完一句话,右侧就会出提示
语音识别使用阿里云百炼的 Fun-ASR 实时模型,约 0.02 元/分钟,新用户有免费额度,以百炼官网为准。
对话模式怎么出提示
- 自动(默认):对方说完一句话立刻出提示。如果对方其实还没说完,这条提示会先撤回,等说完后重写到同一张卡里;「好的」「嗯」这类太短的句子不会触发
- 手动:只在按「出提示」快捷键时出
- 两种方式下都可以随时按「出提示」立即出,不等对方说完;没有新内容时再按一次,会把上一条换个说法重出
- 左边是对方说的话,右边是提示;鼠标移到某条提示上,左边会高亮它对应的问题
- 对话模式采集的是系统音频,线上面试时就是会议里对方的声音,自己说话不会触发提示。「说完判定」的停顿时长和触发字数可以在「设置 → 对话模式 → 高级」里调整
让 AI 参考你的资料
在「设置 → 资料库」导入简历、项目笔记(PDF、Word、Markdown、TXT),或把准备好的问答直接粘贴成文本,AI 作答时会优先参考:
- 经历类问题结合简历里的项目和数据,用第一人称回答;资料里有现成回答的问题,按你准备的要点和说法来
- 每份资料可以分别选择用于截图模式、对话模式
- 资料只保存在本机,但会随每次请求发给该模式使用的 AI 平台。资料越多回答越慢、费用越高,建议每个模式不超过 3 万字;DeepSeek、OpenAI 等平台会自动缓存重复的前缀,连续提问时这部分更快也更便宜
常用快捷键
| 操作 | macOS | Windows |
|---|---|---|
| 截图解题(新开对话) | ⌥ Enter |
Ctrl+Enter |
| 追加截图 | ⌥⇧ Enter |
Ctrl+Shift+Enter |
| 对话模式:出提示 | ⌥ G |
Ctrl+G |
| 对话模式:切换自动 / 手动 | ⌥⇧ G |
Ctrl+Shift+G |
| 语音转录 / 开始停止监听 | ⌥ T |
Ctrl+T |
| 停止生成 | ⌥ . |
Ctrl+. |
| 切换截图 / 对话模式 | ⌥⇧ M |
Ctrl+Shift+M |
| 隐藏 / 显示窗口 | ⌥ H |
Ctrl+H |
| 鼠标穿透 | ⌥ M |
Ctrl+M |
所有快捷键都可以在「设置 → 快捷键」里修改,完整列表见应用内的「帮助中心」。
v3 新变化
- 新增对话模式:根据面试官说的话实时出提示,不需要截图
- 设置页改为分组导航:通用设置(AI 模型、语音、界面与隐私、快捷键)和两种模式的设置分开,不常用的项收进「高级」
- AI 配置按模式选用:配置列表共用,两种模式各选一个。在「AI 模型」里点选配置现在只是打开它来编辑,要改某个模式用哪个配置,请点配置里的「用于」或到该模式的设置组里选。升级后两种模式都沿用你原来在用的配置
- 提示词场景按模式分开,对话模式新增「技术面试」「行为面试」「英文面试」三个预设
- 自 v2.1 以来的其他改进:多显示器选择截图屏幕、只截固定区域、关闭模型思考、自定义请求头、快捷键切换提示词场景、预设场景可删除、答案渲染数学公式、代码自动复制/保存、标题栏显示解题耗时
完整更新日志见 Releases。
关于隐身能力的说明
目前隐身功能适配市面上大部分会议软件(如腾讯会议等),但很少部分软件和浏览器可能无法正常隐身。请务必在正式使用前,用「当前电脑」+「当前会议软件」自行测试。
本项目仅供学习与研究使用,请遵守考试、面试等场合的相关规定,使用本软件产生的一切后果由使用者自行承担。相关问题欢迎提 Issue 讨论。
从源码运行
项目运行依赖 Node.js。
$ npm install
$ npm run dev
也可以在项目根目录创建 .env 文件预配置 AI 平台,程序启动后会自动读取作为默认值:
API_BASE_URL="https://openrouter.ai/api/v1" # 聚合服务的 API 地址,这里以 OpenRouter 为例
API_KEY="sk-1234567890" # 你的 API Key,这里只是示例
MODEL="gpt-5-mini" # 可选,指定模型
自己打包安装包:
$ npm run build:mac # macOS
$ npm run build:win # Windows
更多使用教程和视频请到本项目的 Wiki 查看。
许可协议(License)
本项目采用 CC BY-NC 4.0 协议许可。
您可以自由使用、复制、修改本项目代码,但 禁止任何形式的商业用途,包括但不限于售卖、集成入商业产品、SaaS 服务等。
如需商业授权,请联系作者获得书面许可。
类似项目
原 Interview-Coder 项目在网络上爆火之后,出现了很多类似的项目(本项目也是其中一个),每个项目都各有特色,这里列举一些比较火的项目供参考。