← 开源
ooboqoo

interview-coder-cn

AI 截屏解题助手,考试助手,在「面试」或「在线考试」时,借助AI实时提供解题思路和答案。

ApplicationsCodingProductivityTypeScript
在 GitHub 打开
增长势头
+324 小时新增 Star+0.3%
952
Star
132
Fork
+10
本周
7
贡献者
创建于 2025-08-20 · 更新于 2026-10-07 · 今日第 2610 名
主要开发者
README

编码面试助手 / 语音面试助手 / 在线考试助手 / 笔试助手

面试和笔试的隐身 AI 助手:屏幕上的题,截图就解;面试官的问题,说完就有提示。

版本说明:v3 起新增对话模式,此后只维护 v3(main 分支)。只有截图解题的 v2 版本保留在 v2 分支,不再更新,安装包见 v2.1.0。

截图模式演示

两种模式

  • 截图模式:按下快捷键截取屏幕,视觉模型实时分析屏幕上的题目,流式给出解答;可以追加截图、追问,保持上下文连续
  • 对话模式:实时识别面试官说的话,对方说完一句就给出简短的回答提示——一句能直接说出口的开场,加上几个要点
截图模式 对话模式
解决什么 屏幕上的题:算法题、笔试、机试、测评 面试官嘴里的问题:技术面、HR 面、英文面
怎么触发 按快捷键截图 对方说完一句自动出提示,也可以按快捷键
适合的模型 能识图的模型 关闭思考的快模型,越快越好
额外需要 无 阿里云百炼 API Key(语音识别)

两种模式各自选用 AI 配置和提示词,一场面试里可以随时切换:先聊项目用对话模式,面试官一共享题目,按快捷键切到截图模式就能解题。

为什么选它

  • 两种模式一体:看屏幕和听对话在同一个窗口里,各自选模型、各自配提示词
  • 适配国内生态:中文界面;硅基流动、DeepSeek 等国内平台开箱即用,支持支付宝付款;语音识别用阿里云百炼
  • 屏幕分享隐身:即使被要求共享屏幕,对方也看不到本助手的窗口
  • 不打扰做题:窗口置顶半透明,做题页面不会失焦;支持鼠标穿透,快捷键冲突时还可以用悬浮工具条点按钮操作
  • 开源、自带 Key、没有订阅费:直接调用你自己的 AI 平台,花多少钱看得见
  • 追求快:可以关闭模型思考;对话模式不等停顿结束就出提示,对方没说完会自动重写

适用场景

场景 用法
算法笔试 / 在线编程题 截图模式「解算法题」:给出思路和完整代码,题目长就追加截图,代码可自动复制或保存
技术面试(视频 / 语音) 对话模式「技术面试」;面试官共享编程题时,切到截图模式「解算法题」
HR 面 / 主管面 对话模式「行为面试」:按 STAR 给出经历类问题的回答要点
英文面试 对话模式「英文面试」:给出英文回答要点,并用中文说明对方问的是什么
英语机试 截图模式「英语考试」,听力题可以配合语音转录
能力测评 / 行测 截图模式「能力测评」:逻辑、图形、数字推理,直接给出选项和关键依据
其他在线考试 截图模式「通用问答」:单选、多选、解答等通用题型
以上都不是 在设置里新增自定义场景,写自己的提示词

截图模式的编程题默认用 TypeScript 作答,题目指定了语言时按题目要求。

快速开始

1. 下载安装

到 Releases 下载安装包:Windows 用 setup.exe,macOS 用 .dmg(目前只提供 Apple 芯片版本,Intel 芯片的 Mac 请从源码运行)。安装和首次打开的注意事项见 Wiki 教程。

2. 配置 AI

首次打开会提示填写 API Base URL 和 API Key。任何兼容 OpenAI API 的平台都可以,如国内的 硅基流动、DeepSeek,国外的 OpenRouter,或 OpenAI 官方(只填 API Key 即可)。

在「设置 → AI 模型」里可以保存多套配置,再到「截图模式」「对话模式」两组里分别选用:

  • 截图模式要发截图给模型,需要能识图的模型,设置里会标出不能识图的模型
  • 对话模式只发文字,建议选一个打开「关闭思考」的快模型,出提示更快

部分平台或网关除了 API Key 还要求额外的请求头(如 Azure 的 api-key、Cloudflare AI Gateway 的 cf-aig-authorization),可以在配置的「高级 → 自定义请求头」里每行填一个 名称: 值。

3. 开始使用

  • 截图模式:按 ⌥ Enter(Windows 为 Ctrl+Enter)截图解题
  • 对话模式:
    1. 在百炼平台控制台创建 API Key,填到「设置 → 语音」
    2. 点窗口顶部的「对话」切换过去(或按 ⌥⇧M / Ctrl+Shift+M)
    3. 按 ⌥ T(Windows 为 Ctrl+T)开始监听,对方说完一句话,右侧就会出提示

语音识别使用阿里云百炼的 Fun-ASR 实时模型,约 0.02 元/分钟,新用户有免费额度,以百炼官网为准。

对话模式怎么出提示

  • 自动(默认):对方说完一句话立刻出提示。如果对方其实还没说完,这条提示会先撤回,等说完后重写到同一张卡里;「好的」「嗯」这类太短的句子不会触发
  • 手动:只在按「出提示」快捷键时出
  • 两种方式下都可以随时按「出提示」立即出,不等对方说完;没有新内容时再按一次,会把上一条换个说法重出
  • 左边是对方说的话,右边是提示;鼠标移到某条提示上,左边会高亮它对应的问题
  • 对话模式采集的是系统音频,线上面试时就是会议里对方的声音,自己说话不会触发提示。「说完判定」的停顿时长和触发字数可以在「设置 → 对话模式 → 高级」里调整

让 AI 参考你的资料

在「设置 → 资料库」导入简历、项目笔记(PDF、Word、Markdown、TXT),或把准备好的问答直接粘贴成文本,AI 作答时会优先参考:

  • 经历类问题结合简历里的项目和数据,用第一人称回答;资料里有现成回答的问题,按你准备的要点和说法来
  • 每份资料可以分别选择用于截图模式、对话模式
  • 资料只保存在本机,但会随每次请求发给该模式使用的 AI 平台。资料越多回答越慢、费用越高,建议每个模式不超过 3 万字;DeepSeek、OpenAI 等平台会自动缓存重复的前缀,连续提问时这部分更快也更便宜

常用快捷键

操作 macOS Windows
截图解题(新开对话) ⌥ Enter Ctrl+Enter
追加截图 ⌥⇧ Enter Ctrl+Shift+Enter
对话模式:出提示 ⌥ G Ctrl+G
对话模式:切换自动 / 手动 ⌥⇧ G Ctrl+Shift+G
语音转录 / 开始停止监听 ⌥ T Ctrl+T
停止生成 ⌥ . Ctrl+.
切换截图 / 对话模式 ⌥⇧ M Ctrl+Shift+M
隐藏 / 显示窗口 ⌥ H Ctrl+H
鼠标穿透 ⌥ M Ctrl+M

所有快捷键都可以在「设置 → 快捷键」里修改,完整列表见应用内的「帮助中心」。

v3 新变化

  • 新增对话模式:根据面试官说的话实时出提示,不需要截图
  • 设置页改为分组导航:通用设置(AI 模型、语音、界面与隐私、快捷键)和两种模式的设置分开,不常用的项收进「高级」
  • AI 配置按模式选用:配置列表共用,两种模式各选一个。在「AI 模型」里点选配置现在只是打开它来编辑,要改某个模式用哪个配置,请点配置里的「用于」或到该模式的设置组里选。升级后两种模式都沿用你原来在用的配置
  • 提示词场景按模式分开,对话模式新增「技术面试」「行为面试」「英文面试」三个预设
  • 自 v2.1 以来的其他改进:多显示器选择截图屏幕、只截固定区域、关闭模型思考、自定义请求头、快捷键切换提示词场景、预设场景可删除、答案渲染数学公式、代码自动复制/保存、标题栏显示解题耗时

完整更新日志见 Releases。

关于隐身能力的说明

目前隐身功能适配市面上大部分会议软件(如腾讯会议等),但很少部分软件和浏览器可能无法正常隐身。请务必在正式使用前,用「当前电脑」+「当前会议软件」自行测试。

本项目仅供学习与研究使用,请遵守考试、面试等场合的相关规定,使用本软件产生的一切后果由使用者自行承担。相关问题欢迎提 Issue 讨论。

从源码运行

项目运行依赖 Node.js。

$ npm install
$ npm run dev

也可以在项目根目录创建 .env 文件预配置 AI 平台,程序启动后会自动读取作为默认值:

API_BASE_URL="https://openrouter.ai/api/v1" # 聚合服务的 API 地址,这里以 OpenRouter 为例
API_KEY="sk-1234567890" # 你的 API Key,这里只是示例
MODEL="gpt-5-mini" # 可选,指定模型

自己打包安装包:

$ npm run build:mac   # macOS
$ npm run build:win   # Windows

更多使用教程和视频请到本项目的 Wiki 查看。

许可协议(License)

本项目采用 CC BY-NC 4.0 协议许可。

您可以自由使用、复制、修改本项目代码,但 禁止任何形式的商业用途,包括但不限于售卖、集成入商业产品、SaaS 服务等。

如需商业授权,请联系作者获得书面许可。

类似项目

原 Interview-Coder 项目在网络上爆火之后,出现了很多类似的项目(本项目也是其中一个),每个项目都各有特色,这里列举一些比较火的项目供参考。