Skip to content

Latest commit

 

History

24 Commits

Folders and files

NameName
Last commit message
Last commit date
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 

Repository files navigation

AI 简历填表助手

一个基于 Chrome/Edge Side Panel 的浏览器扩展。

你维护一份标准化简历,扩展负责在网页里扫描表单字段,用大模型只做“字段映射”,再由本地脚本执行确定性填充。默认不会自动提交表单。

AI 简历填表助手 Logo

Chrome Extension Edge Extension Manifest V3 Node Test License GPL-3.0

侧边栏总览 简历配置页

模型与功能界面 填表流程界面

Tip

适合需要频繁填写网申、招聘官网和报名表单的人。扩展默认只填值,不提交表单。

Note

我的开源项目已链接认可 LINUX DO 社区,欢迎在 LINUX DO 开源自荐帖中交流、反馈和共建。

🎯 这项目解决什么问题

大多数网申/招聘表单都有几个共同问题:

  • 同一份信息要反复填写
  • 不同网站字段命名不统一
  • 某些页面用了自定义控件、日期面板、单选/多选组,脚本很难稳定处理
  • 纯“让 AI 直接操作页面”不够可控,也不方便排查失败原因

这个项目的做法不是让 AI 直接乱填页面,而是拆成两步:

  1. 先把你的简历整理成固定 schema
  2. 再让 AI 只判断“页面字段应该对应简历里的哪个路径”

映射完成后,真正的写值、触发事件、匹配选项、处理日期控件,都在内容脚本里本地执行。

这让行为更可控,也更容易调试。

✨ 核心能力

  • 标准简历 schema:内置较完整的简历结构,覆盖基本信息、求职偏好、教育经历、实习、工作、项目、校园经历、证书、语言、补充信息等
  • AI 导入简历:支持粘贴原始简历文本,或者上传带文字层的 PDF,自动抽取并整理为标准简历 JSON
  • 三种填充模式:
    • 整页填充:覆盖当前页面可识别字段
    • 增量填入:跳过已经有值的字段
    • 选区填入:先框选页面区域,只填选区内字段
  • 多控件支持:inputtextareaselectradio groupcheckbox groupcontenteditable
  • 日期控件适配:对部分只读日期输入框和日期面板做了特殊处理
  • 深度扫描:填充前自动展开明确标记为“展开/查看更多”的折叠区块,再扫描新增字段
  • 字段映射缓存:同一页面结构会复用本地映射缓存,减少重复调用模型
  • 运行诊断日志:侧边栏展示关键日志,支持把完整会话自动导出到 debug-logs/
  • 独立简历配置页:复杂简历字段不挤在侧边栏里,支持打开宽页面编辑
  • 多模型配置:内置 DeepSeek,也可以配置任意 OpenAI 兼容接口

🧩 适合什么场景

  • 校招/社招网申表单
  • 企业招聘官网
  • 需要频繁重复填写的申请表
  • 希望保留人工确认,不想自动提交的人

🚫 不做什么

  • 不自动提交表单
  • 不处理 input[type="file"] 的自动上传
  • 不内置 OCR,扫描版 PDF 需要你先 OCR
  • 不依赖后端服务,不上传到你自己的服务器

⚙️ 项目怎么工作

1. 标准简历

扩展先维护一份固定 schema 的简历数据,模型配置和 API Key 都存储在当前设备的 chrome.storage.local 中,不会通过 Chrome Sync 跨设备同步。

简历原文和结构化简历可能超过 Chrome Sync 的单项配额,因此不会参与跨设备同步。升级到本版本时,扩展会自动把旧版同步存储里的简历数据和模型配置迁移到本地存储,并清理旧键。

这一步的价值是把“原始简历文本”变成“可复用字段目录”,后面的映射和填充都围绕它进行。

2. 页面字段扫描

内容脚本会扫描当前页面可填写控件,并尽量提取:

  • 字段标签
  • placeholder
  • 选项列表
  • 上下文文本
  • 附近标签
  • 所在区块语义

项目里专门写了字段标签提取、区块语义判断、日期运行时判断等辅助模块,不是单纯只看 label

3. AI 只做字段映射

发送给模型的是:

  • 当前页面字段列表
  • 已填写的标准简历字段目录
  • 允许的 transform 规则

模型只返回“某个页面字段对应哪个 resumePath”,例如:

  • personal.email
  • educations.0.school
  • internships.0.company

而不是直接返回一整页最终表单值。

4. 深度扫描只展开已有区块

整页填充前,扩展会识别带有“展开”“查看更多”或明确折叠状态的控件,等待新增字段渲染后再开始扫描。为了避免误操作,带有“添加”“新增”“新建”或加号语义的控件不会被自动点击;选区填入也不会触发深度扫描。

5. 本地确定性填充

拿到映射后,扩展会在浏览器里本地完成:

  • 取值
  • 日期/手机号拆分
  • 单选/多选匹配
  • 下拉选择
  • 输入事件与 change 事件触发

这一步不依赖模型,行为更稳定。

🚀 快速开始

1. 安装扩展

  1. 打开 chrome://extensions/edge://extensions/
  2. 开启“开发者模式”
  3. 点击“加载已解压的扩展程序”
  4. 选择当前项目目录
  5. 点击扩展图标,打开侧边栏

这个项目没有构建步骤,源码目录可以直接加载。

2. 配置模型

侧边栏右上角进入设置。

模型配置只保存在当前浏览器的本地扩展存储中,API Key 不会通过消息传给页面脚本;后台会根据模型 ID 读取配置并代理请求。

默认内置一套 DeepSeek 配置模板,你也可以改成任意 OpenAI 兼容接口。当前实现调用的是:

  • POST /chat/completions

常见示例:

  • Base URL: https://api.deepseek.com/v1
  • Model: deepseek-chat
  • API Key: 你自己的 key

3. 准备标准简历

有两种方式:

  • 手动填写标准简历
  • 粘贴原始简历文本,或上传带文字层的 PDF,让 AI 先导入

如果简历内容较多,推荐点击“打开简历配置页”在独立页面里维护。

4. 在网页里执行填充

打开目标表单页后,可在侧边栏选择:

  • 开始填充
  • 增量填入
  • 选区填入

扩展声明 HTTP/HTTPS 页面访问权限,以便侧边栏在切换任意普通网页标签页后仍能读取并填写当前页面。页面脚本不会常驻网站,只会在你点击填充操作后通过 scripting 权限动态注入当前页面。发给模型的页面 URL 会自动移除 query/hash,避免把临时参数和 token 带出。

填充完成后,请自己检查并手动提交。

🧠 当前实现里值得注意的设计点

1. 映射缓存是按“页面结构签名”做的

项目不是简单按 URL 缓存,而是会结合字段种类、标签、placeholder、section 信息等生成签名。

这能避免“同一页面字段已经变了,但还错误复用旧缓存”的问题。

2. 侧边栏日志和完整诊断日志分层显示

UI 里只显示关键过程日志,冗长的结构化诊断不会全部堆到面板里。

如果你授权项目目录,完整会话日志会自动导出到:

  • debug-logs/

适合排查“为什么这个网站没映射上”或“为什么这个日期控件没填进去”。

3. 项目偏向校招/中文网申语义

schema 和映射提示词里,对这些内容做了额外强化:

  • 教育经历
  • 实习经历
  • 校园经历
  • 学历类型 / 培养方式 / 实验室 / 导师 / 学号等字段

如果你的主要场景是中文招聘站,这一套会比通用型 schema 更顺手。

📌 支持与限制

已支持

  • 文本输入框
  • 文本域
  • 下拉框
  • 单选组
  • 多选组
  • contenteditable
  • 部分只读日期输入框与日期面板
  • 整页/增量/选区三种填充模式

明确限制

  • 文件上传字段不能自动写入
  • 扫描版 PDF 没有文字层时无法直接导入
  • 跨域 iframe 内的字段可能无法识别或填写
  • 极端自定义控件仍可能需要单站点适配
  • 深度扫描依赖按钮的可访问性属性、折叠状态或明确文本;站点完全没有这些语义时仍需要手动展开
  • 刚重载扩展后,旧页面里可能还挂着旧版 content script;刷新页面一次再试最稳妥

✅ 测试

仓库里已经带了一组基于 Node 内置测试运行器的测试,覆盖了这些核心部分:

  • schema 结构与归一化
  • AI JSON 解析容错
  • 字段标签提取
  • 页面字段 payload 构造
  • 填充模式辅助逻辑
  • 诊断日志格式
  • 映射缓存版本与签名规则
  • 模型配置迁移、HTTPS 地址校验、敏感值脱敏

运行:

npm test

CI 会同时运行全部 Node 测试、JavaScript 语法检查和扩展 JSON 配置校验。

仓库里还带了一个本地联调用表单:

  • output/playwright/test-form.html

它主要用于验证增量填入和选区填入这两条链路。

🗂️ 项目结构

.
├── manifest.json               # Chrome MV3 配置
├── background.js               # 统一代理 OpenAI 兼容接口调用
├── popup.html / popup.js       # 侧边栏 UI、模型设置、填充入口、日志
├── resume-editor.html / .js    # 独立简历配置页
├── content.js                  # 页面扫描、字段映射、实际填充
├── package.json                 # 本地测试命令
├── .github/workflows/test.yml   # Node 测试、语法和配置校验
├── shared/
│   ├── resume-schema.js        # 标准简历 schema
│   ├── resume-storage.js       # 简历本地存储与旧版同步数据迁移
│   ├── model-storage.js        # 模型配置本地存储与旧版同步配置迁移
│   ├── ai-client.js            # 页面侧统一 AI 消息调用
│   ├── resume-prompts.js       # 简历导入提示词
│   ├── diagnostics.js          # 结构化诊断日志格式化
│   ├── field-text.js           # 字段标签抽取与评分
│   ├── field-semantics.js      # 区块语义判断
│   ├── fill-runtime.js         # 填充值与日期运行时适配
│   ├── log-export.js           # 调试日志导出
│   └── content-bridge.js       # content script 版本/能力握手
├── libs/pdfjs/                 # PDF 文本提取
├── tests/                      # Node 测试
└── output/playwright/          # 本地联调与截图产物

🧪 关于模板模块

仓库里还保留了一组问卷/考试站点模板相关模块:

  • modules/scanner-enhanced.js
  • modules/site-matcher.js
  • modules/template-manager.js
  • templates/wjx.json
  • templates/tencent.json

它们更像一条早期或实验性质的能力线,用于问卷星、腾讯问卷这类站点的题目模板扫描;不是当前“标准简历自动填表”主流程的核心依赖。

🔒 隐私与安全

请默认按“简历数据是敏感信息”来理解这个项目。

  • 你的 API Key、模型配置、标准简历会保存在当前浏览器的本地扩展存储里,不参与 Chrome Sync
  • 用于字段映射和简历导入的内容会发送到你配置的模型接口
  • API Base URL 默认必须使用 HTTPS;仅允许 localhost127.0.0.1::1 的本机 HTTP 调试地址
  • 诊断日志会对常见个人信息脱敏,导出目录最多保留 50 个 JSON 日志文件
  • 发送内容可能包含:简历文本、页面 URL、页面标题、字段标签、选项和上下文文本
  • 项目默认不会自动提交表单

如果你不希望任何简历内容离开本地,就不要配置在线模型接口。

🛠️ 适合怎么继续演进

如果你准备把这个项目继续开源维护,后续最值得做的方向大概是:

  • 增加更多招聘站点和控件适配样例
  • 补一套可复现的端到端联调脚本
  • 把模板模块和主流程的关系进一步梳理清楚
  • 增加英文 README 或双语文档

🤝 贡献

欢迎提 Issue 和 PR。

如果你要反馈某个站点无法填写,最好同时提供:

  • 目标站点页面类型
  • 失败字段示例
  • 侧边栏关键日志
  • debug-logs/ 导出的诊断文件

这样更容易定位问题。

📮 联系方式

如果你想直接交流使用问题、反馈兼容性案例,或者讨论合作,可以扫码联系我:

微信二维码

📄 License

GPL-3.0

About

一个AI+自动填写官网简历信息的浏览器插件:你只需提供简历文本或上传“有文字层”的 PDF,扩展会用 DeepSeek(或任意 OpenAI 兼容 API)解析简历并在目标网页上自动识别表单字段后“一键填充”(不会自动提交)。

Resources

Stars

125 stars

Watchers

1 watching

Forks

Releases

Packages

Contributors

Languages