普通人的AI实战06:网页版DeepSeek装上这个插件,秒变Agent工作台
- 免费干货
- 8小时前
- 35热度
- 0评论

不用安装Claude Code,不用购买Cursor,也不用先充值DeepSeek API。打开DeepSeek网页版,再装一个浏览器插件,就能把它改造成一个会记忆、会调用工具、还能处理本地文件的Agent工作台。
上一期讲了如何选国产agent,但普通人的我们,不想掏钱用agent,那就让我们接着来免费薅羊毛把!
普通网页版的DeepSeek,像一个脑子很好、但双手插兜的同事。
你让它整理文件,它会认真告诉你“建议先按类型分类”;你让它修改电脑里的文档,它会给你写一份《修改文档的标准流程》;你让它执行命令,它会把命令工工整整地展示出来,然后礼貌地把键盘推回你面前。
装上 DeepSeek++ 之后,情况就不太一样了。
它可以给DeepSeek接上长期记忆、Skills、联网搜索、MCP工具、浏览器控制和本地Shell。配置完成后,DeepSeek不只是告诉你“应该怎么做”,而是可以在工具执行后读取结果,再继续完成下一步。

DeepSeek负责动脑,DeepSeek++负责给它接上工具、记忆和执行流程。
不过不要把预期想的太高,毕竟是免费的。DeepSeek++是社区开发的开源浏览器扩展,不是DeepSeek官方产品,也不是“装完立刻获得满血Claude Code”。基础增强很容易上手;本地文件、Office文档和图片视频分析,则需要继续配置本地组件或外部API。
下面直接按照实际使用顺序来。
一、DeepSeek++到底给DeepSeek加了什么?

DeepSeek++面向DeepSeek网页版,支持Chrome、Edge和Firefox。它没有偷偷替换DeepSeek模型,而是在网页外面增加了一层Agent工作流。

你可以把整套结构理解成:
DeepSeek网页版:负责理解、推理和生成
↓
DeepSeek++:负责记忆、Skills、项目和流程
↓
MCP / 浏览器工具:负责搜索、读取网页和调用外部能力
↓
Shell Native Host:负责连接本地文件、命令行和Office工具原来是一个聊天框,装完之后更像一个浏览器里的AI工作台。
它目前比较实用的能力
| 能力 | 实际用途 |
|---|---|
| 长期记忆 | 记住你的写作偏好、项目背景和常用信息 |
| 项目上下文 | 把项目说明、项目记忆和相关对话放在一起 |
| Skills | 用 / 快速调用固定工作流 |
| MCP工具 | 连接搜索、本地命令和第三方工具 |
| Agent续跑 | 工具执行完后,把结果交回DeepSeek继续处理 |
| 浏览器控制 | 操作你明确选中的网页标签页 |
| 对话导出 | 导出Markdown、HTML或PDF |
| 保存项 | 保存常用提示词、片段和网页线索 |
| 自动化任务 | 按cron或RRULE定时运行任务 |
| 可下载产物 | 生成Markdown、JSON、HTML、脚本或项目包 |
| 多模态扩展 | 借助外部模型分析图片和视频 |
对普通用户来说,最重要的不是“功能有多少”,而是它能直接增强你已经熟悉的DeepSeek网页版,不必重新适应另一套AI工具。
二、先装插件,两分钟完成基础增强

最简单的安装方式,是打开Chrome应用商店搜索 DeepSeek++。Edge和Firefox也有对应支持,但浏览器控制等能力在不同浏览器中可能存在差异。
安装完成后,打开:
https://chat.deepseek.com
正常情况下,页面中会出现DeepSeek++的侧边栏入口。

打开侧边栏后,你会看到资料、项目、能力和设置等区域,能力下面还会包含Skills、MCP、工具、浏览器、预设和自动化。

到这里,不装任何本地组件,也已经可以使用一批基础功能:
- 保存和管理长期记忆;
- 创建系统提示词预设;
- 输入
/调用Skill; - 使用联网搜索和网页读取;
- 导出当前对话;
- 保存常用提示词和回答片段;
- 管理项目上下文;
- 在支持的环境中使用侧边栏对话。
建议先做的第一个测试
你可以直接对DeepSeek说:
记住:我的公众号面向AI小白,文章要通俗、具体、少用术语,步骤必须给出示例,语气可以适当幽默。
然后换一个新会话,让它帮你写一段文章,看看它是否会自动沿用这套偏好。
如果你只是希望DeepSeek“更懂你、更好用”,做到这里就已经够了。
如果你希望它能读取电脑文件、运行命令、处理Word或Excel,就继续往下。
三、关键配置,让网页版DeepSeek连接本地电脑

很多人第一次看到“网页版AI可以读取本地文件”,通常会同时产生两个念头:
第一个:“这么厉害?”
第二个:“它是不是准备把我的硬盘连夜搬走?”
先讲清楚原理。
DeepSeek网页
↓
DeepSeek++浏览器扩展
↓
Shell Native Host
↓
本机文件、终端命令和OfficeCLI浏览器扩展本身不能随意操作整台电脑,因此需要安装一个本地Native Host,作为浏览器与操作系统之间的桥梁。
第一步:准备Node.js
Shell Host通过 npx 安装,所以电脑里需要先有Node.js。
可以在终端中输入:
node -v
npm -v只要都能显示版本号,就说明环境基本正常。
第二步:安装Shell Native Host
打开DeepSeek++侧边栏,进入 能力 → MCP。
页面会自动识别当前扩展ID,并生成对应的安装命令。

Chrome版命令格式类似:
npx deepseek-pp-shell-host install --browser chrome --extension-id kdmpkkahkhdmdhfkdihkopikgcocbpbf这条命令会安装Shell Native Host,并配合安装可供Agent调用的命令版OfficeCLI。若你使用的扩展ID不同,应以自己MCP页面自动生成的命令为准,不要机械复制别人的ID。
Windows用户可在PowerShell或Windows Terminal中执行;macOS和Linux用户在终端中执行即可。
安装完成后:
- 彻底关闭浏览器;
- 重新打开浏览器;
- 进入DeepSeek网页;
- 再打开DeepSeek++侧边栏。
第三步:创建Shell预设
重新进入 能力 → MCP:

按照这个顺序操作:
- 打开自动执行;
- 点击“测试”;
- 点击“刷新工具”;
- 确认Shell服务显示为可用;
- 查看工具列表中是否出现
shell_exec等命令工具。
这一步成功后,DeepSeek才算真正接上了本地执行能力。
四、不要一上来就“整理电脑”,先做三个安全测试
刚接通Shell时,不建议直接让AI批量移动文件。
先按“只读 → 新建测试文件 → 复制后修改”的顺序验证。
测试1:只读取文件名
提示词:
列出我桌面上的文件,只返回文件名、扩展名和大小,不要打开文件内容,不要移动、删除或修改任何文件。
这里要观察两件事:
- DeepSeek是否正确调用了Shell工具;
- 工具执行完成后,它是否根据结果继续整理并回复,而不是调用一次就停住。
测试2:创建一个无关紧要的文件
提示词:
在桌面创建一个名为“DeepSeek++测试.txt”的文件,内容为“如果你看到这句话,说明Shell连接成功”。不要修改其他文件。
确认文件确实出现后,再删除这个测试文件。
测试3:先分析,不执行整理
提示词:
扫描
D:\素材库\待整理目录,只列出文件名、类型、大小和修改时间。先给出整理方案,不要移动、重命名、删除或覆盖任何文件。等我确认后再执行。
这类提示词有三个关键点:
- 路径明确;
- 任务明确;
- 权限边界明确。
不要只说:
帮我整理电脑。
这句话的危险程度,和你对一个刚认识五分钟的人说“屋里你随便收拾”差不多。
五、让它处理Word、Excel和PPT

DeepSeek++内置了 /officecli 相关Skill,可以配合Shell MCP调用本机命令版OfficeCLI,读取、检查、修改和验证 .docx、.xlsx、.pptx 文件。
需要注意:相关Skill默认可能没有启用,要到 能力 → Skills 中手动打开。
适合它做的任务
- 提取Word文档的标题和章节结构;
- 检查Excel中的空值、重复项和异常数据;
- 批量替换PPT中的指定文字;
- 检查文档修改前后的差异;
- 修改副本后验证文件能否正常打开;
- 对多个Office文件做统一的格式检查。
示例1:只分析Excel,不修改
读取
D:\报表\6月运营数据.xlsx,统计每个工作表的名称、行数、列数、空值数量和重复行数量。只分析,不修改文件。
示例2:创建副本后清洗
在原文件同目录创建副本“6月运营数据_清洗版.xlsx”。删除完全空白的行,但不要覆盖原文件。修改完成后重新读取副本,确认各工作表仍能正常访问,并汇报修改数量。
示例3:检查Word结构
读取
D:\文章\DeepSeek插件教程.docx,提取一级、二级、三级标题,检查是否存在标题层级跳跃。只输出问题和建议,不修改文档。
示例4:批量替换PPT文字
读取
D:\演示\产品介绍.pptx,查找所有“Deepseek”并统一改成“DeepSeek”。先告诉我会修改多少处,等我确认后再在副本中执行。
这里建议养成一个固定习惯:
先读、再分析、再预览修改计划,最后复制一份执行。
不要让AI直接覆盖“最终版_这次真的是最终版.xlsx”。
AI看到这个文件名,并不会自动产生敬畏。
六、DeepSeek也能“读图”,但不是突然长出了眼睛

DeepSeek++的多模态能力采用的是“外部模型先看图,DeepSeek再继续处理”的思路。
流程大致是:
你附加图片或视频
↓
外部多模态模型完成识别
↓
识别结果返回当前会话
↓
DeepSeek继续总结、分析或执行任务安装多模态Native Host的命令格式为:
npx deepseek-pp-multimodal-mcp install --browser chrome --extension-id <扩展ID>安装完成后,需要在设置中的“多模态API”区域配置OpenAI或Gemini兼容的API Key、模型名称和请求地址,然后回到MCP页面创建并启用“多模态”预设。
配置成功后,你可以直接让它:
分析这张公众号封面,告诉我它的信息层级、视觉焦点、标题可读性和可能影响点击率的地方,并给出三个具体修改方案。
或者:
分析这段操作视频,按时间顺序整理成教程步骤,并标注哪些画面适合截成公众号配图。
需要注意,这部分通常不是完全免费的。
DeepSeek后续文字处理仍然可以继续使用网页版;但图片和视频识别会调用你配置的外部API,并按相应平台规则计费或消耗额度。
更准确的描述是:
只在“看图、看视频”这一步调用多模态模型,后续大量文字整理继续交给DeepSeek。
七、几个比“本地文件”更容易被忽略的功能

1. 长期记忆:让DeepSeek不用每次重新认识你
你可以让它记住:
- 你的职业;
- 内容定位;
- 文章语气;
- 常用输出格式;
- 长期项目背景;
- 你明确反馈过的偏好。
例如:
记住:我的“普通人的AI实战”系列面向非技术用户。文章要先讲使用价值,再讲配置步骤;避免堆概念;每个复杂步骤都要给可复制提示词。
记忆不是越多越好。过期项目、临时要求和错误信息要定期清理,否则AI会像一个态度认真、但笔记本从不撕旧页的助理。
2. Skills:把提示词升级成可重复使用的流程
在输入框中输入 /,就可以调用已启用的Skill。
Skill不是一句简单提示词,而是一套可复用的工作说明书。
例如可以建立:
/公众号写作/选题调研/Excel检查/PPT优化/officecli
以后不必每次重新解释流程,选择Skill后再提供具体材料即可。

3. 项目上下文:让一个系列拥有自己的“工作区”
做长期内容时,可以建立“普通人的AI实战”项目,放入:
- 系列定位;
- 目标读者;
- 常用文章结构;
- 语言风格;
- 禁用表达;
- 历史选题;
- 项目专属记忆。
以后继续写同一系列,不需要每次复制一大段背景。
4. 保存项:把好用提示词和资料片段收起来
常用提示词、网页线索、文章框架和优秀回答,都可以保存成片段或书签,并在后续对话中快速插入。
这比把提示词散落在微信收藏、记事本、飞书和“新建文本文档(27).txt”里靠谱得多。
5. 自动化任务:让固定工作按时运行
DeepSeek++支持手动运行、cron和RRULE规则。

例如:
- 每周一整理本周AI选题;
- 每天检查指定网页是否更新;
- 定期生成固定格式的项目复盘;
- 每隔一段时间继续追踪同一主题。
不过它本质上仍是浏览器扩展里的自动化。浏览器是否开启、登录状态、网络和网页服务都可能影响任务执行,不要把它当成银行级后台调度系统。
6. 浏览器控制,只操作你明确授权的标签页
在支持的Chrome或Edge环境中,可以启用浏览器控制,选择一个目标标签页,让AI完成导航、点击、输入、等待页面内容和读取可见文本结构等操作。
它提供给模型的主要是网页结构和可见文本摘要,不是让AI随时监视所有页面。
即使如此,也建议:
- 只选择当前任务需要的标签页;
- 完成后及时断开;
- 不要同时打开网银、公司后台和敏感系统;
- 涉及提交、付款、删除时必须人工确认。
八、它和普通DeepSeek到底差在哪?
为了避免把插件吹成“万能AI”,可以用一张表看清楚:
| 场景 | 普通DeepSeek网页版 | 装上DeepSeek++ |
|---|---|---|
| 记住长期偏好 | 依赖当前对话或手动重复 | 可管理长期记忆 |
| 固定工作流程 | 每次重新写提示词 | 可使用Skills和预设 |
| 获取网页信息 | 依赖平台现有能力 | 可接入网页搜索和读取工具 |
| 读取本地文件 | 通常需要手动上传 | 配置Shell后可访问指定路径 |
| 执行命令 | 只能给出命令 | 可通过Shell MCP实际执行 |
| 处理Office文件 | 上传后分析,修改链路有限 | 可配合OfficeCLI读取、修改和验证 |
| 多步任务 | 容易在一次回答后结束 | 工具结果可回传并继续下一步 |
| 项目长期管理 | 依赖聊天记录 | 有项目上下文和项目记忆 |
| 自动定时运行 | 不方便 | 支持自动化任务 |
| 图片视频分析 | 取决于当前网页能力 | 可接入外部多模态API |
它最大的变化,不是“DeepSeek突然变聪明了”,而是:
原来只有大脑,现在增加了记忆本、工具箱和执行通道。
九、使用前必须知道的几个局限
1. 它不是DeepSeek官方插件
这是社区开源项目。安装时应核对GitHub仓库、浏览器商店发布者、权限说明和更新记录,避免安装名称相似的仿冒扩展。
2. 本地能力不是装完插件就自动拥有
要读取文件、运行命令和调用OfficeCLI,还需要安装Shell Native Host,并正确配置Node.js、浏览器扩展ID和本地通信。
3. 图片视频分析需要外部API
没有配置OpenAI、Gemini或兼容接口,就不能按这套流程分析媒体文件。
4. 插件补的是工具,不是模型智商
DeepSeek++补上了记忆、工具和流程,但复杂判断、推理质量和代码能力,仍取决于你使用的DeepSeek模型。
5. Agent依然会犯错
涉及以下操作时,必须先预览:
- 删除文件;
- 覆盖文档;
- 批量重命名;
- 大范围移动文件;
- 安装软件;
- 执行不熟悉的终端命令;
- 提交网页表单;
- 操作敏感账户。
十、它适合谁?
比较适合
- 经常使用DeepSeek网页版的人;
- 想体验Agent,但暂时不想购买Claude Code或Cursor的人;
- 需要整理本地资料、文章、表格和PPT的内容创作者;
- 愿意花一点时间安装Node.js和Shell Host的人;
- 希望建立长期项目记忆和固定工作流的人;
- 已经有多模态API,希望只在必要环节调用的人。
不太适合
- 只偶尔问DeepSeek一句话的人;
- 完全不愿意碰终端配置的人;
- 处理高度敏感、不可出错文件的人;
- 希望一个免费插件彻底替代所有专业Agent工具的人;
- 看见“自动执行”四个字就忍不住把整个硬盘交出去的人。
结尾
DeepSeek++真正有意思的地方,不是给网页多加了几个按钮,而是把DeepSeek从一个“回答问题的聊天框”,变成了一个可以记住上下文、调用工具、持续执行任务的浏览器工作台。
你可以按需求逐步升级:
只装浏览器插件
→ 使用记忆、Skills、项目、搜索和导出
继续安装Shell Host
→ 读取本地文件、运行命令、处理Office文档
继续配置多模态API
→ 分析图片和视频它不完美,也不是万能替代品。
但当你第一次让DeepSeek读取一个本地文件、根据内容完成处理、再把结果保存回电脑时,你大概率会产生一种感觉:
对,这才像一个真正能干活的AI。
安全提醒
- 只从项目官方仓库或仓库明确列出的浏览器商店入口安装。
- 第一次使用先测试只读任务,不要直接授权删除或覆盖文件。
- 重要文件先备份,优先创建副本。
- API Key不要发进聊天内容,也不要提交到公开仓库。
- 执行终端命令前,先看懂它准备做什么。
- 浏览器控制只授权当前需要的标签页,完成后及时断开。
- 不要让AI直接处理网银、密码库和高度敏感的公司系统。
参考资料
- DeepSeek++项目仓库:https://github.com/zhu1090093659/deepseek-pp
- DeepSeek网页版:https://chat.deepseek.com
- OfficeCLI项目:https://github.com/iOfficeAI/OfficeCLI
转自:https://mp.weixin.qq.com/s/i-zjE7sy08mQhv_k0FJozA