· 11 分钟

AI 与生产力:工作搭子完全指南

从认知理解、调用方式到工具选型,整理一份面向 AI 初学者和日常办公人群的工作搭子指南。

AI 与生产力:工作搭子完全指南

如何结合 AI 做日常内容生产 —— 从认知理解、调用方式到工具选型的一站式入门手册

面向人群:AI 应用初学者 / 日常办公人群 | 更新时间:2026 年 8 月


目录


一、前置条件:辅助工具

⚠️ 提示:AI 使用过程中,难免需要科学上网。以下工具用于解决网络访问、内容保存与身份验证等基础问题,建议在正式使用 AI 之前先配置好。

1. 科学上网

工具链接
机场注册点击注册
机场工具(FlClash)GitHub 开源地址

2. 浏览器与插件

对于浏览器的选择,推荐使用谷歌 Chrome;国内浏览器暂无使用经验,可自行选择。

Chrome 插件推荐:

插件作用链接
① AI Exporter一键将网页端 AI 对话内容保存成 md 文档到本地saveai.net/zh
② Cookie 编辑器自由导入/导出网站 Cookie,用于 AI 操作无头浏览器身份验证cookie-editor.com

3. Markdown 文档编辑器

强烈建议学习了解 Markdown 格式文档。虽然现在 AI 已经能很好地识别人类自然语言,但很多时候 MD 文档依旧更便于结构化操作、复制粘贴与版本管理。

  • Markdown 编辑器(MarkText):原文档下载直链为 GitHub 临时授权链接,具有时效性,若已失效请前往 MarkText 官方 Releases 页面 获取最新安装包(Windows x64 版本:marktext-win-x64-0.20.0-rc.1-setup.exe)。

二、对 AI 的认知

Artificial Intelligence,人工智能。 核心目标:让计算机具备感知、理解、生成、推理、决策和行动等能力。

传统软件依赖明确规则; AI 通过模型从数据中学习规律,概率 + 规则 = 规律

AI理解示意图1AI理解示意图2
图 2-1:AI 理解方式示意(一)图 2-2:AI 理解方式示意(二)

三、AI 调用方式

我该如何把这些能力接入到我的电脑或工作流中?

目前,将 AI 大模型”请”进你的工作流,主要有两条路径:API 调用本地部署。它们就像是”点外卖”和”自己做饭”的区别,适用于完全不同的场景。

3.1 API 调用:云端借力,即开即用(“点外卖”模式)

这是目前 90% 以上用户的选择。你不需要购买昂贵的设备,只需通过 API(应用程序接口)向云端的 AI 巨头(如 OpenAI、阿里通义、智谱等)发送请求,云端算力处理完毕后,将结果返回给你。

这里还有一个细分类:订阅制按量计费

  • 订阅制:即月费模式,例如豆包每月固定费用。好处是性价比高,但用不完也会扣固定月费,目前不存在类似手机流量的累积制度,属于当月清零、用完即止。
  • 按量计费:不购买套餐,用多少算多少,或套餐用完后超出部分单独计费。国内的 DeepSeek 即为按量计费,并未开放套餐模式。
通义千问套餐订阅详情小米mimo套餐订阅详情
图 3-1:通义千问套餐订阅详情图 3-2:小米 MiMo 套餐订阅详情
维度说明
优势零硬件门槛,能直接调用最聪明、参数量最大的顶级模型;无需维护,即开即用
劣势必须联网;按 Token(字数)计费;数据需上传至云端,不适合处理极度机密的信息
适用人群绝大多数普通用户、追求极致模型智商的创作者、以及需要快速搭建 AI 应用的开发者

API 平台推荐:

平台链接
lanfengAI注册链接
HostCentral注册链接
JOJOAI注册链接
哩布哩布 AIliblib.tv
咖图(画图)katuai.cn

3.2 本地部署:硬核私有,绝对掌控(“自己做饭”模式)

本地部署是指将开源的 AI 模型(如智谱、千问等)下载到你的个人电脑或私有服务器上,利用本地的显卡(GPU)或 CPU 进行推理计算。

📌 考虑到本地部署对设备需求较大,这里仅作简单介绍,不推荐普通用户自行部署。

维度说明
优势100% 的数据隐私(完全断网可用,机密文件绝不外泄);无 API 调用费用;不受云端审查限制,可玩性极高
劣势极度吃硬件(通常需要大显存的独立显卡,如 RTX 5090);受限于本地算力,通常只能运行参数量较小的模型,智商上限不如云端顶级模型;有一定的环境配置门槛
适用人群极客玩家、有严格数据合规要求的企业/开发者、以及拥有高端硬件的 AI 深度爱好者

相关开源模型与硬件参考:

谷歌gemma4多模态模型智谱GLM-5.3-Flash多模态模型
图 3-3:谷歌 26 年上半年开源的 Gemma 4 多模态模型图 3-4:智谱 2026 年 8 月 26 日开源的多模态模型 GLM-5.3-Flash
NVIDIA DGX SparkMac Studio
图 3-5:NVIDIA DGX Spark(淘宝)图 3-6:苹果官网 Mac Studio(中国大陆)

四、AI 工具全景

目前 AI 实际落地应用这块,除了网页 Agent,主要分为两大阵营:CLI 工具Claw 工具

4.1 网页 Chat

阿里千问 Qwen3.8qianwen.comchat.qwen.ai

阿里最新高性能模型免费使用,具有文本 + 多模态任务能力,可分析图片、视频等;

网页端免费 · 图片识别 · 视频识别 · 文本编辑 · 代码编写

智谱chatglm.cnchat.z.ai

智谱最新旗舰模型,具有长上下文记忆,满足日常办公 + 编程能力;

网页端免费 · 图片识别 · 视频识别 · 文本编辑 · 代码编写

DeepSeekchat.deepseek.com

DeepSeek 在国内外强大压力下,于上半年发布了 V4 版本,并说了句:“不诱于誉,不恐于诽,率道而行,端然正己。”

国内其他 AI 对话平台:

平台链接
字节豆包doubao.com
Kimikimi.com
MiniMaxagent.minimaxi.com
小米 MiMoaistudio.xiaomimimo.com
百度文心一言wenxin.baidu.com
美团龙猫longcat.chat
讯飞星火xinghuo.xfyun.cn
阶跃 AIchat.stepfun.com
腾讯元宝yuanbao.tencent.com

🌐 海外平台:以下平台统一都需要翻墙工具进行访问,并且均为订阅制,普通免费用户只有一点点的体验额度。

平台链接备注
谷歌 Geminigemini.google.com对节点比较挑剔,可能会显示”Gemini 目前不支持你所在的地区”
OpenAI ChatGPTchatgpt.com
Anthropic Claudeclaude.ai
马斯克 Grokgrok.com

4.2 CLI 工具

CLI 工具是针对程序编程的,说白了就是写代码。在 25 年底,个人开发者在 GitHub 上发布了”小龙虾”(OpenClaw),当时一夜爆火;没过多久,26 年初,国内开始针对开源的 OpenClaw 进行二创,也就是现在针对日常办公群体的办公工具。

经过几个月的发展,Anthropic 牵头,将日常办公套件(Cowork)与编程套件(Claude Code)结合在一起,用户只需下载一个应用程序,即可完整体验全套产品。OpenAI 紧跟步伐,发布了 ChatGPT 应用(包含 Work 与 Codex 模式)。

美利坚玩物:ChatGPTClaude Cowork

ChatGPT 安装:

  1. auth.json
{
  "auth_mode": "apikey",
  "OPENAI_API_KEY": "YOUR_API_KEY"
}
  1. config.toml
model_provider = "custom"
model = "gpt-5.6-sol"
model_reasoning_effort = "medium"
disable_response_storage = true

[model_providers.custom]
name = "Custom.Studio"
wire_api = "responses"
base_url = "https://custom.api/v1"
requires_openai_auth = true

Claude Cowork 安装:

在命令行中分别输入以下命令,运行安装程序,此时能够正常安装:

set HTTP_PROXY=http://127.0.0.1:7890
set HTTPS_PROXY=http://127.0.0.1:7890
"Claude Setup.exe"

4.3 Claw 工具

而国内厂商主要还是走 Claw 与 CLI 路线,两者有明显的界限。针对不同人群,有不同的产品,国产 CLI 方面就不列出来了,文章主要是给小白看的,就没必要介绍 CLI 了。

好玩的应用端程序有很多,GitHub 也有不少优秀的开源产品,但这里不作过多推荐,后面可自行探索,没有好坏之分,适合自己的才是最好的。

日常使用过程中,一定要看相关产品的文档。文档看不懂,可以截图问 AI。


AI 与生产力 · 工作搭子指南 | 本文档所列第三方链接、价格与产品信息可能随时间变化,请以官方最新信息为准