AI 工具导航
一份精简的 AI 工具清单——每个擅长什么、短板在哪、以及在国内能不能直接用。所有链接直达官网,不经任何跳转。
通用对话
5CChatGPTOpenAI 的通用对话模型,用户量最大的 AI 产品大陆不可用对话写作
收费有免费档,按月订阅解锁更强的模型与更高额度
访问中国大陆无法直接访问,注册也需要境外手机号
把 AI 对话带进大众视野的产品,也是多数人接触的第一个。它的优势在于生态:插件、自定义 GPT、代码解释器、联网检索都集成在同一个界面里,遇到需要多种能力配合的任务时不必换工具。
它的短板同样明显。免费档的模型与付费档差距不小,而遇到长文档或需要严格遵循格式的任务时,输出容易在中途偏离要求。另外它对中文的理解虽然够用,但在中文写作的语感上不如国内几家模型自然——如果你的任务是写中文文案,值得对比一下。
大陆用户需要注意:网站与 App 都无法直接访问,注册环节还需要境外手机号。市面上那些“国内直连版 ChatGPT”绝大多数是套壳转发,你的对话内容会先经过第三方服务器,输入敏感信息前请想清楚这一点。
CClaudeAnthropic 的模型,长文本与代码任务上的表现突出大陆不可用对话长文本
收费有免费档,订阅后放开用量与更强的模型
访问中国大陆不在支持区域,直接访问会被跳转到"服务不可用"页面
在需要“读懂一大段东西再动手”的任务上表现最好的一类模型:几十页的文档、一整个代码库的上下文,它更容易抓住其中的结构关系,而不是只回应你最后那句话。写作输出的语感也比较克制,不太出现那种一眼能认出来的 AI 腔。
代码任务是它的强项,尤其是在既有代码里做修改——理解现有约定、按你的风格续写,而不是另起炉灶给一份“标准答案”。
短板是能力面窄:不生成图像,联网检索比 ChatGPT 和 Gemini 弱,插件生态基本没有。它更像一个能力很强的单体模型,而不是一个平台。
大陆用户:不在支持的国家/地区列表内,直接打开会被跳到服务不可用的提示页。
GGeminiGoogle 的模型,上下文窗口最大,与自家生态打通大陆不可用对话多模态
收费免费额度较为慷慨,订阅解锁更强模型与更高配额
访问中国大陆无法直接访问
上下文窗口是它最实在的优势——可以一次性塞进整本书或几小时的会议记录,而不用先切分再拼接。多模态能力也是几家里最完整的,图片、音频、视频都能直接作为输入。
与 Google 生态的打通是另一个理由:如果你的资料本来就在 Gmail、Drive、Docs 里,它能直接调取,省去导出再粘贴的往返。
代价是输出质量不够稳定。同一个提示词多试几次,结果的差异比 ChatGPT 和 Claude 明显;在需要严格遵循格式的任务上尤其如此。它更适合“帮我处理这一大堆材料”,而不是“帮我把这段文字打磨到能直接用”。
大陆用户:无法直接访问。
DDeepSeek国产开源模型,推理能力接近第一梯队而成本极低对话开源
收费网页版免费;API 价格是同级别国际模型的零头
访问大陆可直接访问
近两年最值得关注的国产模型。它把推理能力做到了接近国际第一梯队的水平,而 API 价格只有同级别产品的几十分之一——对个人开发者和小团队来说,这个差价往往直接决定了一个想法能不能落地。
模型权重开源,可以自行部署,这在需要数据不出内网的场景里是决定性的优势。中文表现自然,处理中文长文本时上下文保持得比多数国际模型稳。
短板在生态:没有插件体系,多模态能力弱于 GPT 与 Gemini,网页版功能也偏朴素。它适合“给我一个准确答案”或“帮我写这段代码”这类任务,不适合需要调用外部工具的复杂工作流。
大陆可以直接访问,无需任何额外配置。
KKimi月之暗面的模型,长文本处理与中文语感是主要卖点对话长文本
收费网页版免费使用
访问大陆可直接访问
国内几家里对长文本处理下功夫最多的。上传几十万字的资料再提问,它在定位具体段落、跨章节关联信息上比多数同价位选择更稳,做资料整理和文献综述类的活比较合适。
中文语感自然,写出来的东西不太需要再改语序。联网检索在国内可用,查中文互联网上的信息比那些访问不了国内站点的国际模型更实际。
短板在推理深度:复杂的多步推导、需要严格逻辑链的问题上,与第一梯队还有差距。写代码也不是它的长处。
大陆可以直接访问,无需额外配置。
编程
3GGitHub Copilot编辑器里的代码补全,覆盖面最广的一个代码补全编辑器插件
收费个人订阅制,学生与开源维护者可申请免费
访问大陆可直接访问
最早铺开、也是编辑器支持最全的一个:VS Code、JetBrains 全家桶、Neovim、Visual Studio 都有官方插件。如果团队用的编辑器不统一,它往往是唯一能让所有人用上同一套工具的选择。
它最擅长的是“顺着写”——你起了个头、写了函数签名或注释,它把剩下的补完。重复性强的代码(测试用例、数据转换、样板配置)省时间最明显。
要有心理准备的是:它补出来的代码看着合理但未必正确,尤其是涉及边界条件和错误处理时。把它当成一个打字快但不细心的搭档,每一行都要看过再留下。
大陆可以访问,但速度取决于你的网络到 GitHub 的连通性。
CCursor内置 AI 的编辑器,改动跨多个文件时更顺手AI 编辑器跨文件改动
收费有免费额度,订阅后放开更强模型的用量
访问大陆可直接访问
基于 VS Code 改造的编辑器,把 AI 从“补全插件”提升成了工作方式。与补全类工具的关键差别在于它理解整个项目:你可以说“把这个函数的错误处理改成和其他地方一致”,它会去看其他地方是怎么写的。
跨文件的改动是它的强项——重命名一个概念、调整一处接口然后同步所有调用点,这类活它做得比在聊天窗口里来回粘贴高效得多。
代价是要换编辑器。如果你的配置、快捷键、插件都在别处,迁移成本是真实的;而它基于的 VS Code 版本有时落后于上游。
大陆可以访问,登录环节偶尔需要一点耐心。
CClaude Code终端里的编程助手,能自己读文件、跑命令、改代码大陆不可用终端自主执行
收费包含在 Claude 订阅内,也可按 API 用量付费
访问需要 Claude 账号,而大陆不在支持区域
与补全工具和 AI 编辑器都不同:它在终端里运行,能自己决定读哪些文件、跑什么命令、改哪里,然后把改动结果拿给你看。你描述要做的事,它去做,而不是给你一段代码让你自己贴。
适合的场景是“跨越多个文件、需要先摸清现状”的任务:排查一个报错、给现有功能补测试、按新约定改造一批代码。它会先去看代码怎么写的,再动手。
需要注意它有执行命令的能力。默认每步都会征求同意,但放开权限前应当清楚它能做什么——尤其在有未提交改动或生产配置的目录里。
账号体系与 Claude 相同,因此大陆同样不在支持区域。
图像生成
3MMidjourney出图审美最稳的一个,代价是可控性大陆不可用图像审美强
收费订阅制,没有长期免费额度
访问大陆直连不通,且早期只能在 Discord 里使用
单看出图的观感,它仍然是最稳的:光影、构图、材质,随便一个提示词都能给出一张“看起来很专业”的图。做概念图、海报、氛围参考时,它省下的挑选时间最多。
代价是可控性。精确指定“这个物体放在左下角、那个人朝右看”这类要求,它经常给你一张更好看但不是你要的图。要做严格符合设计稿的东西,Stable Diffusion 那种可以叠加控制条件的路线更合适。
另外它不开源、不能本地部署,全部依赖订阅,没有长期免费额度——试用之前要清楚这一点。
大陆直连不通。
SStable Diffusion开源图像模型,可本地部署、可精细控制图像开源
收费模型开源免费,官方云服务按量计费
访问大陆可直接访问
开源是它最大的区别点:模型可以下载到自己的机器上跑,图片不经任何第三方,也没有生成内容的政策限制。做商业项目、或者素材本身涉密时,这一条往往就决定了选它。
生态是另一个优势。ControlNet 这类控制手段可以按姿势、深度、边缘图来约束构图,LoRA 可以用少量素材训练出特定风格或角色。要做“每张图里同一个人物”或“严格贴合线稿”,这条路线是可行的,Midjourney 则很难。
代价是上手成本。要自己配环境、挑模型、调参数,本地跑还需要一块像样的显卡。开箱即用的观感也不如 Midjourney,好效果依赖你会不会调。
官网大陆可以打开。
即即梦字节的图像与视频生成工具,中文提示词直接可用图像视频
收费有每日免费额度,超出后按积分计费
访问大陆可直接访问
国内可直接使用的选择里最完整的一个:图像生成、图像编辑、视频生成都在同一个产品里,不需要在几个工具之间导来导去。
对中文用户最实际的好处是提示词不用翻译。国际模型对中文提示词的理解普遍不如英文,而它是按中文语料训练的,描述“国潮风格”“水墨质感”这类本土概念时不会跑偏。中文字体的渲染也明显好于国际模型——后者生成的中文常常是似是而非的字形。
短板是画面的整体质感与 Midjourney 仍有差距,复杂场景容易出结构问题。
大陆可直接访问,需要手机号注册。
视频生成
2RRunway面向创作者的视频生成与编辑,工具链最完整视频后期工具
收费有少量免费额度,之后按订阅或积分计费
访问大陆可直接访问
不只是“输入文字生成视频”,而是一整套后期工具:抠像、消除物体、运动跟踪、把静态图变成有镜头运动的片段,都在同一个界面里。对已经在做视频的人来说,它替代的是若干个原本要分别打开的软件。
生成部分的可控性也高于多数同类:可以指定镜头运动方式、用图像作为首帧或末帧来约束画面走向。
限制是时长和一致性。单次生成的片段很短,把几段拼成有叙事的内容时,人物和场景很难保持一致——这是当前所有视频模型的共同问题,不是它一家的短板。
官网大陆可以打开,但登录与生成环节依赖境外网络。
可可灵快手的视频生成模型,国内可直接使用视频图生视频
收费每日赠送积分,超出后购买
访问大陆可直接访问
国内能直接用的视频生成里效果比较靠前的一个。人物动作的自然度和物理合理性做得不错——手部、走路姿态这些最容易穿帮的地方,出问题的频率低于多数同类。
支持文生视频与图生视频两条路:给一张图让它动起来,比纯文字描述更容易得到你想要的画面,这也是目前所有视频模型里更可控的用法。
短板与整个品类一致:单段时长有限,多段之间难以保持一致,复杂运镜容易出现结构崩坏。中文提示词理解是优势,描述本土场景时不需要绕道英文。
大陆可直接访问。
语音与音乐
2EElevenLabs语音合成,自然度目前最高的一档语音合成声音克隆
收费每月有免费额度,按字符计费
访问大陆可直接访问
合成语音的自然度目前最高的一档:停顿、语气起伏、情绪都接近真人朗读,不像多数 TTS 那样一听就是机器。做有声内容、视频配音、播客草稿时,它的输出往往可以直接用。
支持声音克隆——用几分钟素材复刻一个音色。这个能力很强,但也意味着你要为使用它承担责任:用别人的声音需要对方同意,很多地区对此有明确法律规定。
中文效果不如英文自然,语调偶尔会有外国人说中文的感觉。纯中文内容值得同时试试国内的方案。
官网大陆可以打开。
SSuno从一句描述生成完整歌曲,含人声与歌词大陆不可用音乐生成含人声
收费每日有免费额度,订阅后放开数量与商用许可
访问大陆直连不通
输入一句风格描述,它给你一首完整的歌——编曲、人声、歌词都有。这在几年前还是不可想象的事,现在做背景音乐、短视频配乐、demo 小样,它能在几分钟内给出可用的东西。
歌词可以自己写,也可以让它生成。中文歌的咬字比早期版本好了很多,但仍偶有发音怪异的地方,需要多生成几次挑一个。
要留意版权与授权:免费额度生成的作品通常不含商用许可,用在正式项目里之前务必看清楚当前的条款——这类条款变动比较频繁。
大陆直连不通。
搜索与研究
1PPerplexity带来源引用的 AI 搜索,答案每句都能溯源大陆不可用搜索带引用
收费基础功能免费,订阅解锁更强模型与更高频次
访问大陆直连不通
它解决的是通用对话模型最大的问题:你无法判断答案是真的还是编的。这里每个论断后面都跟着来源链接,可以点进去核对原文。对于需要拿出去用的信息——写报告、做调研、查技术资料——这个差别是决定性的。
比起传统搜索,它的价值在于替你读完前几个结果再作答,而不是丢给你十条链接。查一个明确的事实性问题时,省下的时间很可观。
它不适合需要创造性或长篇输出的任务——那不是它的定位。另外要提醒:有来源不等于来源可靠,它引用低质量网页的情况并不少见,链接仍然要自己看一眼。
大陆直连不通。
以上均为第三方服务,本站不参与运营。定价与功能变动频繁,一切以官网为准。可访问性是从中国大陆网络实测的结果,你的网络环境可能不同。