70款ChatGPT插件评测
我花了四天,把ChatGPT商店里的70个插件全用了一遍,结果让我后背发凉
你知道吗?这个事儿说出来你可能不信。
今年5月,我拿到了OpenAI插件开发的内测邀请。当时网上已经一堆人在聊这个了,但说实话,我看了十篇有九篇都在抄官方文档,列个清单就完事了。真正自己上手测过的,一个手数得过来。
我这人吧,有个毛病:好奇心上来了,谁都拦不住。
二话不说充了Plus,一头扎进去,整整四天。70个插件,每个我至少发了三条不同指令,反复折腾。踩坑踩到怀疑人生——有些插件第一次用还行,第二次直接报错,第三次干脆连不上。但也确实有那么几个,用完之后我坐在电脑前,半天说不出话。
这篇文章,就是那四天的真实记录。
如果你正在纠结要不要开Plus、该装哪些插件,看完这篇心里就有数了。而且我敢打赌,有些结论跟你想象的不一样。
你以为是装个App?错!开发逻辑根本不是你想的那样
说到这儿,我先问你一个问题:你觉得ChatGPT插件跟Chrome扩展、App Store应用是一回事吗?
答案是——完全不是。
很多人以为,开发者写一堆代码,打包上传,用户装上去就能用。典型的应用商店思维,对不对?
但人家根本不是这个玩法。
我接到邀请后干的第一件事,就是跑通一个Demo。你猜怎么着?整个流程是这样的:你先把自己的功能做成一个本地API,比如查天气的接口。然后用大白话写一段描述,告诉GPT什么时候该调这个接口、参数怎么填。剩下的,全是GPT自己判断。
举个例子。我写了个接口叫get_current_weather(location, unit),然后在插件描述里写:“当用户问某个城市的天气时,调用此接口获取实时数据。”之后用户说“波士顿今天多少度”,GPT会自动把这句话转成JSON参数,调用我的API,再把结果翻译成大白话返回。
你品,你细品。
这跟以前写代码、打包、等审核,完全是两个世界。OpenAI在内部文档里说,他们可能已经找到了一种新的零代码开发范式——你甚至不用懂HTTP协议,只要会说人话,就能搭出插件。
我当时看完这个流程,第一反应不是兴奋。
是后背发凉。
因为这意味着,一旦这套东西成熟了,连中间那层手动调用API的步骤都可能被砍掉。OpenAI的目标,根本就不是做个聊天机器人。
70个插件测下来,我整个人麻了
好,进入正题。
截止5月19号,插件商店一共85个插件(后来到近百),其中2个已经下架。我测了70个,每测一个至少发三次不同指令,记录响应质量、速度和实际可用性。
先给你一个整体画像——
八成都在干同一件事
按场景分类:
购物、餐饮、旅行、住房、求职——占了差不多80%。Instacart(买菜)、KAYAK(查机票)、Expedia(订酒店)、OpenTable(订餐厅)、Zillow(看房)……说白了,全是已有的商业平台把功能套了个壳扔进来。
教育、财经、内容社区、编程——占15%左右。比如edX(公开课)、FiscalNote(政策数据)、KeyMate.AI Search(搜索引擎)、Zapier(自动化工作流)。
剩下的5%——商业分析、游戏、心理健康、社交、家庭育儿。这几块基本是空白,几乎没人做。
你看懂了吗?
OpenAI嘴上说开放生态,实际干的事是把自己变成新的流量分发中心。
那些餐厅、旅行、购物插件,用户通过ChatGPT直接下单,平台抽成多少没人知道,但OpenAI肯定也在分账。这是新时代的“应用商店”,而且人家直接从“广告+交易”两端收钱。
七成插件就是导流工具
说到这个我就来气。
我的评价体系里,商业属性和使用体验是分开打的。大约七成插件,让它干正事干不了,只会让你“去我们网站看看”。
比如有个猎头插件,我说“帮我找几个数据科学家的简历”,它直接列出几个职位链接,然后说“请访问原网站查看更多”。你告诉我,这跟百度搜索结果页有什么区别?还不如直接用搜索引擎呢!
更绝的是,某些插件第一轮还能用,第二轮就开始报错。我猜是它们API的免费额度耗尽了,直接返回错误。这就是OpenAI审核不严的后果——开发者上传个“试用版”,用户体验一泡污。
用户真正需要的,就三个能力
所有插件里,被反复用的其实就是这三件事:联网查最新数据(ChatGPT自带知识截止到2021年9月,超出这个时间的东西它一本正经地瞎编)、实时信息获取(股票价格、赛事比分、天气)、以及阅读网页和PDF文件(很多人拿它总结长文、分析财报)。
这三件事做好了,用户就肯掏钱。
做不好,再好玩的插件也只是玩具。
真正值得装的,两只手数得过来
我的评分体系很简单:
- ⭐⭐⭐⭐⭐:能解决实际且频繁的痛点
- ⭐⭐⭐⭐:某些场景下非常好用
- ⭐⭐⭐:有用但可用可不用
- ⭐⭐:几乎没用
- ⭐:直接拉黑
到5月19号,五星插件只有5个,四星8个,其余全是三星以下。
你猜哪几个值得装?
WebPilot(⭐⭐⭐⭐⭐)
这是我用得最多的插件,没有之一。
OpenAI自带的浏览器插件(Browsing)是个笑话——很多网站直接拒绝访问,连国内网站都打不开。但WebPilot能直接访问任何网页,包括百度百科、、微博链接。丢给它一个URL,它能读完整个网页,然后回答关于这个页面的问题。
踩坑提醒:第一版WebPilot经常卡在“正在获取网页……”超过一分钟。后来出了v2版本,速度稳定在20-30秒。建议直接使用最新版。另外,有些网页需要登录才能访问,这个它不行,别难为它了。
Wolfram(⭐⭐⭐⭐⭐)
说实话,要不是Wolfram撑着,ChatGPT在数学和科学计算这块就是智障。
你让它算个sin(x)cos(x)^2的积分,它能胡说八道。但装上Wolfram插件后,它调用的是Wolfram|Alpha的计算引擎,结果精确,还能画图。
我试过让它画y=x+x^2的曲线、解微分方程、查元素周期表、画家谱图。甚至问它“冥王星绕太阳一圈要多久”,它直接调Wolfram的数据给出具体天数。
这玩意儿,应该被列为必装插件。
Prompt Perfect(⭐⭐⭐⭐⭐)
它是所有插件里最“偷懒”的一个——只需要在问题前面加上“perfect”,它就会把提问改得更详细、更具体。
比如我写“写一个关于汽车的故事”,它自动改成“写一个200字的短故事,主题是汽车,主角是一辆老式轿车,通过它的视角描述现代城市的变化”。效果立竿见影,真的。
注意:它只能优化prompt,不能干别的事。免费额度有限,如果长时间卡住,可能是调用次数用完了。
Speak(⭐⭐⭐⭐⭐)
翻译插件。
支持几十种语言,对语境的理解比普通翻译工具好太多。比如我想表达“这汤有点咸”,直接翻译成“This soup is a little salty”没问题,但Speak会解释“在中文里,人们通常用‘有点’这种委婉的表达,而不是直接说‘太咸了’”。
知道为什么这很重要吗?因为语言学习最缺的,就是这个“语境解释”。
Show Me(⭐⭐⭐⭐——我纠结了很久给五星还是四星)
它能画各种图表:流程图、思维导图、UML图、饼图、柱状图。
我说“帮我画罗贯中《三国演义》的人物关系图”,它真的生成了一张有曹操、刘备、孙权等几十个人物和连线的关系图。太酷了!
但问题在于:生成的图是图片格式,不能二次编辑。而且描述不清楚的话,画出来的东西可能不是你要的。所以我给了四星。
AskYourPDF(⭐⭐⭐⭐)
曾经很火的PDF总结工具。
我试过扔一份腾讯122页的财报PDF进去,它能给出摘要,还能回答后半段内容的问题(很多同类工具只能读前面十几页)。
但这插件后来频繁报错,而且使用次数有限。如果你有大量PDF需要分析,建议结合WebPilot(读HTML版本)一起用。
Speechki(⭐⭐⭐⭐⭐——但有点特别)
文本转语音。
中文文本转成女声,英文转成男声,语音非常自然,几乎没有机器感。没有任何文本长度限制。
我拿它把一篇长文章转成音频,效果比设想的还好。唯一的缺点是生成的音频文件链接有时会过期,但你可以直接下载。
其他值得一试,但有前提的插件
- **CreatiCode Scratch** —— 少儿编程工具,能用自然语言生成Scratch积木代码。家里有小孩的可以试试,不过需要一定引导。
- **Chess** —— 国际象棋游戏教练,能对弈也能分析棋谱。问题是响应慢(有时超过1分钟),走一步等半天,体验打折扣。
- **edX** —— 查公开课。可以搜“找顶尖大学的机器学习课程”,它返回结果加链接。本质上是edX的搜索引擎套了个壳。
- **FiscalNote** —— 政策法律数据查询,适合需要跟踪立法信息的专业人士。普通人用不上,但做得确实专业。
五星插件归纳:WebPilot、Wolfram、Speak、Prompt Perfect、Speechki。一共5个。其余大多数插件三星以下,很多两星一星。
OpenAi的野心藏不住,但玩家们还没准备好
说到这儿,我得跟你聊聊背后的逻辑。
你想想,苹果App Store是怎么赚钱的?靠抽成。那谷歌呢?靠广告。
OpenAI玩的,两样都要。
从插件整体布局就能看出来——流量入口是第一个目标,以后用户想订机票、点外卖、找工作,第一个想到的不再是Expedia、美团或猎聘,而是“问一下ChatGPT”。其他平台变成纯后端服务商,OpenAI掌握用户触点。变现模式也清晰:目前插件免费使用,但开发者要获得API权限得申请,未来很可能根据插件交易抽成,跟苹果App Store一个路子。第三层是数据壁垒,用得越多,GPT对你的需求越了解,未来它可以主动推荐插件,像搜索引擎推广告一样。这些数据,只在OpenAI手里。
但现状呢?
大部分插件开发得极其敷衍。
有些开发者上传了一个API Demo,连文档都写不清楚。我试过好几个旅游插件,问“东京有哪些便宜的旅馆”,它返回三个链接,其中两个打不开。这种体验,用户用一次就不会再用。
技术稳定性也堪忧。测试时每个会话最多选3个插件,但经常出现插件冲突、响应超时、GPT直接报错。我甚至遇到过一次:GPT调用了Weather插件,返回结果写的是“北京现在温度是华氏75度”——其实我的API返回的是摄氏温度,但因为插件描述没写清楚单位,GPT直接当华氏输出了。
这事怪谁?不怪OpenAI,是开发者的疏忽毁了用户体验。
蓝海在哪?给开发者的真心话
如果你是个独立开发者或小团队,听我一句劝:别盯着购物餐厅那片红海了。
我整理了数据:除了上面提的那几个方向,下面这几个领域几乎没人做:
商业分析 —— 接入用户自己的数据,自动生成报表、趋势分析。目前只有Wolfram能处理一些表格数据,但灵活性太差。
游戏 —— 不是下棋那种,而是角色扮演、剧情生成、规则查询。已经有小团队在做“AI地下城主”,但很不成熟。
心理健康 —— 冥想指导、心情日记分析、轻度心理支持。有政策风险,但需求真实。
社交 —— 帮你写文案、管理粉丝互动、甚至模拟对手戏。
家庭育儿 —— 食谱定制、儿童故事生成、教育计划安排。
蓝海意味着没有现成API,你得自己造。
但这事本身不复杂:先写一个靠谱的本地API,再写一段精准的自然语言描述,就能上架。如果做得好,OpenAI也许会主动给你流量扶持。
最后说点掏心窝子的话
我测完70个插件之后,删掉了几乎所有非刚需的。
现在日常常开的只有三个:WebPilot、Wolfram、Prompt Perfect。剩下99%的场景,这三个配合GPT-4足够用了。
别被“70个”“85个”这种数字唬住。真正能用、好用的,两只手数得过来。而且大部分插件用不了几次就开始收费或限流,薅不到也别硬薅。
如果你想深入了解,就用我文里提的“必装五件套”先体验一下。至于开发那些事,如果你真有想法,建议先复刻一个简单的Demo跑通,感受一下“零代码开发”到底是怎么回事。当GPT自动调用你的API并返回结果的那一刻,你就会理解为什么OpenAI敢说这可能是新范式。
最后一句话,你记住就行:
数字是拿来唬人的,只有体验才是真的。
题外话:我整理的完整评分文档——85个插件,每个都写了简介、用法、截图和评星。要是你想要,去我公众号“数字生命卡兹克”后台发“CJ”自取。不是引流,纯粹是那个文档太大了,我也没地方存。
读者评论 2