
AI入门第三课——接入agent
相信大家从上节课已经尝试过通过调用API Key来使用cherry studio与rikkahub了。
没错,你现在已经有了自己的专属豆包——更聪明,更严谨,记忆力更强
但是这就结束了吗?没有的!这就是为什么出现了豆包专业版(一个月大几百块呢)——能帮你处理表格,帮你做ppt,帮你画图,甚至帮你操纵电脑!
这是为什么?AI就是个脑子,我们接入客户端这张嘴以后怎么就能给我们处理表格了呢?
这里要引入一个新的概念——agent
agent是什么?简单来说,agent是一个人 他有自己的嘴巴 有自己的脑子,但最重要的——他有自己的四肢
健全的人=脑子+嘴+身体 于是他就能干活了
我们之前的cherry studio是 脑子(大模型)+嘴(客户端) 他没有四肢!
于是我们要想办法加入四肢,加入四肢他就自己动手做ppt 动手画图了!
agent=大模型(脑子)+harness(四肢和嘴)
这个harness就是给他安装的的四肢和嘴巴
你可以这么看 codex=gpt大模型+调用这些大模型的工具
claude code=claude大模型+调用这些大模型的工具

这些工具可以让agent动手干活儿,做ppt,而大模型就负责告诉这些工具怎么干活儿就行了(这么理解就好,没影响)
所以你只要拿到了大模型,接入到harness这个大工具里就有了自己的agent(比如之前爆火的Deepseek harness/DSH就是harness,你接入deepseek或者别的大模型以后就变成了agent!)
补充:我在这里必须澄清,虽然大模型接入harness就是agent,但是也是有高下之分的,比如kimi大模型的架构比较适配他们自己公司的harness,所以在这里调用的话就会显得很聪明,因为kimi大模型这个脑子发现他使用工具得心应手!拿到专武了!
但是!但是!但是!
有些模型就是不太适配某些harness,比如把一个人扔到国外他是很难和别人交流的,因为他的语言不通,不是母语就容易出现障碍!
所以不要再把deepseek接入codex了!codex不是最好的harness,deepseek也不是最好的模型。codex火是因为gpt是世界前沿模型加上codex完全针对gpt,所以效果很好。但是codex的harness具有臃肿、不适配其他模型的缺点!(喜欢我的雷霆报错吗?)

如果你用的不是gpt模型,那就不要接入codex!
什么模型适合什么harness,我这里推荐一些
gpt——无脑codex且仅适合codex
claude opus/sonnet——无脑claude code
deepseek——建议Deepseek harness(也就是DSH) 也可以zcode
glm——无脑zcode
kimi——建议kimi code 也可以zcode
grok——建议grok build或cursor 也可以zcode
gemini——爱用啥用啥
看了这么多专武,我体验下来的就是大模型大多有自己的harness,个人建议使用它们特定的harness,不过下载太多harness对你的C盘不太友好,所以国模我建议zcode,最适配glm,又适配kimi,甚至适配grok
(不是广告,我喜欢zcode,确实好用)
讲了这么多其实都没太大实际作用,我们实际上将大模型接入一个harness,让它变成agent就行了!
于是这期我们介绍zcode——我体验到的一个接入国模甚至部分国外模型都很不错的harness

Zcode——ZCode | GLM-5.3 官方 Harness
Zcode好在哪里?
工作比较透明——做了什么,网页在操作什么一眼能看出来;
调用工具舒服,想开网页就开网页,不会被各种奇奇怪怪的协议束缚;
速度快——我也不知道为什么,但是速度快,又快又好;
对的,相比起你们,gpt和codex,你们无情的抛弃了我😭(openai又发疯降智了),是zcode稳稳接住了我😭
教程
①下载zcode并接入api key(依旧设置-模型设置-添加新模型供应商)

api key填入 url填入 名字随便 API格式可能是chat 可能是response(但大概率不会是anthropic,因为只有claude模型才用这个接口),主要还是跟你用的什么模型和上游怎么设置的有关,两个各试一遍就好。
②填入模型

注意!这里一定不要填错!名字和你的上游的模型名称一定要完全一样!
比如你用的deepseek-v4-flash 那就写deepseek-v4-flash 如果上游是中转站,模型又叫deepseek-v4-flash-0731,你就要写deepseek-v4-flash-0731,至于上游叫什么名称,在你的中转站的模型广场应该都写了
这里能力也要注意:上下文是模型的记忆能力,你多写不会多记忆,少些就会少记忆,但是写太大也不好,容易让模型造成误判(应该吧)
输入类型是他能看什么(文本就是他看得懂字,图片就是他看得懂图片,pdf就是看得懂图片)
这里尤其注意!目前deepseek glm qwen是瞎子!没有输入图片的能力!试验版本的vision模型才有!
输出类型就是他能告诉你说们,文本就是他用文字回复你
这里防止小白不知道填什么,我给大家一些参考(注意 1M就是一百万上下文1000000 128k就是128000 )

如图,如今大部分模型上下文都是1M 你也直接写1000000就行,差个几万差不了多少 这里尤其注意grok是500k 不要多写了
然后到主页调用,恭喜你,你已经入门agent了!

接下来,你可以让他工作了,让他做个ppt,让他写个程序之类的,直接说就好!
接下来是小广告:
写这期blog的时候我其实也在用中转站的kimi-k3对我的blog进行修复,很多gpt-5.5时代的bug一下子就修好了,kimi-k3强,zcode也强。但是原价的kimi-k3实在太贵了,完全用不起!😭所以我使用了中转站(使用特殊方法从特殊渠道获取的模型)
在这里我必须提醒:中转站的水很深,不建议任何人无脑使用中转站!也不要充太多钱!
使用中转站会面临信息泄露和掺水(卖给你低级模型,但却标注高级模型),甚至往里面注入病毒的情况!
但这个时候我用的kimi-k3确实不错,至少比别的站的k3用着更聪明
站长是我的一个朋友(比较好的网友,送了我很多token)。所以在这里分享一下他的站点(不过没必要为了我的面子注册这个!你注册这个我没有什么收益!单纯是帮朋友推荐!不要充太多!)
再次提醒:不要往中转站充太多钱!不要无脑使用来源不明的中转站!

这个站挺不错的,0.08倍率的国模真的很少见,这是我一句话让kimi-k3生成ppt的效果,10页花了200w token,大概4~5毛钱,图片他自己找的,效果自己做的,我只告诉他一句话:做个我的世界介绍ppt,有时间线贯穿

k3是真强哇(
总之需要的话可以试试,模型能力真的不错,价格也很低,看这效果模型挺纯,是我用过很不错很不错的站点了(只针对国模,gpt最近抽风,我还没试过)
再次声明!不要使用来源不明的中转站!不要充太多钱!用几块充几块!也不要为了我注册这个站!我推荐只是因为体验还不错和站长送了我一些token!现在很好用但我没办法保证下周还这么好用!如果这个站变坏了我会立马删掉!
MESSAGE BOARD
评论区
不用登录,填昵称就能评论;图片会作为附件保存,邮箱和网站不会公开展示。