Featured image of post [202609] 还能白嫖的免费 LLM API,包括热门 GLM-5.3-FLASH

[202609] 还能白嫖的免费 LLM API,包括热门 GLM-5.3-FLASH

白嫖党的日常:Opencode、Cline、AMD Token Factory、ZCode 四家免费 LLM API / 客户端额度实测盘点,从平台介绍、额度、速度、国内可访问性到怎么接进客户端,一文说清 2026 年还有哪些免费模型可以薅。

[202609] 还能白嫖的免费 LLM API,包括热门 GLM-5.3-FLASH

又到一年下半年,秉着能白嫖就必须白嫖到底的原则,我一直在盯各大厂的免费模型额度。今年下半年明显感觉几家开始发福利了——Opencode、Cline、AMD、Zcode 四家先后放出了免费 API 或客户端内置免费额度,路子也各不相同:有走客户端内置免费的,有直接送 OpenAI 兼容 Key 的,还有借周末活动白送大量 Token 的。

Opencode:开源编程 Agent,免费模型最新但要留意地区限制

先说说 Opencode 平台:它是一款开源的 AI 编程 Agent,由 SST 团队打造,100% 开源、不绑定特定模型。主打终端界面(TUI),也提供桌面端应用和 IDE 扩展;通过 models.dev 可以对接 75+ 模型提供商(包括本地模型),想用哪个模型自己配 Key 就行。这也是我接触最早的终端工具,之前我也不太习惯用终端编程,但是后面薅着薅着就用习惯了哈,而且这种"自带模型(BYOM)“的用法很对味。

免费模型方面,Opencode 的亮点是"新”,总能第一时间让你白嫖到刚发布的东西。前段时间的 Ox Alpha,也就是 GLM-5.3-Flash 的预览版,我免费爽用了一周;最近又上线了 Metamuse spark 1.3,也是直接切换就能用。

不过这里有两个坑得先说清楚:

  • muse spark 1.3 是 Meta 的模型,国内基本连不上,需要魔法
  • 额度没那么大方——我在开启 high 模式下跑,大概 100k tokens 就提示免费额度用完了。

好在 Opencode 不是只有这一款,其余免费模型切换着来用,应付一般日常任务问题不大。适合那种"今天又出了个新模型,我想白嫖体验一下"的场景。

Cline:开源编程 Agent,从插件长成全家桶,免费额度真的大

Cline 是另一个开源的 AI 编程 Agent(Apache-2.0 协议)。最早认识它的时候它还只是个 VS Code 插件,现在已经长成全家桶:VS Code 扩展、CLIJetBrains 插件,甚至还有 SDKKanban 任务板。它的核心设计是"人在回路"——每一步改文件、跑命令都会先给你确认,而且模型不绑定,主流的 API 提供商(OpenAIAnthropicGeminiOpenRouter 等)都能接。

它的免费策略我比较喜欢:官方提供轮换的免费模型促销,只要是 Cline 账号就能用,在模型选择器里找带 FREE 标签的就行。

主流的免费模型基本都有,比如 GLM-5.3-FlashDeepSeek V4 Flash,免费额度我感觉还挺大的,日常写代码、跑 Agent 够撑一阵。

有个关键点要注意:Cline 的免费模型只绑定在它的 IDE 插件和 CLI 里用,不通过公开的 Cline API 开放。也就是说它给的是"客户端内免费额度",不是能随便拿去别的工具里配置的 Key。如果你想要"一把 Key 到处用",得看下一家 AMD。

额度用完之后,官方会引导你切 ClinePass$9.99/月)或者按量计费的 usage-billing,不过对偶尔用用的人,免费额度基本够撑很久了。

AMD:每天白送 $10,国内直连还不用翻墙

先介绍下背景:AMD Token Factory 是 AMD Radeon Cloud 云平台里的一块免费模型 API 服务,主打"送真 Key"。如果说前两家是"客户端内免费",那它就是直接给你 OpenAI 兼容的免费 API Key,每天白送 $10 额度,一把 Key 通吃多款主流免费模型。

免费模型里面就包含了现在最主流的 DeepSeek-V4-Flash-0731,还有 DeepSeek-V4-Flash-Vision-Exp(视觉模型)、Qwen3.8-Flash-NextMiniCPM5-1B 这些。而且 AMD 同时提供了 国内 API 域名,国内直连速度不慢,不用翻墙,注册也国内友好——支持魔搭(ModelScope)CSDN 这些国内平台直接授权登录,门槛是真的低。

官方地址 https://developer.amd.com.cn/radeon/tokenfactory

注册流程很简单:邮箱注册进 Radeon Cloud,在「Public Free Model APIs」里找到模型,点一下生成 API Key,然后粘进任意 OpenAI 兼容的工具就能用:

1
2
3
4
curl https://developer.amd.com.cn/radeon/api/v1/chat/completions \
  -H "Authorization: Bearer ***" \
  -H "Content-Type: application/json" \
  -d '{"model":"DeepSeek-V4-Flash","messages":[{"role":"user","content":"你好"}]}'

两个关键参数:base_url 填 AMD 接口地址,modelDeepSeek-V4-Flash。我这边实测下来,DeepSeek-V4-Flash-Vision-Exp 这个多模态版本也在列,目前是最新的视觉模型,想测多模态的可以顺手试试。

不过 AMD 免费额度也有明显短板:速度偏慢,我这边体感首字延迟明显比官方慢,高峰时段更明显;每天 $10 用完当天限流,第二天自动恢复。跑 Prompt、写小脚本、给 Agent 当测试后端很香,但高频调用、生产环境就指望不上了。

Zcode:智谱官方 GLM-5.3 编程客户端,周末白送 3 亿 Token

最后这家 Zcode 也先介绍下:它是智谱 Z.ai 官方为 GLM-5.3 打造的智能体开发环境(ADE),而不是传统 IDE——它不以手动敲代码为核心,而是让自研 ZCode Agent 唱主角,你用自然语言描述需求,它来驱动从理解需求、拆解计划、改代码到验证 Review 的完整流程,主打长任务执行和多端跟进(桌面端、手机 Remote、飞书/微信 Bot)。一句话,它就是围绕 GLM-5.3 深度调优的官方编程客户端。

周末狂欢

最近 Zcode 也推出了免费模型服务,而且走的是"周末例行活动"的路子:每周末(周五 20:00 至周一 09:00)登录客户端就能免费领取 3 亿 Tokens

不过要注意这几点:

  • 额度仅限 ZCode 编程客户端内使用,不是开放平台的 API Token,跟 AMD 那种"一把 Key 到处用"不是一回事。
  • 不管新用户老用户、有没有订阅,只要通过本地客户端入口登录,就能看到领取弹窗入口,免费领取。
  • 适合周末集中跑编码任务。本轮(8/29-8/31)领取已结束,等周五 20:00 刷新新一轮,这周刚好又能白嫖。

如果你是昨天领取的话,就要等今天周六早上9点后才能够刷新看到 GLM-5.3-FLASH 模型,注意有效期是到 9月6日晚上23点,所以先赶紧搞起来!

免费额度

除了周末活动,新用户首次使用还有 5 天免费体验,额度是每天发放、5 天后失效(不是长期福利):

  • GLM-5.3300 万 Token / 天
  • GLM-5-turbo200 万 Token / 天
  • 每日合计:500 万 Token(仅限这 5 天)

登录后绑定 BigModel(国内)或 Z.ai(海外)账号即可用内置的 GLM-5.3GLM-5.3-Flash 等模型。因为它本质是客户端额度、不是公开 API,所以主要还是"本地写代码"场景顺手,想把它当通用 API 后端接别的工具就不行了。

总结

四家的定位其实不太一样,按需求挑就好:

  • AMD Token Factory:最推荐先去领一把,国内直连、Key 通用、多款主流免费模型,白嫖跑点轻量任务是性价比之王,就是速度慢了点。
  • Cline:AI 编程主力,客户端内免费额度大,绑定用很省心。
  • Zcode:智谱 GLM-5.3-FLASH 官方客户端,周末白送 3 亿 Token,适合用智谱模型当编程主力的朋友,缺点跟 Cline 一样额度只绑客户端。
  • Opencode:尝鲜最新模型首选,但地区限制和额度都是变量,得看运气。
本博客所有内容无特殊标注均为大卷学长原创内容,复制请保留原文出处。
Built with Hugo
Theme Stack designed by Jimmy