<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>AMD on 大卷学长的博客</title><link>https://blog.liurb.org/tags/amd/</link><description>Recent content in AMD on 大卷学长的博客</description><generator>Hugo -- gohugo.io</generator><language>zh-cn</language><lastBuildDate>Thu, 03 Sep 2026 22:54:32 +0000</lastBuildDate><atom:link href="https://blog.liurb.org/tags/amd/index.xml" rel="self" type="application/rss+xml"/><item><title>[202609] 还能白嫖的免费 LLM API，包括热门 GLM-5.3-FLASH</title><link>https://blog.liurb.org/posts/2026/09/03/free_llm_api/</link><pubDate>Thu, 03 Sep 2026 22:54:32 +0000</pubDate><guid>https://blog.liurb.org/posts/2026/09/03/free_llm_api/</guid><description>&lt;img src="https://blog.liurb.org/images/posts/2026/free_llm_api_logo.png" alt="Featured image of post [202609] 还能白嫖的免费 LLM API，包括热门 GLM-5.3-FLASH" />&lt;h1 id="202609-还能白嫖的免费-llm-api包括热门-glm-53-flash">[202609] 还能白嫖的免费 LLM API，包括热门 GLM-5.3-FLASH
&lt;/h1>&lt;p>又到一年下半年，秉着能白嫖就必须白嫖到底的原则，我一直在盯各大厂的免费模型额度。今年下半年明显感觉几家开始发福利了——&lt;strong>Opencode、Cline、AMD、Zcode&lt;/strong> 四家先后放出了免费 API 或客户端内置免费额度，路子也各不相同：有走客户端内置免费的，有直接送 OpenAI 兼容 Key 的，还有借周末活动白送大量 Token 的。&lt;/p>
&lt;h2 id="opencode开源编程-agent免费模型最新但要留意地区限制">Opencode：开源编程 Agent，免费模型最新但要留意地区限制
&lt;/h2>&lt;p>先说说 &lt;strong>Opencode&lt;/strong> 平台：它是一款开源的 AI 编程 Agent，由 &lt;code>SST&lt;/code> 团队打造，&lt;strong>100% 开源、不绑定特定模型&lt;/strong>。主打终端界面（&lt;code>TUI&lt;/code>），也提供桌面端应用和 &lt;code>IDE&lt;/code> 扩展；通过 &lt;code>models.dev&lt;/code> 可以对接 75+ 模型提供商（包括本地模型），想用哪个模型自己配 Key 就行。这也是我接触最早的终端工具，之前我也不太习惯用终端编程，但是后面薅着薅着就用习惯了哈，而且这种&amp;quot;自带模型（BYOM）&amp;ldquo;的用法很对味。&lt;/p>
&lt;p>免费模型方面，Opencode 的亮点是&amp;quot;新&amp;rdquo;，总能第一时间让你白嫖到刚发布的东西。前段时间的 &lt;code>Ox Alpha&lt;/code>，也就是 &lt;code>GLM-5.3-Flash&lt;/code> 的预览版，我免费爽用了一周；最近又上线了 &lt;strong>Meta&lt;/strong> 的 &lt;code>muse spark 1.3&lt;/code>，也是直接切换就能用。&lt;/p>
&lt;p>&lt;img src="https://blog-worker.liurb.org/api/2026/09/2609_free_api_01_1.png"
loading="lazy"
>&lt;/p>
&lt;p>不过这里有两个坑得先说清楚：&lt;/p>
&lt;ul>
&lt;li>&lt;code>muse spark 1.3&lt;/code> 是 Meta 的模型，&lt;strong>国内基本连不上，需要魔法&lt;/strong>。&lt;/li>
&lt;li>额度没那么大方——我在开启 &lt;code>high&lt;/code> 模式下跑，大概 &lt;strong>100k tokens&lt;/strong> 就提示免费额度用完了。&lt;/li>
&lt;/ul>
&lt;p>好在 Opencode 不是只有这一款，其余免费模型切换着来用，应付一般日常任务问题不大。适合那种&amp;quot;今天又出了个新模型，我想白嫖体验一下&amp;quot;的场景。&lt;/p>
&lt;h2 id="cline开源编程-agent从插件长成全家桶免费额度真的大">Cline：开源编程 Agent，从插件长成全家桶，免费额度真的大
&lt;/h2>&lt;p>&lt;strong>Cline&lt;/strong> 是另一个开源的 AI 编程 Agent（&lt;code>Apache-2.0&lt;/code> 协议）。最早认识它的时候它还只是个 &lt;code>VS Code&lt;/code> 插件，现在已经长成全家桶：&lt;code>VS Code&lt;/code> 扩展、&lt;code>CLI&lt;/code>、&lt;code>JetBrains&lt;/code> 插件，甚至还有 &lt;code>SDK&lt;/code> 和 &lt;code>Kanban&lt;/code> 任务板。它的核心设计是&amp;quot;人在回路&amp;quot;——每一步改文件、跑命令都会先给你确认，而且模型不绑定，主流的 &lt;code>API&lt;/code> 提供商（&lt;code>OpenAI&lt;/code>、&lt;code>Anthropic&lt;/code>、&lt;code>Gemini&lt;/code>、&lt;code>OpenRouter&lt;/code> 等）都能接。&lt;/p>
&lt;p>它的免费策略我比较喜欢：官方提供&lt;strong>轮换的免费模型促销&lt;/strong>，只要是 Cline 账号就能用，在模型选择器里找带 &lt;code>FREE&lt;/code> 标签的就行。&lt;/p>
&lt;p>主流的免费模型基本都有，比如 &lt;code>GLM-5.3-Flash&lt;/code> 和 &lt;code>DeepSeek V4 Flash&lt;/code>，免费额度我感觉还挺大的，日常写代码、跑 Agent 够撑一阵。&lt;/p>
&lt;p>&lt;img src="https://blog-worker.liurb.org/api/2026/09/2609_free_api_02.png"
loading="lazy"
>&lt;/p>
&lt;blockquote>
&lt;p>有个关键点要注意：Cline 的免费模型&lt;strong>只绑定在它的 IDE 插件和 CLI 里用，不通过公开的 Cline API 开放&lt;/strong>。也就是说它给的是&amp;quot;客户端内免费额度&amp;quot;，不是能随便拿去别的工具里配置的 Key。如果你想要&amp;quot;一把 Key 到处用&amp;quot;，得看下一家 AMD。&lt;/p>&lt;/blockquote>
&lt;p>额度用完之后，官方会引导你切 &lt;code>ClinePass&lt;/code>（&lt;code>$9.99/月&lt;/code>）或者按量计费的 &lt;code>usage-billing&lt;/code>，不过对偶尔用用的人，免费额度基本够撑很久了。&lt;/p>
&lt;h2 id="amd每天白送-10国内直连还不用翻墙">AMD：每天白送 $10，国内直连还不用翻墙
&lt;/h2>&lt;p>先介绍下背景：&lt;strong>AMD Token Factory&lt;/strong> 是 AMD &lt;code>Radeon Cloud&lt;/code> 云平台里的一块免费模型 API 服务，主打&amp;quot;送真 Key&amp;quot;。如果说前两家是&amp;quot;客户端内免费&amp;quot;，那它就是&lt;strong>直接给你 OpenAI 兼容的免费 API Key&lt;/strong>，每天白送 &lt;strong>$10 额度&lt;/strong>，一把 Key 通吃多款主流免费模型。&lt;/p>
&lt;p>免费模型里面就包含了现在最主流的 &lt;code>DeepSeek-V4-Flash-0731&lt;/code>，还有 &lt;code>DeepSeek-V4-Flash-Vision-Exp&lt;/code>（视觉模型）、&lt;code>Qwen3.8-Flash-Next&lt;/code>、&lt;code>MiniCPM5-1B&lt;/code> 这些。而且 AMD 同时提供了 &lt;strong>国内 API 域名&lt;/strong>，国内直连速度不慢，&lt;strong>不用翻墙&lt;/strong>，注册也国内友好——支持&lt;strong>魔搭（ModelScope）&lt;/strong>、&lt;strong>CSDN&lt;/strong> 这些国内平台直接授权登录，门槛是真的低。&lt;/p>
&lt;p>&lt;img src="https://blog-worker.liurb.org/api/2026/09/2609_free_api_03.png"
loading="lazy"
>&lt;/p>
&lt;blockquote>
&lt;p>官方地址
&lt;a class="link" href="https://developer.amd.com.cn/radeon/tokenfactory" target="_blank" rel="noopener"
>https://developer.amd.com.cn/radeon/tokenfactory&lt;/a>&lt;/p>&lt;/blockquote>
&lt;p>注册流程很简单：邮箱注册进 &lt;code>Radeon Cloud&lt;/code>，在「Public Free Model APIs」里找到模型，点一下生成 API Key，然后粘进任意 OpenAI 兼容的工具就能用：&lt;/p>
&lt;div class="highlight">&lt;div class="chroma">
&lt;table class="lntable">&lt;tr>&lt;td class="lntd">
&lt;pre tabindex="0" class="chroma">&lt;code>&lt;span class="lnt">1
&lt;/span>&lt;span class="lnt">2
&lt;/span>&lt;span class="lnt">3
&lt;/span>&lt;span class="lnt">4
&lt;/span>&lt;/code>&lt;/pre>&lt;/td>
&lt;td class="lntd">
&lt;pre tabindex="0" class="chroma">&lt;code class="language-bash" data-lang="bash">&lt;span class="line">&lt;span class="cl">curl https://developer.amd.com.cn/radeon/api/v1/chat/completions &lt;span class="se">\
&lt;/span>&lt;/span>&lt;/span>&lt;span class="line">&lt;span class="cl">&lt;span class="se">&lt;/span> -H &lt;span class="s2">&amp;#34;Authorization: Bearer ***&amp;#34;&lt;/span> &lt;span class="se">\
&lt;/span>&lt;/span>&lt;/span>&lt;span class="line">&lt;span class="cl">&lt;span class="se">&lt;/span> -H &lt;span class="s2">&amp;#34;Content-Type: application/json&amp;#34;&lt;/span> &lt;span class="se">\
&lt;/span>&lt;/span>&lt;/span>&lt;span class="line">&lt;span class="cl">&lt;span class="se">&lt;/span> -d &lt;span class="s1">&amp;#39;{&amp;#34;model&amp;#34;:&amp;#34;DeepSeek-V4-Flash&amp;#34;,&amp;#34;messages&amp;#34;:[{&amp;#34;role&amp;#34;:&amp;#34;user&amp;#34;,&amp;#34;content&amp;#34;:&amp;#34;你好&amp;#34;}]}&amp;#39;&lt;/span>
&lt;/span>&lt;/span>&lt;/code>&lt;/pre>&lt;/td>&lt;/tr>&lt;/table>
&lt;/div>
&lt;/div>&lt;p>两个关键参数：&lt;code>base_url&lt;/code> 填 AMD 接口地址，&lt;code>model&lt;/code> 填 &lt;code>DeepSeek-V4-Flash&lt;/code>。我这边实测下来，&lt;code>DeepSeek-V4-Flash-Vision-Exp&lt;/code> 这个多模态版本也在列，目前是最新的视觉模型，想测多模态的可以顺手试试。&lt;/p>
&lt;blockquote>
&lt;p>不过 AMD 免费额度也有明显短板：&lt;strong>速度偏慢&lt;/strong>，我这边体感首字延迟明显比官方慢，高峰时段更明显；每天 &lt;code>$10&lt;/code> 用完当天限流，第二天自动恢复。跑 Prompt、写小脚本、给 Agent 当测试后端很香，但高频调用、生产环境就指望不上了。&lt;/p>&lt;/blockquote>
&lt;h2 id="zcode智谱官方-glm-53-编程客户端周末白送-3-亿-token">Zcode：智谱官方 GLM-5.3 编程客户端，周末白送 3 亿 Token
&lt;/h2>&lt;p>最后这家 &lt;strong>Zcode&lt;/strong> 也先介绍下：它是智谱 &lt;code>Z.ai&lt;/code> 官方为 &lt;code>GLM-5.3&lt;/code> 打造的智能体开发环境（&lt;code>ADE&lt;/code>），而不是传统 &lt;code>IDE&lt;/code>——它不以手动敲代码为核心，而是让自研 &lt;code>ZCode Agent&lt;/code> 唱主角，你用自然语言描述需求，它来驱动从理解需求、拆解计划、改代码到验证 &lt;code>Review&lt;/code> 的完整流程，主打长任务执行和多端跟进（桌面端、手机 &lt;code>Remote&lt;/code>、飞书/微信 &lt;code>Bot&lt;/code>）。一句话，它就是围绕 &lt;code>GLM-5.3&lt;/code> 深度调优的官方编程客户端。&lt;/p>
&lt;h3 id="周末狂欢">周末狂欢
&lt;/h3>&lt;p>最近 &lt;strong>Zcode&lt;/strong> 也推出了免费模型服务，而且走的是&amp;quot;周末例行活动&amp;quot;的路子：每周末（&lt;strong>周五 20:00 至周一 09:00&lt;/strong>）登录客户端就能免费领取 &lt;strong>&lt;code>3 亿 Tokens&lt;/code>&lt;/strong>。&lt;/p>
&lt;p>&lt;img src="https://blog-worker.liurb.org/api/2026/09/2609_free_api_06.png"
loading="lazy"
>&lt;/p>
&lt;p>不过要注意这几点：&lt;/p>
&lt;ul>
&lt;li>额度&lt;strong>仅限 &lt;code>ZCode&lt;/code> 编程客户端内使用&lt;/strong>，不是开放平台的 API Token，跟 AMD 那种&amp;quot;一把 Key 到处用&amp;quot;不是一回事。&lt;/li>
&lt;li>不管新用户老用户、有没有订阅，只要通过本地客户端入口登录，就能看到领取弹窗入口，免费领取。&lt;/li>
&lt;li>适合周末集中跑编码任务。本轮（&lt;code>8/29-8/31&lt;/code>）领取已结束，等周五 20:00 刷新新一轮，这周刚好又能白嫖。&lt;/li>
&lt;/ul>
&lt;p>&lt;img src="https://blog-worker.liurb.org/api/2026/09/2609_free_api_08.png"
loading="lazy"
>&lt;/p>
&lt;p>如果你是昨天领取的话，就要等今天周六早上9点后才能够刷新看到 &lt;code>GLM-5.3-FLASH&lt;/code> 模型，注意有效期是到 &lt;strong>9月6日晚上23点&lt;/strong>，所以先赶紧搞起来！&lt;/p>
&lt;p>&lt;img src="https://blog-worker.liurb.org/api/2026/09/2609_free_api_09.png"
loading="lazy"
>&lt;/p>
&lt;h3 id="免费额度">免费额度
&lt;/h3>&lt;p>除了周末活动，新用户首次使用还有 &lt;strong>5 天免费体验&lt;/strong>，额度是每天发放、5 天后失效（不是长期福利）：&lt;/p>
&lt;ul>
&lt;li>&lt;code>GLM-5.3&lt;/code>：&lt;strong>300 万 Token / 天&lt;/strong>&lt;/li>
&lt;li>&lt;code>GLM-5-turbo&lt;/code>：&lt;strong>200 万 Token / 天&lt;/strong>&lt;/li>
&lt;li>每日合计：&lt;strong>500 万 Token&lt;/strong>（仅限这 5 天）&lt;/li>
&lt;/ul>
&lt;p>登录后绑定 &lt;code>BigModel&lt;/code>（国内）或 &lt;code>Z.ai&lt;/code>（海外）账号即可用内置的 &lt;code>GLM-5.3&lt;/code>、&lt;code>GLM-5.3-Flash&lt;/code> 等模型。因为它本质是客户端额度、不是公开 API，所以主要还是&amp;quot;本地写代码&amp;quot;场景顺手，想把它当通用 API 后端接别的工具就不行了。&lt;/p>
&lt;p>&lt;img src="https://blog-worker.liurb.org/api/2026/09/2609_free_api_10.png"
loading="lazy"
>&lt;/p>
&lt;h2 id="总结">总结
&lt;/h2>&lt;p>四家的定位其实不太一样，按需求挑就好：&lt;/p>
&lt;ul>
&lt;li>&lt;strong>AMD Token Factory&lt;/strong>：最推荐先去领一把，国内直连、Key 通用、多款主流免费模型，白嫖跑点轻量任务是性价比之王，就是速度慢了点。&lt;/li>
&lt;li>&lt;strong>Cline&lt;/strong>：AI 编程主力，客户端内免费额度大，绑定用很省心。&lt;/li>
&lt;li>&lt;strong>Zcode&lt;/strong>：智谱 &lt;code>GLM-5.3-FLASH&lt;/code> 官方客户端，周末白送 &lt;code>3 亿 Token&lt;/code>，适合用智谱模型当编程主力的朋友，缺点跟 Cline 一样额度只绑客户端。&lt;/li>
&lt;li>&lt;strong>Opencode&lt;/strong>：尝鲜最新模型首选，但地区限制和额度都是变量，得看运气。&lt;/li>
&lt;/ul></description></item></channel></rss>