先薅为敬,AMD 免费大模型 API 使用教程

2026-09-03 16:38:22 0点赞 0收藏 0评论

AMD 想抢英伟达的开发者,已经不是一两天的事了。这次的路子更直接,把 Radeon Cloud 平台打开一个口子,直接送大模型 API,免费用,不消耗 GPU 算力。

9 月初,Public Free Model APIs 板块挂着四个模型

  • DeepSeek-V4-Flash-Vision-Exp(DeepSeek 看图说话旗舰)

  • DeepSeek-V4-Flash-0731(DeepSeek 纯文本 0731 快照)

  • Qwen3.8-Flash-Next(阿里千问 Qwen4 架构先导版)

  • MiniCPM5-1B(OpenBMB 出品,1B 小钢炮)

四个都走 OpenAI 兼容协议,curl、Python SDK,或者任何支持 OpenAI 接口的编程工具,接上就能用。这篇教程把注册、拿 Key、写代码三步讲完,顺手告诉你四个模型各自适合什么场景。

先薅为敬,AMD 免费大模型 API 使用教程

一、平台定位与入口

Radeon Cloud 是 AMD 官方的云端 AI 算力平台,类似 Colab 但跑的是 AMD 显卡。海外站是 AMD Developer Cloud。

这块 Public Free Model APIs 是平台专门为开发者开的免费窗口,模型跑在 AMD 自己的服务器上,不需要你自己开实例,也不消耗 GPU 算力额度。底层是 OpenAI 兼容协议,所以任何支持 OpenAI 接口的工具都能接。

官方文档地址在 Token Factory 页面,调用方式、Base URL、API Key、现成的 curl 示例,都能从那里拿到。

二、注册与拿 Key

整个流程十分钟左右,手机号(支持国内号码)或邮箱都能注册,也能用 GitHub、CSDN、魔搭社区账号快捷登录。

步骤 1 访问 Token Factory

打开 https://developer.amd.com.cn/radeon/modelapis,右上角点 Login。

登录方式按需选

  • 手机号注册登录,支持国内手机号码

  • 邮箱注册登录

  • GitHub、CSDN、魔搭社区账号快捷登录,点一下授权就行

避坑提醒,用 GitHub 登录时,AMD 会请求「读基础公开信息」的权限,只用来确认身份,不是偷你的代码,按提示点同意即可。

步骤 2 完成账号验证

首次登录后要完成账号验证,具体走哪步看你注册时选的方式。邮箱注册会收到验证邮件,打开点链接就激活了。用快捷登录的话,只要第三方账号的邮箱已验证,这一步通常会自动跳过。

步骤 3 进入 Token Factory

激活后页面会跳到模型列表。Public Free Model APIs 区域下面就是四个免费模型卡片,每个卡片点进去会弹出一个详情对话框,对话框里展示

  • Base URL,https://developer.amd.com.cn/radeon/api/v1

  • Model 名,如 DeepSeek-V4-FlashQwen3.8-Flash-NextMiniCPM5-1B

  • 你的 API Key(每位用户独立生成)

  • 现成的 curl 测试代码(OpenAI 格式和 Anthropic 格式两套)

把 API Key 复制下来,存到自己的密码管理器里。这个 Key 就是后续调用的「通行证」,所有免费模型共用同一个 Key。

步骤 4 了解积分规则

点开任意一个模型卡片,会看到输入 0.14 pts 每 1M tokens、输出 0.28 pts 每 1M tokens、缓存读取 0.0028 pts 每 1M tokens。

这是积分制的「积分」,不是人民币。页面写得很清楚,「Free to use. Points show relative usage, not a charge」。

意思是平台用积分统计用量,方便你看自己大概跑了几次请求,实际不收费。不用担心用着用着突然扣钱。

三、四个模型怎么选

四个模型定位完全不同,按场景对号入座就行。

DeepSeek-V4-Flash-Vision-Exp

  • 出品方 DeepSeek

  • 类型 多模态(VLM),能看图能读文字

  • 能力 1M 上下文、支持图片理解

  • 亮点 305B 总参数,MoE 激活 13B,8 月 31 日官方仓库刚开源(MIT License)

  • 标签 LIMITED FREE(限时开放窗口)

  • 适合 图片问答、OCR、视觉理解、截图分析

选它的理由,看图说话能力顶级,而且限时免费,遇到就先用。

DeepSeek-V4-Flash-0731

  • 出品方 DeepSeek

  • 类型 纯文本(LLM)

  • 能力 写代码、写文章、问答、翻译、Agent 任务

  • 亮点 DeepSeek V4 Flash 系列的 0731(7 月 31 日)快照版本

  • 标签 FREE

  • 适合 日常文字工作、AI 编程辅助、长文档处理

选它的理由,免费的「全能型选手」,不知道用哪个模型时就用它。

Qwen3.8-Flash-Next

  • 出品方 阿里通义千问

  • 类型 多模态 MoE(AMD 平台标注 LLM 文本)

  • 能力 原生 262144 token 上下文(26 万),可扩展至 1M

  • 亮点 125B 总参数、每 token 激活 6B,训练成本约 Qwen3.7-Plus 的九分之一,是 Qwen4 架构的先导预览

  • 标签 FREE

  • 适合 智能体编程、长文档处理、代码任务

选它的理由,8 月 26 日刚开源的新架构模型,免费跑在 AMD 显卡上,等于提前体验 Qwen4 的底子。官方测试里编程和 Agent 任务都超过 Qwen3.7-Plus,模型权重走 Qwen Community License(开放权重,允许商用)。

MiniCPM5-1B

  • 出品方 清华 OpenBMB(面壁智能)

  • 类型 纯文本(LLM)

  • 能力 1B 参数、AA 榜单小模型组第一(17.9 分)

  • 亮点 INT4 量化后只有 0.5 GB,手机、浏览器都能本地跑

  • 标签 FREE

  • 适合 本地部署、端侧应用、轻量 Agent、IoT 设备

选它的理由,模型极小但性能逆天,AA 榜单上超过 Qwen3.5-2B 这种翻倍参数的对手。如果你准备把模型塞进自己产品里跑,这个最香。

四、三种调用方式

三种方式覆盖从临时测试到日常使用的全部场景。

方式 1 curl 命令行(最轻)

不用装任何东西,终端里一行命令就能测。把 YOUR_API_KEY 换成你的 Key 直接发请求

curl https://developer.amd.com.cn/radeon/api/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -H "Content-Type: application/json" -d '{ "model": "DeepSeek-V4-Flash", "messages": [ {"role": "user", "content": "用一句话介绍 AMD Radeon Cloud"} ] }'

换成 MiniCPM5-1BQwen3.8-Flash-Next,只改 model 字段就行。想看图的请求格式见方式 2,官方文档里也有现成示例。

方式 2 Python openai SDK

写代码前先装包

pip install openai

基础对话

from openai import OpenAI client = OpenAI( api_key="YOUR_API_KEY", base_url="https://developer.amd.com.cn/radeon/api/v1" ) response = client.chat.completions.create( model="DeepSeek-V4-Flash", messages=[ {"role": "user", "content": "写一首关于秋天的五言绝句"} ] ) print(response.choices[0].message.content)

想看图的,换成 Vision 模型,content 里文字和图片各放一段,图片传公网 URL 或 base64 都行

response = client.chat.completions.create( model="DeepSeek-V4-Flash-Vision-Exp", messages=[ { "role": "user", "content": [ {"type": "text", "text": "识别图中的文字"}, {"type": "image_url", "image_url": {"url": "https://example.com/doc.png"}} ] } ] )

换其他模型同理,只改 model 字段。

方式 3 接入 AI 编程助手(以 opencode 为例)

编程助手这类工具都支持接自定义服务商,这里拿 opencode 当例子,不是说只有它能用。opencode 是跑在终端里的开源编程助手,能直接读项目代码、动手改文件,接上 AMD 这套免费 API,等于白得一个能写代码的助手。

接法有两种,个人用界面点几下最快,团队共用建议写配置文件。

界面配置,不用写文件

打开 opencode 的设置,进「提供商」,点「查看更多提供商」,输入 AMD 搜索,选中列表里的 AMD,把 API Key 粘进去保存。API Key 在 Token Factory 页面点开任意免费模型卡片,弹窗里就有,直接复制(见上文步骤 3)。

配置文件,适合团队共用

在项目根目录新建 opencode.json,内容如下

{ "$schema": "https://opencode.ai/config.json", "provider": { "amd": { "npm": "@ai-sdk/openai-compatible", "name": "AMD Radeon Cloud", "options": { "baseURL": "https://developer.amd.com.cn/radeon/api/v1", "apiKey": "{env:AMD_API_KEY}" }, "models": { "DeepSeek-V4-Flash": { "name": "DeepSeek V4 Flash" }, "Qwen3.8-Flash-Next": { "name": "Qwen3.8 Flash Next" }, "MiniCPM5-1B": { "name": "MiniCPM5 1B" } } } } }

Key 不要直接写进文件,先放进环境变量,避免哪天手滑把配置文件传到公开仓库

export AMD_API_KEY="YOUR_API_KEY"

两种方式配好后,启动 opencode,输入 /models 切到 AMD 的模型,就能开始对话。让它读代码、改 bug、补测试,它会一步步执行给你看。

其他 OpenAI 兼容工具(Cherry Studio、Cursor 这类)接法也一样,Base URL 和 Key 填同一个,模型名填平台给的 ID 就行。

五、注意事项

平台免费,但有几条规则要知道。

限速是真的有限

平台用积分做软限流,并发高了会自动降速。实测单请求响应很快,并发超过 5 个就开始排队。不要拿它当生产级高并发 API 用,定位是开发调试。

LIMITED FREE 随时可能撤

Vision 版明确标 LIMITED FREE,AMD 没说会开放多久。遇到就先用,等撤了再换纯文本版。

Key 不要公开

API Key 等同于密码,不要发到公开仓库或公共论坛。万一泄露,去 Token Factory 页面重新生成一个即可。

数据是否保留

平台走的是云端推理,请求内容会上传到 AMD 服务器。涉及敏感数据(比如未公开的产品信息、个人隐私)建议走本地 MiniCPM5-1B 部署。

缓存读取收费极低

DeepSeek 系列支持 prompt cache,缓存读取只要 0.0028 pts 每 1M tokens,比输出便宜两个数量级。多轮对话时把上下文作为消息历史传过去,会自动命中缓存,省一大笔。


免费 API 用得好,能省下的不只是 API 调用的钱,更是把 AMD 生态从头到尾摸一遍的机会。Radeon Cloud 的 GPU 用完不用清理、Key 丢了随时重生成、用量大了再上付费版,这套流程打通了,以后做 AI 应用就有了一个稳的兜底方案。

作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~

展开 收起
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
0
扫一下,分享更方便,购买更轻松