大模型能力分类表
分类维度:对话LLM / Agent能力 / 图像多模态 / 音频(ASR/TTS/音频理解) / 视频理解沿用上面平台,国内、海外分开,保留免费额度、API地址,新增能力勾选。
🇨🇳 国内平台(需实名)
| 平台 | 免费额度类型 | 对话LLM | Agent | 图像 | 音频 | 视频 | API Key获取链接 | 备注 |
|---|---|---|---|---|---|---|---|---|
| 阿里云百炼(DashScope) | 新人一次性赠送(各模型独立100万token,90天);Qwen-Turbo永久免费(限流) | ✅ | ✅ | ✅ | ✅ TTS/ASR/音频理解 | ✅ | [https://dashscope.aliyun.com/ | Qwen-Omni](https://dashscope.aliyun.com/ |
| 智谱AI GLM | GLM-4-Flash永久免费(RPM限流);新注册一次性2000万token | ✅ | ✅ | ✅ | ❌ | ❌ | [https://open.bigmodel.cn/ | ](https://open.bigmodel.cn/ |
| 腾讯云TokenHub | 新人100万token(1年);Hunyuan-Lite永久免费 | ✅ | ✅ | ✅ | ✅ 混元TTS/ASR | ✅ | [https://cloud.tencent.com/product/tokenhub | ](https://cloud.tencent.com/product/tokenhub |
| 百度千帆 | ERNIE-Speed永久免费(限流);新人试用额度 | ✅ | ✅ | ✅ | ✅ 文心TTS/ASR | ✅ | [https://qianfan.cloud.baidu.com/ | ](https://qianfan.cloud.baidu.com/ |
| 硅基流动SiliconFlow | 9B及以下开源模型永久免费;新人赠额度 | ✅ | ⚠️ 依赖模型 | ✅ | ❌ | ❌ | [https://siliconflow.cn/ | ](https://siliconflow.cn/ |
| MiniMax | 新人一次性赠送额度 | ✅ | ✅ | ✅ | ✅ TTS/语音克隆 | ✅ | [https://www.minimaxi.com/ | ](https://www.minimaxi.com/ |
| DeepSeek | 新人一次性赠送Flash额度 | ✅ | ✅ | ✅ | ❌ | ❌ | [https://platform.deepseek.com/ | ](https://platform.deepseek.com/ |
标记说明:
- ✅:平台有原生对应模型,API可直接调用
- ⚠️:部分开源模型支持,不是平台内置能力
- ❌:平台无官方原生模型
🌍 海外平台(海外手机号/部分需要信用卡)
| 平台 | 免费额度类型 | 对话LLM | Agent | 图像 | 音频 | 视频 | API Key获取链接 | 备注 |
|---|---|---|---|---|---|---|---|---|
| Google AI Studio Gemini | 永久免费层(限流,无需绑卡) | ✅ | ✅ | ✅ | ✅ 音频理解 | ✅ | [https://aistudio.google.com/app/apikey | Gemini](https://aistudio.google.com/app/apikey |
| Groq | 永久免费Tier(限流) | ✅ | ⚠️ 依赖模型 | ✅ | ❌ | ❌ | [https://console.groq.com/ | ](https://console.groq.com/ |
| OpenAI API | 新账号一次性$5赠金,有效期3个月 | ✅ | ✅ | ✅ | ✅ Whisper+TTS | ✅ | [https://platform.openai.com/api-keys | GPT4o](https://platform.openai.com/api-keys |
| Anthropic Claude | 新用户一次性$5赠金 | ✅ | ✅ | ✅ | ❌ | ❌ | [https://console.anthropic.com/ | ](https://console.anthropic.com/ |
| xAI Grok API | 新注册赠送$25额度 | ✅ | ✅ | ✅ | ❌ | ❌ | [https://console.x.ai/ | ](https://console.x.ai/ |
术语简单释义(方便选型)
- 对话LLM:基础文本问答、文本生成,所有平台都具备
- Agent:大模型支持工具调用、Function Call,可做任务拆解、调用外部工具(如查天气、调用TTS/ASR接口)
- 图像:VLM视觉模型,图片理解、图文问答、图生图
- 音频:ASR语音转文字 / TTS文本转语音 / 音频内容理解(听录音总结)
- 视频:视频帧理解、视频内容描述、视频问答
快速选型建议(音频Agent场景)
- 音频Agent全链路(LLM Agent + TTS + ASR)原型:阿里云百炼 / MiniMax
- 海外音视频多模态原型:Google Gemini AI Studio(免费不用绑卡)
- 纯文本Agent调试:智谱GLM-4-Flash / Groq(永久免费)
- 图像+文本Agent,不需要音视频:DeepSeek / Claude
@1x.png)




没有回复内容