免费API限制
目前Rate Limit以七种指标衡量:
目前Rate Limit以七种指标衡量:
- RPM( requests per minute,一分钟最多发起的请求数)
- RPH( requests per hour,每小时允许的最大请求数)
- RPD (Requests per day,每天允许的最大请求数)
- TPM( tokens per minute,一分钟最多允许的 token 数)
- TPD( tokens per day,每天最多允许的 token 数)
- IPM( images per minute,一分钟最多生成的图片数)
- IPD( images per day,一天最多生成的图片数)
AI/ML
API Key:https://aimlapi.com/app/keys

moonshot
密钥:https://platform.moonshot.ai/console/api-keys
限制:https://platform.moonshot.ai/docs/pricing/limits

为防止滥用,您首次使用时需要充值至少 1 美元,而当您的累计充值达到 5 美元时,您将获得一张 5 美元的代金券。
| User Level | Cumulative Recharge Amount | Concurrency | RPM | TPM | TPD |
|---|---|---|---|---|---|
| Free | $1 | 1 | 3 | 32,000 | 1,500,000 |
| Tier1 | $10 | 50 | 200 | 128,000 | 10,000,000 |
| Tier2 | $20 | 100 | 500 | 128,000 | 20,000,000 |
| Tier3 | $100 | 200 | 5,000 | 384,000 | Unlimited |
| Tier4 | $1,000 | 400 | 5,000 | 768,000 | Unlimited |
| Tier5 | $3,000 | 1,000 | 10,000 | 2,000,000 | Unlimited |
Concurrency:我们能够同时处理的来自您的最大请求数量。 RPM:每分钟请求数 TPM:每分钟token TPD:每日token数
硅基流动(最佳)
API:https://cloud.siliconflow.cn/me/account/ak
限制:https://docs.siliconflow.cn/cn/userguide/rate-limits/rate-limit-and-upgradation
| 模型名称 | Rate Limit指标 | 当前指标 |
|---|---|---|
| 语言模型(Chat) | RPM、 TPM | RPM=1000-10000 TPM=50000-5000000 |
| 向量模型(Embedding) | RPM、 TPM | RPM:2000-10000 TPM:500000-10000000 |
| 重排序模型(Reranker) | RPM、 TPM | RPM:2000 TPM:500000 |
| 图像生成模型(Image) | IPM、IPD | IPM:2- IPD:400- |
| 多模态模型 (Multimodal Models) | - | - |
优惠挺多的,送钱,国内
魔塔社区(modelscope.cn)
API:https://modelscope.cn/my/myaccesstoken
限制:https://modelscope.cn/docs/model-service/API-Inference/intro
使用限制
- 魔搭推理API-Inference,旨在为开发者提供免费的便捷模型调用方式,请勿用于需要高并发以及SLA保障的线上任务,如有商业化使用的需求,建议使用各商业化平台的API。
- 免费推理API由阿里云提供算力支持,要求您的ModelScope账号必须绑定阿里云账号后才能正常使用。
- 每位魔搭注册用户,当前每天允许进行总数为2000次的API-Inference调用,其中每单个模型不超过500次,具体每个模型的限制可能随时动态调整。
- 在上述调用次数限制的基础上,不同模型允许的调用并发,会根据平台的压力进行动态的速率限制调整,原则上以保障开发者单并发正常使用为目标。
重要
出于资源等因素考虑,在每个模型每天不超过500次调用的基础上,平台可能对于部分模型再进行单独的限制,这包括单个模型的单天调用总数限制,以及并发限制。
- 例如,deepseek-ai/DeepSeek-R1-0528,deepseek-ai/DeepSeek-V3.1等规格较大模型,当前限制单模型每天200次调用额度。其他模型的API调用,也可能会有类似的限制并进行动态调整。实际单模型可用次数以及允许的并发,以平台实时调整为准。
- 此外随着新模型的推出,比较早的模型可能逐渐从API-Inference下架,在下架过程中会进一步降低使用额度,直至完全下架。
Gemini
API:https://aistudio.google.com/api-keys
限制:https://ai.google.dev/gemini-api/docs/rate-limits

阿里云百炼
API:https://bailian.console.aliyun.com/?tab=model#/api-key
limit:
当您首次开通阿里云百炼时,平台会自动为您发放各模型的新人专属免费额度。
说明
仅中国大陆版(北京)模型有免费额度,国际版(新加坡)模型无免费额度。
有效期
新人免费额度有效期通常是30~90天,从开通阿里云百炼或模型申请通过之日起计算。超过有效期或免费额度消耗完后,继续使用模型推理服务将产生计费。
自2025年9月8日11点起,首次开通阿里云百炼的用户,获赠的新人免费额度有效期调整为 90 天,在此之前已开通的用户不受影响,详情参考阿里云百炼新人免费额度有效期调整通知。
免费额度用完即停
默认状态下,免费额度消耗完后继续使用会扣费。启用免费额度用完即停功能后,免费额度耗尽将无法继续调用(返回错误 code:AllocationQuota.FreeTierOnly),避免产生额外费用。

腾讯云T1
API:https://console.cloud.tencent.com/lkeap/api
用量限制:

评论
评论加载中……