之前总觉得免费 API 太笨,白送我也不要!
但随着最近开发的小工具越来越多!!才发现,很多场景有个 AI 兜底其实很香!!!
不求多聪明、能胜任生产级工作,但求能省一点人力!!!
比如字幕或网页翻译 AI 肯定比机器翻译更好、会议记录转文字之后也可以拿 AI 查一下错词错字,课程视频转文字之后可以搞个 AI 总结……
总而言之,今天就是来分享那些真正可永久免费使用的 AI API
- ❌ 不是那种试用一个月
- ❌ 也不是新用户赠送 Token
- ❌ 也并非各种限时活动、限时免费
这篇文章就是为了未来阿虚时不时分享「会用到 AI 的小工具」时,大家有个免费 API 能用,以备不时之需
Agnes(官网:https://agnes-ai.com/)
首先是其离谱的表示旗下三款全模态模型的 API 无限期免费开放!
- 文本模型是 Agnes-2.0-Flash,已支持 1M 超长上下文,跑分和 GPT 5.4 不相上下
- 图片模型是 Agnes-Image-2.1-Flash,已支持 4K 图片生成,跑分和 Nnao Banana 不相上下
- 视频模型是 Agnes-Video-2.0,可以做 720P / 1080P 视频,跑分和 Seedacne 1.5 Pro 不相上下
还有一个 Agnes TTS 能力也正在灰度,即将上线……
虽然现在用的人多了,请求速度慢了很多。但总归来说,目前完全免费!!!
注册后无需身份验证,也无需填写任何支付手段,实测模型质量也是真 · 前沿模型水平,已经算得上大善人行为了
免费用户限制每分钟最大请求次数 20 次1,稍微复杂一点的任务就会触发限流,这是最大的缺点
硅基流动
官网:https://cloud.siliconflow.cn/i/cY0ZT5UG
㊟ 通过上述邀请链接,新注册可多得 16 元代金券
我在网上查到的信息是硅基流动 9B 以下的模型都是永久免费
但阿虚实际验证的时候发现,实际只有极少数模型有「限免」标识
原本我都以为又是营销号毫无根据乱复制粘贴
但好在我不死心,这篇文章都快写完的时候又登上网站翻了一遍 !!!
结果你猜怎么着?
原来这个永久免费「藏在计费规则」里面!
点击具体模型,比如 DeepSeek-R1-0528-Qwen3-8B 你会发现输入、输出价格都是 0
原来永久免费是免费在这一层
不过仍需要特别注意的是,9B 以下存在完全免费的模型 ≠ 9B 以下模型都完全免费
就比如 GLM-4-9B 完全免费,但 Qwen3.5-9B 仍旧是收费的
硅基流动的模型一直是动态更新的,情况说明到这里,具体使用的时候大家请自行看清楚价格
除了免费,硅基流动最大的优势就是速率限制很小,免费用户也能享受每分钟最大请求数 1000 次2
对于网页翻译、PDF 翻译这种多并发场景,可真的是太香了
你可能不知道不知测了多少了免费 API,几乎只有硅基流动能胜任这类任务场景!!!
讯飞星辰 MaaS(官网:https://maas.xfyun.cn/modelSquare)
也因为差点踩了硅基流动这个坑,我又轮番去把各种大模型集市都翻了一遍
结果一翻就发现,还真不枉费我之前专门推荐讯飞星辰 MaaS
且不说这上面经常都会有新的限时免费模型(通常免费一个月)
其实上面还有 Qwen3-2B(强在关键信息提取)、Qwen3-1.7B 这种轻量级小模型可以永久免费用(输入、输出价格都是 0)
关键是并发限制能给到 100 路,每秒请求数也给到了 100 次,算是相当宽松了
同时非常值得一提的是,对话模型以外的一些模型(翻译、OCR 等)
比如 Deepseek-OCR 是限时免费,但 PaddleOCR-VL-1.6、HunyuanOCR 这些 API 都是完全免费的
我后面翻过其他平台,这种 OCR API 常见都是 0.02 元/次甚至更贵
这意味着如果你有一些项目需要 OCR 功能,完全就可以到这上面来免费白嫖
对了还有 Qwen-lmage-2512、Z-lmage-Turbo 这些生图模型,在讯飞星辰上面也都是完全免费的,可以白嫖
模力方舟(官网:https://moark.com/serverless-api)
然后我就开始去挨着翻更多大模型市场了……
但很可惜:华为云没有、腾讯云没有、阿里云百练没有、百度千帆免费模型已退役、超算互联网没有、中国移动云没有、火山引擎没有、七牛云免费模型已退役、数眼智能没有、京东云没有、360 智汇云没有、天翼云没有、紫东太初云没有、OpenModel没有
但也不枉费我不懈努力的寻找 !!!
最终我发现国内知名代码托管平台 Gitee 旗下的模力方舟,上面也提供了不少永久免费模型
文本生成这块,不仅有 Qwen3-8B、DeepSeek-R1-Distill-Qwen-14B 这种小参数模型
更是有智谱的 30B 级 SOTA 模型 GLM-4.7-Flash 可以永久免费用 !!!
并且仔细一看还不限制并发数,阿虚实测甚至拿来做网页翻译 API 都能用!
更甚之,模力方舟目前分别在语言合成、语音识别、风控识别还都有完全免费 API 提供,用途是真的广泛
但这个平台有个唯一缺点就是……
虽然标价 0 元使用,但我实测必须至少充值 10 元购买它这个「全模型 Token 资源包」之后才能实际进行 API 调用
但因为实际调用的模型都是完全免费的,所以这个充进去的 10 块钱,一分钱的花不掉
你可以理解为只需要花 10 元就能买个永久免费 API
智谱 GigModel(官网:https://www.bigmodel.cn)
当然了,其实 GLM-4.7-Flash 这个 30B 级大模型在智谱官网也有免费提供
同样是永久免费,没有 token 限制
但是相比于模力方舟,智谱官方的免费 GLM-4.7-Flash 最高限 1 个并发请求3
简单来说就是同一时间只能处理一个请求。适合用来对话,处理单一任务,不适合翻译这种会对文本分段、批量发送请求的任务
如果需要高一点的并发,可以看看智谱的其他免费模型4,比如 GLM-4V-Flash(对标 GPT-4o mini)
| 模型类型 | 免费模型 | 并发限制 |
|---|---|---|
| 通用模型 | GLM-4.7-Flash | 1 |
| 通用模型 | GLM-4.6V-Flash | 1 |
| 通用模型 | GLM-4.1V-Thinking-Flash | 5 |
| 通用模型 | GLM-4-Flash-250414 | 2 |
| 通用模型 | GLM-4V-Flash | 10 |
| 图像大模型 | CogView-3-Flash | 1 |
| 视频生成模型 | CogVideoX-Flash | 3 |
▲V0 用户免费权益
尽管官方限制更大一点,但好在就就智谱最近这发展趋势(市值破万亿)
永久免费真不是开玩笑的,应该属于各种永久 API 里面最稳的那一档,和最近又获 20 亿 B 轮融资硅基流动坐一桌!!!
英伟达 NVIDIA NIM(官网:https://build.nvidia.com/models)
而如果说国内智谱最稳,国外最稳的免费 API 我觉得就是英伟达了
也不得不说黄老板是真壕性,愣是直接送几十个顶级开源模型给你完全免费用
筛选一下 Free Endpoint,你就会发现什么 GLM、Deepseek、Kimi、Minimax 等等模型都有。而且平台只需要任意邮箱+手机号即可注册(多个手机号就是多个 API),在右上角头像处即可获取 API Key,实测国内可直连使用 。
无 Token 用量上限,不限次数,API 限制为每分钟最高 40 次
我在网上找到了一个网友 4 月份做过的可用性测试6,结论是主流的模型基本都用不了(响应慢到超时)
但好消息是 Deepseek-v3.1、Kimi-K2、minimax-m2.5 等模型是响应快、绝对可以用的
虽然上述提到的不少模型已经下架,但我测试了 gpt-oss-120b(约等于 GPT o4-mini )、qwen3-next-80b-a3b-instruct(约等于 GPT-4.1)等模型,是的确如他所说完全可以用的 !!!
这个量级的模型,可比起级 10B 级、30B 级的模型聪明多了
Ollama(官网:https://ollama.com/search?c=cloud)
Ollama 原本是一个专注于跑本地模型的 AI 平台,但这种「仅面向拥有高端显卡人群」的模式显然不长久
所以在今年 3 月中旬,Ollama 其实已经与 NVIDIA 实现商业合作,推出了云端推理服务
而很 NICE 的就是:国内既能直连访问,同时还有免费 API 额度可长期白嫖!甚至注册限制比 NVIDIA 还低,无需验证信用卡、手机号,仅需一个有效邮箱!这意味着你可以轻松注册多个账号,搞多个免费 API !!!
虽然官方未明确公布具体的 token 限额,但有网友通过实测进行了大致估算,免费额度大致如下:
- 每 5 小时会话限额:约 50 万 token
- 每 7 天周限额:约 100 万 token
同时官网未见每秒钟调用次数、每分钟调用次数限制,只是限制了免费用户并发数为 1 路
具体使用需注意,除了在 Models 模型列表需要筛选 Cloud 云端模型
点进具体模型之后,还要再注意选择带 cloud 后缀的模型 ID,才能通过 API 进行调用 !热门模型事实上需要订阅会员才能使用,但GLM-4.7、minimax-m2.1、gpt-oss 等模型是完全可以用的!
还有不同模型的倍率不同,高倍率的模型可能一下就耗光你的免费额度!具体消耗可以通过看 Size/Usage 那个黑条来大致判断
最后就是官网 API 文档写的不太详细,我实测 API 地址要用这个(OpenAI 兼容):https://ollama.com/v1
上海人工智能实验室(官网:https://internlm.intern-ai.org.cn/)
书生开源大模型官方也有提供免费 API,不过属于是相当冷门了,我都没看多少文章有提到过
但其实背后的「上海人工智能实验室」阿虚曾经介绍过他们,就是他们开发了 PDF 转 WORD 神器 MinerU
而他们这个书生开源大模型也是更偏向解决各类科学任务
平台可免费调用 Intern 系列模型,最新的 Intern-S2-Preview 是一个 35B-A3B 参数的多模态推理模型,支持 256K 上下文窗口,每月直接送 9000 万 Token(输入 9000 万,输出 9000 万)别看只有 35B 参数,其实水平相当顶,这模型在好几个科学任务上能跟 GPT-5.5 掰手腕,科学智能体能力更是直接超 Claude-Haiku-4.5
当然这个 9000 万 Token 看着多,但其实跑几个批量任务就见底了。但如果你做科研、写代码、做一些周期性的分析任务,这个额度足够覆盖。
并且默认每用户每分钟限制 30 次,稍微高并发的任务都不行,还是只能简单使用
不过如果你有开发或者科研任务,可以在后台点击「申请更高流控」尝试填表之后申请更高速率
魔搭社区(官网:https://modelscope.cn/models)
中文版 Hugging Face,阿里达摩院旗下的魔搭平台 Modelscope 也有免费 API 提供
目前的规则是每人每天所有模型总和共 2000 次 API 调用次数(单模型不超过 200)
你需要先在右上角完成阿里云账号绑定,其次再去访问控制这里获取访问令牌,后续才能使用
好消息是 GLM-5.2、Kimi-2.7-Code 这些国内顶尖开源模型都包含在内
但坏消息是,GLM 等主流模型几乎都用不了,基本就是直接报 429 错误
有网友测试了目前基本上所有的文本模型(上下文少于 128k 的除外),能用的大致如下:
Step-3.5-Flash、Qwen3-30B-A3B-Instruct、Qwen3-30B-A3B-ThinkingQwen/Qwen3.5-27B、qwen3.5-397b-a17b(能用但 TPS 速率低)qwen3-14b(必须指定 maxTokens 为 8192,否则会报错)qwen3-235b-a22b-thinking(必须指定上下文 content 为 126976,否则会报错)
总而言之:属于能用,但只能挑着小范围用
讯飞星火(官网:https://xinghuo.xfyun.cn/sparkapi)
最最后来介绍个兜底模型!!!还是讯飞的,但属于讯飞星火。可以看到官网明确写了 Spark Lite 模型可以完全免费使用!
这个模型能力约等于 GPT-3.5-Turbo / GLM-4-Flash,日常对话和文本生成没问题,(复杂推理和代码能力偏弱),永久免费,无限 Token,并发数限制 5,还要什么自行车?
唯一使用时需要注意的就是
点击免费使用后,还得手动领取一下无限量额度!!!
总结
但搜集信息的时候我才发现:🐴的网上全是营销号,全是 AI 生成,全是复制粘贴!
看了一堆文章,信了一堆消息,阿虚实际验证下来全™是坑:
- 美团 LongCat:免费额度是需要内测申请的,但内测申请早已结束
- 阿里云百炼:免费额度仅 90 天有效,而非每月 100 万 token 额度
- 腾讯云:混元 Lite 的免费接口 9 月 30 号就会永久下线
- 百度千帆云:25 年的时候的确有公告说 ERNIE 系列模型永久免费9,但我翻遍了新版官网,根本没找到公告中的 ERNIE-Speed/Lite 等系列模型。去哪了?被吃了!我多番搜索才发现原来是百度早已经在 2026-01-27 下架 ERNIE-Lite-8K、ERNIE-Speed-128K 这俩大模型10
- 中国移动:注册时送一点限时额度,根本没有永久免费 API
- DeepSeek:R1 和 V3 模型免费调用完全是某些自媒体账号杜撰
- 火山引擎:每日 200 万额度本质是协作奖励计划活动,活动将于 6 月 30 日截止
- 七牛云:只有新用户 300 万 token 额度,每日 1000 万 token 额度完全是某些自媒体账号杜撰
- 扣子空间:个人免费版一共就 500 次累计免费额度11
- AtomGit AI:之前是有过部分模型不限量的限时活动,但只有新注册的 200 万额度,没有后续每月免费额度
- OpenRouter:每分钟 20 次请求,并且每天最多 50 次调用,充值 10 美元才能 1000 次/天调用。虽然免费,但国内连卡死,速度比蜗牛还慢,动不动就 400,稍微复杂一点的内容就 429,基本等于不能用
- Cloudflare:的确每天免费 10000 神经元,但我在多个 Agent 中测试均未调用成功,且网上均反馈这点儿神经元不够塞牙缝,稍微几条对话就花完了
- 白山智算:虽然免费提供了 KAT-Coder-Exp-72B 模型,但实测下来几乎不可用,一直超时
- 零一万物:yi-lightning 模型实际并不免费12
- 欧派云:永久免费模型现在只有一个 ERNIE-4.5-0.3B13,的确免费但太弱鸡了
短期内其他文章基本不用看,收藏这一篇完全足够!!!也是欢迎大家转发、分享,避免更多人踩坑~
References
- [1] AgnesAI 免费用户与付费用户速率说明:https://github.com/AgnesAI-Labs/AgnesAI-Models
- [2] 硅基流动速率限制说明:https://api-docs.siliconflow.cn/docs/userguide/faqs/rate-limit-and-upgradation
- [3] 智谱免费模型速率限制说明:https://bigmodel.cn/usercenter/proj-mgmt/rate-limits
- [4] 智谱 BigModel 免费模型:https://docs.bigmodel.cn/cn/guide/models/free
- [5] 智谱用户权益升级说明:https://docs.bigmodel.cn/cn/guide/platform/equity-explain
- [6] 英伟达免费模型可用性测试:https://vibex.iflow.cn/t/topic/5728
- [7] 魔塔社区 API 使用限制:https://modelscope.cn/docs/model-service/API-Inference/limits
- [8] 魔塔社区免费模型可用性测试:https://vibex.iflow.cn/t/topic/5728
- [9] 千帆 ModelBuilder 部分 ERNIE 系列模型免费开放公告:https://ai.baidu.com/ai-doc/WENXINWORKSHOP/wlwg8f1i3
- [10] 百度智能云模型版本升级及退役机制:https://cloud.baidu.com/doc/qianfan/s/zmh4stou3
- [11] 扣子空子 API 介绍:https://docs.coze.cn/developer_guides_coze_api_overview
- [12] 零一万物 API 说明:https://platform.lingyiwanwu.com/docs
- [13] 欧派云 ERNIE-4.5-0.3B:https://ppio.com/model-api/console/model-details/baidu/ernie-4.5-0.3b
本站资源大多来自网络,如有侵犯权益请联系管理员,我们会第一时间审核删除。站内资源仅供学习测试,未经许可禁止商用,请在24小时内删除。
遇到付费内容?升级终身VIP即可全站免费畅享所有资源,可以联系我的微信进行开通。
大海聊天 QQ 3群:478065589









子比主题美化
精品源码资源 

暂无评论内容