免费大模型API哪家强awesome-freellm-apis 上下文窗口与速率限制横向对比指南【免费下载链接】awesome-freellm-apis134 free LLM APIs AI API keys from 40 providers. Google Gemini, NVIDIA NIM, Groq, OpenRouter more. One-click setup for Claude Code, Cursor and Codex.项目地址: https://gitcode.com/gh_mirrors/aw/awesome-freellm-apis免费大模型API哪家强上下文窗口有多大每天能免费调用多少次本文基于开源项目 awesome-freellm-apis收录 508 免费 LLM API 与 31 家供应商的 API Key 获取入口进行整理把 Google Gemini、NVIDIA NIM、Groq、OpenRouter 等主流免费大模型API的上下文窗口与速率限制做成一张表帮你快速选出最适合写代码、长文档或 Agent 场景的那一个。数据每日自动刷新最近更新2026-09-24不怕信息过期。一、什么是 awesome-freellm-apis一份会保鲜的免费大模型API目录大多数免费 API 合集是静态清单——写好后一两年没人更新等你照着申请免费额度早就没了。这个项目做对了几件关键的事亮点说明✅ 数据每日更新通过自动化监控每天刷新各家免费额度而非过期的静态列表✅ 信用卡透明度每个供应商都标注是否需要信用卡、手机验证还是啥都不要✅ 一键配置片段内置 Claude Code、Cursor、Codex 等 10 工具的即用配置✅ 横向对比上下文窗口、速率限制、模态支持一张表并排比较完整目录、Base URL 速查表和模型清单都写在 README.md 中另有简体中文版 README.zh-CN.md、繁体、日文、韩文版随取随用。二、看懂对比表先认识 4 个关键指标在横向对比前花 1 分钟搞懂术语后面看表就不费劲了 上下文窗口Context Window模型一次能记住并处理多少 token。128K≈10 万中文字1M≈70 万字。做长文档问答、喂整个代码库时这个数字越大越从容。RPMRequests Per Minute每分钟最多请求数决定短时间的连发能力。RPDRequests Per Day每天最多请求数决定长期免费额度。TPM / TPDTokens Per Minute / Day按 token 量计的限速长 prompt 场景更吃这个。小建议RPM 看顺不顺RPD 看够不够。两者要结合着看。三、上下文窗口横向对比谁的记性最长以下摘自 README.md 的供应商目录按最大上下文窗口降序精选供应商最大上下文窗口免费模型数需要信用卡xAI (Grok)2M3注册即可NVIDIA NIM1M132需手机验证ModelScope魔搭1M61注册即可OpenRouter1M34注册即可Google Gemini1M19不需要Cloudflare Workers AI262K40不需要Groq262K12不需要Mistral AI256K15不需要Cohere256K12不需要DeepSeek128K2注册即可 几个直观结论1M 阵营是长文档之王NVIDIA NIM、ModelScope、Google Gemini、OpenRouter 都能一次吃下 1M token整本小说或大型代码仓库都能塞进去。免费模型数最多的也是 NVIDIA NIM132 个一次注册、多模型切换性价比极高。128K 对日常对话和单文件编程完全够用不必盲目追大窗口。四、速率限制对比每天能免费调多少次限速写法五花八门这里统一整理成同一张表摘自 README.md 最佳模型表供应商免费层速率限制需要信用卡适合谁Groq30 RPM14,400 RPD不需要免费额度最慷慨首选入门Google Gemini15 RPM1,500 RPD不需要1M 上下文 多模态全能型Mistral AI约 1 RPS500K TPM不需要Medium 3.5 支持 256KCohere20 RPM不需要长文本 / RAG 场景强Kilo Code200 请求/小时不需要Nemotron 3 Ultra 550B 免费SambaNova20 RPM20 RPD200K TPD注册即可推理速度快Cerebras10 RPM100 RPD1M TPD不需要芯片级低延迟LLM7.io10 RPM60 请求/小时不需要匿名也能用AI21 Labs200 RPM10 RPS注册即可每分钟吞吐最高Z AI智谱1 个并发请求不需要GLM-4.7-Flash 免费体验Glhf.chat免费模型不限速注册即可无 RPM 压力社区供给 读表技巧Groq 的 14,400 次/天是目前免费层里最能打的日额度而AI21 的 200 RPM则是每分钟连发能力天花板——前者适合一天慢慢跑很多后者适合短时间猛发。五、按场景选三种推荐组合 场景一纯新手没信用卡闭眼选Groq邮箱注册、免信用卡30 RPM 每天 1.4 万次个人使用绰绰有余想要大上下文就换Google Gemini同样免信用卡1M 窗口 15 RPM。 场景二长文档 / 大代码库分析优先NVIDIA NIM1M 窗口、132 个免费模型或ModelScope1M 窗口、61 个模型国内注册方便。想要多模态图片/PDF/音频则 Gemini 更均衡。⚡ 场景三AI 编程助手Cursor / Claude Code / Codex要工具调用支持好 响应快的组合Groq 的 Llama 3.3 70B、Cerebras 的低延迟端点或用OpenRouter免费模型做统一路由一个 Key 调多家模型。现成的配置片段见 code-examples/cursor.md、code-examples/claude-code.md、code-examples/codex.md。六、3 步把免费API接入工具从 Key 到跑通选供应商并注册——对照上面两张表选一个不需要信用卡的邮箱注册通常 1 分钟内拿到 Key。复制 Base URL 模型 ID——速查表在 README.md 的 Quick Reference 一节所有供应商均为 OpenAI 兼容端点例如 Groq 的端点地址为https://api.groq.com/openai/v1。粘贴进你的工具——Cursor 在 Settings → Models → Add Model 中填入 Key 与 Base URLClaude Code / Codex 通过环境变量配置。具体步骤直接抄 code-examples/ 目录下的对应文档即可。遇到 rate limit429错误说明触顶了——等下个窗口刷新或换一家供应商继续这正是多备几个 Key 的意义。七、数据来源与项目结构 数据每日自动刷新最近更新时间2026-09-24对比的是今天的真实免费额度。项目结构精简核心文件文件内容README.md完整供应商目录、Base URL 速查、最佳免费模型表README.zh-CN.md简体中文版code-examples/cursor.md 等 3 个Cursor / Claude Code / Codex 即用配置CONTRIBUTING.md收录标准与贡献指南八、常见问题 FAQQ1免费额度是永久的还是试用赠送两者都有且表里分得很清楚主体是永久免费层Permanent Free Tiers另有 OpenRouter 等可续充额度单独列出。收录标准见 CONTRIBUTING.md纯广告、无真实免费额度的服务不会入选。Q2上下文窗口越大越好吗不一定。窗口大意味着单次请求 token 成本高、免费额度消耗快。128K–262K 对绝大多数编程与对话场景足够1M 留给一次塞进整本书的极端需求。Q3一定要用信用卡吗不是。对比表中Groq、Google Gemini、Mistral、Cohere、Cloudflare、Cerebras等主流选项均标注不需要邮箱注册即可上手。总结入门首选Groq免费额度最慷慨长文档选NVIDIA NIM / Gemini / ModelScope1M 窗口编程助手用Groq OpenRouter组合最稳。所有对比数据每日更新收藏 README.md 这一份活的免费大模型API目录就能长期用上新鲜准确的额度信息 【免费下载链接】awesome-freellm-apis134 free LLM APIs AI API keys from 40 providers. Google Gemini, NVIDIA NIM, Groq, OpenRouter more. One-click setup for Claude Code, Cursor and Codex.项目地址: https://gitcode.com/gh_mirrors/aw/awesome-freellm-apis创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
企业数字化 ERP 产品动态
相关推荐
用 AI 给 Obsidian 写一个 LLM-wiki 插件:TaoToken 统一 Key 接入与配置骨架 /* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/26 16:38:04
深度解析:Deepseek与Manus的根本区别——大模型与AI智能体的深度对比 /* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/26 16:37:58
ASP.NET邮件收发系统毕设指南:SMTP发送与POP3接收协议解析 简介:这是一份基于ASP.NET与C#的C/S架构电子邮件简单收发系统毕业设计资源,面向计算机专业毕业生或正在制作邮件客户端课题的开发人员。系统基于SMTP和POP3协议,整体采用C/S分层结构,完整实现用户注册、邮件单个发送与群发、邮件收… · 2026/9/26 17:14:59
Hadoop 3.3.6集群搭建实战:从伪分布式到完全分布式部署 简介:面向大数据开发与运维人员的 Hadoop 3.3.6 二进制安装包,来自 Apache 开源分布式框架,可直接用于搭建存储与计算环境,适合在本地或服务器上快速部署。压缩包体积约 696MB,文件数量约 2000 个,其中 HTM… · 2026/9/26 17:14:59
2026第二十三届华为杯数学建模竞赛ABCDEF题思路代码解析 2026第二十三届华为杯研究生数学建模竞赛ABCDEF题思路代码解析,这篇我写了很多年了。每年赛题一出来,总有人私信问我A题是不是该用物理仿真、B题是不是直接套排队论、C题是不是无脑上机器学习……这些问题其实反映了大多数人根本没有一个系统性的选题和破… · 2026/9/26 17:14:59
昇腾Atlas 300V 24G部署YOLO实战:推理加速卡全流程指南 1. 先回答热搜问题:Atlas 300V 24G到底是不是运算加速卡先说结论:是,而且是一张专门为推理场景设计的加速卡,不是训练卡。这段时间后台私信里频繁出现"atlas部署yolo"和"atlas 300v 24g 是运算加速卡吗"这两个… · 2026/9/26 17:14:52
Flink Watermark机制详解:彻底解决乱序数据处理难题 做实时计算的人,迟早都会撞上乱序数据这堵墙。Kafka里的消息明明是按顺序生产的,到了Flink这边却乱了套;或者源头压根就是无序的,比如手机上报的埋点日志、物联网传感器的上报记录。你要是直接按事件发生时间去开窗口统计… · 2026/9/26 17:14:52
数据库课后习题答案别硬背:当测试用例集刷,效率翻倍 简介:万常选版《数据库原理与设计》课后习题答案资源,覆盖第2至6章及第9章,适合正在学习关系模型、数据库建模、关系数据理论与模式求精的本科生、自学者作为复习与自测材料。压缩包共7个文件,含3个doc参考答案、2个sql示例脚本、… · 2026/9/26 0:00:21
OpenClaw 替代品?Hermes Agent 踩坑实录:macOS 飞书接入 TaoToken 配置 /* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/26 0:00:40
向下兼容与向上兼容:接口设计中的兼容性策略与工程实践 一次版本升级事故,是很多团队绕不过去的坎。线上环境里,服务端明明已经上线了新版接口,老的移动端还在照着旧文档传参数。请求一到网关,校验直接拒绝,用户操作失败,客服群炸了锅,开发群里开始互… · 2026/9/26 0:00:46