Typhoon (SCB 10X)
研究展示 API 免费使用——所有 Typhoon 模型 $0泰语 LLM、OCR 和语音,走 OpenAI 兼容的研究 API速率限制:typhoon-asr-realtime: 100 reqs/minute (documented on the ASR page); LLM/OCR models: no published quotas (beta service)长期有效。
最新进展true
过去 48 小时,AI 圈讨论最多的 69 件事
10月1日 00:58 更新 · 按讨论热度排序
研究展示 API 免费使用——所有 Typhoon 模型 $0泰语 LLM、OCR 和语音,走 OpenAI 兼容的研究 API速率限制:typhoon-asr-realtime: 100 reqs/minute (documented on the ASR page); LLM/OCR models: no published quotas (beta service)长期有效。
最新进展true
GLM-4.5-Flash、GLM-4.7-Flash(文本)和 GLM-4.6V-Flash(视觉)官方标注 $0 永久免费(输入、缓存输入、输出全免)永久免费、无试用倒计时的模型速率限制:Not specified with concrete RPM/TPM figures in public docs长期有效。
约 14 个带 :free 后缀的轮换模型(数量浮动),一个 API 通吃多家 provider一个免绑卡 key 背后最全的模型选择速率限制:20 req/min; 50 req/day under 10 credits purchased lifetime, 1000 req/day once 10+ credits purchased (one-time, not a subscription)长期有效。
$0 免费套餐:通过 API 访问云端托管的开放模型(Qwen、GPT-OSS、DeepSeek 等)Ollama 工作流 + 云端开放模型,免绑卡速率限制:Session limits reset every 5 hours and weekly limits every 7 days; 1 concurrent cloud model on the free plan (exact token caps not published)长期有效。
开放权重模型(Llama、Qwen、GPT-OSS)外加 Whisper,免绑信用卡开放权重模型中延迟最低的推理速率限制:e.g. llama-3.1-8b-instant: 30 RPM/14.4K RPD/6K TPM/500K TPD; llama-3.3-70b-versatile: 30 RPM/1K RPD/12K TPM/100K TPD; qwen/qwen3.6-27b: 30 RPM/1K RPD/8K TPM/200K TPD; similar for GPT-OSS and Whisper models长期有效。
每天 10,000 Neurons,所有套餐可用做 side project 可用的最高免费日额度速率限制:30+ models: LLMs (Llama, Mistral, DeepSeek, Qwen...), embeddings, image, audio长期有效。
多个模型永久免费(如 Qwen2.5-7B-Instruct 等),$0 计费;另送 $1 新人额度用于付费模型永久免费的开放模型,没有试用倒计时速率限制:Fixed per-model limits for free models; generic docs cite ranges of 1,000-10,000 RPM and 50,000-5,000,000 TPM depending on model tier — exact limits shown in-account长期有效。
Gemini 2.5 Flash、2.5 Flash-Lite、2.5 Pro(限量)、Embeddings、TTS 模型唯一拥有真正免费档的前沿级模型速率限制:Varies by model: 5-30 RPM and 15-1,000 RPD (e.g. 2.5 Pro: 5 RPM/100 RPD; 2.5 Flash: 10/250; 2.5 Flash-Lite: 15/1,000; embeddings: 100 RPD; TTS: 15 RPD)长期有效。
限速免费档(未绑定支付方式时生效),所有模型通用限速免费档里的高速开放模型速率限制:Free Tier: 20 RPM / 20 RPD / 200,000 TPD across all models; Developer Tier (card required): 60-240 RPM depending on model长期有效。
API-Inference 每天约 2000 次免费调用,覆盖开放权重模型(Qwen3、DeepSeek、GLM、Llama 等)每天免费调用多个开放模型(需实名认证)速率限制:~2,000 calls/day; concurrency/QPS caps applied and dynamically adjusted长期有效。
试用(评估)API key,覆盖 chat、embed 和 rerankRAG 原型免费的 embeddings 和 rerank速率限制:1,000 API calls/month total; 20 req/min chat; 2,000 inputs/min embed; 10 req/min rerank长期有效。
目录中 Qwen3Guard 两个模型(Gen-8B、Gen-0.6B)当前标注免费;可匿名访问,或用绑定 Public Cloud 项目的 API key 访问欧盟托管、免注册即可用的开放模型速率限制:Anonymous access: 2 requests/min per IP per model. Authenticated (API key): 400 requests/min per project per model. Exceeding either returns HTTP 429长期有效。
Free 套餐每月 $100 Serverless Inference 额度(默认支出上限,限时优惠)一个统一 API 背后多个开放权重前沿模型(DeepSeek、Llama、Qwen、GLM、GPT-OSS),带 Weave 追踪速率限制:No RPM/TPM published; default cap of $100/month on the Free tier; concurrency limits per project/user长期有效。
免费托管图像模型(Flux、Turbo、Stable Diffusion),一个 GET URL 即用;也有文本和音频。免注册开玩免注册的免费图像生成(Flux/SD)速率限制:Anonymous ~1 request / 15s; free registration (Seed tier) ~1 request / 5s长期有效。
免费众包文本/图像生成;匿名 API key '0000000000'(免注册),注册可赚 kudos 换优先级匿名、免注册的免费生成(速度看排队)速率限制:Queue-based priority via kudos (no fixed quota); anonymous requests get lowest priority under load长期有效。
明确标注"try and explore"的受限免费档——官方文档建议正式项目升级付费升级前先拿欧洲模型做原型验证速率限制:Not published publicly; exact caps only visible in-console after login (admin.mistral.ai)长期有效。
免费套餐($0):所有文本 LLM(Gemma、Qwen 等),每 2 天约 5 次请求,12K 上下文,一次只跑一个请求永久免费(限速很狠)的测试档速率限制:1 request at a time; ~5 requests per 2 days across all models; max 12K context; delayed responses长期有效。
每月 25,000 次转换(Engine 1 & 2)+ 每月 2,500 次 Engine 3 转换;文件上限 1MB,PDF 最多 3 页经典免费 OCR(每月 2.5 万次,免绑卡)速率限制:500 requests per day per IP address长期有效。
免费套餐:每月 10,000 credits(balanced 解析模式约 1 credit/页,即约 1 万页)RAG 文档解析免费(每月约 1 万页)速率限制:5 concurrent jobs; 1 project; 5 indexes on the free plan长期有效。
TTS 每月 50,000 字符(硬上限)+ 语音 agent 每月 60 分钟免费商用 TTS(每月 5 万字符)速率限制:3 concurrent calls; hard cap pauses at the limit (no overages)长期有效。
Free 套餐 TTS 每月 10,000 字符(约 10 分钟)富有表现力的 TTS,免费档可商用速率限制:15 requests per minute长期有效。
TTS 每月 250,000 字符(约 6 小时音频)免费额度最大的 TTS(每月 25 万字符,需署名)速率限制:Tiered endpoints for different text lengths; specific caps not documented长期有效。
Free Forever 套餐:每月最多 100 个文档——OCR + 结构化数据抽取(收据、发票等 100+ 文档类型)永久免费的文档 OCR(每月 100 个,免绑卡)速率限制:100 documents/month on the free plan长期有效。
Lite 套餐:基础模型推理每月 30 万 tokens,ML 工具每月 20 CUH,文档文本抽取每月 100 页带月度免费配额的企业级合规推理速率限制:2 inference requests per second (explicitly documented for the Lite plan)长期有效。
Starter(免费)套餐:embedding 模型每月 500 万 tokens(llama-text-embed-v2、multilingual-e5-large),rerank 模型 bge-reranker-v2-m3 每月 500 次请求RAG 免费 embeddings + rerank(每月 500 万 tokens)速率限制:5M embedding tokens/mo; 500 rerank requests/mo on Starter长期有效。
免费套餐:Marengo Embed API 全输入类型(视频、音频、图像、文本)免费,另有约 600 分钟索引额度免费多模态(视频/音频/图像/文本)embeddings速率限制:Embed video/audio: 3,000 RPD, 25 RPM; embed text/image: 3,000 RPD, 600 RPM长期有效。
每月 10,000 credits,TTS、STT 等通用(约每月 10 分钟 TTS)最出名的 TTS 音色(免费档不可商用)速率限制:Concurrency tied to the Free plan (not numerically published)长期有效。
每月 20,000 credits(约 27 分钟 Sonic TTS 或约 1 小时 51 分钟 Ink 语音转写)低延迟流式 TTS + STT,每月免费额度自动续速率限制:2 concurrent TTS requests, 8 concurrent STT; 20,000 credits/month长期有效。
每月 8,000 credits(约 7 分钟生成,单次最多 500 字符);TTS、STT 和音色克隆免费多语言 TTS + 音色克隆,个人项目够用速率限制:500 characters per generation; 8,000 credits/month长期有效。
每月 2,000 credits,覆盖约 2.5 万字符 MARS TTS、125 分钟 STT,外加限量带水印配音和翻译(含 5 页 OCR)富有表现力的多语言 TTS、STT 和配音,一个免费额度全包速率限制:500 chars/generation TTS, 15 min/generation STT; 2,000 credits/month长期有效。
每月 15,000 页,每月重置——50+ 文件类型的文档解析/OCR(版式、表格、生成式 OCR 增强)把杂乱文档变成 LLM 可用的结构化数据,每月免费速率限制:15,000 pages/month长期有效。
每月 5,000 credits(按月续,不滚存)——约 5,000 页文本解析;OCR 重度的 'Understand'/'Agentic' 解析 9-18 credits/页文档数据抽取,每月免费额度实打实续速率限制:5,000 credits/month; per-page cost varies by parse mode (1-18 credits)长期有效。
Remove Background API 送 10 次正式调用(一次性),Image Editing API 每月 1,000 次沙盒调用(带水印)程序化抠图和 AI 修图,免费做原型速率限制:1,000 sandbox calls/month; 10 one-time production calls长期有效。
免费 CPU Basic + ZeroGPU(Spaces 用);Inference Providers 每月赠送额度(Free 套餐 $0.10/月,PRO/Team/Enterprise $2.00/月)一个 key 路由到多家开放权重 provider速率限制:No RPM/TPM published, only credit amounts长期有效。
免费档:每月 $5 额度,覆盖部分模型(Free Tier eligible),速率限制更低一个 key 通多家 provider,每月还有免费额度速率限制:Free tier is rate-limited per model (HTTP 429 on exceed), lower than paid; routes to many providers rather than hosting models itself长期有效。
Free 套餐每个 workspace 每月 $5 用量额度,用于 Moondream 视觉模型——caption、query(VQA)、detect、point小而美的视觉模型,OpenAI 兼容,每月免费额度速率限制:Bounded by the $5/month credit长期有效。
试用额度,需手机验证试用 NVIDIA 优化模型(仅限评估)速率限制:Some models have reduced context windows on the free trial长期有效。
100 万 tokens 免费 + 60 分钟 Whisper 转写;从第 1,000,001 个 token 开始计费欧盟托管的开放模型,100 万免费 tokens速率限制:Gemma, Llama, Mistral, Qwen长期有效。
1000 万免费 tokens(一次性),全模型通用——embeddings、rerank、分类器;另有免 key 的 Reader(r.jina.ai)基础版OpenAI 兼容接口后的免费 embeddings 和 rerank速率限制:Free key: 100 RPM / 100k TPM for embeddings & reranker (2 concurrent); keyless Reader 20 RPM长期有效。
注册送 $50 免费额度(免绑卡)——离线/流式语音转写、Speech Understanding,以及 OpenAI 兼容的 LLM Gateway(25+ 模型)免费语音转写,外加 OpenAI 兼容的 LLM 网关速率限制:Free tier: 5 parallel transcriptions; streaming 5 new streams/min; global 20k requests / 5 min长期有效。
Solar Pro 4 限时免费(促销);其余 API 为预付费($100/月起)——Solar LLM(chat + embeddings)外加 Document Parse / OCR / 信息抽取;Studio agent 送 10 次免费运行Solar LLM + 文档 OCR,一个 OpenAI 兼容 key速率限制:Document Parse billed $0.01/page (+$0.03 for extract); Tier 1 rate limits apply on prepaid tiers长期有效。
新账户 $5 免费额度,所有公开模型通用晶圆级硬件上 tokens/秒最快的推理速率限制:Published Free Trial per-model limits: 5 RPM / 30,000 TPM / 1,000,000 TPH / 1,000,000 TPD (e.g. gpt-oss-120b, zai-glm-4.7, gemma-4-31b); limits vary by model有效期至 30 days。
每月免费额度:工作邮箱 $20 / 个人邮箱 $10——90+ 语言 OCR、PDF 转 markdown、表格、表单和结构化抽取开源血统的 OCR(Marker/Surya),每月免费额度速率限制:10 requests/min on the free tier; per-page pricing (see datalab.to/pricing)长期有效。
新账户送免费额度;当前定价页未公布具体金额用免费启动额度评估托管的自定义/开放模型速率限制:Model APIs are priced per token; dedicated deployments are priced by compute time (per minute)长期有效。
$1 试用额度,30 天有效$1 试用之后,低价的开放模型推理速率限制:Various open-weight models有效期至 30 days。
$100 沙盒额度,90 天有效用 $100 沙盒额度试 Model API、GPU 和 agent 工作流速率限制:Various open-weight models有效期至 90 days。
$10 试用额度,3 个月有效$10 试用 Jamba 长上下文模型速率限制:Jamba Large/Mini: 10 RPS / 200 RPM by default有效期至 3 months。
100 万 tokens(示例值,按模型浮动),仅限国际/新加坡地域Qwen 模型的大额免费 token 包(新加坡地域)速率限制:Qwen open & proprietary models有效期至 30-90 days。
一次性 $5 额度,通用于 serverless 模型(GPT-OSS-120B、Claude、Llama)、视觉、embeddings 和图像生成用 $5 额度试多模态(LLM + 视觉)模型速率限制:15 requests/second global default (CONN_THROTTLED on exceed)有效期至 30 days。
注册送 ₹100 免费额度,全 API 通用,包括 Sarvam-M 聊天/LLM API 和语音(STT/TTS)一个 OpenAI 兼容 key 通吃印度语系聊天 + 语音速率限制:Not published; bounded by the ₹100 credit长期有效。
混元文本 LLM 100 万免费 tokens(hunyuan-a13b、turbos、翻译和视觉模型),另有 hunyuan-embedding 单独 100 万 token 包中文 LLM 工作流,OpenAI 兼容接口速率限制:Not published; bounded by the token package有效期至 1 year。
Laguna M.1(225B)和 Laguna XS.2(33B,开放权重)限时免费,自助 developer API key 即用(OpenRouter 上也有)免费的代码专用 LLM,OpenAI 兼容 key速率限制:Preview rate limits not published长期有效。
Starter 套餐每月 $30 循环额度用每月免费 GPU 额度自托管开放模型速率限制:Starter: 100 containers + 10 GPU concurrency, 5 crons, 1-day log retention长期有效。
注册送 $200 免费额度(免绑卡、不过期)——Nova 语音转写、Aura 语音合成按量计费全站最大额度的免费语音额度(STT/TTS)速率限制:STT pre-recorded up to 50 concurrent; STT streaming up to 150; TTS REST up to 15; TTS streaming up to 45长期有效。
Starter 套餐:$5 一次性额度(免绑卡)——embeddings(mxbai-embed-large-v1)、rerank,以及 PDF/图片/文档/代码多模态搜索免绑卡的 embeddings 和 rerank 额度速率限制:Starter plan: 100 requests/min长期有效。
注册送 $2 额度,用于第一方图像模型(FLUX.1/FLUX.2、Stable Diffusion 3、SDXL),Sonic 推理引擎——可生成数百到数千张高速图像模型 + $2 免绑卡额度速率限制:Not publicly specified; per-account concurrency applies长期有效。
注册送 $50 免费额度(一次性),用于数据抽取 / OCR 工作流用 $50 免绑卡额度做文档抽取速率限制:Up to 3 users on the free credit长期有效。
$15 试用额度用 $15 试用 NLP 任务(命名实体识别、分类、摘要)速率限制:Variable by model, no numeric RPM/TPM published长期有效。
$100 一次性用量额度(免绑卡),覆盖语音转写和语音合成高精度 STT + TTS,用 $100 免绑卡额度速率限制:2 concurrent real-time STT sessions; 3 voice-agent conversations; 1 batch job/sec (bounded by the $100 credit)长期有效。
注册送 €50 免费额度用于语音转写(按现价约 80+ 小时离线或 60+ 小时实时)高精度离线 + 实时转写,先免费试速率限制:Not published; bounded by the €50 credit长期有效。
新账户送 3,000 分钟免费 TTS(Starter 套餐)低延迟会话式 TTS,做原型验证速率限制:Starter: 20 concurrent TTS generations长期有效。
当前 embedding 模型(voyage-4-large、voyage-4、voyage-4-lite、voyage-context-4、voyage-code-4)和 rerank(rerank-2.5 系列)各送 2 亿免费 tokens;voyage-multimodal-3.5 / voyage-multimodal-3 送 2 亿文本 tokens + 1500 亿像素——每个模型一次性的大额赠送顶级的 embeddings 和 rerank,免费额度给得大方速率限制:Standard per-model RPM/TPM limits apply; the free-token allotment is the practical ceiling长期有效。
按需套餐 $25 免费额度,可用于 Rerank(rerank-v2)和 Generate API免费试用指令跟随能力强的 reranker速率限制:Bounded by the $25 credit balance长期有效。
免费额度相当于 5 小时 Reverb ASR(语音转写),Rev AI 全产品通用5 小时免费高精度语音转写,先评估效果速率限制:Bounded by the 5-hour credit grant长期有效。
注册送 $50 免费额度(免绑信用卡)——语音转写免绑卡语音转写里额度最大的($50)速率限制:Bounded by the $50 credit; pay-as-you-go afterward (4 concurrent requests or 4 hours of audio/hour)长期有效。
$10 免费额度,全功能——TTS、STT、speech-to-speech 和音色克隆用 $10 额度玩高速 TTS + 音色克隆速率限制:Bounded by the $10 credit长期有效。
$10 免费额度 + 20 路免费并发——语音 agent 编排(STT + LLM + TTS)用 $10 额度搭一个语音 agent速率限制:20 free concurrent calls; voice agents ~$0.07-$0.31/min after the credit长期有效。
热度来自参与同一事件的独立账号与机构,重复采集只算一次,并按 24 小时半衰期衰减。它衡量讨论活跃程度,不是报道质量评分。
榜单统计过去 48 小时。趋势只比较持续覆盖的同一组信源;它反映我们的监测范围,不代表全网人数。缺少可比历史时,不展示趋势线。
信源名单只展示可公开阅读的报道来源;讨论参与者还包括只计入热度的账号与机构。同一机构的多个渠道可能合并计数,因此参与者不一定多于信源数。点击事件可查看各方报道与观点。