书生大模型介绍与免费API接入指南!书生大模型是国内专注科研领域的AI大模型品牌,旗下「书生·端砚」平台近期动作不少——不仅集成了多款国产头部模型,还提供完全免费的 API 接口,兼容 OpenAI 和 Anthropic 两种协议,研究者和开发者可以直接上手调用。

文章目录
显示
平台地址与接入方式
- 官网:https://discovery.intern-ai.org.cn
- API 地址(Base URL)OpenAI 协议:https://discovery-api.intern-ai.org.cn/v1
- API 地址(Base URL)Anthropic 协议:https://discovery-api.intern-ai.org.cn
两个协议都能用,按现有代码框架选对应的就行,迁移成本很低。
免费额度怎么用
新用户每月自动赠送 10 墨点,1 墨点约等于 20,000,000 tokens,也就是每月能白嫖到 2 亿 token 的调用额度。对于跑实验、练 Prompt、做研究来说,这个量级基本够用。
速率方面也有明确限制:
- – RPM(每分钟请求数)上限:50 次/分钟
- – TPM(每分钟 token 数)上限:2,000,000
- – 5 小时限额:消耗 10 墨点(即 2 亿 tokens)
- – 7 天限额:50 墨点
这个节奏对日常使用足够宽松,不会被限速卡脖子。
可用模型ID一览
目前平台开放的模型阵容挺齐,涵盖大语言模型和多模态模型,以下是完整列表!从阵容看,覆盖了 DeepSeek、GLM、Kimi、MiniMax、Qwen 这几家国内主流模型的开放版本,场景覆盖也比较全——有偏向科学推理的,有支持深度思考的,还有能处理图文的多模态型号。
| 模型名称 | 模型 ID | 模型类型 | 输入类型 | 上下文长度 | 模型能力 | 协议 |
|---|---|---|---|---|---|---|
| Agents-A1 |
Agents-A1 |
多模态模型 | 文本、图像 | 262.1K | 工具调用 · 科学推理 | OpenAI Chat / Anthropic Messages |
| Atria-Dawn-Preview |
Atria-Dawn-Preview |
大语言模型 | 文本 | 262.1K | 科学推理 | OpenAI Chat / Anthropic Messages / OpenAI Responses |
| DeepSeek-V4-Flash-0731 |
deepseek-v4-flash-0731 |
大语言模型 | 文本 | 1.0M | 深度思考 · 工具调用 | OpenAI Chat / Anthropic Messages / OpenAI Responses |
| DeepSeek-V4-Flash-Vision |
deepseek-v4-flash-vision |
多模态模型 | 文本、图像 | 1.0M | 工具调用 · 深度思考 | OpenAI Chat / Anthropic Messages / OpenAI Responses |
| DeepSeek-V4-Pro-0813 |
deepseek-v4-pro-0813 |
大语言模型 | 文本 | 1.0M | 工具调用 · 深度思考 | OpenAI Chat / Anthropic Messages / OpenAI Responses |
| GLM-5.3 |
glm-5.3 |
大语言模型 | 文本 | 1.0M | 工具调用 · 深度思考 | OpenAI Chat / Anthropic Messages / OpenAI Responses |
| 书生-S2 |
intern-s2 |
多模态模型 | 文本、图像 | 262.1K | 工具调用 · 科学推理 | OpenAI Chat / Anthropic Messages |
| Kimi-K2.6 |
kimi-k2.6 |
多模态模型 | 文本、图像 | 262.1K | 工具调用 · 深度思考 | OpenAI Chat / Anthropic Messages / OpenAI Responses |
| MiniMax-M3 |
minimax-m3 |
大语言模型 | 文本 | 1.0M | 工具调用 · 深度思考 | OpenAI Chat / Anthropic Messages / OpenAI Responses |
| Qwen3.8-27B |
qwen3.8-27b |
多模态模型 | 文本、图像 | 262.1K | 工具调用 · 深度思考 | OpenAI Chat / Anthropic Messages |
适合谁用
这个平台特别适合做科研实验、跑模型测试、写 Prompt 调优的群体。每月 2 亿 tokens 的免费额度不算是小数目,配合双协议支持,接入现有项目几乎零成本。对预算敏感、需要大量调用的团队来说,是个不错的起步选择。
当然,免费额度有速率和时间上的限制,如果是高并发生产环境,还是需要评估是否够用。

建站经验分享






