支持的模型列表
|
模型名称
|
参数量
|
激活参数量
|
上下文窗口
|
推理资源推荐
|
|
DeepSeek-V3
|
671B
|
37B
|
128K
|
多机分布式部署,节点数量:2个,单节点配置:HCCPNV6 机型
|
|
DeepSeek-R1
|
671B
|
37B
|
128k
|
多机分布式部署,节点数量:2个,单节点配置:HCCPNV6 机型
|
|
DeepSeek-R1-Distill-Qwen-1.5B
|
1.5B
|
-
|
-
|
12C44GB 1卡A10
|
|
DeepSeek-R1-Distill-Qwen-7B
|
7B
|
-
|
-
|
12C44GB 1卡A10
|
|
DeepSeek-R1-Distill-Llama-8B
|
8B
|
-
|
128K
|
12C44GB 1卡A10
|
|
DeepSeek-R1-Distill-Qwen-14B
|
14B
|
-
|
-
|
16C96G 1卡A100
|
|
DeepSeek-R1-Distill-Qwen-32B
|
32B
|
-
|
-
|
32C192G 2卡A100
|
|
DeepSeek-R1-Distill-Llama-70B
|
70B
|
-
|
128K
|
164C948G 8卡A100
|
限时免费体验

API 调用指引
模型部署实践
前置准备工作
步骤一:部署模型服务



步骤二:体验模型效果


步骤三:调用模型推理 API
方式一:使用 TI 平台内置工具测试 API 调用



{"model": "ms-xxxxxxxx","messages":[{"role": "user","content": "描述一下你对人工智能的理解。"}]}


方式二:使用命令行工具测试 API 调用

curl -X POST https://ms-xxxxxxxx-xxxxxxxx.gw.ap-shanghai.ti.tencentcs.com/ms-xxxxxxxx/v1/chat/completions -H 'Content-Type: application/json' -d'{"model": "ms-xxxxxxxx","messages":[{"role": "user","content": "描述一下你对人工智能的理解。"}]}'

方式三:使用第三方应用开发工具调用 API










步骤四:管理推理服务

不同模型部署的注意事项
大小模型的效果对比
在我的厨房里,有一张桌子,上面放着一个杯子,杯子里有一个球。我把杯子移到了卧室的床上,并将杯子倒过来。然后,我再次拿起杯子,移到了主房间。现在,球在哪里?
|
对比范围
|
DeepSeek-R1-Distill-Qwen-1.5B
|
DeepSeek-R1
|
|
截图示例
|
![]()
|
![]()
|


企业QQ咨询




