dshbase

插件目录 / AI Models / dsh-llm-qianfan

dsh-llm-qianfan

已验证 · 实测可装 hyt-ao

✓ 持续维护 2 位贡献者 基于 9 个官方 DSH 包 纯 TypeScript

查看 GitHub ↗ ← 返回插件目录

0Stars
0Forks
0未关闭 issue
TypeScript语言
2026-08-20最近推送
跨平台平台

功能简介

百度千帆大模型适配器:对接 Chat Completions,支持流式输出、工具调用与思考模式。

我们的评价
可用 — 实测通过,早期项目

百度千帆大模型适配器:对接 Chat Completions,支持流式输出、工具调用与思考模式。 实测能干净安装、正常启动。早期项目,但功能可用。

「已验证」表示我们的自动化 CI 在干净 profile 里实际执行了 dsh plugin add 并启动成功——仅此而已。功能描述与版本兼容性均为作者声明。这不是安全审计,也不代表对第三方代码的背书。

⚠ 需要外部账号 / 服务 — 该插件未通过完整验证,因为它需要我们的沙箱无法提供的东西: Baidu Qianfan API key (env or .env.qianfan)。它在你自己的环境里可能工作正常。

你是作者?可以提供所需账号 / 服务,或提交一份自测报告 (环境 + 安装步骤 + 运行结果),我们审核后点亮徽章。 提交证据或自测报告 ↗

README

dsh-llm-qianfan

百度千帆(Baidu Qianfan)大模型适配器插件,用于 https://github.com/deepseek-ai/deepseek-harness(DSH)的 LLM 接口层。

功能

- 将 DSH 的统一 LLM 接口对接到百度千帆的 Chat Completions API - 支持流式输出(SSE streaming) - 支持工具调用(function calling / tool use) - 支持思考模式(thinking / reasoning models,如 ERNIE-4.5) - 内置速率限制器(token bucket + header-based back-pressure) - 支持通过环境变量或 .env.qianfan 文件配置 API Key 和模型列表

安装

方式一:从 GitHub 安装(推荐,零编译)

``bash dsh plugin add github:hyt-ao/dsh-llm-qianfan ` > 仓库已包含预构建的 lib/ 目录,克隆后无需编译,无需配置 allowBuilds

方式二:克隆后本地安装

`bash git clone https://github.com/hyt-ao/dsh-llm-qianfan.git dsh plugin add ./dsh-llm-qianfan `

配置

1. 设置 API Key

在 DSH 的
llm-qianfan: 设置区块中填入你的千帆 API Key,或通过环境变量提供: `bash export QIANFAN_API_KEY="your-api-key-here" ` 也可以在项目根目录创建 .env.qianfan 文件: ` QIANFAN_API_KEY=your-api-key-here `

2. 自定义模型列表(可选)

默认支持以下模型。如需添加或修改,设置环境变量:
`bash export QIANFAN_MODELS='[{"id":"ernie-4.5-turbo-128k","thinking":true},{"id":"deepseek-v3"}]' ` 每个模型对象的字段: - id(必填):千帆平台上的模型标识 - thinking(可选,布尔值):是否为思考模式模型

3. 速率限制(可选)

通过环境变量配置速率限制器: | 环境变量 | 说明 | 默认值 | |---------|------|--------| |
QIANFAN_RATE_LIMIT_TPM | 每分钟 token 上限 | 不限制 | | QIANFAN_RATE_LIMIT_RPM | 每分钟请求上限 | 不限制 | | QIANFAN_RATE_LIMIT_CONCURRENCY | 最大并发请求数 | 不限制 | | QIANFAN_RATE_LIMIT_IDLE_TIMEOUT_MS | 空闲超时(毫秒) | 300000 |

注:最好做限制,不然容易超出限制导致中断

个人配置如下:

`

Tokens-per-minute quota (0 or unset → disabled)

QIANFAN_RATE_LIMIT_TPM=300000

Requests-per-minute quota (0 or unset → disabled)

QIANFAN_RATE_LIMIT_RPM=100

Safety margin 0–1. Effective limit = quota × (1 − margin). Default 0.15

QIANFAN_RATE_LIMIT_SAFETY_MARGIN=0.15

Minimum interval between consecutive requests (ms). Default 200

QIANFAN_RATE_LIMIT_MIN_INTERVAL_MS=200
`

从源码构建

如需自行修改并重新构建:
`bash pnpm install pnpm build ` 构建产物输出到 lib/` 目录。

技术参数

| 参数 | 默认值 | |------|--------| | 上下文窗口 | 128,000 tokens | | 最大输出 tokens | 8,192 | | 流式空闲超时 | 300,000 ms (5 分钟) |

许可证

MIT

安装

🧩 让 Agent 自动装(推荐)

装一次目录插件,之后本站所有插件都能让 DeepSeek Harness 自动找、自动装:

dsh plugin add dshbase-catalog

然后对 agent 说「帮我装 dsh-llm-qianfan」,它会在目录里找到并自动安装。文档:dshbase-catalog · 已验证场景包

该插件是 GitHub 源码(未发 npm)——直接从仓库装:

Web profile:

dsh plugin --profile web add github:hyt-ao/dsh-llm-qianfan

Headless(CLI)profile:

dsh plugin --profile headless add github:hyt-ao/dsh-llm-qianfan

实测报告

验证通过:从 GitHub 源码完成 L1 安装 + L2 加载 + L3 运行(dsh 0.1.0-rc.6)。

安全:尚未扫描——我们的每日静态扫描将很快覆盖它。

分享徽章

AI Models 里更多

浏览全部 7795 个插件 →