OpenVINO Model Server:API Key 怎么拿、怎么接进手机写小说

没有 N 卡的 Intel 路线:CPU、核显、Arc 独显直接跑 int4 量化模型,配 Hugging Face 上的 OpenVINO 预转换模型库开箱即用——一台办公本也能搭起私有续写后端。 本页是 OpenVINO Model Server 的 BYOK 接入直答:取 Key 分步、控制台与定价页直链、接进 Foreverse 的注意事项。核实于 2026-07-18。

两个入口先放这:取 Key 去 官方下载页(本地运行,没有定价页——账单为零)。价格与免费额度随时会调,以官方页面实时为准。

在 Foreverse 里能用它做什么?

预置模板给 OpenVINO Model Server 声明了 1 个模态位。实际可用模型以 App 内拉取的该家模型目录为准——各家上新很快,模板标记只代表接入协议已就绪。

模态在 App 里对应
文本续写 · 角色聊天 · Agent

OpenVINO Model Server 怎么装、怎么让手机连上?

  1. 在 Intel 机器上装 Docker(纯 CPU 可跑;用核显/Arc 独显加速则容器要挂 --device /dev/dri 并用 latest-gpu 镜像)。
  2. 一条命令起服务并自动下载预转换模型:docker run -d -p 8000:8000 -v $(pwd)/models:/models openvino/model_server:latest --source_model OpenVINO/Qwen3-8B-int4-ov --model_repository_path /models --task text_generation --rest_port 8000。
  3. 模型直接用 Hugging Face 上 OpenVINO 组织的预转换 int4 权重(如 OpenVINO/Qwen3-8B-int4-ov),不用自己转格式。
  4. 防火墙放行 8000;手机与电脑同一 Wi-Fi,把 App 里的地址改成 http://<电脑IP>:8000/v3。

拿到 Key 之后:接进 Foreverse 三步

  1. 打开 App 的设置 → AI 模型与服务,列表里找到 OpenVINO Model Server(62 家预置之一,带 logo 可搜索)。
  2. 粘贴 Key,点「测连通」——发一次真实请求验证密钥与网络,顺手拉回这家的模型列表。
  3. 启用要用的模型,在「默认模型」里按模态分别指定(文本/生图/朗读/视频各设各的);之后续写、聊天、听书就都走这家了。

改 API 地址时的通用坑:地址必须带完整版本前缀(这家该是什么样,下面注意事项里写了),App 不会替你补 /v1。

OpenVINO Model Server 专属注意

App 预置 http://localhost:8000/v3——注意版本前缀是 /v3 不是 /v1(OVMS 把 OpenAI 兼容端点挂在 /v3 下)。真机把 localhost 换成部署机内网/Tailscale IP 时要写全 /v3:只填 ip:端口的话 App 会按通用规则补 /v1,路径就错了。无鉴权,Key 填占位即可;模型 ID 必须与服务端加载名一致(如 OpenVINO/Qwen3-8B-int4-ov)。

常见问题

OpenVINO Model Server 有免费额度吗?

开源软件(Apache-2.0),全程没有 API 账单;成本是自己机器的算力与电费。

填进 App 的 Key 存在哪里?

系统级加密后只存在你的手机本机,不上传、不同步到 Foreverse 任何服务器;请求从手机直连供应商官方端点,我们不经手也不加价。想撤销就去供应商控制台吊销那把 Key。

OpenVINO Model Server API Key 怎么拿?取 Key 到手机接入全流程(BYOK) · Foreverse · 新梦