模型与提供商

概述

Neotask 支持广泛的 AI 模型提供商。您可以使用 Anthropic、OpenAI 和 Google 的云托管模型,通过 Ollama 或 vLLM 运行本地模型,或连接到任何 OpenAI 兼容的 API 端点。

支持的提供商

云提供商

提供商 模型 认证
Anthropic Claude Opus 4.6、Claude Sonnet 4.1、Claude Haiku 4.5 API key 或 setup-token
OpenAI GPT-5.2、GPT-5.1、GPT-4 Turbo、GPT-4 API key
Google (Gemini) Gemini 3 Pro、Gemini 2 Flash、Gemini 1 Pro API key 或 OAuth
Together AI 各种开放权重模型(Llama、Mixtral 等) API key
Moonshot (Kimi) Moonshot v1(32K、128K 上下文) API key
OpenRouter 来自多个提供商的 100+ 模型 API key
DeepSeek DeepSeek Chat、DeepSeek Coder API key
OpenCode Zen Claude 变体、自定义调优模型 API key

本地模型提供商

提供商 描述
Ollama 本地运行开放权重模型(Llama、Mistral 等)
vLLM 高吞吐量本地推理服务器
LiteLLM 100+ 提供商的统一代理

自定义提供商

通过指定基础 URL 和 API key 连接任何 OpenAI 兼容或 Anthropic 兼容的 API。适用于自托管推理服务器、企业代理端点和第三方模型 API。

模型配置

主模型

为所有代理设置默认模型。每个代理可以用自己的主模型覆盖此设置。

回退链

配置优先级回退模型列表。如果主模型失败(速率限制、停机、认证错误),Neotask 自动尝试链中的下一个模型。

图像模型

用于图像分析和生成的独立模型配置。支持 Claude Vision、GPT-4 Vision 和 DALL-E 3。

模型别名

为长模型名称创建快捷方式。例如,将 fast 别名为 anthropic/claude-haiku-4-5 以便快速引用。

按代理覆盖

每个代理可以拥有自己的模型配置,独立于全局默认值。

模型允许列表

限制代理可以使用的模型。适用于成本控制或合规。

API Key 管理

Key 来源(优先级顺序)

  1. 实时覆盖 key(最高优先级)
  2. 逗号分隔的 key 列表(轮换)
  3. 主 key
  4. 编号 key(key_1、key_2 等)

自动 Key 轮换

当遇到速率限制时,Neotask 自动轮换到下一个可用的 key。非速率限制失败会立即返回错误而不进行轮换。

按提供商配置

每个提供商可以拥有自己的 API key 集、认证配置和模型特定设置。

提供商认证方法

方法 描述
API Key 标准 bearer token 认证
Setup Token 交互式认证流程(Anthropic)
OAuth 带刷新 token 的委托认证(Google、GitHub Copilot)
Token Paste 用于专业提供商的手动 token 输入

模型选择优先级

当代理需要进行 LLM 调用时,模型按以下顺序选择:

  1. 按代理覆盖(如果设置)
  2. 全局默认模型
  3. 模型允许列表(如果配置,限制选项)
  4. 第一个可用模型(回退)

提供商特定工具限制

您可以限制特定模型或提供商可用的工具。例如,限制不太受信任的模型只能进行文件操作,同时给 Claude 完整的工具访问权限。