跳到主要内容

模型选择

CubePlex 允许你选择为每条消息提供支持的 AI 模型。不同模型各有优势——成本、速度、推理深度、视觉支持等。在发送消息前,可从输入栏选择模型。

预设

模型通过 预设 提供给工作区成员。预设是由组织管理员创建的命名配置,它将易读标签(例如“Claude Sonnet”“GPT-4o”)映射到特定提供商上的特定模型。

每个工作区都有一个 默认预设,开始新对话时会自动选中它。你可以随时切换到其他可用预设。

如何切换预设

  1. 查看输入栏中、文本区域上方的位置。预设选择器 下拉菜单会显示当前选中的预设。
  2. 点击下拉菜单并选择其他预设。
  3. 你的下一条消息(以及此对话中的后续所有消息)都会使用新预设,直到你再次切换。

预设选择会 在每个工作区中保持——如果你切换到“Claude Opus”,它也会在该工作区中的下一次对话中保持选中,直到你修改它。每个工作区都会在浏览器中独立记住其选择,因此切换工作区不会继承该选择。

默认徽章

工作区默认预设会在下拉菜单中显示一个小型“默认”徽章。这是新成员和新的浏览器会话开始时使用的模型。

思考(扩展推理)

部分模型支持 扩展思考——一种在生成最终答案前让智能体逐步推理的模式。CubePlex 将其作为预设选择器旁独立的 投入程度 控件(“更快 → 更智能”滑块)提供。

思考级别

级别行为
关闭不使用扩展思考。智能体直接回复。
简短的内部推理。速度快,成本低。
中等推理深度。适合作为大多数任务的默认设置。
深度推理。更适合复杂的分析或编码任务。
最大最大推理投入。适用于最困难的问题。

较高的思考级别会消耗更多 token 且耗时更长,但能为复杂问题提供更深入的分析。对于简单问题(“法国的首都是哪里?”),思考只会增加成本而没有收益。

与预设一样,思考级别也会在消息之间保持。CubePlex 将其存储为标准推理设置(modeeffortsummary),并映射到各个提供商的 API。当启用较高的级别时,控件旁会显示一个 思考徽章,以免你在常规问题中不小心一直使用高等级。

查看思考输出

启用思考后,智能体的回复会在主答案上方包含一个可折叠的 思考 块。展开它可查看推理链。这有助于:

  • 了解智能体如何处理问题。
  • 发现复杂推理中的逻辑错误。
  • 从智能体的分析过程中学习。

模型故障切换

如果所选模型暂时不可用(提供商故障、速率限制、网络问题),CubePlex 可以自动切换到同一预设回退链中的备用模型。发生切换时,聊天中会显示一个小横幅,说明切换前后的模型:

已从 <provider>/<model> 切换到 <fallback-provider>/<fallback-model>

点击横幅可将其展开并查看故障切换原因。对话会在备用模型上继续,直到下一条消息;届时 CubePlex 会再次尝试主模型。

如果整个回退链均已耗尽(预设中的所有模型都不可用),横幅会显示 <provider>/<model> 的故障切换已耗尽”,并停止运行。请稍后重试,或切换到其他预设。

应选择哪个模型

没有唯一最佳的模型。以下是实用建议:

任务类型推荐方法
快速提问、总结、格式化使用快速、性价比高的模型(例如 Haiku、GPT-4o-mini)。关闭思考。
编码、调试、代码审查使用能力较强的模型,并将思考设为中或高。
复杂分析、多步骤推理使用顶级模型,并将思考设为高或最大。
图片理解、截图分析使用支持 视觉 的模型。请向管理员确认哪些预设支持视觉。
长文档、大型上下文使用拥有较大上下文窗口的模型。

组织管理员控制的内容

可用预设的集合由组织管理员决定。如果你需要访问未列出的模型:

  • 请管理员在 管理 > 模型 中添加提供商和模型。
  • 请管理员创建包含该模型的预设。

有关提供商和预设的配置方式,请参阅模型管理管理员指南。

提示

  • 让模型匹配任务。 不要每条消息都使用最昂贵的模型。简单的后续问题切换到快速模型,将强大的模型留给复杂任务。
  • 简单交流时关闭思考。 扩展推理会增加延迟和成本。仅在任务确实能从逐步分析中获益时使用它。
  • 留意思考徽章。 如果你此前将思考设为高等级后忘记关闭,徽章会提醒你。当不再需要深度推理时,点击控件将其调低。
  • 针对同一任务尝试不同模型。 如果你对某个回复不满意,请切换预设后重新提问。不同模型各有优势,同一个问题可能从其他模型获得更好的答案。