模型选择
CubePlex 允许你选择为每条消息提供支持的 AI 模型。不同模型各有优势——成本、速度、推理深度、视觉支持等。在发送消息前,可从输入栏选择模型。
预设
模型通过 预设 提供给工作区成员。预设是由组织管理员创建的命名配置,它将易读标签(例如“Claude Sonnet”“GPT-4o”)映射到特定提供商上的特定模型。
每个工作区都有一个 默认预设,开始新对话时会自动选中它。你可以随时切换到其他可用预设。
如何切换预设
- 查看输入栏中、文本区域上方的位置。预设选择器 下拉菜单会显示当前选中的预设。
- 点击下拉菜单并选择其他预设。
- 你的下一条消息(以及此对话中的后续所有消息)都会使用新预设,直到你再次切换。
预设选择会 在每个工作区中保持——如果你切换到“Claude Opus”,它也会在该工作区中的下一次对话中保持选中,直到你修改它。每个工作区都会在浏览器中独立记住其选择,因此切换工作区不会继承该选择。
默认徽章
工作区默认预设会在下拉菜单中显示一个小型“默认”徽章。这是新成员和新的浏览器会话开始时使用的模型。
思考(扩展推理)
部分模型支持 扩展思考——一种在生成最终答案前让智能体逐步推理的模式。CubePlex 将其作为预设选择器旁独立的 投入程度 控件(“更快 → 更智能”滑块)提供。
思考级别
| 级别 | 行为 |
|---|---|
| 关闭 | 不使用扩展思考。智能体直接回复。 |
| 低 | 简短的内部推理。速度快,成本低。 |
| 中 | 中等推理深度。适合作为大多数任务的默认设置。 |
| 高 | 深度推理。更适合复杂的分析或编码任务。 |
| 最大 | 最大推理投入。适用于最困难的问题。 |
较高的思考级别会消耗更多 token 且耗时更长,但能为复杂问题提供更深入的分析。对于简单问题(“法国的首都是哪里?”),思考只会增加成本而没有收益。
与预设一样,思考级别也会在消息之间保持。CubePlex 将其存储为标准推理设置(mode、effort 和 summary),并映射到各个提供商的 API。当启用较高的级别时,控件旁会显示一个 思考徽章,以免你在常规问题中不小心一直使用高等级。
查看思考输出
启用思考后,智能体的回复会在主答案上方包含一个可折叠的 思考 块。展开它可查看推理链。这有助于:
- 了解智能体如何处理问题。
- 发现复杂推理中的逻辑错误。
- 从智能体的分析过程中学习。
模型故障切换
如果所选模型暂时不可用(提供商故障、速率限制、网络问题),CubePlex 可以自动切换到同一预设回退链中的备用模型。发生切换时,聊天中会显示一个小横幅,说明切换前后的模型:
已从
<provider>/<model>切换到<fallback-provider>/<fallback-model>
点击横幅可将其展开并查看故障切换原因。对话会在备用模型上继续,直到下一条消息;届时 CubePlex 会再次尝试主模型。
如果整个回退链均已耗尽(预设中的所有模型都不可用),横幅会显示 “<provider>/<model> 的故障切换已耗尽”,并停止运行。请稍后重试,或切换到其他预设。
应选择哪个模型
没有唯一最佳的模型。以下是实用建议:
| 任务类型 | 推荐方法 |
|---|---|
| 快速提问、总结、格式化 | 使用快速、性价比高的模型(例如 Haiku、GPT-4o-mini)。关闭思考。 |
| 编码、调试、代码审查 | 使用能力较强的模型,并将思考设为中或高。 |
| 复杂分析、多步骤推理 | 使用顶级模型,并将思考设为高或最大。 |
| 图片理解、截图分析 | 使用支持 视觉 的模型。请向管理员确认哪些预设支持视觉。 |
| 长文档、大型上下文 | 使用拥有较大上下文窗口的模型。 |
组织管理员控制的内容
可用预设的集合由组织管理员决定。如果你需要访问未列出的模型:
- 请管理员在 管理 > 模型 中添加提供商和模型。
- 请管理员创建包含该模型的预设。
有关提供商和预设的配置方式,请参阅模型管理管理员指南。
提示
- 让模型匹配任务。 不要每条消息都使用最昂贵的模型。简单的后续问题切换到快速模型,将强大的模型留给复杂任务。
- 简单交流时关闭思考。 扩展推理会增加延迟和成本。仅在任务确实能从逐步分析中获益时使用它。
- 留意思考徽章。 如果你此前将思考设为高等级后忘记关闭,徽章会提醒你。当不再需要深度推理时,点击控件将其调低。
- 针对同一任务尝试不同模型。 如果你对某个回复不满意,请切换预设后重新提问。不同模型各有优势,同一个问题可能从其他模型获得更好的答案。