AI Slides 功能边界
本文档用于说明 AI-Slides 在业务使用中的能力边界、系统限制和已知风险,帮助业务团队建立合理预期。
一、关键执行上限
| 限制项 | 默认值 | 业务影响 |
|---|---|---|
| 背景调研最大步数 | 30 步 | 超过后会停止继续调研,基于已有信息继续生成,可能导致信息不完整 |
| 背景调研超时 | 15 分钟 | 超时后不会继续等,会直接用已收集内容继续出大纲 |
| 单次搜索返回条数 | 5 条 | 搜索覆盖面有限,长尾信息可能未被纳入 |
| 大纲最大页数 | 30 页 | 超过 30 页的请求会被截断 |
| 图片生成并发 | 3 | 大量图片场景下会排队,整体完成时间拉长 |
| 上传图片大小 | 10 MB/张 | 超限文件无法上传 |
| 支持图片格式 | jpeg/png/webp/gif | 其他格式无法上传 |
| 单次模型请求超时 | 120 秒 | 超时会重试,仍失败则报错 |
| 模型请求重试次数 | 2 次 | 连续失败后任务会中断或部分失败 |
| 网关单请求时长 | 600 秒 | 超长请求可能被网关终止 |
二、两类任务模式的业务差异
1) 对话式大纲生成
- 适合“边聊边改”的场景
- 支持中断、确认、修改、重新生成
- 会话状态可延续,适合多轮打磨
- 路由由模型自主决策:可能直接出大纲,也可能先做背景调研
2) 批量生成幻灯片
- 适合“一次性批量出稿”场景
- 后台异步执行,前端断开连接后任务通常继续
- 支持重连后继续查看进度
- 支持仅重试失败页,不必整套重跑
注意
- 对话式模式更灵活但路径不完全可控
- 批量模式更稳定,但仍可能出现“部分页失败”
三、中断与人工确认边界
系统在关键节点会要求人工确认,常见场景:
- 大纲生成后确认(确认/修改/重生成)
- 模板选择确认
- 重新生成但未给明确方向时,系统会给建议供选择
需要注意:AI-Slides 不是"全自动一键到底",关键步骤需要人工参与。如果多次选择"重生成"但不给明确方向,可能进入反复等待。
四、图片生成边界
- 单任务图片并发上限为 3
- 图片生成失败默认不自动重试
- 图片失败不阻塞正文生成,正文仍可先完成
因此最终结果可能出现"文案已完成但个别图片缺失"的情况,需要手动补图或单页重试。
五、权限与数据隔 离边界
权限边界
- 模板管理(创建/修改/删除)属于超管权限
- 普通用户无法操作超管接口
数据隔离边界
- 用户默认只能访问自己的数据
- 用户身份以系统鉴权结果为准,不接受前端自行指定
这意味着跨账号查看或操作数据会被拦截,权限不足时会直接失败,不会"降级放行"。
六、外部工具与依赖边界
背景调研依赖外部工具(搜索、知识库、MCP 等):
- 某个工具不可用时,系统可能跳过该工具继续执行
- 调研超时或中断时,会用“已获得的部分信息”继续产出
在这种情况下,任务不一定失败,但输出完整度和深度可能下降,同一问题在不同时间结果也可能有波动。
七、多语言边界
- 系统支持中/英/日/韩界面与错误消息
- AI 生成内容语言主要由任务设置与提示词决定
需要注意界面语言可切换,但这不代表 AI 内容一定严格同语种。输出语言异常通常需调整提示词或任务参数。
八、模型与结果稳定性边界
1) 大页数/复杂模板风险
- AI-Slides 在“单次生成整套内容”时,对模型上下文和输出能力要求较高
- 页数越多、模板越复杂,越容易出现截断或部分页失败
2) 路径不确定性
- 调研与生成路径由模型动态决策
- 同样输入可能出现不同组织结构和表达方式
3) 部分结果机制
- 调研超时、图片失败、个别页生成失败时,系统可能先返回部分可用结果
业务建议
- 重要场景优先分批生成(例如按章节分次)
- 对关键页保留人工复核与补充时间
九、已验证模型范围
当前已做功能验证的模型包括:
- OpenAI:GPT-4.1、GPT-5.2、GPT-5.4
- Anthropic/AWS:Claude(Bedrock)
- Google:Gemini 2.5、Gemini 3
- Qwen:qwen3.6-plus-no-think、qwen3.6-flash、qwen3.6-max-preview