跳到主要内容

AI Slides 功能边界

本文档用于说明 AI-Slides 在业务使用中的能力边界、系统限制和已知风险,帮助业务团队建立合理预期。


一、关键执行上限

限制项默认值业务影响
背景调研最大步数30 步超过后会停止继续调研,基于已有信息继续生成,可能导致信息不完整
背景调研超时15 分钟超时后不会继续等,会直接用已收集内容继续出大纲
单次搜索返回条数5 条搜索覆盖面有限,长尾信息可能未被纳入
大纲最大页数30 页超过 30 页的请求会被截断
图片生成并发3大量图片场景下会排队,整体完成时间拉长
上传图片大小10 MB/张超限文件无法上传
支持图片格式jpeg/png/webp/gif其他格式无法上传
单次模型请求超时120 秒超时会重试,仍失败则报错
模型请求重试次数2 次连续失败后任务会中断或部分失败
网关单请求时长600 秒超长请求可能被网关终止

二、两类任务模式的业务差异

1) 对话式大纲生成

  • 适合“边聊边改”的场景
  • 支持中断、确认、修改、重新生成
  • 会话状态可延续,适合多轮打磨
  • 路由由模型自主决策:可能直接出大纲,也可能先做背景调研

2) 批量生成幻灯片

  • 适合“一次性批量出稿”场景
  • 后台异步执行,前端断开连接后任务通常继续
  • 支持重连后继续查看进度
  • 支持仅重试失败页,不必整套重跑

注意

  • 对话式模式更灵活但路径不完全可控
  • 批量模式更稳定,但仍可能出现“部分页失败”

三、中断与人工确认边界

系统在关键节点会要求人工确认,常见场景:

  • 大纲生成后确认(确认/修改/重生成)
  • 模板选择确认
  • 重新生成但未给明确方向时,系统会给建议供选择

需要注意:AI-Slides 不是"全自动一键到底",关键步骤需要人工参与。如果多次选择"重生成"但不给明确方向,可能进入反复等待。


四、图片生成边界

  • 单任务图片并发上限为 3
  • 图片生成失败默认不自动重试
  • 图片失败不阻塞正文生成,正文仍可先完成

因此最终结果可能出现"文案已完成但个别图片缺失"的情况,需要手动补图或单页重试。


五、权限与数据隔离边界

权限边界

  • 模板管理(创建/修改/删除)属于超管权限
  • 普通用户无法操作超管接口

数据隔离边界

  • 用户默认只能访问自己的数据
  • 用户身份以系统鉴权结果为准,不接受前端自行指定

这意味着跨账号查看或操作数据会被拦截,权限不足时会直接失败,不会"降级放行"。


六、外部工具与依赖边界

背景调研依赖外部工具(搜索、知识库、MCP 等):

  • 某个工具不可用时,系统可能跳过该工具继续执行
  • 调研超时或中断时,会用“已获得的部分信息”继续产出

在这种情况下,任务不一定失败,但输出完整度和深度可能下降,同一问题在不同时间结果也可能有波动。


七、多语言边界

  • 系统支持中/英/日/韩界面与错误消息
  • AI 生成内容语言主要由任务设置与提示词决定

需要注意界面语言可切换,但这不代表 AI 内容一定严格同语种。输出语言异常通常需调整提示词或任务参数。


八、模型与结果稳定性边界

1) 大页数/复杂模板风险

  • AI-Slides 在“单次生成整套内容”时,对模型上下文和输出能力要求较高
  • 页数越多、模板越复杂,越容易出现截断或部分页失败

2) 路径不确定性

  • 调研与生成路径由模型动态决策
  • 同样输入可能出现不同组织结构和表达方式

3) 部分结果机制

  • 调研超时、图片失败、个别页生成失败时,系统可能先返回部分可用结果

业务建议

  • 重要场景优先分批生成(例如按章节分次)
  • 对关键页保留人工复核与补充时间

九、已验证模型范围

当前已做功能验证的模型包括:

  • OpenAI:GPT-4.1、GPT-5.2、GPT-5.4
  • Anthropic/AWS:Claude(Bedrock)
  • Google:Gemini 2.5、Gemini 3
  • Qwen:qwen3.6-plus-no-think、qwen3.6-flash、qwen3.6-max-preview