虎嗅

AI 能做一百件事,就做不了一个好看的PPT

该文章尚未提供 Русский 解读,以下为中文版内容。

核心内容总结

AI做PPT的工具虽然遍地开花(从硅谷的Gamma到国内的百度文库智能PPT,大厂和创业公司都在抢赛道),但实际用起来却处处踩坑:要么导出格式乱成一团,要么内容空洞像"白开水",要么模板太死板不让改,连ChatGPT、Claude这些通用AI也搞不定。本质上,做PPT需要AI同时搞定"内容理解""视觉审美""格式兼容"三件事,这三者形成了"不可能三角",目前还没有工具能完美突破,所以打工人还是得自己磨PPT。

1. 导出就翻车?AI做PPT的格式兼容难题

AI做PPT最直观的坑就是"网页上好看,导出就崩"。比如硅谷的Gamma工具,网页上生成的PPT排版精致、配色高级,但导出成PPTX文件后,字体错位、图层塌陷、图文重叠,瞬间从"高级感"变成"格式残骸"——测试显示每25次导出里,只有30%能保留原图层。

国内工具(比如百度文库智能PPT)导出稳定性好,但设计感又掉链子,排版审美停留在"能看就行"的水平。为啥?因为不同软件的格式标准不一样(比如Gamma想让你在它平台上演示,而打工人最终要在PowerPoint里打开),AI要兼容所有格式就像让一个人同时说十国语言,很难做到完美。

2. 内容像白开水?AI做PPT的"基因缺陷"

AI生成的PPT内容大多是"模板+GPT填字":你给个主题,它拉大纲、套模板,但内容全是空话。比如你要做"年度销售总结",AI会写"业绩增长显著""团队协作高效",但没有具体数据、案例,每一页都在用不同句式说同一件事,信息密度极低。

Reddit用户总结得扎心:"对流程有帮助的约30%,主动妨碍你的约40%"。少数工具(比如秘塔)靠文档库兜底,内容是从已有资料里提炼的,至少信息是实的,但设计又很平庸;GenPPT先搜资料再生成,但模板太少还不能当主力。大部分工具卡在中间:排版比秘塔好看,但内容比GenPPT还空,既不能当生产力工具,也不能当设计工具。

3. 模板要么太死要么太丑?AI的审美和灵活性难两全

有些工具想靠"智能模板"解决问题,结果变成了"PPT牢笼"。比如Beautiful.ai,你输入内容它自动调整布局,但你想把图片往左挪一点?不行,AI说它该在中间;想换个标题样式?模板里没有;想插个非标准布局?抱歉不存在。它的逻辑是"大多数人排版不如AI",但实际把"帮我做"变成了"替我做"——用户和AI较劲,而且AI的审美还很固定,全世界PPT都是莫兰迪或赛博朋克配色,看久了腻。

国内的WPS AI嵌在软件里很方便,但生成的PPT平平无奇,只能省时间,想"出彩"根本指望不上。不管是嵌入式(WPS AI)还是独立式(Gamma),都没跑通最后一公里。

4. 通用AI也失灵?PPT需求的特殊性难适配

ChatGPT、Claude这些通用AI也试过做PPT,但体验一言难尽。ChatGPT的PPT插件需要极其精细的prompt(比如你得写清楚每一页的标题、内容、配图要求),否则生成的东西没法用;Claude要先做HTML网站再转PDF,绕一大圈;Gemini擅长多模态但不擅长PPT,Kimi的版式太死板(偏爱"框框套娃"的dashboard风格),只适合咨询场景,教学类PPT就完全不适用。

为啥通用AI搞不定?因为PPT是"信息表达"的载体,需要结合内容逻辑、视觉呈现、格式兼容,而通用AI擅长单一任务(比如写文字、生成图片),但把这些任务串起来就拉胯——找图片素材本身就是做PPT的卡点,AI连这个都搞不定,更别说整体协调了。

5. AI做PPT为啥这么难?三大能力的"不可能三角"

做PPT看似简单,实则需要AI同时具备三个核心能力:

  • 模型能力:读懂内容逻辑(比如PDF里的标题层级、图表含义);
  • 工程功底:兼容各种格式(PowerPoint、PDF等);
  • 设计品位:做出符合用户审美的排版、配色。

这三者就像"鱼和熊掌和燕窝",很难同时兼得。比如Gamma设计好但格式差,百度文库格式稳但设计丑,秘塔内容实但设计平庸。只要有一个环节掉链子,结果就是"看着还行,但不敢拿给老板看"。

PPT是一亿白领的日常,是信息从"内部消化"到"对外表达"的必经通道,但目前所有工具都还在门外转悠——不是产品经理不努力,是这个需求本身就卡在AI能力的天花板上。

总结:AI做PPT的热闹背后,是打工人的无奈。想要AI真正替代人工做PPT,还得等AI同时突破内容理解、视觉审美和格式兼容这三道坎——但短期内,恐怕还是得自己动手磨细节。