S4 · 多模态岛

S4 多模态岛

看见 PPT、转写、OCR、生图、短视频等文字之外的能力。

这一岛帮助 HR 把 AI 用到课件、会议记录、图片识别和传播物料,不再只停留在打字。

ISLAND PATH

岛内学习路径

跟着路径一步步学,把工具真正用进 HR 工作。
学习指南
01
01
主干(必看)

开篇:AI 远不止会打字

建立动机、打开思路。

8 分钟 · 主干(必看)
未开始
02
02
主干

让 AI 帮你做 PPT

培训课件、述职汇报、入职材料更快成型。

10 分钟 · 主干
未开始开始任务
03
03
主干

会议与语音转文字

面试记录、访谈、培训纪要更省力。

5 分钟 · 主干
未开始开始任务
04
04
主干

把图片变成可用信息(识图 / OCR)

纸质登记表、名片、截图可快速转录。

12 分钟 · 主干
未开始
05
05
主干(进阶)

让 AI 生成图片

招聘海报、培训插图、活动物料可快速起稿。

5 分钟 · 主干(进阶)
未开始开始任务

COURSE NODES

本岛学习节点

点开节点直接进入图文课;未上线内容只显示素材状态,不再和正文分成两套入口。
4 节已上线
S4-18 分钟 · 主干(必看)

开篇:AI 远不止会打字

用各模态成品快闪打开想象。

多模态概览
建立动机、打开思路。
S4-2
10 分钟 · 主干让 AI 帮你做 PPT

了解 Gamma、AiPPT、islide 等工具。

PPT课件
让 AI 帮你做 PPT

做 PPT 是 HR 的高频体力活——培训课件、述职汇报、入职材料,光排版就能耗掉半天。这一节告诉你一条省力的路子:先让 AI(如 Kimi)把你的内容理成一份大纲,再丢进 Gamma 这类工具,自动生成一整套配好版式的幻灯片。看视频时重点看这个"两步走"的衔接:内容和排版是分开的两件事,AI 各管一段。视频里说"完全不懂某个行业也能出一份漂亮 PPT",你要盯的正是它怎么从一段文字变出成型的一套页面。

核心要点

AI 做 PPT 通常分两步:先生成结构化大纲(讲什么、分几页),再由生成工具套版式出图。

看完你应该能回答:为什么"先把大纲改满意再生成幻灯片"比"直接让它出 PPT 再逐页改"省事?

AI 出的是一版排版整齐的初稿,内容准确性、公司信息、数据仍要你自己核和填。

想要风格统一,就在生成前把主题、配色、受众告诉它,别等出完再一页页返工。

生成后一般还能导出成 PPT/PDF 继续在本地微调,不是只能在线用。

现在就试试

  1. 挑一个你近期真要做的 PPT——比如给新人做的入职培训课件。先用 AI 把内容理成大纲:告诉它主题、听众是谁、时长多久、想讲哪几块,让它列出每页标题和要点。你把大纲改到满意后,再丢进 Gamma 生成整套幻灯片,选一个顺眼的模板。最后花十分钟填上公司真实信息、换掉占位内容。一个原本要磨一下午的课件,这样一小时内就能有个像样的初版。
S4-3
5 分钟 · 主干会议与语音转文字

使用飞书妙记、通义听悟等工具。

会议转写
会议与语音转文字

HR 一天里有大把时间在开会、面试、做访谈,会后还要凭记忆和潦草笔记补纪要,又慢又容易漏。这一节讲的工具能把一段录音自动转成文字,再顺手总结成一份会议纪要。看视频时重点看两层能力:一是"转写"——把说的话变成文字;二是"总结"——把一大篇逐字稿浓缩成要点和待办。对着面试记录、员工访谈、培训回顾这些场景,这一步能帮你省下整段整理的时间。

核心要点

语音转文字工具做的是两件事:先把音频转成逐字文稿,再(可选)把文稿总结成纪要和待办。

看完你应该能回答:拿到逐字稿后,让 AI"提取待办和决议"和"总结要点"分别适合什么场景?

转写准确率受口音、专业术语、多人抢话影响,人名和关键数字务必回听核对。

涉及员工隐私或敏感谈话的录音,上传前要确认工具的隐私政策,遵守公司规定和 S1-7 安全红线。

录音时离说话人近、环境安静,转写质量会明显更高。

现在就试试

  1. 下次开一个非敏感的例会或做一次培训回顾,用手机或工具录一段音(提前告知在场同事),会后传进飞书妙记或通义听悟这类工具转成文字。拿到逐字稿后,让 AI 帮你做三件事:总结三条核心结论、列出谁负责的待办事项、标出需要跟进的时间点。对照你自己的记忆核一遍人名和日期,一份纪要十分钟就能发出去,而不是拖到第二天。
S4-412 分钟 · 主干

把图片变成可用信息(识图 / OCR)

把图片转成文字、表格和可处理信息。

OCR识图
纸质登记表、名片、截图可快速转录。
S4-5
5 分钟 · 主干(进阶)让 AI 生成图片

了解即梦、文心一格、Midjourney 等出图工具。

生图物料
让 AI 生成图片

招聘海报、培训插图、节日活动物料——这些以前要么求设计师、要么自己在模板里硬套。这一节告诉你 AI 也能按你的描述直接出图。视频演示的是一条顺手的组合:先用 DeepSeek 把你想要的画面写成一段清楚的作图提示词,再丢给即梦这类工具出图,5 分钟出一版海报。看的时候重点盯"提示词怎么写"——画面里要有什么、什么风格、什么色调、留不留放字的位置,描述得越具体,出图越接近你想要的。

核心要点

AI 生图的效果高度取决于提示词:主体、场景、风格、色调、构图说得越具体,越接近预期。

看完你应该能回答:为什么"先让 AI 帮你把想法写成作图提示词"往往比自己硬憋一句描述出图更好?

AI 出的是起稿而非成品——它擅长给你一个方向和底图,精修排版、加准确文字仍要人来。

AI 目前对"图里写中文字"常出错,海报上的标题文字建议留白后用设计工具另加。

多生成几版挑一版,比死磕一版反复改更快找到满意的。

现在就试试

  1. 挑一个你近期要出的物料,比如一张内推招聘海报。先让 AI(如 DeepSeek)帮你把需求写成作图提示词:告诉它用途、想要的氛围(专业、活力、温暖)、主色调、画面里要有什么元素、顶部留出放标题的空间。把提示词丢进即梦生成几版,选一版顺眼的下载。最后用你熟悉的工具(甚至 PPT)在留白处加上招聘岗位和联系方式。一张原本要等设计排期的海报,一顿饭工夫就能自己搞定初版。
S4-6
15 分钟 · 主干(进阶)AI 数字人与短视频

了解剪映、HeyGen、可灵等视频工具。

短视频数字人
AI 数字人与短视频

想做个培训小视频或招聘宣传片,一想到要出镜、要拍摄、要剪辑就放弃了。这一节告诉你一条低门槛的路:用剪映的数字人功能,不出镜、不拍摄,把一段写好的文稿直接生成一个虚拟人物口播的视频。看视频时重点看整个流程有多简单——选形象、粘文稿、生成,核心其实是你那段"文稿"写得好不好。对培训视频、内部宣讲、招聘介绍这些场景,这一步能让你几乎零成本地启动。

核心要点

数字人视频的本质是"文稿 + 虚拟形象 + 合成语音",你写的口播稿质量直接决定成片好不好。

看完你应该能回答:为什么做数字人视频前,先把口播稿逐句念一遍顺不顺很重要?(机器照读,拗口的地方它不会帮你改)

数字人适合信息传达型内容(政策讲解、流程介绍),不太适合需要真情实感的场合。

免费工具在形象、时长、水印上通常有限制,正式对外用前先确认清楚。

口播稿要写成"说的话"而不是"写的字",短句、口语化,念起来才自然。

现在就试试

  1. 挑一件你反复要对新人讲的事,比如"入职第一周要办哪些手续"。先把它写成一段两三分钟、像当面说话一样的口播稿(短句、分点、口语化)。打开剪映找到数字人功能,选一个形象,把稿子粘进去生成视频。生成后自己看一遍,重点听有没有读错的词、停顿是否自然,再决定要不要改稿重生成。做成一条,以后新人入职直接发视频,省得你一遍遍口头重复。

SELECTED RESOURCES

扩展学习资源

课程视频只是补充材料,这里只放人工筛选过的内容。B站资源支持站内预览。
下一步:主干(必看)开篇:AI 远不止会打字
继续小练习进入 S5 智能体岛