搜索

生成式 AI (AIGC、GenAI) 教学

基本介绍

关于生成式 AI 关于 AI 绘图 AI 绘图的提示技巧 AI 绘图软件比较 ( 2023 ) AI 绘图软件推荐 ( 2024 ) 2025 生成式 AI 工具推荐

Vibe Coding 专区

Vibe Coding 教学导读 认识 Vibe Coding Vibe Coding 新手入门 Vibe Coding 规划架构流程 Vibe Coding 网页知识 Vibe Coding Python 知识 Vibe Coding 下载网页程序码 Vibe Coding Google App Script 部署网页 Vibe Coding Github 部署网页 Vibe Coding 使用外部图片 Vibe Coding 使用 SVG 图示 Vibe Coding 使用外部字体 Vibe Coding 固定网页样式 Vibe Coding + Spreadsheet 数据库 Vibe Coding + Firebase 即时数据库 Vibe Coding + Firestore 数据库 Vibe Coding 数据库安全防护 Vibe Coding 串接账号验证机制 Vibe Coding 串接 Google 云端硬盘 Vibe Coding 串接 Gemini API Vibe Coding 打造 LINE Bot Vibe Coding 实战:线上订餐系统 Vibe Coding 实战:文件上传系统 Vibe Coding 实战:线上点名单 Vibe Coding 实战:英文单字卡

AI 实用技巧

AI 语音转 srt 字幕

2025 AI 影音工具

ChatGPT - 图片提示词技巧 ChatGPT - 客制化机器人 ChatGPT - 使用画布功能 Gemini - 开始使用 Gemini - 客制化机器人 Gemini - 串接 Google 服务 Gemini - 使用画布功能 NotebookLM - 开始使用 NotebookLM - 建构知识库 Google AI Studio - 界面功能 Nano Banana - 图像生成与编辑 Gemini Educator 线上认证 图片 - AI 图片快速去背 图片 - AI 黑白照片上色 声音 - AI 影词组音转字幕 影片 - Pika 生成创意影片 影片 - KlingAI 生成影片 影片 - AI 影片趣味特效 影片 - AI 拥抱 ( AI Hug ) 影片 - AI 老照片动起来 图片 - Dreamina 生成图片 音乐 - SUNO 创作音乐 音乐 - 免费 AI 音乐素材

ChatGPT

认识 ChatGPT 开始使用 ChatGPT 优良的提示技巧 基本提示 实用组合提示 角色扮演&对话主题 阅读并模仿风格 对话中显示图片 创作长篇故事与小说 使用 Bing Chat 相关工具或服务

Poe ( Poe AI )

开始使用 Poe 聊天机器人 生成图片机器人 建立自己的机器人 Youtube 影片重点整理 PDF 重点整理 GPT-4o-mini 分析图片 读取网页进行重点整理 让 AI 美化提示词

Ideogram

开始使用 Ideogram 文字产生图片 图片 Retry 与 Remix

dzine

开始使用 dzine 提示词产生图片 图片产生图片 运用图层功能 运用文字和画笔 ( 范例 ) 室内设计透视图实体化 ( 范例 ) 名画转真人照片 ( 范例 ) 真人照片转卡通 ( 范例 ) 真人卡通贴图

Image Creator

开始使用 Image Creator 提示原则与技巧 搭配 Bing Copilot 产生图片 ( 范例 ) 产生分享文章缩图 ( 范例 ) 漫画书风格

Leonardo.Ai

Leonardo.Ai 教学导读 Leonardo.Ai vs Midjourney 认识 Leonardo.Ai 注册与登录 Leonardo.Ai 使用图片产生器 文字提示语法和准则 Elements 风格元素 使用图片产生图片 AI 图片编辑器 ( Canvas Editor ) 即时 AI 画布 ( Realtime Canvas ) 即时图片产生器 ( Realtime Gen ) 图片升级器 ( Universal Upscaler ) 产生图片的后续步骤 Prompt Magic 魔法提示 PhotoReal&Alchemy 特色模型 训练自己的模型 ( 范例 ) 填补缺少的披萨 ( 范例 ) 组合两片披萨 ( 范例 ) 虚拟陈雷 ( 范例 ) 修改人物年龄 ( 范例 ) 换脸特效 ( 范例 ) 隐藏的人脸或文字 ( 范例 ) 全部填满皮卡丘 ( 范例 ) 名画转真人照片

Recraft

开始使用 Recraft 位图 Raster image 向量图 Vector image 图示 Icon 与 Logo 系列图像 Image Set 原型示意图 Mockup 画框 Frame、文字 Text 放大 Upscale、改色 Recolor 图片去背、替换图片背景 添加、修改、移除景物 图片产生图片 位图转向量图 自定义图片风格 合并不同图片 ( 范例 ) 名画转真人照片 ( 范例 ) 照片转卡通插画 ( 范例 ) 自制表情贴图 ( 范例 ) 多格漫画风格 ( 范例 ) 图片中加入文字 ( 范例 ) 延伸图片范围

Midjourney

Midjourney 教学导读 认识 Midjourney 使用 Midjourney 使用 niji.journey 设定指令 功能参数 使用文字提示产生图片 使用图片产生图片 优良的提示技巧 多重提示的权重与顺序 style tuner 样式调校 remix 放大、修改与重绘 blend 混合多张图片 删除图片&传送信息 ( 范例 ) 修改人物年龄 ( 范例 ) 阿尔钦博托风格 ( 范例 ) 照片转卡通人物 ( 范例 ) 变胖、变瘦

Vidnoz AI

开始使用 Vidnoz AI ( 影片 ) 照片讲话 ( 图片 ) 人物换脸 ( 图片 ) 图片去背

Canva AI 魔法功能

AI 魔法媒体工具 ( 文字产生图片和影片 ) AI 魔法工作室 ( 使用 AI 编辑照片 ) AI 魔法变形工具 ( 转换文字或形状 ) AI 魔法文案工具 ( Magic Write )

Clipdrop

开始使用 Clipdrop 修改图片选取区域 延展图片并生成内容 人物换脸 图片去背 移除特定对象 放大与增强图像 图像打光 替换天空

Playground AI

开始使用 Playground AI Board 文字产生图片 Canvas 绘制与修改图片 Remix 与 Edit 图片 延展和放大增强图片 图片去背、移除对象 搭配 Poe AI 产生图片

Replicate 模型

认识 Replicate ( 修图 ) 黑白照片上色 ( 修图 ) 修复老照片 ( 修图 ) 增强与放大照片 ( 修图 ) 更换发型和表情 ( 绘图 ) 似颜绘贴图 ( 绘图 ) 真人照片转公仔 ( 绘图 ) 隐藏的图案或文字 ( 提示 ) 图片转提示词 ( 提示 ) 改善提示词

AI 绘图效果&范例

着色本效果 2D 卡通人物 物品开箱照 像素艺术 百科全书风格 卡通贴纸

AI 绘图风格大全

风格大全 ( 总览 ) 风格大全 ( 摄影、照片 ) 风格大全 ( 画面角度效果 ) 风格大全 ( 媒材、材质 ) 风格大全 ( 卡通、漫画 ) 风格大全 ( 艺术流派风格 ) 风格大全 ( 艺术家、画家 ) 风格大全 ( 插画风格 1 ) 风格大全 ( 插画风格 2 ) 风格大全 ( 特色风格 )

声音 - AI 影词组音转字幕

随着线上影片需求的增加,出现了越来越多“AI 转字幕”的工具,但很可惜目前几乎所有的线上 AI 转字幕工具都是要付费的,最多也都只有几分钟的免费额度,因此这篇教学会介绍一些免费额度较多的线上转字幕工具,以及如何在本机环境安装线上转字幕工具。

快速导览:

AI 影片转字幕 ( 语音逐字稿、MP3 转字幕 )

cSubtitle

cSubtitlea 是一款可以“不用注册”,且能“免费”将语音转换文字至少 3 分钟的线上工具,只需要打开网站,上传语音音档或影片,就可以将语音音档或影片的语音,转换成纯文字 ( txt ) 或是字幕 ( srt )。

前往:cSubtitle 语音转字幕

AI 影片转字幕 ( 语音逐字稿、MP3 转字幕 ) - cSubtitle 语音转字幕

上传文件后,cSubtitlea 就会开始透过 AI 分析音档内容,完成后就可以下载字幕文件或纯文字文件。

AI 影片转字幕 ( 语音逐字稿、MP3 转字幕 ) - cSubtitle 语音转字幕

下方是转换后的字幕:

1
00:00:00,470 --> 00:00:02,770
測試語音轉文字

2
00:00:03,390 --> 00:00:07,290
不知道轉出來的效果準不準確

3
00:00:08,480 --> 00:00:13,900
五秒鐘不知道會不會太少十秒十一秒十二秒

4
00:00:15,080 --> 00:00:15,560
測試一下

5
00:00:16,160 --> 00:00:18,420
那就傳個二十秒

6
00:00:19,390 --> 00:00:19,910
完成

turboscribe

turboscribe 是一款可以“需要注册”,但可以“免费”将语音转换文字至少 30 分钟的线上工具,只需要打开网站并注册登录,就能上传语音音档或影片,将语音音档或影片的语音,转换成纯文字 ( txt ) 或是字幕 ( srt )。

前往:turboscribe 语音转字幕

AI 影片转字幕 ( 语音逐字稿、MP3 转字幕 ) - turboscribe 语音转字幕

上传文件后,可以选择语系、转录模式或一些进阶设定。

AI 影片转字幕 ( 语音逐字稿、MP3 转字幕 ) - turboscribe 语音转字幕

转换完成后,可以在网站上看见转换后的文字和时间戳记,从右侧也可以将其下载为 txt 或 srt 文件,不过下载时因为还要手动设定“每句的字词数量”,常导致字幕段落和预期不同,因此不建议使用它的下载功能,为了避免这种状况,可以先“手动复制”网站上转换后的文字。

AI 影片转字幕 ( 语音逐字稿、MP3 转字幕 ) - turboscribe 语音转字幕

接着使用任何一套 AI 工具 ( ChatGPT、Gemini、Poe AI 皆可 ),将刚刚复制的文字转换成字幕文件 ( ChatGPT 还会直接提供 .srt 文件下载 )。

幫我將下面這段字幕變成字幕檔 .srt
`
(0:00) 測試語音轉文字 (0:04) 不知道轉出來的效果準不準確 (0:08) 5秒鐘不知道會不會太少 (0:11) 10秒、11秒、12秒 (0:14) 測試一下 (0:16) 那就傳個20秒 (0:19) 完成
` 

下方是转换后的字幕:

1
00:00:00,000 --> 00:00:04,000
測試語音轉文字

2
00:00:04,000 --> 00:00:08,000
不知道轉出來的效果準不準確

3
00:00:08,000 --> 00:00:11,000
5秒鐘不知道會不會太少

4
00:00:11,000 --> 00:00:14,000
10秒、11秒、12秒

5
00:00:14,000 --> 00:00:16,000
測試一下

6
00:00:16,000 --> 00:00:19,000
那就傳個20秒

7
00:00:19,000 --> 00:00:19,800
完成

本机安装 OpenAI Whisper 转字幕工具

由于现在几乎所有线上语音转字幕工具都“要收费”,就算有提供免费额度往往也不太够,所以如果不排斥“本机环境”,也可以安装 OpenAI 所开发的 Whisper,在本机环境转换字幕,就可以完全不受额度限制。Whisper 是由 OpenAI 所开发的一个开源自动语音辨识模型,能够将语音转换成文字,支援多种语言辨识与翻译,具备高度准确性和灵活性,Whisper 提供下列几种模型:

模型名称 精确度 执行速度 备注
tiny 低 最快 使用 CPU
base 较低 块 使用 CPU
small 中等 中等 使用 CPU,推荐
medium 高 慢 建议使用 GPU
large 最高 最慢 GPU,支援最多语言

Mac 环境安装

在 Mac 环境下安装,需要先安装 Homebrew ( 如果尚未安装 ),打开“终端机 ( Terminal )”输入下方指令:

/bin/bash -c "$(curl -fsSL https://raw.githubusercontent.com/Homebrew/install/HEAD/install.sh)"

接着安装 ffmpeg ( 让 Whisper 可以处理声音音讯 )

brew install ffmpeg

在 Python 环境中安装 Whisper ( 参考:使用 Python 虚拟环境 )

pip install -U openai-whisper

安装后就能在 Python 开发环境中,在终端机输入下列指令转换,转换后会在同一个目录下,产生一个同样档名的 srt 文件。

whisper sample.mp3 --language Chinese --output_format srt --task transcribe --model small 

下方列出相关指令说明:

部分 功能
whisper 启动 Whisper 命令列工具 ( 需安装 openai-whisper )。
sample.mp3 欲转换的音讯文件 ( 支援 .mp3, .wav, .m4a, .mp4 等格式 )。
--language 指定语音的语言 ( 支援语言:English、Chinese、Japanese、French 等 )。
--task 任务类型,选项为 transcribe 和 translate ( 会翻译为英文 )。
--model 指定使用的模型。

下方是转换后的字幕文件:

1
00:00:00,000 --> 00:00:03,000
測試語音轉文字

2
00:00:03,000 --> 00:00:07,000
不知道轉出來的效果準不準確

3
00:00:08,000 --> 00:00:11,000
5秒鐘不知道會不會太少

4
00:00:11,000 --> 00:00:14,000
10秒、11秒、12秒

5
00:00:14,000 --> 00:00:16,000
測試一下

6
00:00:16,000 --> 00:00:19,000
那就轉個20秒

7
00:00:19,000 --> 00:00:21,000
完成

Windows 环境安装

在 Windows 中安装 Whisper 的步骤如下:

下方列出相关指令说明:

部分 功能
whisper 启动 Whisper 命令列工具 ( 需安装 openai-whisper )。
sample.mp3 欲转换的音讯文件 ( 支援 .mp3, .wav, .m4a, .mp4 等格式 )。
--language 指定语音的语言 ( 支援语言:English、Chinese、Japanese、French 等 )。
--task 任务类型,选项为 transcribe 和 translate ( 会翻译为英文 )。
--model 指定使用的模型。

下方是转换后的字幕文件:

1
00:00:00,000 --> 00:00:03,000
測試語音轉文字

2
00:00:03,000 --> 00:00:07,000
不知道轉出來的效果準不準確

3
00:00:08,000 --> 00:00:11,000
5秒鐘不知道會不會太少

4
00:00:11,000 --> 00:00:14,000
10秒、11秒、12秒

5
00:00:14,000 --> 00:00:16,000
測試一下

6
00:00:16,000 --> 00:00:19,000
那就轉個20秒

7
00:00:19,000 --> 00:00:21,000
完成

小结

对于制作影片而言,字幕往往是最难处理的,如果可以透过一些 AI 工具辅助转换字幕,就能省下非常多“上字幕”的时间,赶快运用这篇教学所介绍的方法,加速自己的创作时间吧。

意见反馈

微信二维码 微信扫码关注 抖音二维码 抖音扫码关注