图片生成(新)一个图像生成和编辑模型,支持文生图、图生图。
Kimi 阅读助手勾选要读的内容(附件、文本、链接都行),写一句指令,Kimi 读完直接给结果:总结、提要点、翻译、抽字段、回答问题都可以。
AI 图片生成(image-2.5)Image 2.5 文生图与改图
视频生成(Seedance 2.5)用 Seedance 2.0 模型把一张参考图片或视频生成动态视频,可选模型、比例、时长(4~15 秒)、音频。
语音转字幕把视频/音频中的语音识别转写为字幕文件(SRT/WebVTT),写入附件字段。
PDF 转 Word(特价版)每次 ¥0.01。把 PDF 转成可编辑的 Word 文档,保留原有版式与表格。适合合同、报告二次编辑。
文本理解(自选模型)把整列文本交给你指定的 AI 模型处理:总结、翻译、抽取、改写、分类、问答都可以,模型名到波波 API 复制粘贴即可,留空用默认。
图片理解(自选模型)把表格里的图片交给你指定的视觉模型:描述画面、提取图中文字、多图对比、提取商品卖点,一次最多识别 10 张。
抖音Tiktok作品数据获取播放点赞评论收藏数据采集
智能文档翻译(特价版)每次 ¥0.01。翻译文档中的全部文字并输出为 Word。中文原文译为英文,其余语种译为中文,保持段落结构。
视频加字幕把字幕文件(SRT/VTT/ASS)烧录到视频上,写入附件字段。
视频生成(MiniMax H3)用 MiniMax 最新一代视频模型 H3 生成视频:原生 2K 画质、自带声音、4~15 秒任意时长,支持首尾帧、参考图、参考音频等多模态素材。
企业信息查询(企查查)输入公司名查工商信息
AI 视频生成(海螺)用 MiniMax 海螺(Hailuo)系列视频生成模型根据提示词生成视频,支持文生视频和图生视频,可选 512P / 768P / 1080P 三档画质 + 6 秒 / 10 秒两档时长。
Kimi 招聘助手简历附件 + 岗位描述丢进去,一次产出 11 个字段:姓名、性别、年龄、手机号、邮箱、最高学历、教育经历、工作经历、匹配度、匹配度原因、面试建议。
通义千问 3.8用阿里通义千问(Qwen)系列模型完成文本总结、翻译、抽取、改写、问答,模型可手动填写或按行引用字段
视频生成(Seedance 1.5)用 Seedance 1.5 Pro 模型根据提示词生成视频,支持文生视频和图生视频。每次生成固定扣 450 积分。
视频理解PRO输入视频文件和提示词, 自动解析视频内容
智谱 GLM 阅读助手文档图片网页,一句话读懂
智谱 GLM 图片理解调用智谱 GLM 原生多模态模型(glm-5.3-flash)理解图片:识图、提取图中文字、OCR、图表解读、视觉定位、内容总结与问答,支持一次多张。
通义千问 阅读助手PDF、Word、Excel、合同、图片、网页链接,勾上写一句指令就读懂:总结、提要点、抽字段、翻译、问答都行。默认通义千问 3.5 Plus,也可切更省的 3-VL Plus。
阅读助手(DeepSeek)PDF、Word、Excel、合同、长文、网页链接,勾上写一句指令就读懂:总结、提要点、抽字段、翻译、问答都行。图片也能读,自动转成文字。DeepSeek V4 Flash 支持 1M 超长上下文,整列批量也不怕。
豆包 阅读助手PDF、Word、Excel、合同、图片、网页链接,勾上写一句指令就读懂:总结、提要点、抽字段、翻译、问答都行。默认豆包 2.0 Pro,读文档看图都稳,整列批量也不怕。
通义千问 图片理解识图、提取图中文字、看懂图表、描述卖点,一句提示词搞定。默认 3-VL 视觉专款,比通用款便宜约 58%;文档链接文本也能混着选。
豆包 图片理解识图、提取图中文字、看懂图表、描述卖点,一句提示词搞定。豆包直接看图识别;文档链接文本也能混着选,整列批量执行。
MiniMax M3用 MiniMax 系列大模型(M1 / M2 / M2.1 / M2.5 / M2.7)对单元格文本做总结、翻译、抽取、改写、问答,自动剥离思考过程只返回正文。
增值税发票识别发票号码税号金额明细提取
营业执照识别执照信用代码范围提取
银行卡识别银行卡号有效期识别
识别食品经营许可证食品经营许可证提取
识别台湾通行证台湾通行证信息提取
识别食品生产许可证食品生产许可证提取
识别名片名片联系方式提取
识别火车票车次站点席别票价提取
识别行驶证行驶证车辆信息提取
识别出租车发票车牌时间里程金额提取
识别护照护照号码姓名有效期
解析简历简历字段结构化解析
识别港澳通行证港澳通行证信息提取
识别驾驶证驾驶证准驾有效期提取
Kimi K3用 Moonshot AI 的 Kimi 系列大模型(K2 / K2-thinking / K2.5 / K2.6 / Moonshot-v1)对单元格文本做总结、翻译、抽取、改写、问答
MiniMax 阅读助手PDF、Word、Excel、合同、图片、网页链接,勾上写一句指令就读懂:总结、提要点、抽字段、翻译、问答都行。默认 MiniMax M3:最快、还能原生看图(照片图表直接识别)。整列批量执行不在话下。
MiniMax 图片理解识图、提取图中文字、看懂图表、描述卖点,一句提示词搞定。默认 M3 原生多模态、响应快;文档链接文本也能混着选,整列批量执行。
身份证识别正反面合并提取9项信息
合同要素提取甲乙双方金额期限开户行
抖音Tiktok评论获取评论采集含点赞IP属地
抖音Tiktok博主信息获取KOL粉丝数作品数采集
AI 短视频口播转写视频转文字,提文案出字幕逐字稿
视频理解(自选模型)把表格里的视频交给你指定的多模态模型:总结视频内容、提取口播文案、按时间列出关键画面,单个视频最大 1GB。
文件理解(自选模型)PDF/Word/Excel/CSV/TXT 自动转文本再交给 AI 完成总结、条款提取、问答;超长文件自动分片阅读后汇总,不怕大文件。
AI 图片生成(image-2.5-standard)Image 2.5 文生图与改图
AI 生图 image2(特价版多图模式)一次运行最多出 5 张各不相同的图:填 5 个提示词各生成一张,全部写回同一个附件单元格。支持参考图(图生图/图像编辑)、1K/2K/4K 尺寸。
DeepSeek V4 PRO用 DeepSeek V4 模型对单元格文本做总结、翻译、抽取、改写、问答,可选推理强度。
网页转截图PDF(特价版)每次 ¥0.01。把整个网页渲染成 PDF 存档。渲染前自动滚动全页,确保懒加载的图片也被载入。
图片转 PPT(特价版)每次 ¥0.01。把图片内容整理成演示稿大纲并生成 PPT,每页含标题与要点。适合把白板照片、截图变成可讲的幻灯片。
图片转 Word(特价版)每次 ¥0.01。识别图片中的文字与版面结构,还原成可编辑的 Word 文档,标题、段落、表格分别还原。
图片转 PDF(特价版)每次 ¥0.01。把一张或多张图片按顺序合成一个 PDF,支持透明背景自动垫白底。适合批量归档截图与扫描件。
图片转 Excel(特价版)每次 ¥0.01。识别图片中的表格并还原成 Excel,行列与原表一致。适合把截图、拍照的表格变成可计算的数据。
PDF 转 Excel(特价版)每次 ¥0.01。抽取 PDF 里的表格并还原成 Excel,逐页分表。没有表格时自动退回按行提取文本。
PDF 转 PPT(特价版)每次 ¥0.01。把 PDF 每一页转成一张幻灯片,按原始页面比例排版。适合把方案稿、报告快速变成演示文稿。
Kimi 图片理解把图片、PDF/Word/Excel 文档、网页链接和文本混着交给 Kimi 按提示词处理:识图、提取图中文字、看懂图表、总结文档、抽取字段都行。
AI 网页生成(Artifacts)写一句要求(可选再挑些素材),AI 自动生成排版精美的网页并返回可分享公开链接。支持把 PDF/Word/Excel/图片附件、文本、链接作为素材。
智谱 GLM 视频理解选择视频附件并填写提示词,GLM 5.3 Flash 原生解析视频画面与语音:总结内容、提取口播文案、识别关键画面、按时间线梳理都行。单个视频最大 1GB,整列批量执行。
MiniMax 视频理解选择视频附件并填写提示词,MiniMax M3 原生解析视频画面与语音:总结内容、提取口播文案、识别关键画面、按时间线梳理都行。1M 超长上下文,长视频整段理解。
DeepSeek 图片理解识图、提取图中文字、看懂图表、描述卖点,一句提示词搞定。默认 V4 Flash Vision——DeepSeek 首个原生看图模型。文档链接文本也能混着选,整列批量执行。
豆包 视频理解选择视频附件并填写提示词,豆包 Seed 2.0 Lite 原生解析视频画面与语音:总结内容、提取口播文案、识别关键画面、按时间线梳理都行。单个视频最大 1GB,整列批量执行。
Kimi 视频理解选择视频附件并填写提示词,Kimi K2.7 原生解析视频画面与语音:总结内容、提取口播文案、识别关键画面、按时间线梳理都行。单个视频最大 1GB,整列批量执行。
妙笔生花(特价版)读懂图片文档音视频
视频裁剪按开始/结束时间裁剪视频片段,结果自动写入附件字段。
视频生成(Omi)用模型把一张参考图生成约 10 秒动态视频:填提示词、选参考图、宽高比即可。
AI 图像增强用 AI 对图片智能去噪、优化纹理细节、提升人像质量,让模糊噪点多的图片变清晰自然。
音频混音叠加把多条音频叠加混音成一条,写入附件字段。
AI 图片裁剪按九宫格锚点和目标宽高裁剪图片,批量出固定尺寸图,结果自动写入附件字段。
视频画中画把视频或图片以画中画方式叠加到主视频,可设位置、大小、出现时间,结果写入附件字段。
AI 播客生成粘贴一篇文章或写一个主题,AI 自动改写成双人对话脚本并合成播客音频(MP3),自动写入附件字段。
视频加水印在视频上叠加文字水印,可设字号与颜色,写入附件字段。
图片画质提升用 AI 超分把图片清晰度提升 4 倍,智能去噪、补全细节,模糊低清图一键变清晰。
音频智能降噪智能去除音视频中的背景噪声,提升音质,写入附件字段。
图片生成(2代新)一个图像生成和编辑模型,支持文生图、图生图。
AI 图片生成(image-2.0)根据提示词生成图片,支持文生图和图生图,按比例生成。
视频生成(可灵-Omni)可灵 Omni(O1)多模态模型,最多 7 张参考图,让多张图里的人物/物体出现在同一段视频里互动,支持指定首帧,结果自动写入附件字段。
AI 图片旋转把表格里的图片按指定角度顺时针旋转(90/180/270),结果自动写入附件字段。
AI 图片风格转换把图片 AI 重渲成羊毛毡/陶土泥塑/赛博朋克/翡翠玉雕风格,结果自动写入附件字段。
BGM分离把音视频分离为人声和背景声两条音轨,分别写入附件字段。
语音合成 TTS(自带 Key)用豆包语音合成模型把文本一键转成自然语音(mp3),11 种音色可选、可调语速。按字符计费,使用波波 API 你自己的额度。
视频分辨率提升把低清视频智能超分到 720P/1080P/2K/4K 并增强画质,写入附件字段。
音视频合成把音频(配音/BGM)合成到视频上,可保留原声,写入附件字段。
音量响度均衡对音视频做响度均衡,统一音量,写入附件字段。
视频生成(G-1.5)一句提示词(可附一张参考图)生成 6/10/15 秒的 AI 动态视频,支持文字生视频与图生视频,结果自动写入附件字段。
图片+音乐合成视频把多张图片和背景音乐合成为视频,写入附件字段。
视频生成(G-3)最多 7 张参考图,提示词用 @img1~@img7 引用对应图片,生成人物/物体同框互动视频(如换装、产品展示),结果自动写入附件字段。
视频生成(V3.1)模型按提示词生成视频,支持文生视频与图生视频(多张参考图),可选 16:9 / 9:16。
AI 音乐生成一句话描述歌曲主题与风格,AI 自动作词作曲并演唱成完整歌曲,可选曲风/情绪/演唱/时长。
视频理解(通义千问)选择视频附件并填写提示词,通义千问 qwen3-vl-flash 真实解析视频画面与语音,完成总结、口播提取、画面识别、时间线梳理等任务,性价比极高,使用波波 API(apibobo.com)计费。