---
name: ai-text-content-processing
description: "当用户需要使用咕咕数据公开 API 完成内容工作流、业务数据组合、参数传递、接口选型或结果校验时使用；不适用于绕过接口详情页、购买规则或人工复核要求的场景。"
---

# AI 文本与内容处理 Skill

面向文本摘要、翻译、纠错、关键词、实体识别、文章抽取和内容生产的公开 API 组合。

## 业务场景

用于内容工作流、智能编辑器、知识库整理、舆情分析、文本清洗和多语言内容处理。适合把语种检测、正文抽取、摘要、翻译、纠错、关键词、实体、情感、相似度、润色和隐私信息去除组合成文本处理链路。

- 数据范围：覆盖文章抽取、PDF 摘要、多语言摘要、翻译、纠错、关键词、情感、隐私信息去除、润色、语种检测、中文分词、命名实体、相似度、诗歌、对联、故事和起名等文本能力。
- 关键数据维度：输入维度：文本、URL、PDF、HTML、语言、长度和处理目标。；理解维度：摘要、关键词、实体、情感、相似度和语言识别。；生成维度：翻译、润色、纠错、诗歌、故事、对联和命名结果。；治理维度：隐私信息去除、格式规范化和可读性整理。

## 何时使用

- 从网页、PDF 或原始文本中提取可用正文并生成摘要。
- 对文本做翻译、纠错、润色、关键词提取、实体识别和情感分析。
- 为知识库、内容审核、运营编辑和客服助手准备结构化文本。

## 不适用场景

- 用户只需要查看某一个接口的完整参数、响应字段、价格或购买入口时，直接打开接口详情页。
- 用户希望绕过接口开通、鉴权、配额或人工复核要求时，不应使用 Skill 作为替代。
- 任务需要法律、医疗、金融投资或升学录取的最终决策时，Skill 只能提供数据辅助和复核线索。

## 用户需要提供的信息

- 业务目标、查询对象、时间范围、地区范围和输出格式。
- 调用接口所需的 AppKey、开通状态和接口详情页限制。

## 推荐工作流

1. 先识别语言、抽取正文或结构化内容。
2. 再做摘要、关键词、实体、情感、相似度和纠错处理。
3. 需要面向用户输出时，使用润色、翻译、诗歌或故事生成接口。

## 参数传递关系

- URL 或文件先抽取正文，再把正文传给摘要、关键词、实体、情感、翻译、纠错或润色接口。
- 翻译、摘要和纠错需要保留原文语言、目标语言和文本长度。
- 隐私信息去除应在对外展示或二次生成前执行，并保留人工复核环节。

## 典型任务模板

- 文章整理：输入 URL 或正文；输出摘要、关键词、实体和情感。
- 多语言处理：输入文本、源语言和目标语言；输出翻译、纠错和润色版本。
- 知识库入库：输入文档文本；输出标题、摘要、标签、结构化字段和复核提示。

## 接口与关键参数

统一鉴权：调用接口前需要准备咕咕数据 AppKey。推荐在服务端通过 Header 传递 AppKey；历史 Query 参数 `appkey` 仍以接口详情页说明为准。

接口较多时，本节使用紧凑参数摘要；完整参数、响应字段和调用示例以接口 Markdown 和详情页为准。

### 文章抽取信息化 JSON

- 业务角色：文章结构化
- 调用阶段：内容抽取
- 接口地址：`POST https://api.gugudata.com/ai/v1/articles/extract`
- 产出用途：用于抽取文章信息化 JSON 或从 HTML 提取文章内容。
- 参数来源：URL 或域名由用户提供，调用前需要确认协议、跳转和可访问性
- 接口资料：详情页 https://www.gugudata.com/api/details/article-extract；接口 Markdown https://www.gugudata.com/api/details/article-extract/llm.md

关键请求参数：`url`(必填，string，URL 或域名由用户提供，调用前需要确认协议、跳转和可访问性)

### 文本多语言 AI 摘要

- 业务角色：文本摘要
- 调用阶段：文本理解
- 接口地址：`POST https://api.gugudata.com/ai/text-summarize`
- 产出用途：用于多语言文本摘要。
- 参数来源：文本内容来自用户输入、网页正文抽取或文档识别结果
- 接口资料：详情页 https://www.gugudata.com/api/details/summarize-text；接口 Markdown https://www.gugudata.com/api/details/summarize-text/llm.md

关键请求参数：`textContent`(必填，string，文本内容来自用户输入、网页正文抽取或文档识别结果)；`streaming`(可选，boolean，由用户输入、业务筛选条件或上一轮接口结果确定)

### PDF 全文多语言 AI 摘要

- 业务角色：PDF 摘要
- 调用阶段：文本理解
- 接口地址：`POST https://api.gugudata.com/ai/summarize`
- 产出用途：用于 PDF 全文多语言 AI 摘要。
- 参数来源：文件或图片来自用户上传、公开 URL 或上一轮转换结果
- 接口资料：详情页 https://www.gugudata.com/api/details/summarize-pdf；接口 Markdown https://www.gugudata.com/api/details/summarize-pdf/llm.md

关键请求参数：`file`(必填，string/binary，文件或图片来自用户上传、公开 URL 或上一轮转换结果)；`lang`(可选，string，由用户输入、业务筛选条件或上一轮接口结果确定)；`streaming`(可选，boolean，由用户输入、业务筛选条件或上一轮接口结果确定)

### 多语言 AI 翻译

- 业务角色：多语言翻译
- 调用阶段：文本生成
- 接口地址：`POST https://api.gugudata.com/ai/multilingual-translation`
- 产出用途：用于 AI 多语言翻译。
- 参数来源：语言参数来自用户指定的源语言、目标语言或语种检测结果；文本内容来自用户输入、网页正文抽取或文档识别结果
- 接口资料：详情页 https://www.gugudata.com/api/details/multilingual-translation；接口 Markdown https://www.gugudata.com/api/details/multilingual-translation/llm.md

关键请求参数：`language`(必填，string，语言参数来自用户指定的源语言、目标语言或语种检测结果)；`content`(必填，string，文本内容来自用户输入、网页正文抽取或文档识别结果)；`streaming`(可选，boolean，由用户输入、业务筛选条件或上一轮接口结果确定)

### 多语言文本 AI 纠错格式化

- 业务角色：文本纠错
- 调用阶段：文本清洗
- 接口地址：`POST https://api.gugudata.com/ai/grammar-correction`
- 产出用途：用于多语言文本纠错格式化。
- 参数来源：文本内容来自用户输入、网页正文抽取或文档识别结果
- 接口资料：详情页 https://www.gugudata.com/api/details/grammar-correction；接口 Markdown https://www.gugudata.com/api/details/grammar-correction/llm.md

关键请求参数：`textContent`(必填，string，文本内容来自用户输入、网页正文抽取或文档识别结果)；`streaming`(可选，boolean，由用户输入、业务筛选条件或上一轮接口结果确定)

### 多语言长文本 AI 关键字提取

- 业务角色：关键词提取
- 调用阶段：文本理解
- 接口地址：`POST https://api.gugudata.com/ai/keyword-extraction`
- 产出用途：用于长文本关键词提取。
- 参数来源：文本内容来自用户输入、网页正文抽取或文档识别结果；关键词由用户输入或从上一轮内容抽取结果中生成
- 接口资料：详情页 https://www.gugudata.com/api/details/keyword-extraction；接口 Markdown https://www.gugudata.com/api/details/keyword-extraction/llm.md

关键请求参数：`textContent`(必填，string，文本内容来自用户输入、网页正文抽取或文档识别结果)；`keywordMaxLength`(可选，integer，关键词由用户输入或从上一轮内容抽取结果中生成)；`streaming`(可选，boolean，由用户输入、业务筛选条件或上一轮接口结果确定)

### 多语言文本 AI 情感分析

- 业务角色：情感分析
- 调用阶段：文本理解
- 接口地址：`POST https://api.gugudata.com/ai/sentiment-analysis`
- 产出用途：用于多语言文本情感分析。
- 参数来源：文本内容来自用户输入、网页正文抽取或文档识别结果
- 接口资料：详情页 https://www.gugudata.com/api/details/sentiment-analysis；接口 Markdown https://www.gugudata.com/api/details/sentiment-analysis/llm.md

关键请求参数：`textContent`(必填，string，文本内容来自用户输入、网页正文抽取或文档识别结果)；`streaming`(可选，boolean，由用户输入、业务筛选条件或上一轮接口结果确定)

### 个人可识别信息(PII) AI 去除

- 业务角色：隐私信息去除
- 调用阶段：文本清洗
- 接口地址：`POST https://api.gugudata.com/ai/pii-removal`
- 产出用途：用于个人可识别信息去除。
- 参数来源：文本内容来自用户输入、网页正文抽取或文档识别结果
- 接口资料：详情页 https://www.gugudata.com/api/details/pii-removal；接口 Markdown https://www.gugudata.com/api/details/pii-removal/llm.md

关键请求参数：`content`(必填，string，文本内容来自用户输入、网页正文抽取或文档识别结果)；`streaming`(可选，boolean，由用户输入、业务筛选条件或上一轮接口结果确定)

### 文章自然润色

- 业务角色：文章润色
- 调用阶段：文本生成
- 接口地址：`POST https://api.gugudata.com/ai/article-polishing`
- 产出用途：用于文章自然润色。
- 参数来源：文本内容来自用户输入、网页正文抽取或文档识别结果
- 接口资料：详情页 https://www.gugudata.com/api/details/article-polishing；接口 Markdown https://www.gugudata.com/api/details/article-polishing/llm.md

关键请求参数：`content`(必填，string，文本内容来自用户输入、网页正文抽取或文档识别结果)；`streaming`(可选，boolean，由用户输入、业务筛选条件或上一轮接口结果确定)

### NLP 语种检测

- 业务角色：语种检测
- 调用阶段：NLP 基础
- 接口地址：`POST https://api.gugudata.com/text/detectlanguage`
- 产出用途：用于 NLP 语种检测。
- 参数来源：文本内容来自用户输入、网页正文抽取或文档识别结果
- 接口资料：详情页 https://www.gugudata.com/api/details/nlpdetectlanguage；接口 Markdown https://www.gugudata.com/api/details/nlpdetectlanguage/llm.md

关键请求参数：`content`(必填，string，文本内容来自用户输入、网页正文抽取或文档识别结果)

### NLP 中文智能纠错

- 业务角色：中文纠错
- 调用阶段：NLP 基础
- 接口地址：`POST https://api.gugudata.com/text/correct`
- 产出用途：用于中文智能纠错。
- 参数来源：文本内容来自用户输入、网页正文抽取或文档识别结果
- 接口资料：详情页 https://www.gugudata.com/api/details/nlpcorrect；接口 Markdown https://www.gugudata.com/api/details/nlpcorrect/llm.md

关键请求参数：`content`(必填，string，文本内容来自用户输入、网页正文抽取或文档识别结果)

### NLP 关键字摘要智能提取

- 业务角色：摘要提取
- 调用阶段：NLP 基础
- 接口地址：`POST https://api.gugudata.com/text/nlpabstract`
- 产出用途：用于关键字摘要智能提取。
- 参数来源：文本内容来自用户输入、网页正文抽取或文档识别结果
- 接口资料：详情页 https://www.gugudata.com/api/details/nlpabstract；接口 Markdown https://www.gugudata.com/api/details/nlpabstract/llm.md

关键请求参数：`content`(必填，string，文本内容来自用户输入、网页正文抽取或文档识别结果)

### NLP 命名实体识别

- 业务角色：实体识别
- 调用阶段：NLP 基础
- 接口地址：`POST https://api.gugudata.com/text/entityrecognition`
- 产出用途：用于命名实体识别。
- 参数来源：文本内容来自用户输入、网页正文抽取或文档识别结果
- 接口资料：详情页 https://www.gugudata.com/api/details/nlpentityrecognition；接口 Markdown https://www.gugudata.com/api/details/nlpentityrecognition/llm.md

关键请求参数：`content`(必填，string，文本内容来自用户输入、网页正文抽取或文档识别结果)

### NLP 文本语义相似度检测

- 业务角色：语义相似度
- 调用阶段：NLP 基础
- 接口地址：`POST https://api.gugudata.com/text/similarity`
- 产出用途：用于文本语义相似度检测。
- 参数来源：文本内容来自用户输入、网页正文抽取或文档识别结果
- 接口资料：详情页 https://www.gugudata.com/api/details/nlpsimilarity；接口 Markdown https://www.gugudata.com/api/details/nlpsimilarity/llm.md

关键请求参数：`content1`(必填，string，文本内容来自用户输入、网页正文抽取或文档识别结果)；`content2`(必填，string，文本内容来自用户输入、网页正文抽取或文档识别结果)

### NLP 中文文本分词

- 业务角色：中文分词
- 调用阶段：NLP 基础
- 接口地址：`GET https://api.gugudata.com/text/segment`
- 产出用途：用于中文文本分词。
- 参数来源：文本内容来自用户输入、网页正文抽取或文档识别结果
- 接口资料：详情页 https://www.gugudata.com/api/details/segment；接口 Markdown https://www.gugudata.com/api/details/segment/llm.md

关键请求参数：`text`(必填，string，文本内容来自用户输入、网页正文抽取或文档识别结果)；`split`(可选，string，由用户输入、业务筛选条件或上一轮接口结果确定)

### NLP 中英文排版规范化

- 业务角色：排版规范化
- 调用阶段：文本清洗
- 接口地址：`POST https://api.gugudata.com/text/formatarticle`
- 产出用途：用于中英文排版规范化。
- 参数来源：文本内容来自用户输入、网页正文抽取或文档识别结果
- 接口资料：详情页 https://www.gugudata.com/api/details/formatarticle；接口 Markdown https://www.gugudata.com/api/details/formatarticle/llm.md

关键请求参数：`content`(必填，string，文本内容来自用户输入、网页正文抽取或文档识别结果)

### 中文转拼音

- 业务角色：中文转拼音
- 调用阶段：中文工具
- 接口地址：`POST https://api.gugudata.com/text/chinesepinyin`
- 产出用途：用于中文转拼音。
- 参数来源：文本内容来自用户输入、网页正文抽取或文档识别结果
- 接口资料：详情页 https://www.gugudata.com/api/details/chinesepinyin；接口 Markdown https://www.gugudata.com/api/details/chinesepinyin/llm.md

关键请求参数：`content`(必填，string，文本内容来自用户输入、网页正文抽取或文档识别结果)

### 简体繁体互转

- 业务角色：简繁互转
- 调用阶段：中文工具
- 接口地址：`POST https://api.gugudata.com/text/stconvert`
- 产出用途：用于简体繁体互转。
- 参数来源：文本内容来自用户输入、网页正文抽取或文档识别结果
- 接口资料：详情页 https://www.gugudata.com/api/details/stconvert；接口 Markdown https://www.gugudata.com/api/details/stconvert/llm.md

关键请求参数：`content`(必填，string，文本内容来自用户输入、网页正文抽取或文档识别结果)；`from`(必填，string，由用户输入、业务筛选条件或上一轮接口结果确定)；`to`(必填，string，由用户输入、业务筛选条件或上一轮接口结果确定)

### 英文单词中文释义查询

- 业务角色：英文释义
- 调用阶段：语言工具
- 接口地址：`GET https://api.gugudata.com/text/english-words-chinese`
- 产出用途：用于英文单词中文释义查询。
- 参数来源：关键词由用户输入或从上一轮内容抽取结果中生成；分页参数由调用方控制，用于分批读取结果
- 接口资料：详情页 https://www.gugudata.com/api/details/english-words-chinese；接口 Markdown https://www.gugudata.com/api/details/english-words-chinese/llm.md

关键请求参数：`keywords`(必填，string，关键词由用户输入或从上一轮内容抽取结果中生成)；`pageSize`(可选，integer，分页参数由调用方控制，用于分批读取结果)；`pageNumber`(可选，integer，由用户输入、业务筛选条件或上一轮接口结果确定)

### 唐诗宋词大全

- 业务角色：唐诗宋词
- 调用阶段：内容数据
- 接口地址：`GET https://api.gugudata.com/text/chinesepoem`
- 产出用途：用于唐诗宋词数据查询。
- 参数来源：分页参数由调用方控制，用于分批读取结果；关键词由用户输入或从上一轮内容抽取结果中生成
- 接口资料：详情页 https://www.gugudata.com/api/details/chinesepoem；接口 Markdown https://www.gugudata.com/api/details/chinesepoem/llm.md

关键请求参数：`pagesize`(必填，integer，分页参数由调用方控制，用于分批读取结果)；`pagenumber`(必填，integer，由用户输入、业务筛选条件或上一轮接口结果确定)；`type`(可选，string，由用户输入、业务筛选条件或上一轮接口结果确定)；`keywords`(可选，string，关键词由用户输入或从上一轮内容抽取结果中生成)；`searchtype`(可选，string，由用户输入、业务筛选条件或上一轮接口结果确定)

### 百万中国对联数据

- 业务角色：中国对联
- 调用阶段：内容数据
- 接口地址：`GET https://api.gugudata.com/text/couplet`
- 产出用途：用于百万中国对联数据查询。
- 参数来源：分页参数由调用方控制，用于分批读取结果；关键词由用户输入或从上一轮内容抽取结果中生成
- 接口资料：详情页 https://www.gugudata.com/api/details/couplet；接口 Markdown https://www.gugudata.com/api/details/couplet/llm.md

关键请求参数：`pagesize`(必填，integer，分页参数由调用方控制，用于分批读取结果)；`pagenumber`(必填，integer，由用户输入、业务筛选条件或上一轮接口结果确定)；`keywords`(可选，string，关键词由用户输入或从上一轮内容抽取结果中生成)

### 人工智能对联生成

- 业务角色：AI 对联
- 调用阶段：内容生成
- 接口地址：`POST https://api.gugudata.com/text/coupletai`
- 产出用途：用于人工智能对联生成。
- 参数来源：由用户输入、业务筛选条件或上一轮接口结果确定
- 接口资料：详情页 https://www.gugudata.com/api/details/coupletai；接口 Markdown https://www.gugudata.com/api/details/coupletai/llm.md

关键请求参数：`firstpair`(必填，string，由用户输入、业务筛选条件或上一轮接口结果确定)

### 儿童故事创作大师

- 业务角色：儿童故事
- 调用阶段：内容生成
- 接口地址：`POST https://api.gugudata.com/ai/children-story-creator`
- 产出用途：用于儿童故事创作。
- 参数来源：由用户输入、业务筛选条件或上一轮接口结果确定
- 接口资料：详情页 https://www.gugudata.com/api/details/children-story-creator；接口 Markdown https://www.gugudata.com/api/details/children-story-creator/llm.md

关键请求参数：`topic`(必填，string，由用户输入、业务筛选条件或上一轮接口结果确定)；`length`(必填，string，由用户输入、业务筛选条件或上一轮接口结果确定)；`streaming`(可选，boolean，由用户输入、业务筛选条件或上一轮接口结果确定)

### 诗歌创作 AI 大师

- 业务角色：诗歌创作
- 调用阶段：内容生成
- 接口地址：`POST https://api.gugudata.com/ai/poet-writing`
- 产出用途：用于诗歌创作。
- 参数来源：由用户输入、业务筛选条件或上一轮接口结果确定
- 接口资料：详情页 https://www.gugudata.com/api/details/poet-writing；接口 Markdown https://www.gugudata.com/api/details/poet-writing/llm.md

关键请求参数：`topic`(必填，string，由用户输入、业务筛选条件或上一轮接口结果确定)；`streaming`(可选，boolean，由用户输入、业务筛选条件或上一轮接口结果确定)

### 八字喜用神起名大师

- 业务角色：起名
- 调用阶段：内容生成
- 接口地址：`POST https://api.gugudata.com/ai/name-generator`
- 产出用途：用于八字喜用神起名。
- 参数来源：时间参数来自用户指定日期、业务统计周期或接口支持的历史范围
- 可参考的相关能力：任务状态查询
- 接口资料：详情页 https://www.gugudata.com/api/details/name-generator；接口 Markdown https://www.gugudata.com/api/details/name-generator/llm.md

关键请求参数：`lastname`(必填，string，由用户输入、业务筛选条件或上一轮接口结果确定)；`gender`(必填，string，由用户输入、业务筛选条件或上一轮接口结果确定)；`birthDateTime`(必填，string，时间参数来自用户指定日期、业务统计周期或接口支持的历史范围)；`birthPlace`(必填，string，由用户输入、业务筛选条件或上一轮接口结果确定)；`parentNames`(可选，string，由用户输入、业务筛选条件或上一轮接口结果确定)；`avoidWords`(可选，string，由用户输入、业务筛选条件或上一轮接口结果确定)
更多请求参数以接口 Markdown 为准：https://www.gugudata.com/api/details/name-generator/llm.md

### 盲派八字推理

- 业务角色：八字推理
- 调用阶段：内容生成
- 接口地址：`POST https://api.gugudata.com/ai/bazi-fortune-teller`
- 产出用途：用于盲派八字推理内容生成。
- 参数来源：时间参数来自用户指定日期、业务统计周期或接口支持的历史范围
- 可参考的相关能力：任务状态查询
- 接口资料：详情页 https://www.gugudata.com/api/details/bazi-fortune-teller；接口 Markdown https://www.gugudata.com/api/details/bazi-fortune-teller/llm.md

关键请求参数：`userinfo`(可选，string，由用户输入、业务筛选条件或上一轮接口结果确定)；`gender`(可选，string，由用户输入、业务筛选条件或上一轮接口结果确定)；`calendarType`(可选，string，由用户输入、业务筛选条件或上一轮接口结果确定)；`birthDate`(可选，string，时间参数来自用户指定日期、业务统计周期或接口支持的历史范围)；`birthTime`(可选，string，由用户输入、业务筛选条件或上一轮接口结果确定)；`birthPlace`(可选，string，由用户输入、业务筛选条件或上一轮接口结果确定)
更多请求参数以接口 Markdown 为准：https://www.gugudata.com/api/details/bazi-fortune-teller/llm.md

### 紫微星斗大师

- 业务角色：紫微星斗
- 调用阶段：内容生成
- 接口地址：`POST https://api.gugudata.com/ai/ziwei-fortune`
- 产出用途：用于紫微星斗内容生成。
- 参数来源：时间参数来自用户指定日期、业务统计周期或接口支持的历史范围
- 可参考的相关能力：任务状态查询
- 接口资料：详情页 https://www.gugudata.com/api/details/ziwei-fortune；接口 Markdown https://www.gugudata.com/api/details/ziwei-fortune/llm.md

关键请求参数：`gender`(必填，string，由用户输入、业务筛选条件或上一轮接口结果确定)；`calendarType`(必填，string，由用户输入、业务筛选条件或上一轮接口结果确定)；`birthDate`(必填，string，时间参数来自用户指定日期、业务统计周期或接口支持的历史范围)；`birthTime`(必填，string，由用户输入、业务筛选条件或上一轮接口结果确定)；`birthPlace`(必填，string，由用户输入、业务筛选条件或上一轮接口结果确定)；`isLeapMonth`(可选，boolean，时间参数来自用户指定日期、业务统计周期或接口支持的历史范围)
更多请求参数以接口 Markdown 为准：https://www.gugudata.com/api/details/ziwei-fortune/llm.md

## 数据校验与使用边界

- 先确认输入文本来源、语言和长度，再选择摘要、翻译或结构化处理。
- AI 生成内容需要人工复核，尤其是事实、引用、法律、医疗和金融内容。
- 隐私信息处理不等于合规审计，应结合业务制度和人工抽检。

## 输出建议

- 输出时说明输入来源、处理目标、所用接口和结果限制。
- 对摘要、翻译和润色结果保留原文链接或原始片段以便复核。
- 结构化输出建议包含标题、摘要、关键词、实体、语言和风险提示。

## 常见问题

- 问：什么情况下应该使用这个 Skill？ 答：当用户提出的目标需要多个咕咕数据公开 API 组合完成，而不是只查询一个接口时，优先阅读这个 Skill。
- 问：这个 Skill 是否需要单独购买？ 答：不需要。Skill 文档只负责业务流程和接口选型，具体接口购买、价格和账号权益仍以接口详情页为准。
- 问：Agent 应该怎样使用这个 Skill？ 答：Agent 应先阅读 SKILL.md，确认业务场景和推荐工作流，再进入接口详情页核对参数、响应字段、价格和调用示例。
- 问：调用接口前需要先核对什么？ 答：需要核对业务对象、地区、时间范围、输入格式、必填参数、返回字段、购买状态和接口详情页中的限制说明。
- 问：AI 文本与内容处理 Skill 会替代接口文档吗？ 答：不会。Skill 负责说明业务组合和调用顺序，接口参数、响应结构、计费和购买入口仍以接口详情页为准。

