文本处理
对一段文本做一种处理并输出结果。只要替换指定内容,用 替换文本。
当前模块定义
sys:stringProcess输入 10 · 输出 2 · 枚举 3
输入参数
- 待处理内容
dataText可选需要进行文本处理的内容
- 处理
methodEnum必填对文本进行什么处理
39 个选项英文转大写、英文转小写、前后反转
英文转大写toUpper英文转小写toLower前后反转reverse截取substring去除前面空白字符trimStart去除后面空白字符trimEnd去除前后空白字符trimURL编码urlEncodeURL解码 (+解码为空格urlDecodeURL数据解码 (保留+号urlDataDecodeHtml编码htmlEncodeHtml解码htmlDecode组合词拆分成句子(thisIsChina=>this Is ChinaintercappedToSentenceBase64编码base64EncodeBase64解码base64Decode去除空行removeEmptyLine合并多个空行mergeEmptyLine排序多行A-ZsortLinesAsc排序多行Z-AsortLinesDesc翻转多行顺序reverseLines首字母大写toTitleCase格式化JSONformatJson计算MD5哈希md5计算SHA256哈希sha256Hash计算SHA1哈希sha1Hash转义文本为合法Json值escapeJson解码Unicode字串(\uXXXX转普通字符DecodeUnicode转换编码convertEncoding金额数字转换为大写toCnNum中文转数字cn2num数字转中文num2cn替换环境变量ExpandEnvironmentVariables从左侧补齐长度padLeft从右侧补齐长度padRight插入内容insert追加内容append移除内容remove移除零宽字符removeZeroWidthCharsHTML转纯文本html2text - 编码
srcEncodingText可选6 个选项utf-8、gbk、gb2312
utf-8默认utf-8gbkgbkgb2312gb2312big5big5utf-16utf-16utf-32utf-32 - 目标编码
dstEncodingText可选6 个选项utf-8、gbk、gb2312
utf-8utf-8gbk默认gbkgb2312gb2312big5big5utf-16utf-16utf-32utf-32 - 开始位置
startInteger可选开始截取/插入位置,从0开始。如果为负值,表示从文本末尾开始向前的字符数。
- 内容
valueText可选插入或追加的内容
- 长度
lengthInteger可选截取或移除字符个数。截取时,0表示开始位置以后的所有内容,负值表示截取到结束前的多少个字符。
- 总宽度
totalWidthInteger可选补齐后的总字符数
- 填充字符
paddingCharText可选补齐时使用的填充字符,默认为空格。
- 失败后停止
stopIfFailBoolean可选失败后是否停止动作
输出参数
- 是否成功
isSuccessBoolean操作是否成功
- 结果
outputText处理后的文本
概述
先选 处理,再按类型填写附加参数。点开下拉可看当前全部选项。
文本处理
各种文本处理功能
参数说明
待处理内容:原文。
处理:要做哪一种。下面按类型说明;名称与下拉一致。
失败后停止:处理失败是否中止动作。默认开启。
大小写与翻转
| 处理 | 说明 |
|---|---|
| 英文转大写 / 英文转小写 | abc ↔ ABC |
| 前后反转 | ABC → CBA |
| 首字母大写 | 每个单词首字母大写 |
| 组合词拆分成句子(thisIsChina=>this Is China) | 驼峰拆成词,方便搜索或翻译 |
截取、插入、删除、补齐
这些项会显示 开始位置、长度、内容、总宽度、填充字符(按处理类型)。
开始位置:从 0 计;负数表示从末尾往前。
长度:截取时 0 表示一直到末尾;负数表示截到结束前若干字符。移除时是要删的个数。
内容:插入或追加的文字。追加也可用表达式 $={文本1} + "追加内容"。
总宽度 / 填充字符:左右补齐用,默认空格。
文本处理
各种文本处理功能
例如:aaa 在位置 2 插入 bb → aabba;abcdefg 从 -2 移除长度 2 → abcde;abc 左侧用 * 补到 5 → **abc。
空白与多行
| 处理 | 说明 |
|---|---|
| 去除前面 / 后面 / 前后空白字符 | 去空格和 Tab,不含零宽字符 |
| 移除零宽字符 | 旧稿未写 |
| 去除空行 | 丢掉没有可见字符的行 |
| 合并多个空行 | 连续空行收成 1 行 |
| 排序多行A-Z / 排序多行Z-A | 按字母序 |
| 翻转多行顺序 | 整行倒序 |
编解码与哈希
| 处理 | 说明 |
|---|---|
| URL编码 / URL解码 (+解码为空格) | 解码时 + 变空格 |
| URL数据解码 (保留+号) | 旧稿未写 |
| Html编码 / Html解码 | |
| HTML转纯文本 | 旧稿未写 |
| Base64编码 / Base64解码 | |
| 计算MD5 / SHA1 / SHA256哈希 | |
| 转义文本为合法Json值 | 避免拼进 JSON 时格式乱掉 |
| 格式化JSON | 输入必须是合法 JSON |
| 解码Unicode字串(\uXXXX转普通字符) | \u65b9\u6b63\u5c0f → 方正小 |
| 转换编码 | 显示 编码、目标编码,常用于网络返回值 |
文本处理
各种文本处理功能
中文数字与环境变量
| 处理 | 例子 |
|---|---|
| 金额数字转换为大写 | 1234 → 壹仟贰佰叁拾肆元 |
| 中文转数字 | 一万二千三百四十五点四五 → 12345.45 |
| 数字转中文 | 12345.45 或 12,345.45 → 一万二千三百四十五点四五 |
| 替换环境变量 | %USERPROFILE%\AppData → 实际用户目录 |
输出
- 是否成功:处理是否成功。
- 结果:处理后的文本。
限制与排障
格式化 JSON 时输入不合法会失败。去空白不含零宽字符,需要时另选 移除零宽字符。哈希整文件请用 检查路径/获取文件信息,避免整文件进内存。
相关链接
更新于