对稿、去重、数中文字数

纯文本活。字数和查找替换分开,避免两页抢同一个词。制度新旧稿不是 git,也不是 WPS 修订。

制度新旧稿、重复的手机号行、标题要变成英文路径——文本活不该先丢到随便一个云笔记。这里也不是 git,不是 WPS 的修订。从微信/WPS 贴过来的不间断空格,是查找替换对不上的常见原因。

结构化文本去开发分类。扫描件先提取或 OCR(本站英文为主),不要把照片当正文去数字数。客户名单留在标签页,用完清掉。

一个动词一页

  • 文本 Diff比。很长一行里改几个字,整行都会标红。压缩 JSON 先格式化。
  • 查找替换 只改一份草稿。简称可能误伤编号。
  • 行去重与排序 给名单和日志。整行精确,不是 CRM 模糊合并。
  • 空白清理 会连 Python 缩进一起干掉。适合名单,不适合代码。
  • URL Slug 生成 给英文路径。中文如何折叠,不和任何 CMS 保证一致,也不会自动变拼音。
  • 大小写转换 只管拉丁字母。网申姓名请按身份证。
  • 字数统计 是本页口径。公众号、小红书门槛常变,不要写死数字
  • 占位文花体文字 是排版玩具。花体 Unicode 会让 ATS、学信网式表格和读屏出问题。

正则是浏览器 RegExp,回溯能卡死,样品请短。HTML 实体、URL 百分号在编码分类。

容易抢词的几页

查找替换是字面量。正则是浏览器 RegExp,回溯能卡死。空白清理会毁掉 Python 缩进。去重按整行。差分不是 git。花体不要进简历和密码。slug 是英文连字符,中文可能被丢掉。字数以编辑器提示为准。