在Google表单单元格中删除HTML

Edd*_*din 2 regex google-sheets

尝试确定在Google表格中的列中的所有单元格中自动删除HTML的最佳方法.

细胞数据示例:

<span style="color:#0000FF">test</span>
Run Code Online (Sandbox Code Playgroud)

我想删除所有HTML并在添加新行时自动保留纯文本.

我不确定在单元格中使用正则表达式作为公式还是某种类型的脚本是更好的方法.

Max*_*rov 7

您可以使用REGEXREPLACE函数:

=REGEXREPLACE(A1,"</?\S+[^<>]*>","")
Run Code Online (Sandbox Code Playgroud)

这个公式也可以转换成ArrayFormula:

=ARRAYFORMULA(REGEXREPLACE(offset(A1,,,COUNTA(A:A)),"</?\S+[^<>]*>",""))
Run Code Online (Sandbox Code Playgroud)

此公式将自动填充.COUNTA(A:A)是包含数据的列[A]中的行数


Wik*_*żew 6

您只需使用"查找和替换"对话框即可.

找什么: </?\S+[^<>]*>

用...来代替: <empty string>

搜索:Specific range= '<SHEET_NAME>'!<COLUMN>:<COLUMN>(例如'Copy of Sheet1'!A:A)

确保选中使用正则表达式进行搜索.然后,单击全部替换.

这是一个屏幕:

在此输入图像描述