运行工具
本工具帮助开发者和内容创作者快速从 HTML 源码中提取纯文本内容。只需粘贴包含标签的文本,系统即可自动移除 HTML 标记,同时解码常见的命名实体如版权符号和货币符号。您可以灵活控制输出格式:默认情况下,工具会保留段落和列表产生的换行符,使结果保持原有的阅读结构;同时支持保留超链接,将链接地址附加在文本后方。若需精简内容,可启用脚本移除选项,自动清除 script 和 style 标签及其内部代码。转换后的文本会自动规范化空白字符,去除首尾空格并合并多余空行,确保结果整洁。适用于邮件模板清洗、网页内容抓取预处理或文档归档等场景,无需安装软件,直接在浏览器中即可完成高效转换。
使用说明
- 在“文本”输入框中粘贴包含 HTML 标签的代码或网页片段。
- 根据需要调整选项:勾选“保留换行”以维持段落结构,勾选“保留链接”以显示 URL,勾选“移除脚本”以清理代码。
- 点击“运行”按钮开始转换。
- 在结果面板查看并复制生成的纯文本内容。
示例
- 输入:<p>欢迎访问 <a href="https://example.com">示例网站</a></p> 输出(默认设置):欢迎访问 示例网站 [https://example.com]
- 输入:<div style="color:red">测试<br>内容</div><script>alert(1)</script> 输出(移除脚本):测试 内容
常见问题
工具会保留 HTML 中的图片吗?
不会。该工具专注于提取文本内容,img 标签会被移除,且不会尝试提取 alt 属性或图片 URL。
为什么转换后的文本有多余的空行?
如果源 HTML 中包含多个连续的块级元素或手动换行,可能会产生多行。工具会自动将三个或更多连续换行符合并为两个,以保持版面整洁。
支持处理复杂的 JavaScript 动态内容吗?
不支持。本工具仅处理静态 HTML 字符串。如果内容需要执行 JavaScript 才能渲染,请先在浏览器中查看源代码或使用其他工具获取最终 HTML。
特殊符号如 © 或 € 能正常显示吗?
可以。工具会自动解码常见的 HTML 命名实体和十进制数字字符引用,将其转换为对应的 Unicode 字符。