URL 提取工具

文本

从文本中批量提取 URL 链接,支持 http/https/mailto 等协议识别与去重输出。适合从日志、网页源码与文档中收集链接资源、安全审计 URL 清单与引用整理。

等待输入
输入文本
0 行
提取结果
0 个 URL

关于 URL 提取工具

URL 提取工具使用优化的正则表达式从任意文本中识别并提取所有超链接,覆盖 http、https、带 www 前缀以及 FTP 等协议格式。匹配引擎遵循 RFC 3986 定义的 URI 通用语法,能正确处理含端口号、查询参数、锚点片段和 IPv4 地址的复杂 URL。提取结果自动去重并按出现顺序排列,支持导出为纯文本列表。全部识别过程在浏览器本地执行,不向服务器传输任何数据,适合处理网页源码、邮件正文、日志文件等含链接的文本。建议收藏本工具以便日常快速使用。所有计算均在浏览器本地完成,数据不上传,可放心操作。推荐将本工具加入浏览器书签,需要时一键打开即可使用。数据全程在本地内存中处理,刷新页面后自动清除。

使用方法

  1. 打开 URL 提取工具 工具页面
  2. 根据需求输入或粘贴数据到输入区域
  3. 查看实时处理结果,使用复制按钮获取输出

使用场景

  • 提取网页外链 — 从 HTML 源码中批量抓取所有超链接,用于 SEO 外链分析和友链检查。
  • 日志链接排查 — 从服务器访问日志中提取异常 URL,快速定位问题请求和爬虫路径。
  • 邮件链接审计 — 检查邮件正文中的所有超链接,识别钓鱼链接或失效地址。
  • 文档链接汇总 — 从 Markdown 或文本文档中提取所有引用链接,生成链接清单。
  • 数据清洗去重 — 从爬虫结果中提取 URL 并自动去重,减少重复抓取请求。

常见问题

能提取不带 http 的裸链接吗?

可以。工具会自动识别以 www 开头的域名链接,同时也支持完整的 http 和 https 协议格式。

提取结果会去重吗?

会。同一个 URL 即使在文本中出现多次,结果列表中也只保留一条,并按首次出现顺序排列。

支持 FTP 协议的链接吗?

支持 http、https、ftp 等常见协议。对于 mailto 等特殊协议,建议使用对应的专用提取工具。

能处理含特殊字符的 URL 吗?

能。工具兼容 RFC 3986 标准,能正确识别含百分号编码和 Unicode 字符的国际化 URL。

数据安全吗?

安全。所有提取过程在浏览器本地通过正则引擎完成,不发送任何网络请求,可安全处理含敏感信息的文本。

广告

评论与讨论

还没有评论,来抢沙发吧!

评论仅保存在你的浏览器本地,切换设备后不可见。配置 Giscus 后可支持云端评论。