Daily Tech Briefing
AI 科技速览

每天 5 分钟内学习 AI。获取最新的人工智能新闻,理解其重要性,并学习如何将其应用于您的工作。

microlinkhq

top-user-agents

347+0/dayJavaScript去 GitHub
分享
AI 中文解读
这个项目叫top-user-agents,听起来有点技术,但它解决的是开发者日常中一个很实际的问题:当你在写爬虫、做自动化测试、或者模拟浏览器行为的时候,需要一个真实且最新的User-Agent(就是HTTP请求里用来标识浏览器类型的字符串)。如果用老的或者随便从网上扒的列表,很容易被目标网站识别为机器人,直接封掉。这个项目直接从每月超过3亿次的真实请求数据中提炼出最常用的100个User-Agent字符串,相当于给你的请求穿上一件“最流行”的浏览器外衣,让服务器觉得你是个活人。 技术上它有几个让人省心的亮点:首先数据是每周自动更新的,通过CI/CD流水线跑出来的,你不用操心手动维护。其次它把桌面端和移动端分别整理成了单独的文件,需要哪个拿哪个,还附带TypeScript类型定义,代码提示很舒服。最厉害的是零依赖,安装后体积非常小,不会拖累你的项目。 适合谁用呢?主要是做Web爬虫的工程师、搞前端自动化测试的QA、或者是任何需要伪造浏览器身份的服务。比如你的爬虫要抓取电商数据,用这个包随机拿一个最新Chrome的User-Agent请求头,成功率会高很多。甚至你写的自动化脚本要登录某个网站,不再需要被人肉识别出来。 新手完全不用担心上手难度。只要会用Node.js和npm,一行命令安装,然后require进来调用一个方法就能拿到随机UserAgent,代码只有两行。不需要懂底层原理,直接当工具用就行。整个项目小巧精炼,文档也很清晰,几分钟就能跑起来。从本质上说,它就是一个维护成本极低但价值很大的“字典”,替你去掉了找数据、更新的烦恼。
An always up-to-date list of the top 100 HTTP user-agents most used over the Internet.