[北京立水桥][玩加赛事]爬虫工程师

V2EX = way to explore

V2EX 是一个关于分享和探索的地方

现在注册

已注册用户请登录

• 外包信息请发到 /go/outsourcing 节点。

• 不要把相同的信息发到不同的节点

这是一个创建于 2974 天前的主题，其中的信息可能已经有所发展或是发生改变。

职位描述：

1. 负责多平台、大规模信息爬取和爬取内容的提取、清洗、落地、分析；
2. 参与爬虫系统的架构设计和研发，以及性能优化；
3. 抓取策略算法的更新维护，以及确保数据抽取准确、高效。

职位要求：

1. 理解 HTTP 协议，熟悉 HTML、DOM、XPath、熟悉浏览器内核、渲染机制；
2. 熟悉 Linux 开发环境，至少熟悉 Python/Go/Java/Node.js 中的一种编程语言；
3. 有爬虫、信息抽取、文本分类、大数据处理相关经验优先；
4. 有自然语言处理、机器学习经验优先。

薪资范围 15-30K 简历接收邮件： [email protected]

熟悉

抽取

立水桥

[email protected]

1 条回复 • 2017-12-25 19:03:59 +08:00

wanplus

2017 年 12 月 25 日