Skip to content

Instantly share code, notes, and snippets.

@baymaxium
baymaxium / content.md
Created October 18, 2017 08:52
开源硬件起步的 8 个步骤

原文:Linux中国

制造自己的硬件比以往任何时候都更容易,更便宜。以下是你设计、构建和测试你的第一块板子所需的事情。

-- John 'warthog9' Hawley

本文导航

@baymaxium
baymaxium / content.md
Created October 18, 2017 09:20
爬虫工程师如何绕过验证码?寻找阿登高地之路

原文:高可用架构

导读:马奇诺防线是二战前法国耗时十余年修建的防御工事,十分坚固,但是由于造价昂贵,仅修建了法德边境部分,绵延数百公里,而法比边界的阿登高地地形崎岖,不易运动作战,且比利时反对在该边界修建防线,固法军再次并没过多防备,满心期望能够依靠坚固的马奇诺防线来阻挡德军的攻势。没想到后来德军避开德法边境正面,通过阿登高地从防线左翼迂回,绕过了马奇诺防线,然后就是英法联军的敦克尔克大撤退了。

网站验证码就如同马奇诺防线一样,阻挡了爬虫工程师的正面进攻。

随着爬虫和反爬虫双方围绕验证码的不断较量,最终导致了验证码识别难度的不断上升。现在复杂的验证码长这样:

@baymaxium
baymaxium / content.md
Created October 18, 2017 09:20
基于Falcon的滴滴内部监控系统

原文:高可用架构

导读:监控是架构可用性中最关键的环节之一,高可用架构邀请了滴滴的研发工程师聂安,分享了滴滴监控系统 DD-Falcon 近期的一些进展。

作者简介

聂安,滴滴运维研发工程师,长期从事监控、部署等运维工具平台的开发。现就职于滴滴,曾就职于阿里、小米。

很高兴和大家一起分享滴滴监控系统 DD-Falcon 近期的一些进展。今天分享主要包括如下几个部分 (技术架构、产品形态):

@baymaxium
baymaxium / content.md
Created October 18, 2017 09:41
一个可供参考的系统部署工具

原文:高效开发运维

  

说到系统部署工具,大的互联网公司基本上是自己研发,一键自动部署到数百台到数千台服务器, 比如 twitter 开源的 Murder。小的公司可能使用一些开源工具,比如 Jenkins、Puppet、Ansible 结合一些脚本进行。

开源的部署工具有 Capistrano、瓦力等,在线部署的有 http://dploy.io/。其中瓦力是国人开发的一个系统部署工具。

贝聊之前也使用了瓦力来部署 web 服务和 dubbo 服务,在使用的过程中遇到一些问题:

@baymaxium
baymaxium / content.md
Created October 18, 2017 08:49
你应该再给 Firefox 一次机会
@baymaxium
baymaxium / content.md
Created October 18, 2017 08:48
动态端口转发:安装带有 SSH 的 SOCKS 服务器
@baymaxium
baymaxium / content.md
Created October 18, 2017 09:08
数据科学和 ML 领域常用的 Python 库

原文:Python开发者

(点击上方蓝字,快速关注我们)

编译:伯乐在线 - 李趴趴要化身女超人

如有好文章投稿,请点击 → 这里了解详情

Python 对于数据科学家来说几乎是一项必备技能。正如你看到的那样,很多数据科学家的岗位要求具备 Python 编程的能力。这篇文章将会针对数据科学介绍几种常用的 Python 包。在与数据挖掘、机器学习以及数据分析相关的项目中,这些 Python 包通常会得到广泛应用。

@baymaxium
baymaxium / content.md
Created October 18, 2017 08:53
Linux 桌面系统的优势

原文:Linux中国

对于那些还对 Linux 系统犹豫不决,或是那些不甚了解 Linux 系统的用户,我将通过这篇文章给大家介绍一些使用 Linux 桌面系统的优势。

-- Jonathan Terrasi

本文导航

@baymaxium
baymaxium / content.md
Created October 18, 2017 09:08
深入理解 Python 异步编程(上)

原文:Python开发者

(点击上方蓝字,快速关注我们)

来源:阿驹的自荐投稿(微信公号:驹说码事) 

如有好文章投稿,请点击 → 这里了解详情

前言

@baymaxium
baymaxium / content.md
Created October 18, 2017 08:31
应用级缓存——《亿级流量》

原文:开涛的博客

缓存简介

缓存,笔者的理解是让数据更接近于使用者,目的是让访问速度更多。工作机制是先从缓存中读取数据,如果没有,则再从慢速设备上读取实际数据并同步到缓存。那些经常读取的数据、频繁访问的数据、热点数据、IO瓶颈数据、计算昂贵的数据、符合五分钟法则和局部性原理的数据都可以进行缓存。如CPU→L1/L2/L3→内存→磁盘就是一个典型的例子,CPU需要数据时先从L1读取,如果没有找到,则查找L2/L3读取,如果没有,则到内存中查找,如果还没有,则会到磁盘中查找。还有比如用过Maven的朋友都应该知道,加载依赖的时候,先从本机仓库找,再从本地服务器仓库找,最后到远程仓库服务器找。还有如京东的物流为什么那么快?他们在各地都有分仓库,如果该仓库有货物,那么送货的速度是非常快的。

本文以Java应用缓存为示例进行讲解。

缓存命中率