ajax | erman_康康

使用nginx作图片服务器的访问权限控制

2012 年 12 月 03 日作者：erman
暂无评论

说到访问权限控制，很多看了nginx相关文章的朋友都会自然联想到X-Accel-Redirect这个头。这个头有个缺陷，就是所有的访问都会先经过一个fastcgi来判断权限。在下载系统上，用这个方法是非常合适的，但是在访问量非常大的图片服务器，单单用这个方法会使大量无需权限判定的图片也经过一个fastcgi处理，多此一举并且无端耗费大量的资源。虽然X-Accel-Redirect是一个新的方案，但是并不代表它能很好的解决所有问题，同时也不妨碍继续思考解决问题的其它办法。

图片服务器加上权限判断主要用于博客和相册这样的系统。在网上稍微观察，可以看到目前大部分的博客相册等系统并没有针对图片本身加入权限判断，而仅仅是将网页部分的权限控制住。这样的话很多网友将其图片加锁，实际上此图片在外部仍有办法打开。我估计此原因有其一是实现起来有性能问题，其二是诸多网站将图片放置到CDN上，而CDN并没有对此有相应的方案的缘故。走了一圈发现只有QQ空间在用带权限的图片，而它看上去是直接用fastcgi实现的，性能居然还不错，佩服一下。

下文单纯解决性能问题，其思路是在访问图片附近放置一个控制文件，通过nginx判断决定是否要到fastcgi认证，其原理类似apache的.htaccess。有用到CDN的，因为CDN多数是squid，要加入清理squid缓存的机制。

1、针对单一图片的控制

如果图片按照哈希结构放置，那么用户的图片加锁后要把每一张图片都加上控制文件，如果该用户图片较多，写入时稍嫌多些。

比如有一张图：

/data/image/a/z/asdfqerqwegasd.jpg

写上一个空文件：

/data/image/a/z/asdfqerqwegasd.jpg.lock

然后在nginx配置判断：

location / {
root /data/image/;
if ( -f “${request_filename}.lock” )
{
#rewrite ^(.*)$ http://www.sudone.com/access.jsp?url=$1 last;
return 403;#test
}
}

这样，只要在图片旁边有一个.lock文件，就会访问到403 Forbidden；使用rewrite会将图片链接和cookie定位到后端，由后端返回判定结果X-Accel-Redirect头或者重定向到另外一个jsp去填密码。

2、针对目录的控制

如果图片是按照目录放置，那么配置会稍微复杂一些。

location / {
root /data/image/;
if ( $request_filename ~ ^(.*)/[^/]*$ ){
set $dir $1;
}
if ( -f “${dir}/lock” )
{
#rewrite ^(.*)$ http://www.sudone.com/access.jsp?url=$1 last;
return 403;#test
}
}

首先用正则表达式取出图片路径的目录，然后带上控制文件名判断此文件是否存在，这样只要在图片的目录中放置一个名叫lock的空文件就能控制完整个目录：

/data/image/a/z/lock

测试一下，效果不错，只要控制文件存在，访问立刻403；删去控制文件，访问正常。
tibet

2012 年 09 月 23 日作者：erman
暂无评论

30日14:35 抵达西藏

D1，拉萨，布宫，大昭寺，逛逛八角街

D2，拉萨—羊湖—江孜—日喀则

(羊卓雍错，卡若拉冰川，宗山古堡，白居寺)

D3，日喀则—定日—珠峰

(景点：珠峰，绒布寺)

D4，珠峰—日喀则

(景点：扎什伦布寺)

D5，日喀则—羊八井—纳木错

(景点：纳木错，念青唐古拉山)

D6，纳木错—拉萨

对应海拔：

拉萨：3650

八一：2900

泽当：3560

江孜：4000

日喀则：3850

珠峰大本营：5200

拉孜：4000

纳木错：4718
笑话

2012 年 09 月 17 日作者：erman
暂无评论

1.两位棋手一动不动地在棋盘前已经沉默地坐了五个钟头了。他们全神贯注地盯着每粒棋子。
突然，一位棋手说：“原则上我是反对在下棋时说话的，但是我现在不得不开口问：我们到底该谁先下一步棋？”
2.某日，一个对中文略知一二的老外去某工厂参观。
半路当中，厂长说：“对不起，我去方便一下。”
老外不懂这句中文，问翻译：“方便是什么意思。”
翻译说，“就是去厕所。”老外：“哦……”
参观结束，厂长热情地对老外说：“下次你方便的时候一起吃饭！”
老外一脸不高兴，用生硬的中文说：“我在方便的时候从来不吃饭！”

樱子跟小强说：“今天考试的时候我踢你一下，你就要给我瞄一下。 ”到了考试的时候，樱子踢了小强一下，小强便回答：喵！

甲：你年薪多少？乙：1000万。甲：那一个月有80万多哦！乙：是的，这是基本工资。甲：不错嘛，做什么的？乙：做梦的 ……

一美女从的士上下来，把照相机落在后座了。司机见状赶忙把头伸出窗外，冲着美女喊：“小姐，你相机~。” 美女一脸红，扭过头骂道：“你TMD像鸭！” 然后的士走了。然后美女追着喊：“师傅，我相机，我相机……”

甲：老同学，好久不见了，你的女朋友小丽还好吗？乙：（得意洋洋）：哈哈，她早就不是我的女朋友了！甲：嗯，你早该这样了，在大学时，我就听说她跟咱们班里好几个男生有染，想当年我还和她有过一腿呢！乙脸色铁青，半晌才低声吐出几个字：她现在是我的老婆…

A：你的仇人和情敌同时掉入水里，有个板砖你砸谁？B：思考了一会。B：谁救砸谁。

一天一个非洲人走在沙漠上，看到一个神灯，捡起便擦。
出现了一个精灵说：“我可以实现你三个愿望。”
非洲人说：“我要变白，我要天天可以喝到水，我要天天看到女人的屁股。”
说完“碰”的一声他变成了一个马桶。

一司机大雾天晚上迷了路，隐隐约约看见路边有一个路标，就把车停崴下来。可是雾太大，怎么也看不见写的什么字。于是决定爬上去看看。好不容易爬到顶上，终于看清上面的字：油漆未干。

公园有一对恋人正在甜蜜，女孩撒娇说老公：我牙痛！男孩于是吻了女孩一口问：还疼吗女孩说不痛了！一会女孩又撒娇的说：老公，我脖子痛！男孩又吻了吻女孩的脖子，又问这回还疼吗女孩很开心的说：不痛了！旁边一老太太站着看了半天了，忍不住了，上前就问小伙子说：小伙子你真神了，你能治痔疮不能。

几个人在高尔夫更衣室，一手机响很久，一男人按了免提键。女：亲爱的你在俱乐部吗？男:在。女：我看到一辆宝马才不到两百万。男人：买。女：还有那个楼盘又放盘了，6万一平。男：买。女：好爱你。男：也爱你。 旁边男人敬佩得目瞪口呆。男人挂了电话，问：这是谁的手机？

某剩女在一次相亲时拐弯抹角地打听男方家底：“你最常用的交通工具是什么？” 男方回答：“飞机，动车。” 女方觉得男方属于高档商务白领，遂嫁之。婚后发现男方是个民工，骑一辆破自行车上下班。女怒道：“当初你竟然骗我。” 男茫然答道：“没骗你啊，我说的就是非机动车呀。”
convert -resize 命令用法 {%} {@} {!} {<} {>} {^}

2012 年 08 月 20 日作者：erman
暂无评论

1. 默认时，宽度和高度表示要最终需要转换图像的最大尺寸，同时Convert会控制图片的宽和高，保证图片按比例进行缩放。

如：convert -resize 600×600 src.jpg dst.jpg

转换后的dst.jpg的图片大小(宽度为600，而高度已经按比例调整为450).

2.如果需要转换成600×600，而图片无需保持原有比例，可以在宽高后面加上一个感叹号!.

如：convert -resize 600×600! src.jpg dst.jpg

3. 只指定高度，图片会转换成指定的高度值，而宽度会按原始图片比例进行转换。

如：convert -resize 400 src.jpg dst.jpg

转换后的dst.jpg的图片大小(宽度为400，而高度已经按比例调整为300)，和例1有点类似。

4. 默认都是使用像素作为单位，也可以使用百分比来形象图片的缩放。

如：convert -resize 50%x100%! src.jpg dst.jpg 或者convert -resize 50%x100% src.jpg dst.jpg

此参数只会按你的比例计算后缩放，不保持原有比例。（结果尺寸为100×150)

5.使用 @ 来制定图片的像素个数。

如：convert -resize “10000@” src.jpg dst.jpg

此命令执行后，dst.jpg图片大小为（115×86），图片保持原有比例（115×86= 9080 < 10000)。

6.当原始文件大于指定的宽高时，才进行图片放大缩小，可使用>命令后缀。

如：convert -resize “100×50>” src.jpg dst.jpg

此命令执行后，dst.jpg图片大小为（67×50），图片保持原有比例。

如：convert -resize “100×50>!” src.jpg dst.jpg

此命令执行后，dst.jpg图片大小为（100×50），图片不保持原有比例。

7.当原始文件小于指定的宽高时，才进行图片放大转换，可使用<命令后缀。

如：convert -resize “100×500<” src.jpg dst.jpg 或者convert -resize “100×100<!” src.jpg dst.jpg

此命令执行后，dst.jpg和src.jpg大小相同，因为原始图片宽比100大。

如：convert -resize “600×600<” src.jpg dst.jpg

此命令执行后，dst.jpg图片大小为（600×450），图片保持原有比例。

如：convert -resize “600×600<!” src.jpg dst.jpg

此命令执行后，dst.jpg图片大小为（600×600），图片不保持原有比例。

8.使用^命令后缀可以使用宽高中较小的那个值作为尺寸

如：convert -resize “300×300^” src.jpg dst.jpg

此命令执行后，dst.jpg图片大小为（400×300），图片保持原有比例，(300:300 < 200:150，选择高作为最小尺寸）。

如：convert -resize “300×200^” src.jpg dst.jpg

此命令执行后，dst.jpg图片大小为（300×225），图片保持原有比例，(300:200 > 200:150，选择宽作为最小尺寸）。
MySQL索引类型及优化

2012 年 06 月 24 日作者：erman
暂无评论

索引是快速搜索的关键。MySQL索引的建立对于MySQL的高效运行是很重要的。下面介绍几种常见的MySQL索引类型。

在数据库表中，对字段建立索引可以大大提高查询速度。假如我们创建了一个 mytable表：

CREATE TABLE mytable(

ID INT NOT NULL,

username VARCHAR(16) NOT NULL

);

我们随机向里面插入了10000条记录，其中有一条：5555, admin。

在查找username=”admin”的记录 SELECT * FROM mytable WHERE username=’admin’;时，如果在username上已经建立了索引，MySQL无须任何扫描，即准确可找到该记录。相反，MySQL会扫描所有记录，即要查询10000条记录。

索引分单列索引和组合索引。单列索引，即一个索引只包含单个列，一个表可以有多个单列索引，但这不是组合索引。组合索引，即一个索包含多个列。

MySQL索引类型包括：

（1）普通索引

这是最基本的索引，它没有任何限制。它有以下几种创建方式：

◆创建索引

CREATE INDEX indexName ON mytable(username(length));
如果是CHAR，VARCHAR类型，length可以小于字段实际长度；如果是BLOB和TEXT类型，必须指定 length，下同。

◆修改表结构

ALTER mytable ADD INDEX [indexName] ON (username(length))
◆创建表的时候直接指定

CREATE TABLE mytable(

ID INT NOT NULL,

username VARCHAR(16) NOT NULL,

INDEX [indexName] (username(length))

);
删除索引的语法：

DROP INDEX [indexName] ON mytable;
（2）唯一索引

它与前面的普通索引类似，不同的就是：索引列的值必须唯一，但允许有空值。如果是组合索引，则列值的组合必须唯一。它有以下几种创建方式：

◆创建索引

CREATE UNIQUE INDEX indexName ON mytable(username(length))
◆修改表结构

ALTER mytable ADD UNIQUE [indexName] ON (username(length))
◆创建表的时候直接指定

CREATE TABLE mytable(

ID INT NOT NULL,

username VARCHAR(16) NOT NULL,

UNIQUE [indexName] (username(length))

);
（3）主键索引

它是一种特殊的唯一索引，不允许有空值。一般是在建表的时候同时创建主键索引：

CREATE TABLE mytable(

ID INT NOT NULL,

username VARCHAR(16) NOT NULL,

PRIMARY KEY(ID)

);
当然也可以用 ALTER 命令。记住：一个表只能有一个主键。

（4）组合索引

为了形象地对比单列索引和组合索引，为表添加多个字段：

CREATE TABLE mytable(

ID INT NOT NULL,

username VARCHAR(16) NOT NULL,

city VARCHAR(50) NOT NULL,

age INT NOT NULL

);
为了进一步榨取MySQL的效率，就要考虑建立组合索引。就是将 name, city, age建到一个索引里：

ALTER TABLE mytable ADD INDEX name_city_age (name(10),city,age);
建表时，usernname长度为 16，这里用 10。这是因为一般情况下名字的长度不会超过10，这样会加速索引查询速度，还会减少索引文件的大小，提高INSERT的更新速度。

如果分别在 usernname，city，age上建立单列索引，让该表有3个单列索引，查询时和上述的组合索引效率也会大不一样，远远低于我们的组合索引。虽然此时有了三个索引，但MySQL只能用到其中的那个它认为似乎是最有效率的单列索引。

建立这样的组合索引，其实是相当于分别建立了下面三组组合索引：

usernname,city,age

usernname,city

usernname
为什么没有 city，age这样的组合索引呢？这是因为MySQL组合索引“最左前缀”的结果。简单的理解就是只从最左面的开始组合。并不是只要包含这三列的查询都会用到该组合索引，下面的几个SQL就会用到这个组合索引：

SELECT * FROM mytable WHREE username=”admin” AND city=”郑州”

SELECT * FROM mytable WHREE username=”admin”
而下面几个则不会用到：

SELECT * FROM mytable WHREE age=20 AND city=”郑州”

SELECT * FROM mytable WHREE city=”郑州”
（5）建立索引的时机

到这里我们已经学会了建立索引，那么我们需要在什么情况下建立索引呢？一般来说，在WHERE和JOIN中出现的列需要建立索引，但也不完全如此，因为MySQL只对<，<=，=，>，>=，BETWEEN，IN，以及某些时候的LIKE才会使用索引。例如：

SELECT t.Name

FROM mytable t LEFT JOIN mytable m

ON t.Name=m.username WHERE m.age=20 AND m.city=’郑州’
此时就需要对city和age建立索引，由于mytable表的userame也出现在了JOIN子句中，也有对它建立索引的必要。

刚才提到只有某些时候的LIKE才需建立索引。因为在以通配符%和_开头作查询时，MySQL不会使用索引。例如下句会使用索引：

SELECT * FROM mytable WHERE username like’admin%’
而下句就不会使用：

SELECT * FROM mytable WHEREt Name like’%admin’
因此，在使用LIKE时应注意以上的区别。

（6）索引的不足之处

上面都在说使用索引的好处，但过多的使用索引将会造成滥用。因此索引也会有它的缺点：

◆虽然索引大大提高了查询速度，同时却会降低更新表的速度，如对表进行INSERT、UPDATE和DELETE。因为更新表时，MySQL不仅要保存数据，还要保存一下索引文件。

◆建立索引会占用磁盘空间的索引文件。一般情况这个问题不太严重，但如果你在一个大表上创建了多种组合索引，索引文件的会膨胀很快。

索引只是提高效率的一个因素，如果你的MySQL有大数据量的表，就需要花时间研究建立最优秀的索引，或优化查询语句。

（7）使用索引的注意事项

使用索引时，有以下一些技巧和注意事项：

◆索引不会包含有NULL值的列

只要列中包含有NULL值都将不会被包含在索引中，复合索引中只要有一列含有NULL值，那么这一列对于此复合索引就是无效的。所以我们在数据库设计时不要让字段的默认值为NULL。

◆使用短索引

对串列进行索引，如果可能应该指定一个前缀长度。例如，如果有一个CHAR(255)的列，如果在前10个或20个字符内，多数值是惟一的，那么就不要对整个列进行索引。短索引不仅可以提高查询速度而且可以节省磁盘空间和I/O操作。

◆索引列排序

MySQL查询只使用一个索引，因此如果where子句中已经使用了索引的话，那么order by中的列是不会使用索引的。因此数据库默认排序可以符合要求的情况下不要使用排序操作；尽量不要包含多个列的排序，如果需要最好给这些列创建复合索引。

◆like语句操作

一般情况下不鼓励使用like操作，如果非使用不可，如何使用也是一个问题。like “%aaa%” 不会使用索引而like “aaa%”可以使用索引。

◆不要在列上进行运算

select * from users where YEAR(adddate)<2007;
将在每个行上进行运算，这将导致索引失效而进行全表扫描，因此我们可以改成

select * from users where adddate<‘2007-01-01’;
◆不使用NOT IN和<>操作

以上，就对其中MySQL索引类型进行了介绍。

索引对查询的速度有着至关重要的影响，理解索引也是进行数据库性能调优的起点。考虑如下情况，假设数据库中一个表有10^6条记录，DBMS的页面大小为4K，并存储100条记录。如果没有索引，查询将对整个表进行扫描，最坏的情况下，如果所有数据页都不在内存，需要读取10^4 个页面，如果这10^4个页面在磁盘上随机分布，需要进行10^4次I/O，假设磁盘每次I/O时间为10ms(忽略数据传输时间)，则总共需要 100s(但实际上要好很多很多)。如果对之建立B-Tree索引，则只需要进行log100(10^6)=3次页面读取，最坏情况下耗时30ms。这就是索引带来的效果，很多时候，当你的应用程序进行SQL查询速度很慢时，应该想想是否可以建索引。进入正题：

第二章、索引与优化

1、选择索引的数据类型

MySQL支持很多数据类型，选择合适的数据类型存储数据对性能有很大的影响。通常来说，可以遵循以下一些指导原则：

(1)越小的数据类型通常更好：越小的数据类型通常在磁盘、内存和CPU缓存中都需要更少的空间，处理起来更快。
(2)简单的数据类型更好：整型数据比起字符，处理开销更小，因为字符串的比较更复杂。在MySQL中，应该用内置的日期和时间数据类型，而不是用字符串来存储时间；以及用整型数据类型存储IP地址。
(3)尽量避免NULL：应该指定列为NOT NULL，除非你想存储NULL。在MySQL中，含有空值的列很难进行查询优化，因为它们使得索引、索引的统计信息以及比较运算更加复杂。你应该用0、一个特殊的值或者一个空串代替空值。

1.1、选择标识符
选择合适的标识符是非常重要的。选择时不仅应该考虑存储类型，而且应该考虑MySQL是怎样进行运算和比较的。一旦选定数据类型，应该保证所有相关的表都使用相同的数据类型。
(1)   整型：通常是作为标识符的最好选择，因为可以更快的处理，而且可以设置为AUTO_INCREMENT。

(2)   字符串：尽量避免使用字符串作为标识符，它们消耗更好的空间，处理起来也较慢。而且，通常来说，字符串都是随机的，所以它们在索引中的位置也是随机的，这会导致页面分裂、随机访问磁盘，聚簇索引分裂（对于使用聚簇索引的存储引擎）。

2、索引入门
对于任何DBMS，索引都是进行优化的最主要的因素。对于少量的数据，没有合适的索引影响不是很大，但是，当随着数据量的增加，性能会急剧下降。
如果对多列进行索引(组合索引)，列的顺序非常重要，MySQL仅能对索引最左边的前缀进行有效的查找。例如：
假设存在组合索引it1c1c2(c1,c2)，查询语句select * from t1 where c1=1 and c2=2能够使用该索引。查询语句select * from t1 where c1=1也能够使用该索引。但是，查询语句select * from t1 where c2=2不能够使用该索引，因为没有组合索引的引导列，即，要想使用c2列进行查找，必需出现c1等于某值。

2.1、索引的类型
索引是在存储引擎中实现的，而不是在服务器层中实现的。所以，每种存储引擎的索引都不一定完全相同，并不是所有的存储引擎都支持所有的索引类型。
2.1.1、B-Tree索引
假设有如下一个表：

CREATE TABLE People (

last_name varchar(50)    not null,

first_name varchar(50)    not null,

dob        date           not null,

gender     enum(‘m’, ‘f’) not null,

key(last_name, first_name, dob)

);

其索引包含表中每一行的last_name、first_name和dob列。其结构大致如下：

索引存储的值按索引列中的顺序排列。可以利用B-Tree索引进行全关键字、关键字范围和关键字前缀查询，当然，如果想使用索引，你必须保证按索引的最左边前缀(leftmost prefix of the index)来进行查询。
(1)匹配全值(Match the full value)：对索引中的所有列都指定具体的值。例如，上图中索引可以帮助你查找出生于1960-01-01的Cuba Allen。
(2)匹配最左前缀(Match a leftmost prefix)：你可以利用索引查找last name为Allen的人，仅仅使用索引中的第1列。
(3)匹配列前缀(Match a column prefix)：例如，你可以利用索引查找last name以J开始的人，这仅仅使用索引中的第1列。
(4)匹配值的范围查询(Match a range of values)：可以利用索引查找last name在Allen和Barrymore之间的人，仅仅使用索引中第1列。
(5)匹配部分精确而其它部分进行范围匹配(Match one part exactly and match a range on another part)：可以利用索引查找last name为Allen，而first name以字母K开始的人。
(6)仅对索引进行查询(Index-only queries)：如果查询的列都位于索引中，则不需要读取元组的值。
由于B-树中的节点都是顺序存储的，所以可以利用索引进行查找(找某些值)，也可以对查询结果进行ORDER BY。当然，使用B-tree索引有以下一些限制：
(1) 查询必须从索引的最左边的列开始。关于这点已经提了很多遍了。例如你不能利用索引查找在某一天出生的人。
(2) 不能跳过某一索引列。例如，你不能利用索引查找last name为Smith且出生于某一天的人。
(3) 存储引擎不能使用索引中范围条件右边的列。例如，如果你的查询语句为WHERE last_name=”Smith” AND first_name LIKE ‘J%’ AND dob=’1976-12-23’，则该查询只会使用索引中的前两列，因为LIKE是范围查询。

2.1.2、Hash索引
MySQL 中，只有Memory存储引擎显示支持hash索引，是Memory表的默认索引类型，尽管Memory表也可以使用B-Tree索引。Memory存储引擎支持非唯一hash索引，这在数据库领域是罕见的，如果多个值有相同的hash code，索引把它们的行指针用链表保存到同一个hash表项中。
假设创建如下一个表：
CREATE TABLE testhash (
fname VARCHAR(50) NOT NULL,
lname VARCHAR(50) NOT NULL,
KEY USING HASH(fname)
) ENGINE=MEMORY;
包含的数据如下：

假设索引使用hash函数f( )，如下：

f(‘Arjen’) = 2323

f(‘Baron’) = 7437

f(‘Peter’) = 8784

f(‘Vadim’) = 2458

此时，索引的结构大概如下：

Slots是有序的，但是记录不是有序的。当你执行
mysql> SELECT lname FROM testhash WHERE fname=’Peter’;
MySQL会计算’Peter’的hash值，然后通过它来查询索引的行指针。因为f(‘Peter’) = 8784，MySQL会在索引中查找8784，得到指向记录3的指针。
因为索引自己仅仅存储很短的值，所以，索引非常紧凑。Hash值不取决于列的数据类型，一个TINYINT列的索引与一个长字符串列的索引一样大。

Hash索引有以下一些限制：
(1)由于索引仅包含hash code和记录指针，所以，MySQL不能通过使用索引避免读取记录。但是访问内存中的记录是非常迅速的，不会对性造成太大的影响。
(2)不能使用hash索引排序。
(3)Hash索引不支持键的部分匹配，因为是通过整个索引值来计算hash值的。
(4)Hash索引只支持等值比较，例如使用=，IN( )和<=>。对于WHERE price>100并不能加速查询。
2.1.3、空间(R-Tree)索引
MyISAM支持空间索引，主要用于地理空间数据类型，例如GEOMETRY。
2.1.4、全文(Full-text)索引
全文索引是MyISAM的一个特殊索引类型，主要用于全文检索。

3、高性能的索引策略
3.1、聚簇索引(Clustered Indexes)
聚簇索引保证关键字的值相近的元组存储的物理位置也相同（所以字符串类型不宜建立聚簇索引，特别是随机字符串，会使得系统进行大量的移动操作），且一个表只能有一个聚簇索引。因为由存储引擎实现索引，所以，并不是所有的引擎都支持聚簇索引。目前，只有solidDB和InnoDB支持。
聚簇索引的结构大致如下：

注：叶子页面包含完整的元组，而内节点页面仅包含索引的列(索引的列为整型)。一些DBMS允许用户指定聚簇索引，但是MySQL的存储引擎到目前为止都不支持。InnoDB对主键建立聚簇索引。如果你不指定主键，InnoDB会用一个具有唯一且非空值的索引来代替。如果不存在这样的索引，InnoDB会定义一个隐藏的主键，然后对其建立聚簇索引。一般来说，DBMS都会以聚簇索引的形式来存储实际的数据，它是其它二级索引的基础。

3.1.1、InnoDB和MyISAM的数据布局的比较
为了更加理解聚簇索引和非聚簇索引，或者primary索引和second索引(MyISAM不支持聚簇索引)，来比较一下InnoDB和MyISAM的数据布局，对于如下表：

CREATE TABLE layout_test (

col1 int NOT NULL,

col2 int NOT NULL,

PRIMARY KEY(col1),

KEY(col2)

);

假设主键的值位于1—10,000之间，且按随机顺序插入，然后用OPTIMIZE TABLE进行优化。col2随机赋予1—100之间的值，所以会存在许多重复的值。
(1)   MyISAM的数据布局
其布局十分简单，MyISAM按照插入的顺序在磁盘上存储数据，如下：

注：左边为行号(row number)，从0开始。因为元组的大小固定，所以MyISAM可以很容易的从表的开始位置找到某一字节的位置。
据些建立的primary key的索引结构大致如下：

注：MyISAM不支持聚簇索引，索引中每一个叶子节点仅仅包含行号(row number)，且叶子节点按照col1的顺序存储。
来看看col2的索引结构：

实际上，在MyISAM中，primary key和其它索引没有什么区别。Primary key仅仅只是一个叫做PRIMARY的唯一，非空的索引而已。

(2)   InnoDB的数据布局
InnoDB按聚簇索引的形式存储数据，所以它的数据布局有着很大的不同。它存储表的结构大致如下：

注：聚簇索引中的每个叶子节点包含primary key的值，事务ID和回滚指针(rollback pointer)——用于事务和MVCC，和余下的列(如col2)。

相对于MyISAM，二级索引与聚簇索引有很大的不同。InnoDB的二级索引的叶子包含primary key的值，而不是行指针(row pointers)，这减小了移动数据或者数据页面分裂时维护二级索引的开销，因为InnoDB不需要更新索引的行指针。其结构大致如下：

聚簇索引和非聚簇索引表的对比：

3.1.2、按primary key的顺序插入行(InnoDB)

如果你用InnoDB，而且不需要特殊的聚簇索引，一个好的做法就是使用代理主键(surrogate key)——独立于你的应用中的数据。最简单的做法就是使用一个AUTO_INCREMENT的列，这会保证记录按照顺序插入，而且能提高使用 primary key进行连接的查询的性能。应该尽量避免随机的聚簇主键，例如，字符串主键就是一个不好的选择，它使得插入操作变得随机。

3.2、覆盖索引(Covering Indexes)
如果索引包含满足查询的所有数据，就称为覆盖索引。覆盖索引是一种非常强大的工具，能大大提高查询性能。只需要读取索引而不用读取数据有以下一些优点：
(1)索引项通常比记录要小，所以MySQL访问更少的数据；
(2)索引都按值的大小顺序存储，相对于随机访问记录，需要更少的I/O；
(3)大多数据引擎能更好的缓存索引。比如MyISAM只缓存索引。
(4)覆盖索引对于InnoDB表尤其有用，因为InnoDB使用聚集索引组织数据，如果二级索引中包含查询所需的数据，就不再需要在聚集索引中查找了。
覆盖索引不能是任何索引，只有B-TREE索引存储相应的值。而且不同的存储引擎实现覆盖索引的方式都不同，并不是所有存储引擎都支持覆盖索引(Memory和Falcon就不支持)。
对于索引覆盖查询(index-covered query)，使用EXPLAIN时，可以在Extra一列中看到“Using index”。例如，在sakila的inventory表中，有一个组合索引(store_id,film_id)，对于只需要访问这两列的查询，MySQL就可以使用索引，如下：

mysql> EXPLAIN SELECT store_id, film_id FROM sakila.inventory\G

*************************** 1. row ***************************

id: 1

select_type: SIMPLE

table: inventory

type: index

possible_keys: NULL

key: idx_store_id_film_id

key_len: 3

ref: NULL

rows: 5007

Extra: Using index

1 row in set (0.17 sec)

在大多数引擎中，只有当查询语句所访问的列是索引的一部分时，索引才会覆盖。但是，InnoDB不限于此，InnoDB的二级索引在叶子节点中存储了 primary key的值。因此，sakila.actor表使用InnoDB，而且对于是last_name上有索引，所以，索引能覆盖那些访问actor_id的查询，如：

mysql> EXPLAIN SELECT actor_id, last_name

-> FROM sakila.actor WHERE last_name = ‘HOPPER’\G

*************************** 1. row ***************************

id: 1

select_type: SIMPLE

table: actor

type: ref

possible_keys: idx_actor_last_name

key: idx_actor_last_name

key_len: 137

ref: const

rows: 2

Extra: Using where; Using index

3.3、利用索引进行排序
MySQL 中，有两种方式生成有序结果集：一是使用filesort，二是按索引顺序扫描。利用索引进行排序操作是非常快的，而且可以利用同一索引同时进行查找和排序操作。当索引的顺序与ORDER BY中的列顺序相同且所有的列是同一方向(全部升序或者全部降序)时，可以使用索引来排序。如果查询是连接多个表，仅当ORDER BY中的所有列都是第一个表的列时才会使用索引。其它情况都会使用filesort。

create table actor(

actor_id int unsigned NOT NULL AUTO_INCREMENT,

name      varchar(16) NOT NULL DEFAULT ”,

password        varchar(16) NOT NULL DEFAULT ”,

PRIMARY KEY(actor_id),

KEY     (name)

) ENGINE=InnoDB

insert into actor(name,password) values(‘cat01′,’1234567’);

insert into actor(name,password) values(‘cat02′,’1234567’);

insert into actor(name,password) values(‘ddddd’,’1234567′);

insert into actor(name,password) values(‘aaaaa’,’1234567′);

mysql> explain select actor_id from actor order by actor_id \G

*************************** 1. row ***************************

id: 1

select_type: SIMPLE

table: actor

type: index

possible_keys: NULL

key: PRIMARY

key_len: 4

ref: NULL

rows: 4

Extra: Using index

1 row in set (0.00 sec)

mysql> explain select actor_id from actor order by password \G

*************************** 1. row ***************************

id: 1

select_type: SIMPLE

table: actor

type: ALL

possible_keys: NULL

key: NULL

key_len: NULL

ref: NULL

rows: 4

Extra: Using filesort

1 row in set (0.00 sec)

mysql> explain select actor_id from actor order by name \G

*************************** 1. row ***************************

id: 1

select_type: SIMPLE

table: actor

type: index

possible_keys: NULL

key: name

key_len: 18

ref: NULL

rows: 4

Extra: Using index

1 row in set (0.00 sec)

当 MySQL不能使用索引进行排序时，就会利用自己的排序算法(快速排序算法)在内存(sort buffer)中对数据进行排序，如果内存装载不下，它会将磁盘上的数据进行分块，再对各个数据块进行排序，然后将各个块合并成有序的结果集（实际上就是外排序）。对于filesort，MySQL有两种排序算法。
(1)两遍扫描算法(Two passes)
实现方式是先将须要排序的字段和可以直接定位到相关行数据的指针信息取出，然后在设定的内存（通过参数sort_buffer_size设定）中进行排序，完成排序之后再次通过行指针信息取出所需的Columns。
注：该算法是4.1之前采用的算法，它需要两次访问数据，尤其是第二次读取操作会导致大量的随机I/O操作。另一方面，内存开销较小。
(3)   一次扫描算法(single pass)
该算法一次性将所需的Columns全部取出，在内存中排序后直接将结果输出。
注：从 MySQL 4.1 版本开始使用该算法。它减少了I/O的次数，效率较高，但是内存开销也较大。如果我们将并不需要的Columns也取出来，就会极大地浪费排序过程所需要的内存。在 MySQL 4.1 之后的版本中，可以通过设置 max_length_for_sort_data 参数来控制 MySQL 选择第一种排序算法还是第二种。当取出的所有大字段总大小大于 max_length_for_sort_data 的设置时，MySQL 就会选择使用第一种排序算法，反之，则会选择第二种。为了尽可能地提高排序性能，我们自然更希望使用第二种排序算法，所以在 Query 中仅仅取出需要的 Columns 是非常有必要的。

当对连接操作进行排序时，如果ORDER BY仅仅引用第一个表的列，MySQL对该表进行filesort操作，然后进行连接处理，此时，EXPLAIN输出“Using filesort”；否则，MySQL必须将查询的结果集生成一个临时表，在连接完成之后进行filesort操作，此时，EXPLAIN输出 “Using temporary;Using filesort”。

3.4、索引与加锁
索引对于InnoDB非常重要，因为它可以让查询锁更少的元组。这点十分重要，因为MySQL 5.0中，InnoDB直到事务提交时才会解锁。有两个方面的原因：首先，即使InnoDB行级锁的开销非常高效，内存开销也较小，但不管怎么样，还是存在开销。其次，对不需要的元组的加锁，会增加锁的开销，降低并发性。
InnoDB仅对需要访问的元组加锁，而索引能够减少InnoDB访问的元组数。但是，只有在存储引擎层过滤掉那些不需要的数据才能达到这种目的。一旦索引不允许InnoDB那样做（即达不到过滤的目的），MySQL服务器只能对 InnoDB返回的数据进行WHERE操作，此时，已经无法避免对那些元组加锁了：InnoDB已经锁住那些元组，服务器无法解锁了。
来看个例子：

create table actor(

actor_id int unsigned NOT NULL AUTO_INCREMENT,

name      varchar(16) NOT NULL DEFAULT ”,

password        varchar(16) NOT NULL DEFAULT ”,

PRIMARY KEY(actor_id),

KEY     (name)

) ENGINE=InnoDB

insert into actor(name,password) values(‘cat01′,’1234567’);

insert into actor(name,password) values(‘cat02′,’1234567’);

insert into actor(name,password) values(‘ddddd’,’1234567′);

insert into actor(name,password) values(‘aaaaa’,’1234567′);

SET AUTOCOMMIT=0;

BEGIN;

SELECT actor_id FROM actor WHERE actor_id < 4

AND actor_id <> 1 FOR UPDATE;

该查询仅仅返回2—3的数据，实际已经对1—3的数据加上排它锁了。InnoDB锁住元组1是因为MySQL的查询计划仅使用索引进行范围查询（而没有进行过滤操作，WHERE中第二个条件已经无法使用索引了）：

mysql> EXPLAIN SELECT actor_id FROM test.actor

-> WHERE actor_id < 4 AND actor_id <> 1 FOR UPDATE \G

*************************** 1. row ***************************

id: 1

select_type: SIMPLE

table: actor

type: index

possible_keys: PRIMARY

key: PRIMARY

key_len: 4

ref: NULL

rows: 4

Extra: Using where; Using index

1 row in set (0.00 sec)

mysql>

表明存储引擎从索引的起始处开始，获取所有的行，直到actor_id<4为假，服务器无法告诉InnoDB去掉元组1。
为了证明row 1已经被锁住，我们另外建一个连接，执行如下操作：

SET AUTOCOMMIT=0;

BEGIN;

SELECT actor_id FROM actor WHERE actor_id = 1 FOR UPDATE;

该查询会被挂起，直到第一个连接的事务提交释放锁时，才会执行（这种行为对于基于语句的复制(statement-based replication)是必要的）。
如上所示，当使用索引时，InnoDB会锁住它不需要的元组。更糟糕的是，如果查询不能使用索引，MySQL会进行全表扫描，并锁住每一个元组，不管是否真正需要。

linux下如何删除（中文）乱码文件名的文件或者文件夹

2012 年 06 月 10 日作者：erman

暂无评论

linux下：

如果FTP上传没有选用 BIN（二进制），解压就会出现乱码

如果有中文，有些就会出现乱码

ls -i 列出乱码文件，前面的文件的 i 节点号
find ./ -inum 123456 -print -exec rm {} -rf \;

（上面的：123456 换成你的乱码文件节点号）

jquery reference

2012 年 06 月 10 日作者：erman

暂无评论

Selector	Example	Selects
*	$(“*”)	All elements
#id	$(“#lastname”)	The element with id=lastname
.class	$(“.intro”)	All elements with
element	$(“p”)	All p elements
.class.class	$(“.intro.demo”)	All elements with the classes “intro” and “demo”

:first	$(“p:first”)	The first p element
:last	$(“p:last”)	The last p element
:even	$(“tr:even”)	All even tr elements
:odd	$(“tr:odd”)	All odd tr elements

:eq(index)	$(“ul li:eq(3)”)	The fourth element in a list (index starts at 0)
:gt(no)	$(“ul li:gt(3)”)	List elements with an index greater than 3
:lt(no)	$(“ul li:lt(3)”)	List elements with an index less than 3
:not(selector)	$(“input:not(:empty)”)	All input elements that are not empty

:header	$(“:header”)	All header elements h1, h2 …
:animated	$(“:animated”)	All animated elements

:contains(text)	$(“:contains(‘W3Schools’)”)	All elements which contains the text
:empty	$(“:empty”)	All elements with no child (elements) nodes
:hidden	$(“p:hidden”)	All hidden p elements
:visible	$(“table:visible”)	All visible tables

s1,s2,s3	$(“th,td,.intro”)	All elements with matching selectors

[attribute]	$(“[href]”)	All elements with a href attribute
[attribute=value]	$(“[href=’default.htm’]”)	All elements with a href attribute value equal to “default.htm”
[attribute!=value]	$(“[href!=’default.htm’]”)	All elements with a href attribute value not equal to “default.htm”
[attribute$=value]	$(“[href$=’.jpg’]”)	All elements with a href attribute value ending with “.jpg”
[attribute^=value]	$(“[href^=’jquery_’]”)	All elements with a href attribute value starting with “jquery_”

:input	$(“:input”)	All input elements
:text	$(“:text”)	All input elements with type=”text”
:password	$(“:password”)	All input elements with type=”password”
:radio	$(“:radio”)	All input elements with type=”radio”
:checkbox	$(“:checkbox”)	All input elements with type=”checkbox”
:submit	$(“:submit”)	All input elements with type=”submit”
:reset	$(“:reset”)	All input elements with type=”reset”
:button	$(“:button”)	All input elements with type=”button”
:image	$(“:image”)	All input elements with type=”image”
:file	$(“:file”)	All input elements with type=”file”

:enabled	$(“:enabled”)	All enabled input elements
:disabled	$(“:disabled”)	All disabled input elements
:selected	$(“:selected”)	All selected input elements
:checked	$(“:checked”)	All checked input elements

一些常用开源软件

2012 年 04 月 13 日作者：erman
暂无评论

操作系统：Centos※,Freebsd,Ubuntu
网站服务：apache※,nginx※,lighttpd,php※,tomcat※,resin※
数据库：Mysql※,PostgreSQL,Mysql-proxy
代理相关：lvs,keepalived,haproxy,nginx,apache,heartbeat（此行都是※）
网站缓存：squid※,nginx※,varnish
内存缓存：memcache※,memcached,TokyoTyrant※,MongoDB,Cassandra※,redis※,tair,CouchDB
存储相关：Nfs※,Moosefs※,Hadoop※,gfs※,lustre,FastDFS
版本管理：cvs,svn※,git※
监控报警：mboy,mrtg,nagios※,cacti※,zbbix,munin※,hyperic※
域名解析：bind※,powerdns,dnsmq※
同步软件：rsync,sersync,drbd,csync2+lsyncd（此行都是※）
分发工具：Secboy※,expect※,puppet※,cfengine※,ssh+rsync+sersync※
虚拟软件：xen※,kvm
内网软件：iptables※,zebra※,iftraf,ntop※,tc※,iftop
邮件软件：qmail※,posfix※,sendmail
远程拨号：openvpn※,pptp,openswan※,ipip※
统一认证：ldap※
队列工具：ActiveMQ※,RabbitMQ
打包发布：mvn※,ants※,jenkins※
测试软件：apache ab,smokeping,siege,JMeter,Webbench,LoadRunner（此行都是※）
日志相关：syslog,rsyslog,Awstats
DB代理：mysql-proxy,amoeba
linux下 crontab文件在哪 crontab文件路径

2012 年 03 月 20 日作者：erman
暂无评论

用户的都在/var/spool/cron/下

/var/spool/cron/crontabs/root
linux三台以上服务器集群间建立ssh信任关系

2012 年 03 月 20 日作者：erman
暂无评论

linux服务器集群之间进行ssh访问时需要输入密码，对进行scp等操作很麻烦，现教大家如何在linux服务器集群之间实现无密码访问。 ssh访问是是需要指定用户的，所以此处建立用户信任关系时以root用户为例，如服务器集群中有三台服务器，分别为A、B、C。现在要实现三台机器之间的root用户的相互无密码访问，操作步骤如下：

（1 ）用root用户登录A服务器，执行ssh-keygen -t rsa 命令，此命令为A机器上的用户root 生成密钥对。当询问保存路径时全部回车采用默认路径即可，当提示要为密钥输入 passphrase 是回车采用空密码。此命令执行完毕生成一对密钥文件 id_rsa （私钥）和 id_rsa.pub （公钥），默认存储在 /root/.ssh 下;
（2 ）把生成的id_ras.pub 重定向到authorized_keys，命令是cat id_ras.pub > authorized_keys，把authorized_keys文件拷贝到B机器上得的同一目录下（命令为：scp /root/.ssh/authorized_keys root@B: /root/.ssh/ 或者 scp ./authorized_keys root@B: pwd）;

（3）用root用户登录B机器，按照要求执行（1）步骤，然后，将生成的 id_ras.pub 追加到authorized_keys文件中，命令是cat id_ras.pub >> authorized_keys，然后将 authorized_keys文件拷贝覆盖掉A级器上的authorized_keys文件，这样A，B机器之间就可以实现相互之间的ssh无密码访问。

（4）对于C机器，同样将生成的生成的 id_ras.pub 追加到authorized_keys文件中，然后用新的authorized_keys文件覆盖A、B机器上的authorized_keys文件，则A、B、C机器之间就可以进行ssh无密码访问了。
注：以上是对root用户而言，如果是普通用户的话，则权限需要修改，.ssh文件夹权限是700，authorized_keys文件的权限是600，执行以下两个语句即可：
chmod 700 .ssh
chmod 600 authorized_keys

使用nginx作图片服务器的访问权限控制

tibet

笑话

convert -resize 命令用法 {%} {@} {!} {<} {>} {^}

MySQL索引类型及优化

linux下如何删除（中文）乱码文件名的文件或者文件夹

jquery reference

一些常用开源软件

linux下 crontab文件在哪 crontab文件路径

linux三台以上服务器集群间建立ssh信任关系

Tag

最新发布

功能

链接表