2007年11月4日 星期日

Google的产品开发理念

Google 的使命( mission ):

Orgnize the world's information to make it universary accessible and useful (致力于全球信息资源的有序化,并向世界各地的用户提供有用的服务)

成功关键 :聪明的人+ 创造性地环境+ 创意的出口 = 创新

 

具体的诠释:

1 )人

雇用最好中的最好的人才,重视大学的教育背景并关注各领域有丰富经验的非传统人才,重视创新的能力,在公司内部采用扁平化的组织结构。

2 )工作环境

创造性的装修(在内部称之为 GooglePlex),像校园和游乐场的结合。

3 )用户为中心的设计

- 开发用户真正需要的产品

- 产品的设计以用户的需求为出发点

- 重视集体智慧

- 不做邪恶的事的理念贯穿到产品之中

4 )产品管理过程

- 接受每个人的创意

相信每个人的智慧,多种形式的创意采集,相信员工是创意的最好来源(也同样重视来自于用户的反馈),每周的头脑风暴会。

- 优化过程,产生top100

罗列所有的想法和创意,评价每一项,这样很容易比较出优先级。

标准有:

1. 对用户的有用程度

2. 对留住用户的帮助有多大

3. 成功的可能性有多大

4. 是否会分散收入来源

5. 成本投入有多大(投入产出比)

最终,其中的四五个被认同的创意会得以继续。

- 小而灵活的工程师队伍

3 人为一个单元,单元是一个基本的项目组,并与Program manager ( PM)坐在一起。人员在项目中的流动性大,通常 3~4个月一个项目,因此能够做一些高回报、高风险的项目。每一个 PM面对 9~10个工程师,单元内 3名工程师中有一个主管( leader),保证技术实现角度的优秀。大的项目(例如企业产品)被按照逻辑划分成模块单元。

在文档方面,通常比较少,唯一必须的是 Product requirement document (PRD)

- 自组织和透明化

公共的日程表,显示每个项目的进展和状态。每周每个员工提交便条(以项目来组织),重视工作成功的重用性。

- 用户为中心的设计

一周一次的用户学习 (user study)

我理解等同于易用性测试,就是邀请用户实际使用产品,然后从中观察了解用户的行为习惯,并作为改进产品的重要依据。

关键点:

发现用户首先看页面中的链接,而不是 logo、广告、导航条、帮助等

发现技术词汇用户不理解,因此需要更好的解释和更少的主观推测

一般在单面镜的实验室中进行,并通过专门软件记录鼠标行为;有时也在书店等公共场所内用笔记本电脑进行测试

在产品发布前后都要测试

试验

有好的想法就进行试验

不要用内部员工做试验(缺少普遍和客观)

Iteration

例如: Google news.首先产生了 demo版,然后 Google的员工使用它阅读新闻,开始立项,样子产生。

当不确定哪一个方案更好时,就让市场和用户来做决定

 

一些重要的结论:

想法的管理和收集

使用多种技术、统计和分析用户的行为

服务应该为用户提供价值(最终的目标)

服务必须是为用户设计的

2007年5月21日 星期一

在线免费Logo制作网站大全


http://www.logomaker.cn/famouslogo/index.aspx   可以生成 GoogleYahoo 等各种风格。狂好用!

http://phorum.com.tw/Generator.aspx   可以生成网站 Logo和条码。好用。

http://cooltext.com/   可以生成网站 Logo和条码。好用。

http://www.eoool.com/ (中文):最全的邮件/QQ/MSN/BLOG 图片生成器,支持国内外主要的邮箱,支持BLOGSNSIM 图标生成,支持blog 的相关免费logo 图标生成。

http://email.playtime.uni.cc/ EmailSignatureGenerator   支持Gmail/Yahoo/Hotmail/MSN 多个邮箱,有三种图片样式供用户选择,而且网站还开放了原代码,您可以下载后,安装到自己的网站中。

http://www.logo91.com/bbs就要设计  有上千种种图片样式供用户选择,而且网站还开放了原代码,您可以下载后,安装到自己的网站中。

http://www.html-kit.com/e/favicon.cgi 收藏夹图标生成器。Favicon.ico 是收藏夹图标,在收藏夹或者浏览器的地址栏里就可以看到这个显著的图标。而且在多标签浏览器时Favicon 可以方便用户迅速定位到他需要的那个标签。 " 收藏夹" 图标有着它特有的规格:图标的大小为16*1632*3248*48 三种格式(以像素为单位),在收藏夹里出现的是16*16favicon.ico 文件生成还是有些难度的:它不是标准的位图文件,需要用专门的favicon 编辑器Microangelo 98favicon.com 等生成。现在发现了一个在线favicon 生成器服务:直接上传你自己的图片(GIF/JPG 格式) ,直接生成16*16 像素的favicon.ico 文件,还可以在线预览和下载。  

http://searchdon.com/create.asp 网站LOGO 在线制作。可以生成多种样式的免费LOGO ,包括google,yahooLOGO 样式

http://www.logogle.com/  可以生成 google LOGO样式图标,可以生成类似 google logo的图标,你可以输入数字、字母和部分符号 [/@;:+-!?] 或者空格。当然还可以生成你自己 LOGO google搜索引擎。

  http://www.streetsigngenerator.com/街道签名生成器(不过不支持中文)

2007年5月20日 星期日

发展垂直搜索引擎的真语

引语

1."确解用户之意,切返用户之需。"

2."门户网站都想着是怎样省钱,而不是怎样花钱来买技术。"

3."搜索引擎不是人人都能做的领域,进入的门槛比较高。"

4."只是优秀还不够,最好的方式是将一件事情做到极致。"( google十大真理)

5."做搜索引擎需要专注" "对于一项排到第四的业务,门户很难做到专注。"

6."用户无法描述他要找什么,除非让他看到想找的东西。"

7. "所谓楔形,其实就是个倒三角,倒三角的尖端部分代表搜索技术,中部是基于技术的产品应用平台,最上端是对整个搜索引擎用户人群文化的认识和理解,以及现代公司竞争最关键也最捉摸不定的所谓品牌。" "楔形"蕴涵的另一个意义是:楔子要打到墙里,尖端是否锐利很重要,但楔子的破坏性有多强,究竟能在墙面挤压出多大的空间,其中端、后端的沉稳与厚重才是关键。

 

搜索引擎的技术和理念都是需要时间和经验的积累的,更是需要长期不断的完善进步的,绝对不要认为可以一蹴而就,要达到一个相对成熟领先的搜索引擎从开始到领先的周期一般需要是四年。着急不得。原因是因为搜索引擎太复杂,而且"用户无法描述他要找什么,除非让他看到想找的东西。" 一切都需要摸索,尝试,问题需要一个一个解决,用户的需要得一点点的挖掘。

搜索引擎是一个产品,给用户提供服务的产品,需要长期的不断的改进升级调整才能持续不断的提用户体验,需要满足用户不断增长并且变化的需求、需要不断适应网络的变化。这是因为网络环境是不断变化的、网民的需求也是不断变化的。千万不要把搜索当成项目来做,做完了撂那让用户去用那你肯定没戏。在搜索引擎领域是讲体验的、新的引擎如果用户体验一旦整体上有领先一年以上的差距并且持续 2年,那前期的领先者的优势就荡然无存,因为搜索引擎的用户转移成本相对而言是比较低的而且口碑是最佳的传播方式。如果一个搜索引擎不能持续不断的技术创新理念创新,那对于这个搜索引擎来说就等于死亡。我们一般形容搜索引擎的领先是以时间计算的。比如:中搜离百度整体差距×年,百度离 google的整体差距×年,……只要你能在用户体验上保持一年的领先优势持续 2年,不需要炒作,一切纷至沓来。在用户体验面前,任何的炒作都显得很渺小。

作垂直搜索引擎,麻雀虽小,但是五脏俱全。无论理念文化、产品管理、应用、技术都和搜索引擎的楔形理论没有什么区别。所以要做好一垂直搜索必须解决这几个方面。

 

 

 

楔形的尖:垂直搜索技术。

垂直搜索技术主要分为两个层次:模板级和网页库级。模板级是针对网页进行模板设定或者自动生成模板的方式抽取数据,对网页的采集也是针对性的采集,适合规模比较小、信息源少且稳定的需求,优点是快速实施、成本低、灵活性强,缺点是后期维护成本高,信息源和信息量小。网页库级就是在信息源数量上、数据容量上检索容量上、稳定性可靠性上都是网页库搜索引擎级别的要求,和模板方式最大的区别是对具体网页不依赖,可针对任意正常的网页进信息采集信息抽取……。这就导致这种方式数据容量上和模板方式有质的区别,但是其灵活性差、成本高。当然模板方式和网页库级的方式不是对立的,这两者对于垂直搜索引擎来说是相互补充的,因为技术只是手段,目的是切反用户之需。本文谈及的技术主要是指网页库级别垂直搜索引擎技术。

搜索引擎的确是一项对技术要求比较高的应用,几年前相关的人才也比较少。现在搜索技术人才多了,相关的技术和技术的应用得相对以前而言更加成熟,但是竞争也更加激烈了。垂直搜索大致需要以下技术:

1. 信息采集技术

2. 网页信息抽取技术

3. 信息的处理技术,包括:重复识别、聚类、比较、分析、语料分析等

4. 语意相关性分析

5. 分词

6. 索引

信息采集技术

垂直搜索引擎spider 和网页库的spider相比应该是更加专业,可定制化。可定向性的采集和垂直搜索范围相关的网页,忽略不相关的网页和不必要的网页,选择内容相关的以及适合做进一步处理的网页深度优先采集、对页面有选择的调整更新频率……,采集可通过人工设定网址和网页分析 url方式共同进行。

垂直搜索对信息的更新有着特别的要求,根据这些特点可以从以下几点考虑:

(1)信息源的稳定性(不能让信息源网站感觉到 spider的压力)

(2)抓取的成本问题

(3)对用户体验改善程度。

根据以上几点制定一种比较好的策略,要做到恰到好处。策略上可以评估网站/ 网页更新的系数、网站/ 网页的重要系数、用户点击系数(或曝光系数)、网站稳定系数……,根据这些系数来确定对这些网站/ 网页更新的频率。再由于新信息和更新了的信息list 页面前面或者首页,所以对网页进行很好的分级可以以低成本很好的解决更新问题,系数比较低的网页一月update 一次,稍微高点的一周update一次、中等的几天到一天一次、高的几小时到几分钟一次。类似搜索引擎的大库、周库、日库,小时库……

基于视觉网页块分析技术,模拟IE 浏览器的显示方式,对网页进行解析。根据人类视觉原理,把网页解析处理的结果,进行分块,再根据需要,对这些块进行处理,如:采集定向、介绍抽取和一些必要的内容的抽取正文抽取……

结构化信息抽取技术,将网页中的非结构化数据按照一定的需求抽取成结构化数据。有两种方式,简单的就是模板方式,另外就是对网页不依赖 web结构化信息抽取方式,这两种方式可以互取长处,以最简单最有效的办法满足需求。垂直搜索引擎和通用搜索引擎最大的区别就是对网页信息结构化抽取后再结构化数据进行深度的处理,提供专业的搜索服务。所以 web结构化信息抽取的技术水平是决定垂直搜索引擎质量的重要技术指标。其实 web结构化信息抽取在百度、 google早已经广泛应用了,如: MP3、图片搜索、google 的本地搜索就是从网页库抽取出企业信息,添加到其地图搜索中的, google通过这种技术正在颠覆做内容的方式。同样的技术应用还在 qihoosogou 购物、shopping 等各种应用中体现。

简单的语法分析,简单的语法分析在搜索引擎中非常重要,可以通过简单的语法分析来改善数据的质量,低成本的获得某类信息,改善排序,寻找需要的内容……

信息处理技术,信息处理包括的范围比较广,主要包括去重、聚类、分析……,这根据需要相关的技术就非常多。

数据挖掘,找出您的信息的关联性对于垂直搜索来说非常重要,有效,可以在这些相关性上为用户提供更细致的服务。

分词技术,面向搜索的分词技术,建立和您的行业相关的词库。注意这是面向搜索的分词,不是面向识别和准确的分词。就这个工作安排十几个人不停的维护也不会嫌多。

索引技术,索引技术对于垂直搜索非常关键,一个网页库级的搜索引擎必须要支持分布索引、分层建库、分布检索、灵活的更新、灵活的权值调整、灵活的索引和灵活的升级扩展、高可靠性稳定性冗余性。还需要支持各种技术的扩展,如偏移量计算等。

其它技术,略。

 

 

 

垂直搜索引擎的技术评估应从以下几点来判断

1. 全面性

2. 更新性

3. 准确性

4. 功能性

 

 

 

锲形的中和尾:产品应用平台和对搜索引擎文化理念的理解

对于任何一个产品来说,产品的模式是最重要的,技术只是手段、工具、途径。用户不会关心你的技术是如何实现的、更不会关心你的技术水平是什么样的,只要用户感觉:这就是我需要的东西,很好用,而且是最好用的。那么你的产品就 OK了。

考虑一个产品的模式需要考虑的东西很多,如:用户需要什么?需求有多大?能不能完整的实现用户的需求?需要什么资源?怎么做到?竞争分析?差异化?根据自身情况能做到什么程度?怎么样保持领先优势?能否收到钱?怎么样收钱?怎么样推广?需要多少时间?如何保证在时间窗口期内有效完成进度?如何分步分期优先完成用户最需要的需求?如何建立有效的反馈机制让我可以了解用户的需求变化和挖掘用户自己也无法表达的需求?如何进一步改善?分期需要多大的投入?如何降低整体成本和前期成本?如何分期投入?投资回报比?周期?……

1. 确解用户之意

任何应用最难的就是了解用户的需求,甚至是用户自己都不知道的需求。

建立完善的、快速的用户意见反馈机制和用户需求调查机制,所有人都应倾听用户的牢骚、建议。不断的分析、修改。

2. 切返用户之需

满足用户的需求,一切纷至沓来。不需要炒作,请把您的资源多多花费在为用户提供良好的体验上来。

3. 不要干扰用户的意图,培养用户的使用习惯和技巧

有一个故事是这样的:还在yahoo 使用google的搜索的时候,华尔街的几个分析师来评估这两个搜索哪个好用,去掉 logo。结果一致评价 yahoo的检索效果好。因为 yahoo是使用的google 检索结果,并且对热点关键词进行了人工调整。但是一转身这些分析师回到自己的电脑边查询东西,不约而同的打开了 google

4. 细节决定成败

信息不是越多越好,在海量的信息时代,如果不能妥善的整理信息,那就等于没有信息。每个页面的每个字,每个像素、图片的放置都值得花费时间去琢磨。把用户最需要的放在最显眼的位置,次需要的放置到更多页面,不需要的扔掉。

5. 将一件事情做到极致

不仅仅要关注80% 的用户的80%的需求, 20%的用户的 20%的需求是您成败关键所在。

6. 专注

这么多需要你解决的问题,你还能干其它事情?对于一个排在第四的业务你是没有机会的。所以垂直搜索引擎的成功肯定不是具备良好资源的行业门户、也不会是大搜索的公司,必然是专注于某一行业的搜索引擎公司。因为只有专注,才能将一件事情做到极致。

7. 创新

失败不要紧,但是如果搜索引擎公司没有创新,那这个搜索引擎公司必然面向的就是死亡。

8. 需要完全掌握主要技术

一个核心业务不可能通过外包手段来解决技术问题。虽然找个大公司外包技术看起来很美丽,很快速,甚至成本比较低。但是这是在毁灭你的将来。因为这是产品,不是项目。产品是需要不断完善调整的,用户的需求也是变化的需要挖掘的,互联网也是变化的,你外包技术绝对不可能做到灵活、及时满足各种变化。

在和竞争对手竞争的时候您如何保持您的领先优势?(前文说了,如果被对手保持领先一段时间,那么你之前的领先优势就荡然无存)。这里还没有考虑竞争问题,购买其它搜索引擎公司的技术,对方会不会把真正的技术毫不保留的卖给你。再说,卖给你你能搞懂吗?技术再困难也要自行解决。否则你注定失败。 最好的办法就是购买核心技术缩短研发周期、成本、风险,再在这个核心技术进行自主研发。

这是垂直搜索的技术门槛,看似不高,其实很高。

对于技术问题可以迂回解决,用最简单的技术满足用户最迫切的需求。用户是不会关心技术实现的。

模板方式可以是网页结构化信息抽取技术的补充。对于可行的应用早期采用模板技术也是不错的选择。比如 chinabbs就做的很好,用户的主要需求是要浏览到好的帖子,所以加强内容的建设,找高水平的编辑做推荐,而且在界面和易用性上也很不错。领先 qihoo。技术方面他们初期采用的应该是模板自动生成方式采集论坛信息,比 qihoo技术水平差,但是这目前不是用户需求的关键,而且 qihoo技术水平层次虽然高但是如果不成熟,体现给用户的东西未必就强。 Chinabbs接下来再解决技术难点,在技术上有提升,那么他就能持续保持领先优势了。 (但是话又说回来,招聘好的编辑很容易,技术要提升一个层次并且成熟很难,而且很耗费时间,当然用户习惯和知名度也是需要很长时间培养的 )

9. 用最简单的技术实现用户最迫切的需要

技术重要,但是技术的使用得当更重要,技术是为用户体验服务的。只要能满足用户需要,什么技术都可以,简单不代表不行,用最简单的技术实现用户最迫切的需要。百度的整体技术我认为离 google中文至少有 1年以上差距,很多方面差距更大,但是百度的效果比 google好,原因就是将简单的技术用于实现用户迫切的需求。

举个我身边的例子来描述简单的技术实现需求:我把我们的基于视觉的网页块分析的正文抽取技术演示给一好友看,好友看后说:我们也实现了。我大惊,他们不是做搜索的,居然也实现了! 他告诉我他们实现的方法后,我再次吃惊,深感简单的技术也可以很好的解决问题,虽然不完全解决,但是能满足自己的需求就好。他们的解决方法是:对网页的 html进行分析,将整段文字中没有 html代码的文字提取出来,这就是正文。(惊叹!!如此简单!!注:他们的信息源都是这样的格式)

10. 根据中国本土互联网特点,强力的 antispam,对信息进行清洗。

11. 误解垂直搜索

很多人误解垂直搜索就是把相关的行业网页做一个采集,进行正文抽取,实现搜索,完成信息册查询。其实并非如此。如果这样无法和网页搜索竞争,网页搜索很容易就可以将网页库按行业分类、按地区分类。

 

垂直搜索应该是对垂直行业信息进行深度的加工,有效的整合,为用户提供网页搜索无法做到的专业性、功能性,为用户提供深一步的服务和完整的体验,而且不仅仅是提供信息的检索。垂直搜索是和信息搜索有本质的差异化的。

12. 专注用户体验的改善