SEOSEO
动态网站的搜索引擎策略动态网站的搜索引擎策略动态网站的搜索引擎策略动态网站的搜索引擎策略

动态网站的搜索引擎策略


动态网站的搜索引擎策略



摘要:动态网站丰富了网站的功能,但是对于搜索引擎来说,情况就不同了,动态页面是在用户“输入内容”或者进行“选择”时动态生成的,但是搜索引擎的“搜索机器人”无法“输入”和“选择”。另外,搜索引擎要避免“搜索机器人陷阱(spider traps)”的脚本错误。



一、动态网站的出现和优势



  最早互联网出现时,站点内容都是以HTML静态页面形式存放在服务器上,访问者浏览到的页面都是这些实际存在的静态页面。随着技术的发展,特别是数据库和脚本技术PERL、ASP、PHP和JSP的发展,越来越多的站点都开始采取动态的页面发布手段。比如,我们在GOOGLE.COM上搜索一个内容,得到的搜索结果页面文件"本身"在GOOGLE服务器上并不存在,而是通过程序在我们输入搜索内容时调用后台数据库实时生成的,也就是说,这些结果页面是动态的。



  静态页面的站点只涉及文件的传输问题,而动态站点则复杂得多,用户和站点之间出现大量的交互,网站不再仅仅是内容的发布,而是成为了一种"应用(Application)",是软件业向互联网上的扩张,从软件的角度看,动态站点是逻辑应用层和数据层的分离,数据库负责站点数据的存储管理,而ASP、PHP、JSP等负责处理站点的逻辑应用。这样做的好处除了增加很多交互功能外,更重要的是站点的维护、更新和升级都方便了许多。可以说,没有动态网站技术,目前互联网上的这些超大型站点就不可能出现。



二、搜索引擎抓取动态网站页面时面临的问题



  从用户的角度看,动态网站非常不错,丰富了站点的功能,但是对于搜索引擎来说,情况就不同了。(关于搜索引擎和分类目录的区别,以及搜索引擎的工作原理,请? "了解搜索引擎"http://www.emarketer.cn/em/expert/45.htm)



  根本的问题在于"输入"和"选择",动态页面是在用户"输入内容"或者进行"选择"时动态生成的,但是搜索引擎的"搜索机器人"无法"输入"和"选择"。比如我们要在当当书店站点查看冯英健的《网络营销基础与实践》一书,介绍页面是动态生成的,URL地址是:http://www.dangdang.com/product_detail/product_detail.asp?product_id=493698
这里在"?"后面的product_id参数值需要我们输入的,"搜索机器人"可以通过链接找到http://www.dangdang.com/product_detail/product_detail.asp 页面,但是它无法输入"?"后面的product_id参数值,从而无法抓取这个页面文件。



  另外,对于通过链接达到这种带"?"的页面,技术上搜索引擎可以抓取,但是一般情况下搜索引擎选择不去抓取,这是为了避免一种叫"搜索机器人陷阱(spider traps)"的脚本错误,这种错误会让搜索机器人进行无限循环的抓取,无法退出而浪费时间。



三、动态网站的搜索引擎策略



  动态网站要被搜索引擎抓取,可以采用内容发布系统软件将动态站点转化成静态页面,这种办法对于页面发布后变动少的站点比较合适,比如一些新闻类的站点(如新浪的新闻中心:http://news.sina.com.cn/ )。



  一般的动态网站可以通过下面的办法让搜索引擎抓取:
首先,我们要让动态页面的URL地址中没有"?",让动态页面看上去象"静态页面"。看看下面这个页面http://www.amazon.com/exec/obidos/tg/detail/-/043935806X/ ,这明显是一个动态页面,但是URL地址看上去却象"静态页面"。针对不同的动态技术可以采用下面技术实现:



  ·对于采用ASP技术的动态页面Exception Digital公司提供一种工具叫着XQASP(http://www.xde.net/products/product_xqasp.htm )可以将"?"替换为"/"。
  ·对于采用ColdFusion技术的站点,需要重新配置服务器上的ColdFusion,用"/"代替"?"将参数传输到URL,更详细的信息请见http://coldfusion.com/ 站点。
  ·对于使用Apache服务器的站点,可以使用rewrite模块将带参数的URL地址转换成搜索引擎支持的形式,该模块mod_rewrite在Apache服务器中不是缺省安装的,详细的信息请见http://httpd.apache.org/docs/mod/mod_rewrite.html 。



  对于其他的动态技术也能找到对应的方法改变URL的形式。



  然后,要创建一些静态页面指向这些动态页面(以改变过的URL链接)。
前面说过,搜索引擎机器人并不会自己"输入"参数,所以要让上面这些动态页面被搜索引擎抓取,我们还需要告诉机器人这些页面的地址(也就是参数)。我们可以创建一些静态的页面,一般在网络营销中称? "gateway page"(入口页面),这些页面上有大量指向这些动态页面的链接。



  将这些入口页面的地址提交到搜索引擎,这些页面和链接的动态页面(改变过URL形式)就能都被搜索引擎抓取了。



四、搜索引擎对动态网站支持的改进



  在我们调整动态站点适应搜索引擎的同时,搜索引擎也在发展。到目前为止,绝大多数的搜索引擎还不支持动态页面的抓取,但是GOOGLE、HOTBOT等和国内的百度开始尝试抓取动态网站页面(包括? "?"的页面),这就是我们现在在这些搜索引擎进行搜索时,结果中出现动态链接的原因。



  这些搜索引擎抓取动态页面时,为了避免"搜索机器人陷阱",都只抓取从静态页面(至少"看上去"是静态的页面)链接到的动态页面,而从动态页面链接出的动态页面都不再抓取。



  所以一个动态站点如果只针对上面这些搜索引擎,可以在上面小节介绍方法的基础上简化:只用创建一些入口页面,链接很多动态页面,然后将这些入口页面递交到这些搜索引擎就可以了。



  对于直接使用动态的URL地址,请注意:
  ·文件URL中不要有Session Id,同时不要用ID作为参数名称(特别是对于GOOGLE);
  ·参数越少越好,尽量不要超过2个;
  ·能在URL中不用参数尽量不要用,一些参数转移到其他地方,这样可以增加动态页面被抓取的深度和数目。




动态网站的搜索引擎策略
 
  • Google遗漏了什么2004/02/07
  • 综述:2003年的中国网络营销2004/02/07
  • 如何在GOOGLE上投放广告2004/02/07
  • 百度排名2004/02/07
  • Alexa 世界网站排名研究(下)2004/02/07
  • Alexa 世界网站排名研究(上)2004/02/07
  • Google:涉嫌商标侵权?2004/02/07
  • 警惕《揭穿Google关键词广告服务的暴利内幕! 》的更大骗局!2004/02/07
  • Google广告服务暴利内幕!2004/02/07
  • Alexa数据在中国被“强奸”2004/02/07
  • 马云:明年初进入搜索市场2004/02/06
  • 综述:大鱼Google面对问题2004/02/06
  • 评论:《黑客帝国3》之Google2004/02/06
  • 链接流行度(Link Popularity)2004/02/06
  • 几款搜索引擎优化检测工具2004/02/06
  • 别把GOOGLE太当真2004/02/06
  • 搜索引擎市场酝酿大并购2004/02/06
  • Google的技术剖析2004/02/06
  • Google的原罪--网页序列等级2004/02/06
  • 国外英文目录索引---Yahoo2004/02/06
  • 国外英文目录索引----[ODP/Dmoz]2004/02/06
  • 国外英文目录索引---ASK Jeeves2004/02/06
  • 国外英文目录索引---LookSmart2004/02/06
  • 国外英文目录索引---ABOUT2004/02/06
  • 国外搜索引擎介绍---Alltheweb2004/02/06
  • 国外搜索引擎介绍---AltaVista2004/02/06
  • 国外搜索引擎介绍----Overture2004/02/06
  • 国外搜索引擎介绍---Lycos2004/02/06
  • 国外搜索引擎介绍---HotBot2004/02/06
  • 国内目录索引--sohu搜狐2004/02/06
  • 国内目录索引 ---sina新浪2004/02/06
  • 国内目录索引-----163网易2004/02/06
  • 国内搜索引擎介绍---百度2004/02/06
  • 收费环境下的搜索引擎推广策略2004/02/06
  • 谁敢夸口跟google比?2004/02/06
  • 网络推广的效果评估标准2004/02/06
  • IBM统一人工智能学术2004/02/06
  • 雅虎收购Overture意味着什么?2004/02/06
  • 关于SEO写作中五个最常问的问题2004/02/06
  • 中文搜索引擎的十大误区2004/02/06
  • 微软看好网络搜索服务市场2004/02/06
  • 影响网站排名的一些问题2004/02/06
  • 如何使用关键字才算适当呢?2004/02/06
  • 创建有意义的链接人气度(链接数)2004/02/06
  • 桥页之道2004/02/06
  • Robots Meta Tag的使用2004/02/06
  • Robots.txt指南2004/02/06
  • 搜索引擎和网站的目录结构2004/02/06
  • 如何选择合适的域名2004/02/06
  • 拥有自己的域名的重要性2004/02/06
  • 关于搜索引擎提交的问题2004/02/06
  • 如何建立网站地图(site map)2004/02/06
  • 框架型网页的优化技巧2004/02/06
  • 怎样避免被搜索引擎视为作弊2004/02/06
  • 为网站的Web Robot 设计路标2004/02/06
  • HTML文档中小meta的大作用2004/02/06
  • 实战中文搜索引擎推广2004/02/06
  • 搜索引擎排名算法新趋势2004/02/06
  • 动态网站的搜索引擎策略2004/02/06
  • 从三个方面提高网站的链接广泛度2004/02/06
  • 搜索引擎的十大秘密2004/02/06
  • 如何在搜寻结果名中名列前茅2004/02/06
  • 搜索引擎与spam2004/02/06
  • robots.txt和Robots META标签2004/02/06
  • 用户搜索常见问题及解决方法小结2004/02/06
  • 恋上百度2004/02/06
  • 简谈搜索引擎工作流程2004/02/06
  • 什么是搜索引擎2004/02/06
  • 高级搜索指南2004/02/06
  • 搜索引擎控制关系2004/02/06
  • Google中site:的使用方法总结2004/02/06
  • 学习搜索的网站2004/02/06
  • 网络搜索引擎与智能代理技术2004/02/06
  • 全文检索2004/02/06
  • 从中国人网看搜索引擎的ASP服务2004/02/06
  • 自动分词与中文搜索引擎2004/02/06
  • 搜索引擎的技术发展趋势2004/02/06
  • 目前搜索引擎提供的主要检索服务2004/02/06
  • Google快速锁定内容技巧一瞥2004/02/06
  • 创建Google关键词广告的12高招2004/02/06
  • 对Google更新过程的最终解释2004/02/06
  • Googleplex-Google情结2004/02/06
  • 浅谈Google网页级别2004/02/06
  • 深度分析:Google毁了Web?2004/02/06
  • google中文关键词广告效果测试2004/02/06
  • 搜索引擎使用技巧2004/02/06
  • 搜索引擎跟踪2004/02/06
  • 搜索引擎技术及趋势2004/02/06
  • 如何提高网站的Google PR值2004/02/06
  • 了解Google Dance工具2004/02/06
  • 感动一广告 2004/02/06

  • SEO | Google排名 | Google左侧排名 | 网站设计 | 网站优化 | 网站建设 | 网页设计 | 网页制作 | 排名策略 | 网站排名
    国际Google排名 | Google优化排名 | Google推广 | 网站推广 | 网页推广 | Google排名研究 | Google搜索引擎排名 | 推广服务
    搜索引擎推广 | 搜索引擎排名 | 网络营销 | 中国SEO | 网页优化 | 国际网站推广 | Google排名推广
    搜索引擎注册 | Google广告 | 网站宣传 | 网络宣传 | 网络营销


    ©2004 66t.net 路路通营销网 Our Site Map
    2004/02/06