游客:
注册
|
登录
|
帮助
网友俱乐部
»
建站推广
»
Google adsense
» 让你google广告更多一些
网友生活网
|
网友学堂
如何获得金币?
诚招斑竹
IP归属地查询 PR查询 收录查询 whois查询
免费超短2级域名,your.jpy.cc
传世私服
|
传奇世界私服
注册亚洲交友中心,找个人来同居吧!
免费存储空间,免费网络硬盘
‹‹ 上一主题
|
下一主题 ››
投票
交易
悬赏
活动
打印
|
推荐
|
订阅
|
收藏
标题: 让你google广告更多一些
ljjk5
元帅
UID 46706
精华
1
积分 99426
帖子 49690
威望 554
金币 48489
热心 505
阅读权限 100
注册 2007-2-25
状态 离线
#1
使用道具
发表于 2007-4-30 20:23
资料
个人空间
主页
短消息
加为好友
让你google广告更多一些
让你google广告更多一些,Mediapartners-Google/2.1 爬虫对Adsense的分析
在线广告的系统需求最主要有一点:
1] 能够快速识别新网页的类别。
如何针对网页分类一直是一个困惑搜索引擎的问题,即便现有的方法有很多,例如:
LR,NNet(Neural network), Knn K-nearest neighbor, SVM 。
前面我讲述信息的分类的方法基本上按照线性的SVM方法进行分类,但是信息空间一旦加大到几十万维,要计算一个网页的类别是很困难的。
针对在线广告google的Mediapartners爬虫有一些比较好的特征,能够满足在线广告的需要。这里阐述一下Mediapartners的工作原理:
1] 当我们打开一个网页的时候,这个网页:
<1> 已经被Mediapartners 爬过并分类处理了,那么广告的相关性就有了。
<2>是一个新网页,我们主要讲述新网页。
2] Mediapartners 爬虫在这个网页被load的同时发现了这是一个新网页,那么
进行最简单的判断:
<1> Url 的标记是否有关键词,例如:
http://www.admin5.net/football.html
这里的football 马上就作为一个临时的分类的类别。
<2> 如果没有的话这个网页上一级的分类继承为这个网页的临时分类。
如果以上<1> <2> 都没有,那么刊登公益广告。
3] 然后Mediapartners 进行离线的分析,这里就没有太多的悬念了。Booso.com 最近也做了可以对网页进行分类的计算,例如Mediapartners-Google/2.1 爬虫对Adsense的分析可以在Booso.com 里计算各种类别的权重。
4] 然后下次当网页被浏览时就可以根据权重随机的抽取适合的广告了。
5] 改进
针对更加准确的离线分类,除了Hilltop的方法外,可以增加以下的规则:
<1> 根据网页被搜索到的关键词分类,在线,超强,超准确。
<2> 根据网页的 http_referral 的上一个网页的分类的继承到这个网页。
<3> 根据这个网页里联接出去的 link out 的网页的分类进行反向推导。
网友
ljjk5
签名 - 网友社区
===
[广告]
免费域名(Free Subdomain)
免费空间(Free hosting)
PR查询(Google Pagerank)
投票
交易
悬赏
活动
控制面板首页
编辑个人资料
积分交易
公众用户组
好友列表
个人空间管理
基本概况
流量统计
客户软件
发帖量记录
论坛排行
主题排行
发帖排行
积分排行
在线时间
管理团队
管理统计
当前时区 GMT+8, 现在时间是 2008-10-12 13:22
信产部ICP备案:
京ICP备05066424号
北京市公安局网监备案:1101050648号
Powered by
Discuz!
5.5.0
TOP
清除 Cookies
-
联系我们
-
网友俱乐部
-
Archiver
-
WAP