全部标签

百度搜索研发部

分类描述：

百度搜索研发部官方原介绍：百度搜索研发部官方博客（http://www.baidu-tech.com）由百度搜索研发部创建并维护。我们希望通过网络社区与关注搜索引擎及相关产品的技术人员交流互动，分享百度工程师研究的方向和取得的成果。

注：后貌似在2013年底关停。故而我在互联网中收集整理出部分和搜索引擎相关的内容转发出来，供大家查看。

这些内容对我们了解搜索引擎应该是极具价值的，尤其是当年(那时候我还没接触SEO呢)，不过毕竟是时间很长的文章了，现在部分内容在百度资源平台的一些文档中也有提及。

最新随机最多浏览最多喜欢最多评论

分类：
SEO教程 SEO基础 SEO技巧 SEO服务 SEO话题 SEO资讯 SEO课程 SEO赚钱 SEO问答 HTML和SEO Python与SEO WordPress与SEO 百度官方内容百度搜索研发部百度搜索资源平台

百度搜索研发部百度官方内容

浅谈互联网页面价值

搜索引擎每天处理着数以亿计的查询请求，每个查询请求都代表了一个用户对于某种资源的特定需求。多数时候，通过查询返回的网页结果，这些需求被满足了，我们可以认为结果中的某些页面对特定用户的特定需求产生了价值。那么对于搜索引擎而言，页面的价值是指什么，我们为什么要研究页面价值，技术上怎样判断页面的价值呢？本文将逐一回答这些问题。一、什么是页面价值前面我们说了，某个页面满足了某一用户的特定需求，就体…...
- 塵風
- 22年5月25日
- 0
- 0
- 662
百度搜索研发部百度官方内容

搜索背后的奥秘–浅谈语义主题计算

摘要: 两篇文档是否相关往往不只决定于字面上的词语重复，还取决于文字背后的语义关联。对语义关联的挖掘，可以让我们的搜索更加智能化。本文着重介绍了一个语义挖掘的利器:主题模型。主题模型是对文字隐含主题进行建模的方法。它克服了传统信息检索中文档相似度计算方法的缺点，并且能够在海量互联网数据中自动寻找出文字间的语义主题。近些年来各大互联网公司都开始了这方面的探索和尝试。就让我们看一下究竟吧。关键词:主…...
- 塵風
- 22年5月25日
- 0
- 0
- 878
百度搜索研发部百度官方内容

智能算法在站点质量评级体系中的应用

互联网的迅速发展，海量Web数据的扑面而来，给搜索引擎技术带来了严峻的挑战，但同时也带来了新的机遇。从网页抓取的角度来看，同一站点往往包含质量相似的资源，对一个优质网站进行爬取，往往可以找到更多的优质资源。因此，我们希望对网站的质量进行评级，来反映资源的质量水平，从而影响spider的调度和收录。在以往的实践中，大体思路是根据人工调研出的经验构造出规则和阈值。发现问题后逐个打补丁、调阈值，来适应变…...
- 塵風
- 22年6月28日
- 0
- 0
- 844
百度搜索研发部百度官方内容

视频站收录浅析

随着网速的不断提高，人们通过互联网观看视频的需求正越来越大。互联网上的视频站和视频资源也在不断增加，人们经常需要借助搜索引擎来查找自己需要的视频。对视频资源的索引也相应地成为了搜索引擎的一个基本功能。而要提供对视频资源的良好索引需要首先做到对视频站点的足够好的收录。本文将对视频站的收录进行简单探讨。一、简述视频检索系统一种数据流图如下图所示。主要包括网页的抓取、网页上信息的抽取以及建立起索引…...
- 塵風
- 22年6月18日
- 0
- 0
- 710
百度搜索研发部百度官方内容

若无云，岂有风——词语语义相似度计算简介

诸多事物都要受到其周边事物的影响，进而改变自身的形态，甚至确立自己的存在——云动，方知风的存在。反映在人的眼中，则是云赋予了风的含义：若无云，岂有风？ 0. 动机武林高手经常从山川之间顿悟，并由山川之形变化出上乘武艺。风云之间的飘渺互动，实则也为实打实的科学、工程实践提供了指引。风是客观存在的，而只有籍由云，我们才能观察到它。在技术领域的日常工作中，诸如此类的例子数不胜数。而在自然语言语义的研究…...
- 塵風
- 22年6月25日
- 0
- 0
- 991
百度搜索研发部百度官方内容

Boosting算法简介

一、Boosting算法的发展历史　　Boosting算法是一种把若干个分类器整合为一个分类器的方法，在boosting算法产生之前，还出现过两种比较重要的将多个分类器整合为一个分类器的方法，即boostrapping方法和bagging方法。我们先简要介绍一下bootstrapping方法和bagging方法。　　1）bootstrapping方法的主要过程　　主要步骤：　　i)重复地从…...
- 塵風
- 22年5月25日
- 0
- 0
- 791
百度搜索研发部百度官方内容

基于hash计算的多层实验流量切分的实现

1. 背景介绍站点新功能或者是站内新策略开发完毕之后，在全流量上线之前要评估新功能或者新策略的优劣，常用的评估方法是A-B测试，做法是在全量中抽样出两份小流量，分别走新策略分支和旧策略分支，通过对比这两份流量下的各指标的差异，我们可以评估出…...
- 塵風
- 22年6月3日
- 0
- 0
- 958

TOP1

谷歌浏览器(Google Chrome)各版本以及历史版本下载
23年8月22日
TOP2

Python爬虫报错：(Caused by SSLError(SSLEOFError(8, ‘EOF occurred in violation of protocol (_ssl.c:1129)’)))解决
22年6月26日
TOP3

命令（CMD）终端的清屏/清空命令/快捷键
22年8月21日
下/卸载鲁大师后浏览器主页被篡改为360导航的解决方法
22年12月11日
Windows10系统电脑日历添加节假日信息
22年7月30日
彻底禁止Windows10系统自动更新方法
22年10月4日

HTML标签：rel=”bookmark”解释以及SEO作用
21年9月19日
商君列传八——至德者不和于俗，成大功者不谋于众
21年11月9日
SEO优化技巧：首页链接nofollow
21年10月4日
阿里云/腾讯推荐新用户以及新用户购买云服务器注意事项
21年12月6日
WordPress编辑器增强插件推荐：Advanced Editor Tools
24年1月16日
WordPress批量修改文章分类
23年10月28日

❯

解锁会员权限

个人中心

购物车

优惠劵

今日签到

有新私信私信列表

搜索

幸运之星正在降临...

点击领取今天的签到奖励！

恭喜！您今天获得了{{mission.data.mission.credit}}积分

今日签到

连续签到

{{item.credit}}

连续{{item.count}}天

查看所有

我的优惠劵

_￥_优惠劵

使用时效：无法使用

使用时效：
之前

使用时效：永久有效

优惠劵ID：
×

限制以下商品使用：限制以下商品分类使用：不限制使用：

[{{ct.name}}]

所有商品和商品类型均可使用

没有优惠劵可用!

购物车

×

删除

购物车空空如也!

清空购物车前往结算

您有新的私信

没有新私信

写新私信查看全部

{{userData.name}}已认证

百度搜索研发部

浅谈互联网页面价值

搜索背后的奥秘–浅谈语义主题计算

智能算法在站点质量评级体系中的应用

视频站收录浅析

若无云，岂有风——词语语义相似度计算简介

Boosting算法简介

基于hash计算的多层实验流量切分的实现

谷歌浏览器(Google Chrome)各版本以及历史版本下载

Python爬虫报错：(Caused by SSLError(SSLEOFError(8, ‘EOF occurred in violation of protocol (_ssl.c:1129)’)))解决

命令（CMD）终端的清屏/清空命令/快捷键

下/卸载鲁大师后浏览器主页被篡改为360导航的解决方法

Windows10系统电脑日历添加节假日信息

彻底禁止Windows10系统自动更新方法

HTML标签：rel=”bookmark”解释以及SEO作用

商君列传八——至德者不和于俗，成大功者不谋于众

SEO优化技巧：首页链接nofollow

阿里云/腾讯推荐新用户以及新用户购买云服务器注意事项

WordPress编辑器增强插件推荐：Advanced Editor Tools

WordPress批量修改文章分类