当前位置: 首页 > news >正文

东莞公司网站建设公司哪家好港港网app下载最新版

东莞公司网站建设公司哪家好,港港网app下载最新版,免费的crm软件,营销的网站Apache Lucene : Flush, Commit Elasticsearch 是一个基于 Apache Lucene 构建的搜索引擎。 它利用 Lucene 的倒排索引、查询处理和返回搜索结果等功能来执行搜索。 它还扩展了 Lucene 的功能,添加分布式处理功能以支持大型数据集的搜索。 让我们看一下 Apache Luc…

Apache Lucene : Flush, Commit

Elasticsearch 是一个基于 Apache Lucene 构建的搜索引擎。 它利用 Lucene 的倒排索引、查询处理和返回搜索结果等功能来执行搜索。 它还扩展了 Lucene 的功能,添加分布式处理功能以支持大型数据集的搜索。 让我们看一下 Apache Lucene 的功能,这些功能使 Elasticsearch 能够执行这些角色。

Apache Lucene: Flush

Apache Lucene: Flush

当收到文档索引请求时,Lucene 会为文档创建一个倒排索引并将其存储在内存缓冲区中。 当执行索引、更新或删除文档等操作时,Lucene 将这些更改保存在内存缓冲区中,并定期将它们刷新(flush)到磁盘。

刷新(flush)是指将索引文档从易失性内存缓冲区(例如 RAM)移动到物理段的过程。 执行刷新有以下好处:

  • 改进的性能:如果索引文档存储在内存中,则每次执行搜索时都必须从内存中读取它们。 将文档刷新到磁盘可以提高搜索性能。
  • 数据丢失预防:如果发生内存丢失,索引文档可能会丢失。 将文档刷新到磁盘可以防止数据丢失。
private ExternalReaderManager createReaderManager(RefreshWarmerListener externalRefreshListener) throws EngineException {boolean success = false;ElasticsearchReaderManager internalReaderManager = null;try {try {final ElasticsearchDirectoryReader directoryReader = ElasticsearchDirectoryReader.wrap(// DirectoryReader.open() !DirectoryReader.open(indexWriter),shardId);internalReaderManager = new ElasticsearchReaderManager(directoryReader);// lastCommittedSegmentInfos lastCommittedSegmentInfos = store.readLastCommittedSegmentsInfo();ExternalReaderManager externalReaderManager = new ExternalReaderManager(internalReaderManager, externalRefreshListener);success = true;return externalReaderManager;} catch (IOException e) {maybeFailEngine("start", e);try {indexWriter.rollback();} catch (IOException inner) { // iw is closed belowe.addSuppressed(inner);}throw new EngineCreationFailureException(shardId, "failed to open reader on writer", e);}} finally {if (success == false) { // release everything we created on a failureIOUtils.closeWhileHandlingException(internalReaderManager, indexWriter);}}}
  • DirectoryReader.open() 方法打开 DirectoryReader 来读取索引文档。 此方法检查需要刷新的段,并在必要时刷新它们。
  • 代码 lastCommitedSegmentInfos = store.readLastCommissedSegmentsInfo(); 读取最后提交的段信息。 该信息用于确定哪些段需要刷新。

Apache Lucene: Commit

Lucene 的 flush 操作只能保证数据传输到系统的页缓存(page cache)中,但不能保证文件真正安全地写入磁盘。

因此,Lucene 会定期执行同步操作,通过 fsync 系统调用将内核系统页缓存的内容与当前写入磁盘的内容进行同步。 这个操作称为 Lucene 提交 (commit)。

什么是系统的页面缓存?

系统的页缓存是操作系统存储在内存中的数据缓存。 操作系统使用页面缓存,以便程序可以从硬盘读取数据,而不必直接访问内存。 在页面缓存中存储数据有以下好处:

  • 它提高了程序性能,因为程序可以从硬盘读取数据,而无需直接访问内存。
  • 它减少了磁盘读取次数,从而可以延长硬盘的使用寿命。

fsync系统调用是什么?

fsync 系统调用是用于将文件内容永久写入磁盘的系统调用。 它将文件的内容从操作系统的页面缓存复制到磁盘,然后更新磁盘上的标头(有关文件的大小、内容、格式、创建、修改日期和权限的信息)。

通过执行这些操作,Apache Lucene 确保索引文档不仅存储在操作系统的页面缓存中,而且永久存储在磁盘上,从而防止数据丢失。

更多阅读:Elasticsearch:Elasticsearch 中的 refresh 和 flush 操作指南

http://www.yidumall.com/news/29900.html

相关文章:

  • 个人网站备注谷歌seo网站优化
  • 珠海建设企业网站的公司河北seo基础
  • 网站建设公司的岗位职责广州竞价外包
  • 游戏网站网页设计广东疫情最新情况
  • 网站建设微站常见的网络营销模式
  • 手机资讯类网站模板樱桃磁力bt天堂
  • 北京网站建设 一流商丘搜索引擎优化
  • 电商网站建设关键词优化市场调研方法有哪几种
  • 青岛做外贸网站建设seo优化推荐
  • 贷款网站怎么做的近一周的新闻大事热点
  • 申请网站空间有哪几种方式网站站点
  • 做网站时如何给文字做超链接网站seo专员
  • 大连网站快速排名提升怎么优化网站
  • 专门做高端网站设计的云华设计官方app下载安装
  • 备案查询系统绍兴seo网站管理
  • 外贸网站源码去一品资源提高工作效率的方法
  • 使用wget对网站做镜像百度推广一般要多少钱
  • 充值选建设银行打不开网站优化水平
  • iis如何做同时运行两个网站80端口投百度做广告效果怎么样
  • seochinaz查询蜗牛精灵seo
  • 旧版wordpress长岭网站优化公司
  • 如何做网站拓扑结构图云南疫情最新情况
  • h5小游戏源码大全google搜索引擎优化
  • excel 表格 做的网站台州seo服务
  • 网站功能优化蚂蚁链接bt链接
  • 襄阳做网站的cms自助建站系统
  • 个人网站怎么做淘宝客专门做排行榜的软件
  • wordpress企业站主题百度seo优化收费标准
  • 做网站怎么切片百度首页百度
  • c 可以用来做网站吗推广软件下载