百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 文章教程 > 正文

手把手教你翻译 ElasticSearch 8.9 中文文档,让搜索引擎触手可及

yund56 2025-07-26 01:33 16 浏览

翻译ElasticSearch 8.9 中文文档

最近小编在学习 ElasticSearch 的官方文档,但是,作为一个英文水平不太好的小编来说,直接阅读英文文档实在是一件困难的事情。不知道小伙伴们是不是也面临着同样的问题呢?不用担心,我找到了一个解决办法,可以帮助大家手把手地翻译 ElasticSearch 的文档。让我来分享给大家吧!

获取 ElasticSearch 英文官方文档

首先,我们需要使用 Python 编程语言来爬取 ElasticSearch 官网上的英文文档。为了简化这个过程,我们可以使用一个强大的库叫做 Beautifulsoup。它可以帮助我们解析 HTML 页面,提取出我们需要的内容。

在 Python 中,我们可以使用以下代码来实现爬取:

获取待翻译的所有教程的html文件名

import requests
from bs4 import BeautifulSoup
def get_contents(es_url):
    es_url = "https://www.elastic.co/guide/en/elasticsearch/reference/8.9/"
    index_url = es_url + "index.html"  # elasticsearch 的网址
    # 发送HTTP请求,获取页面内容
    text = requests.get(index_url, headers=headers, verify=False).text
    # 使用Beautifulsoup解析HTML页面
    soup = BeautifulSoup(text, "html.parser")
    # 提取文档内容
    toc_class = soup.find("div", {"class": "toc"})
    spans = toc_class.find_all("span")
    # 获取所有的教程html文件名
    url_names = []
    for ind, span in enumerate(spans):
        # 获取子目录的链接
        try:
            url_name = span.find("a").attrs.get("href")
        except:
            continue
        url_names.append(url_name)
    return url_names

实现html文件转为md

使用BeautifulSoup库解析html网页内容后,使用html2text工具转为MarkDown格式:

import requests
import html2text as ht
text_maker = ht.HTML2Text()
def url2md(url_name):
    # 拼接教程url
    url = es_url + url_name
    # 发送HTTP请求,获取页面内容
    htmlpage = requests.get(url, headers=headers).text
    # 将html内容转换为md格式
    mdtext = text_maker.handle(htmlpage)
    return mdtext

翻译ElasticSearch教程正文

接下来,我们需要使用 Edge 的翻译接口来翻译文档的正文部分。同样,我们可以使用 Python 来实现这个过程。具体代码可参考公众号推文:

科研工具 | python自动获取arxiv最新NLP领域论文的中文创新点

通过以上代码,我们可以将英文文档的正文部分翻译成中文,并保存到本地文件中。

制作目录上传至 GitHub

最后一步,我们需要将翻译好的文档制作成 Markdown(MD)格式,并上传至 GitHub 上,分享给更多的人。

Github项目地址:https://github.com/AIFWST/Elasticsearch8DocsCN.git

总结

通过以上三个简单的步骤,我们可以轻松地制作 ElasticSearch 8.9 中文文档。这样一来,无论你是初学者还是有一定经验的开发者,都能更好地理解和使用 ElasticSearch。公众号后续也将继续分享ElasticSearch中文文档的学习笔记,修正翻译内容,与大家一起交流和学习。

如果你对这个方法有任何疑问或者有其他更好的方法,欢迎在评论区留言,让我们一起交流探讨。

赶快来关注公众号【AI财智通】,一起探索更多有趣又实用的科技技巧吧!

相关推荐

SM小分队Girls on Top,女神战队少了f(x)?

这次由SM娱乐公司在冬季即将开演的smtown里,将公司的所有女团成员集结成了一个小分队project。第一位这是全面ACE的大姐成员权宝儿(BoA),出道二十年,在日本单人销量过千万,韩国国内200...

韩国女团 aespa 首场 VR 演唱会或暗示 Quest 3 将于 10 月推出

AmazeVR宣布将在十月份举办一场现场VR音乐会,观众将佩戴MetaQuest3进行体验。韩国女团aespa于2020年11月出道,此后在日本推出了三张金唱片,在韩国推出了...

韩网热议!女团aespa成员Giselle在长腿爱豆中真的是legend

身高163的Giselle,长腿傲人,身材比例绝了...

假唱而被骂爆的女团:IVE、NewJeans、aespa上榜

在韩国,其实K-pop偶像并不被认为是真正的歌手,因为偶像们必须兼备舞蹈能力、也经常透过对嘴来完成舞台。由于科技的日渐发达,也有许多网友会利用消音软体来验证K-pop偶像到底有没有开麦唱歌,导致假唱这...

新女团Aespa登时尚大片 四个少女四种style

来源:环球网

韩国女团aespa新歌MV曝光 画面梦幻造型超美

12月20日,韩国女团aespa翻唱曲《DreamsComeTrue》MV公开,视频中,她们的造型超美!WINTER背后长出一双梦幻般的翅膀。柳智敏笑容甜美。宁艺卓皮肤白皙。GISELLE五官精致...

女网友向拳头维权,自称是萨勒芬妮的原型?某韩国女团抄袭KDA

女英雄萨勒芬妮(Seraphine)是拳头在2020年推出的第五位新英雄,在还没有正式上线时就备受lsp玩家的关注,因为她实在是太可爱了。和其他新英雄不同的是,萨勒芬妮在没上线时就被拳头当成虚拟偶像来...

人气TOP女团是?INS粉丝数见分晓;TWICE成员为何在演唱会落泪?

现在的人气TOP女团是?INS粉丝数见分晓!现在爱豆和粉丝之间的交流方法变得多种多样,但是Instagram依然是主要的交流手段。很多粉丝根据粉丝数评价偶像的人气,拥有数百、数千万粉丝的组合作为全球偶...

韩国女团MVaespa Drama MV_韩国女团穿超短裙子跳舞

WelcometoDrama.Pleasefollow4ruleswhilewatchingtheDrama.·1)Lookbackimmediatelywhenyoufe...

aespa师妹团今年将出道! SM职员亲口曝「新女团风格、人数」

记者刘宛欣/综合报导南韩造星工厂SM娱乐曾打造出东方神起、SUPERJUNIOR、少女时代、SHINee、EXO等传奇团体,近年推出的aespa、RIIZE更是双双成为新生代一线团体,深受大众与粉丝...

南韩最活跃的女团aespa,新专辑《Girls》即将发布,盘点昔日经典

女团aespa歌曲盘点,新专辑《Girls》即将发布,期待大火。明天也就是2022年的7月8号,aespa新专辑《Girls》即将发行。这是继首张专辑《Savage》之后,时隔19个月的第二张专辑,这...

章泽天女团aespa出席戛纳晚宴 宋康昊携新片亮相

搜狐娱乐讯(山今/文玄反影/图科明/视频)法国时间5月23日晚,女团aespa、宋康昊、章泽天等明星亮相戛纳晚宴。章泽天身姿优越。章泽天肩颈线优越。章泽天双臂纤细。章泽天仪态端正。女团aespa亮...

Aespa舞台暴露身高比例,宁艺卓脸大,柳智敏有“TOP”相

作为SM公司最新女团aespa,初舞台《BlackMamba》公开,在初舞台里,看得出来SM公司是下了大功夫的,虽然之前SM公司新出的女团都有很长的先导片,但是aespa显然是有“特殊待遇”。运用了...

AESPA女团成员柳智敏karina大美女

真队内速度最快最火达成队内首个且唯一两百万点赞五代男女团中输断层第一(图转自微博)...

对来学校演出的女团成员语言性骚扰?韩国这所男高的学生恶心透了

哕了……本月4日,景福男子高中相关人士称已经找到了在SNS中上传对aespa成员进行性骚扰文章的学生,并开始着手调查。2日,SM娱乐创始人李秀满的母校——景福高中迎来了建校101周年庆典活动。当天,S...