有位小伙伴提问,如何快速统计 word 文档中不重复的英文单词?下面以 wps 为例给大家演示。在这篇 word 文档中,有英文段落,也有中文段落,其中中文段落中也有部分是英文单词, 我们可以试着让 wps ai 来解答,比如我在这里提问,如何统计本文档中不重复的英文单词个数? wps ai 给出的答案是这样的,我们可以看一下。点击审阅字数统计, 这里并没有不重复英文单词的个数,只有非中文单词,总共是九十一个,也就是说包括了重复的英文单词。那么如何统计不重复的英文单词呢?我的 思路是这样的,可以先查找非英文的字符,然后将他们删除,那么留下来的就是英文。接下来就可以进行分段,也就是一个单词,一个段落,然后借助 wps 表格来进行统计。好,点击开始显示编辑标记,调用,查找,替换掉, 点击高级搜索,勾选,使用通配符。我们可以先输入一对半角的中括号,然后在中括里面输入感叹号,也就是非,然后小写的 a 到 z, 大写的 a 到 z, 同时我们输入一个空格,再输入 ctrp, ctrp 代表段落标记,查找非英文字母,非空格,并且是非段落标记的字符。点击查找,在 下方位内查找主文档。 wps 找到了四百二十五个,但是呢,其中包括段落标记,我们如果将 p 换成十三,再来查找一下, wps 直接提示错误。那么如果我们不希望选中这些,断了标记可以变通处理。我们先输入 ctrl p, 也就是断了标记 查找,在以下范围内查找主文档,我们可以将这些端的标记呢全部改成空格替换为空格。全部替换,我们再来查找非英文的字符,也就是中括号里面输入一个英文的感叹号, 然后再输入小写的 a 到 z 和大写的 a 到 z, 同时再加一个空格查找。在以下范围内查找主文档, 替换,替换为空,点击全部替换确定。接下来我们只要将所有的空格换成动作标记就可以了, 全部替换确定,然后将多余的段位标题删除。在查找内容中,可以输入两个 ctrl p 替换为一个,点击全部替换,再次点击全部替换,直到全部替换为止。 好,现在我们只要全选复制,然后切换到 wps 表格,可以在 a e 单元格里面输入单词,然后直接粘贴,可以看到总共有九十一个插入数据透视表,可以放在现有 工作表,点击确定。然后只要将字段列表的单词拖到直区域,并且拖到行区域。好,我们发现这里有个空格,可以选中第九十二行删除。刷新一下数据头饰表, 可以选中总记,右击删除总记。现在我们就可以看到这里总共有七十三个不重复的英文单词, nice!
粉丝1.1万获赞14.0万

哈喽,大家好,我是秦老师,今天继续给大家带来不一样的干货啊,我们小伙伴呢想知道啊,一个单元格当中啊,有多少个英语单词啊,其实方法思路也很多啊,比如说啊,算这个单元格当中这个空格有多少个 啊?空格加一啊,就算出大概有多少,对吧?好,我们这里呢教大家一个最简单的方法啊,就是把这个啊 单词给他拆分到每一个单元格,然后算这个非空单元格的个数啊,我们可以这样来操作啊,我们来看怎么操作啊, 然后呢把这一列选中啊,因为我们已经写好了,对吧,然后这个时候呢在分列里面啊,数据分列里面呢,然后分割符号,然后点这个空格,是吧?用空格来进行拆分啊,然后这个时候点完成。好,你看好,接下来我们 只要选这个康的 a 函数啊,然后这个时候呢去选这个范围,对吧?啊,选最长的啊,拆掉最长的这个范围,然后这个时候啊双击朝下,我就算出来啊,这个单元格的个数有多少,对吧?啊,所以大家把这一招呢也掌握好,谢谢大家 好,那么欢迎大家能够好,那么最后呢,还是欢迎大家能够关注曲老师的 nb office 啊,成为职场王者。

本视频内容由数据与智能团队制作, 小伙伴们大家好,欢迎来到数据与智能小课堂。今天的课程内容为 my produce 实力 g word count 单词统计。 上次课我们学习了 my produce 的核心思想与工作过程,今天我们就来看一下他的实力 what count 瓷瓶统计 本次课程将分为两个部分来为大家讲解,第一部分是 word count 任务的描述,第二部分是实验的准备以及 具体过程。在我们这次的 worldcom 实验中,我们将会用到 a a, b, b, c, c 三个 txt 文件, 然后 a a 点 text, 它的文件内容是 disc data and intelligence, 然后 b b 点 text, 文件的内容是 hello everyone, 然后 c c 点 text 文件,它的内容是 welcome。 这次的任务我们会按照英文字母排序统计,三个文件中每个单词出现的次数会是平次,然后每个单词和他的次数占一行,单词和字母之间有间隔。 在我们的实验中,输入部分就是 hello everyone 和 welcome 三个文件,然后他的输出结果就如右边的表格琐事。 在我们的实验准备和具体过程中,我们需要启动虚拟机连接插销,然后启动嗨度集群,最后进行 wedcom 的实验。具体的操作我们来看一下, 接下来我们就来看一下 word count 单词统计的具体实验步骤。首先我们需要打开虚拟机以及连接插校, 我的虚拟机已经提前开启了,然后先 现在就连接插校,现在也已经连接成功了。在开始实验之前,我们首先要启动我们之前搭建过的海度集群, 在这里我们输入 user local 黑度。 二点六点五 i spin start d f s 点 s h。 我们首先开启 d f s, 我们稍微等待一下,现在可以看到名称节点,数据节点第二名 结点已经启动好了, 然后我们再来启动一下样框架, 那么我们的集群就已经启动好了。接下来我们来打开浏览器,查看一下我们在这次的 word count 单词统计中需要用到哪些文件。 我们打开浏览器之后,输入 master 五零零七零 dfs health, 点 jsp, 然后点开这个浏览文件系统, 然后在这个 usa 下 root txt txt dir 就是我之前已经在 hdfs 的常用命令中创建了一些文件。 我们今天使用的是 aa 点 tax, bb 点 tax, cc 点 tax 这三个文件,然后我们来查看一下这些文件中的内容。 a dantex strong 包含的内容是 dc data and intelligence b b, 点 taxi 是 hello everyone cc 点 tax 是 welcome。 我们将用 aa 点 tax bb 点 tax cc text 来进行 word count 瓷瓶统计。首先我们要在海度的安装包中找到 word count 设立包的所在位置, 他在这个海度二点六点五的 shell 文件中,然后有一个 head to, 然后有一个 map reduce, 然后在 sauce 里面 我们找到这个 examples 二点六点五 sources 的架包,然后我们 点击右键进行解压,然后这里我已经解压好了, 然后在这个, 然后在这个 example 二点六点五 source 中 我们可以看到有 examples, 然后在这里有一个 word count 点 java 的文件,这个就是我们需要用到的 word count 的视力包。 我们在这里输入 had to jar user local, 这是我们的安装位置,然后同样是 share how do i produce map reduce examples? 二点六点五的架包, 在这里我们要用到的就是我们刚刚找到的 word count 这个文件。 在这里我们需要输入一些参数,他后面可以接 一定数量的文件名称,然后如果输入了 n 个文件路径,就会把前 n 减一个作为 word count 的输入,然后把最后一个文件路径作为 word count 的输出。我们所使用的 是 user route txtdir 中的 aabb cc 文件,因此我们还要创建一个 word count 的文件夹,然后来作为输出。这里我们输入 user root t x t d i r a a d text bb then text。 然后我们再在这个目录下创建一个, 创建一个 new word count, 然后以他来作为我们文件的我们 word count 运行之后的输出文件,我们来运行一下, 我们可以看到它的分片是三个, 然后这个是他的任务 id, 这里我们可以看到他的进程 现在还在进行 map 任务,然后看到 map 任务已经完成了, 然后 reduce 的任务也已经完 完成。我们在这里可以看到在 map reduce 框架中的一些运行过程。 然后我们再次打开浏览器,我们在八零八八端口可以查看一下 may produce 的任务过程。 我们在这里可以看到这里是他的任务 id 号,和我们刚刚看到的是一样的。 然后执行的是 word count 程序,它使用的是 map reduce 的一个框架, 我们可以看到他现在的状态是以 已经解析完成了,也是解析成功的。 然后我们返回到五零零七零, 我们在 user root txtdi 中可以看到我们刚刚创建的一个 new account 这个文件, 然后在这个 part 这个文件中,我们可以看到他的单词统计的情况, 在我们使用的三个 a abbcc 点 tax 的文件中,每一个单词都只出现了一次,所以它的 单词的统计,每个单词就是出现了一次,那么我们 wordcom 单词统计的实验就到这里结束了。 以上就是今天关于 word come 的实验的全部过程,今天的课程内容到这里就结束了,欢迎大家扫描二维码关注数据与智能微信公众号获取更多好内容,我们下次见。

英语四六级听力听不懂?不要慌,带一把尺子。如果选项是一一二二,比如 a 三、 b 三 c, 四得四,那么就要从两个词数最少的选项中量出最短的就是答案。如果有的选项单词数量是十的话,那么直接从十里边选出长度最短的就 是答案。如果选项是一二二,比如 a 三、 b 四 c 四得四,那么用尺子量出长度最短的就是答案。如果三的长度大于等于四,那么就要选长度第二短。如果选项是一一二三, 比如 a、 三、 b 三、 c, 四得五,那么就要选出现次数最少且长度最短的就是答案。

大家好,今天是我们函数系列的第三个视频,今天呢我们来把三个函数放在一起来进行说明,三个函数呢都是技术函数, 我们来看三个函数他的一个作用。第一个函数亢的函数,他是统计数字单元格的个数,也就是说我们一个区域中有多少个数字,他是统计数字的一个个数。第二个函数 conta, 这里呢就是说他是统计非空单元格的一个个数, 这里是飞空,然后下面一个 count black 函数是统计空单元格的个数,这里呢是大概的一个三个函数的对比,我们来看下面的一个实力, 下面有一系列的一个数据,这三个数据呢都是一样的,我们分别用这三个函数来进行计算,我们来统计这个区域中他的一个数字的个数,这个时候我们用抗函数 cut 选 d 这个区域,然后我们打勾确定结果呢是五,这里呢我们可以来大概的验证一下,这里是一二三四五,然后其他的这些它都不是数字,所以说它的计算结果呢是一个五,我们看第二个 ctrl a, 它的作用呢是统计飞空代表格, 然后我们用这个函数来试一下,我们同样的选中这个函数,我们打勾确定结果呢是九, 他为什么是九?他的作用呢是统计非空单元格,而这里呢我们是一个空单元格,其他的全部都是有内容的,只有这一个是空的,所以说呢,这里是有九个,这里七个,这里有两个,一共是九个。 然后呢我们再来看第三个,我们同样的写函数, 考得不让你函数,我们把这个区域选中 么的勾确定,结果呢是一个一,他的作用呢是统计空单元格的个数,而我们这个区域中只有这个单元格,他是空的,所以说他的结果呢是一。经过这三个函数的一个对比,我们可以总结一下, 这里呢是他们啊表面上的一个区别,但是呢,我们观察这里的数据,我们可以看到呢,这里呢是有一个 a, 他是文本,这里呢是有一个错误值,这里呢是有空值,这里呢是有啊文本,英文字母 excel, 然后这里有汉字,而我们的抗函数只是针对数字进行统计的, 同样的这个区域和我们这个是一样的,他呢?呃,康德 a 这个函数呢,他是只针对非空单元格,他不管你里面是装的什么内容,是文本也好,数字也好,是错误制也好, 他只是啊不空,就是说里面有内容,他都在计算的范围内,所以说呢,这里的结果呢是九。而我们的 controbry 函数,他的作用呢是统计空单元格, 我不管你里面是什么内容我都不管,只要是空的,就在我的一个统计范围内。所以说呢,这三个函数对于我们的数字文本错误值都有他的一个特定的一个统计范围,这里呢就是我们今天讲到的三个基础函数的一个简单应用, 希望对大家呢有所帮助。如果想要系统的学习我们的函数,可以看我们橱窗的一个视频。

hello, 大家好,我们今天要讲的是 exact 函数判断是否是大小写,我们来看一下例子。我们先看一下 exact 的 用法, 里面有两个参数, text 一 text 二,对比是 force, 如果都是大写,这是 true, 可以 先来把单词转化为大写, 我们再来对比这两个单词, 用 if 嵌套, 如果是去的话, 是否则 是是否对的。

如何随机的生成某些符号呢?今天教大家一个方法哈,通过函数来解决,在这里呢我们就输入通过 me 函数, me 函数,然后这个字符串看见没?第一个字符串这里,那么双引号,双引号,这里面 我们就放上我们需要随机生成的这种符号,这种符号在哪里找着,然后在这个搜狗输入法,然后右键点击一下,这里有个符号大全,然后在这里呢,我们输入我们想要的那种符号哈,比如说随机选取几个,一个,两个,三个, 三个,四个,五个,比如随机输,嗯,选输入的五个,然后接着呢再逗号,这是第一个,这字母串开始位置哈,密的函数,第二个参数开始位置,开始位置呢,我们就通过让的比特来解决, 左上的笔寸,上的笔寸呢?因为总共是五个字符,所以我们这里是一逗号五,再随机生成一到五的某个数字,然后呢第三 彩虹蜜的第三个彩盒,就是你提取这里面字符的第几,提取出几个,我们提取出一个出来,对吧?所以按下确定键,哎,看到没有,他随机的生成了一个符号哈, 我们集中一下来,在这,接下来呢,我们把公式来向下拖拽一下,看到没有,就是随机生成了不同的这种符号,就通过密的函数和软的比寸函数欠套来实现了,学会了吗?加个关注吧。
![[GESP202503 三级] 词频统计
#科技特长生 #代码 #每天跟我涨知识](https://p3-pc-sign.douyinpic.com/image-cut-tos-priv/2c00fc7287a59ae6a822adc253770266~tplv-dy-resize-origshort-autoq-75:330.jpeg?lk3s=138a59ce&x-expires=2103267600&x-signature=3r60UvbjIAp6OHeQ8ING58JZNmQ%3D&from=327834062&s=PackSourceEnum_AWEME_DETAIL&se=false&sc=cover&biz_tag=pcweb_cover&l=2026082817595001051E9C159451535F93)
hello, 大家好,我是齐老师,今天呢,我们来看一道这个 g s p 二零二五零三三级的这道题,叫做词频统计, 那么这道题的难度呢,其实应该算是简单啊,它仅仅是考察了大家对于容器的一个理解啊, s t r 容器的一个理解,那么我们 做题的第一步肯定是来看题啊,题目那么文本处理中统计一个词单词出现的这个频率啊,那么给定 n 个单词,然后这个是关键啊,找到其中出现次 数最多的一个单词,那么同时要忽略掉单词中的大小写啊。关键点,在看题目的时候尽量滑一滑,找到关键点,然后自己组织一下思路, 其中这个用力让力输入啊,也是一个非常重要的点啊,当你没有完全啊,没有办法完全理解这个题目的时候,你这个时候就需要通过让力来理解啊。 那么首先第一个六代表什么?一定是代表六个单词吧,六个单词,六个单词,然后接下来这个六个单词接收,那么题目中要忽略掉大小写,那么我们只要在接收之后,把这个单词过一遍,把所有的大写转换成小写,然后放到容器里面来进行统计。 在我们处理完之后,我们只要再把这个容器过一遍,找到里面出现次数最多的这个单词就可以了啊,整个题目的思路呢,还是比较清晰的好,我们接下来就可以写一下这个代码了。 好,这个写代码的时候一定要注意啊,因为我们要用到的是 str 中的 map 啊,或者是 on order the map, 那 么这里的话是只有一个 ios, 您可以把它改成这个万能头啊,也可以,怎么样呢?也可以导入这个 map map 文件,然后接下来我们要在外面定一个啊, map 这个容器,然后第一个键它里面的这个 map 的 容器啊,它里面是键值对的形式,我们把它的键设为 string, 然后第二个值设为 int, 代表的是字幕串出现了多少次,对吧? 然后我们用 mp 就 可以了,那这个就叫 mp, 然后我们再定义两个变量,一个是 string 类型,我们等会儿用来接收的叫 s, 然后还有个 int 是 n, 然后我们接收一下 n 循环,或者 y 循环也行啊, y 循环, y 循环, n 减减,对吧?然后每一次接收一个 s, 然后呢后循环处理一下,我这边写一下,这个叫处理字不串 s 中的大写 好后循环 int i 等于零, i 小 于 s 点 size i 加加。那么判断一下,如果说 s i, 我们这里面要涉及到一个知识点,就是阿斯玛啊,这个我们在课上应该学过,这个阿斯玛,零的阿斯玛是多少?零的阿斯玛是四十八,大写 a 的 阿斯玛是六十五,小写 a 是 九十七,所以我们要把大写转换成小写的话,只需要加上三十二就行了。如果呃大于等于字母 a, 并且 si 小 a 等于字母大写 z 的 话,那么 s i 啊,这边要对齐啊,要养成一个良好的习惯, s i 加等于三十二点,对吧?好,这个函数出来处理就结束了,接下来我们就要把它放进这个容器里面,那么 m p s 加加就可以了,对吧?哎,这样是非常简单的一个过程啊,这样是非常简单的过程。 好,接下来我们把每一个字母串加到这个容器中之后,接下来我们就要找出里面出现的最多次数的一个单词是什么,那么刚刚用过这个 s 已经没有用了,这一回的话我们可以用来把它存 结果,然后呢,我们这个 n 其实也没有用了,那么我们可以把它用来存什么呢?用来存这个最多出现的次数,所以我们首先要出示化一下 n 等于零, 然后呢?呃 for 编一下这个 map for auto i 冒号 m p m p 啊,就把这个我们刚刚这个容器全部每一个元素全部过一遍,那么它里面每一个元素都是 p r 数值,那么 这个 pair 数组里面第一个叫做 first, 第二个叫做 second。 啊,这个这个都是基础知识。好,我们直接判断一下。如果说我们呃 i 点 second is 一 些问题, second 如果大于 n 的 话,就是它这个单词出现的数量已经大于我们这个 n 了,说明这个 这个单词之前出出现次数比我们之前要多,那么这个时候我们就要记录一下这个单词,我们 s 就 等于 i 点 first, 然后并且我们要更改一下 n 的 值,不然的话 n 永远是零啊,每一个单词出现的次数都都会大于大于零的,然后 n 就 等于这个 i 点 seven, 然后我们循环结束之后我们 select 一下 s 就 可以了。 好,这样的话我们这道题就过了啊,如果还有需要齐老师讲解的代码呢?可以发在评论区啊,齐老师慢慢来讲解。

工作中,当我们输入身份证号时,数字自动跳下一行,前面文字间距也自动变宽,如果点退格键又会删除文字,怎么办呢? 首先框选文字,鼠标右键点击下方段落,点击换行和分页勾选允许新闻在单词中间换行,点击确定就好了,你学会了吗?