你在搜索引擎里搜一个问题,排在最前面的几个网站,总能拿走绝大多数的点击。很多人以为这些位置都是花钱买的,但其实这背后藏着一套不花钱也能让网站排到前面的规则,也就是 seo 中文叫搜索引擎优化, 他到底是靠什么运转的?他和花钱买排名有什么区别?搜索引擎又是怎么给成千上万的网站打分的?今天我们就把这套机制理清楚。首先要打掉一个最常见的误解,排在前面不等于花了钱。 你在搜索结果最顶部看到带着广告两个小字的,那叫竞价排名,是网站主按点击次数给搜索引擎交的广告费,一旦停钱,位置立刻消失。而 seo 争取的是广告下方的自然排名, 这部分位置是不收钱的。搜索引擎之所以把它们放前面,是因为算法认为这些网站最能解决用户的问题。那搜索引擎是怎么知道哪个网站最能解决问题的呢? 你可以把搜索引擎想象成一个超级图书馆的管理员。互联网上每天新增几百万个网页,管理员不可能自己挨个看, 他会派出无数个叫爬虫的自动程序,顺着网页上的链接,不间断的在互联网上爬取新内容, 抓回来的内容会被分门别类的存进一个巨大的数据库里,这个过程叫建立锁影。只有被收入进锁影库的网站才有资格参与后续的排名。当用户输入关键词搜索时,管理员就要从锁影库里挑出最匹配的结果排在前面。 别人的网站凭什么排在你前面?因为他在三个核心维度上得分更高。第一是技术基础,也就是网站加载快不快,手机端适不适配。这就像一本书,装订的好不好,翻阅顺不顺滑。 第二是内容相关性,网页里的文字和标题是不是精准,回答了用户的搜索词,也就是书的内容对不对题。 第三是站外权威,也就是互联网上有多少其他高质量网站放了链接指向他。在搜索引擎眼里,别的网站给他放链接,就等于在给他投票,票数越多,投票的人越权威,他的排名就越靠前。 不过这套打分机制也有他的边界和失效场景。有些人为了快速排到前面,会故意在网页里隐藏堆砌几百个关键词,或者花钱买一堆垃圾网站的假链接。 这种做法叫黑帽。 seo 短期内可能真的能骗过算法,但搜索引擎的防作弊系统一旦识别出来,就会直接把这个网站从锁影库里彻底出名。这时候你就算在搜索框里输入这个网站的全名,都找不到它。 所以, seo 表面上是在研究怎么迎合搜索引擎的算法规则,但算法的最终目的是为了给真实用户找到最有用的信息。 当一个网站的结构足够清晰,内容足够扎实,并且真的帮到了别人,他自然会获得推荐和链接。看懂了这套机制,你就会明白,在搜索世界里,最好的优化,其实就是老老实实把内容做好。
粉丝3136获赞1.6万

为什么网页做出来了,但搜索引擎不一定看得见?你花了好几天时间把网站设计的漂漂亮亮,上线之后满怀期待的在搜索引擎里打上自己的网站名,结果翻了三页都没找到。 这不是什么灵异事件,而是网页的可见性问题。我会用几分钟时间把搜索引擎如何看待网页这件事讲清楚,不讲玄学排名,只讲最基础也最容易被忽略的四件事, 标题结构、速度和内容质量。如果你正在做网站,或者用过 ai 生成网页,记得先收藏,这属于迟早会用到的那类知识。 我们先对其一个底层认知,你打开自己网站时,看到的是排版好的页面,图片在左,按钮在右,颜色搭配得刚刚好。但搜索引擎看到的完全是另一套东西。它派出的爬虫程序就像一个有视力障碍的速读员,不认视觉设计,只认代码。 它沿着 html 标签一路往下读,读到标题标签才知道这页的主题是什么,读到段落标签才知道正文在哪里, 读到链接标签才知道页面之间的关系。如果你的网页代码里缺乏这些语义标签或者标签写得不准确,在搜索引擎的认知里,这个页面就约等于一团模糊的文字堆。这就解释了那个最常见的错觉,我明明把店装修得很漂亮,为什么没人路过? 因为你的店开在了搜索引擎这条主干道旁边的一条小巷里,而且门口既没有门牌也没有招牌。搜索引擎不是不想让你被人看见,而是他真的不知道该怎么把你的页面归类,也不知道该在什么情况下把你的页面推给用户。 代码层面,最直接的门牌号就是抬头标签。你每打开一个网页,浏览器,标签页上显示的那行字就是抬头的内容。 搜索引擎把这个标签当做页面最核心的主题。声明用户搜索关键词时,搜索引擎会把 title 和用户输入的内容做匹配。如果连 title 里都没有出现相关词汇,这个页面被展示出来的概率会断崖式下降。 很多人犯同一个错误,网站所有页面的开头都写成了首页或者自己公司的名字。想象一下,如果你的每间房间门口贴的门牌都只写着房间,来访者永远不知道哪个是书房,哪个是仓库。 还有一个被严重低估的标签是 description, 也就是页面的描述信息。它虽然不直接决定排名,但它直接决定用户会不会点进来。 在搜索结果页里链接下方那两行灰色小字通常就来自 description。 如果这一块是空的,搜索引擎会自动从页面正文里截取一段,截出来的内容往往前言不搭后语,用户一看就觉得这个网站不靠谱,直接跳过去点下一个。 你的页面可能排在第二页,但因为描述信息清晰,点击率反而比第一页那些没有描述的页面更高。可见性这件事从来不只是被搜到,还包括被点开。标题和描述是门牌和招牌。接下来的问题是,客人进了门,能不能快速找到他想要的东西。 搜索引擎会用标题层级来判断页面内容的组织方式。 h 一 标签代表整页的大标题。 h 二标签代表各个板块的核心论点。 h 三往下是更细的支撑点。 这个层级体系就像一本书的目录,爬虫扫一遍就知道你的页面在讲什么,逻辑清不清晰。很多网站在结构上走了两个极端,一种是把一堆关键词硬塞进标题标签里,看起来像是在骗搜索引擎的注意力,实际上会被识别为堆砌,直接降低内容可信度。 另一种是把所有文字都放进 diy 和 span 这种无语义的容器中,整页没有任何标题层级,爬虫读完第一遍完全抓不住重点。 这两种情况的结果是一样的,信息传达到了,但没传达到位。还有一个结构要素是链接页面内部的链接,告诉搜索引擎哪些内容互相关联,外部的其他网站指向你的链接则像是别人在帮你说话。 高质量的外部链接能显著提升页面的可信度,但这个话题属于更进阶的讨论范围。今天先记住一点,结构不只是排版问题,而是搜索引擎能否理解你内容的根本前提。 搜索引擎对加载速度的敏感程度远超普通用户的想象。从用户体验角度看,一个页面如果超过三秒还没打开,超过一半的用户会直接关掉。 搜索引擎记录下这个行为之后就会做出判断,这个页面可能无法满足用户的及时需求,那我在排序时就把它往后放一下。 从爬虫效率角度看就更直接了。搜索引擎分配给每个网站的扫描资源是有上限的,如果你的服务器响应慢、代码体积庞大,图片未经压缩,爬虫在单位时间内能抓取的页面数量就会减少,这意味着你的新内容可能很久之后才会被收录。 别人周二发的文章,周三就有了搜索曝光,你上周发的内容还在排队,这不是内容质量的差别,而是技术基建上的差距。 搜索引擎衡量内容质量的方式非常机械,它不看你的措辞是否优美,只看两个东西,相关性和清晰度。相关性很好理解用户搜索怎样养护多肉植物。如果你的页面通篇都在讲多肉的种类,而不提养护方法, 哪怕内容再专业,也会因为找不到相关答案而失去曝光机会。清晰度则关系到搜索引擎愿不愿意把你的内容当做优质来源。 段落分割是否清楚有没有用列表或小节把步骤拆开来写,关键信息是不是被埋在了又长又密的段落中间,这些都会影响爬虫的提取效率。 与其写一篇三千字的长文堆砌知识,不如把一个具体问题讲透。页面内容越专注,搜索引擎就越容易判定这个页面在某些特定搜索词上具有高相关性。 有一个经常被忽略的细节是,图片搜索引擎目前识别图片内容主要依靠两个信息,图片的文件名和 alt 属性,也就是图片的文字替代描述。 一张屏幕截图保存为 img 二零二四零三零二,点 png, 上传和保存为 seo basic structure, 点 png, 并配上对应的 alt 描述。在搜索引擎眼中的辨识度完全是两个级别。现在越来越多人在用 ai 工具生成网页,不管是写宣传页还是搭建个人薄课, ai 都能在几十秒内输出一套看起来完整的 html 代码,但这些代码往往只有外观层,缺少羽翼层。 title 写的可能是一个通用站位符。 description 干脆是空的,标题满屏都是 div 包裹着的加粗文字,而非真正的 h 一 或 h 二。这就是为什么 ai 生成的页面看起来像模像样,上线之后却几乎没有搜索流量。解决办法并不复杂, 拿到 ai 输出的代码之后,先检查三件事,每页的 title 是 否准确描述了页面主题,每页的 description 是 否写清了这页提供什么价值, 页面正文是否用标题标签建立了清晰的层级结构。这个补充动作通常不超过十分钟,但它直接决定了搜索引擎能不能顺利读懂你的网站,也决定了你的内容会不会消失在搜索结果的深海里。 搜索引擎从来不藏东西,它只是有一套自己的阅读方式,你能帮它读得清楚,它就愿意把你推给更多需要的人。这个逻辑和店开在哪里很像,把门牌盯好,把招牌擦亮,客人才能找到你。

为什么收东西千万别碰这款搜索引擎,因为它的作用真的会吓到你。他就是秀丹,也叫暗黑谷歌,但他和百度、谷歌完全不是一类东西,普通搜索引擎爬的是网页、视频、新闻这些表面信息,而秀丹专门扫描全球联网的底层设备,他没有广告, 搜索精度极高,平时我们刷的视频网购页面他也根本不收入。他真正强大的地方在于能直接抓到网络深 出的开放设备与敏感信息,你平常收不到的东西这里都有。举个最简单的例子,只要输入一个手机号,通过它就能扒出和这个号码关联的各类隐藏信息。那么我问你,你知道秀丹最恐怖的用法是什么吗?

各位观众,我们聊个硬核话题,你敢信吗?你家的摄像头、打印机都可能被全球黑客围观,今天就来揭秘这个黑客圈的上帝之眼,收的,首先收的到底是啥?他是个搜索引擎,但他搜的不是网页,而是联网设备,小到摄像头、打印机、智能冰箱,大到服务器、工业控制系统,只要连着网就可能被他找到, 所以它被称为互联网搜索引擎。你以为谷歌就是互联网的全部?一个搜索引擎正默默扫描全球,把你的摄像头和服务器变成公开可查的目标。今天我们聊聊搜的,很多人问怎么在渗透测试里用它做侦查。首先要明白,搜的不是谷歌, 谷歌锁引的是网页内容,搜的锁引的是设备、电脑、服务器、摄像头、打印机,甚至智能冰箱。一切暴露在公网的设备都是它的目标。它被称为互联网的搜索引擎, 他是怎么做到的?传统搜索引擎用爬虫抓取网页,稍等,不这么干,他二十四小时扫描全球 ip, 寻找开放的端口,然后执行一部关键操作, banner 挂饼,起标抓取,这是个很重要的概念。在客户端服务器架构里,服务器会发给客户端一个 banner, 这个 banner 包含了软件、版本、配置等信息, 本来是为了正常通信,但在黑客眼里,这就是情报。通过抓取 banner, 我 们可以知道服务器的操作系统版本,知道它运行着什么版本的 ftp 服务, 这些信息是寻找漏洞的起点。 server 把海量的版本信息存进数据库,面对如此庞大的数据,我们怎么找到想要的?答案是过滤器,这是 server 最强大的地方,我们来看几个核心的渗透测试用法。首先是地理位置过滤,输入 country u s 就 能锁定美国的所有设备。结果会告诉你这些设备主要分布在哪些城市, 开放了哪些服务。比如 h t t p s s 属于哪些组织? google cloud, 甚至美国海军网络信息中心运行着什么操作系统? linux 还是 windows? 你甚至可以进一步缩小范围,用 city new york 只看纽约的设备。接下来按服务和软件过滤。比如我们想找 apache 服务器,直接搜索 arp, 全球两千五百多万台,美国、德国、中国排在前列。 shoudan 还会告诉你这些服务器上已知存在的漏洞,它整合了 exploit d b 和 medsploit 的 漏洞库,你可以直接看到漏洞类型是远程执行还是拒绝服务。 我们还能按操作系统搜索于发誓 os and windows 是 设备暴露在公网,比如 softbank。 这时你可以把过滤器组合起来, 比如 os and windows, dosore and amazon, 搜索属于 amazon 的 运行 windows 时的攻网设备。现在我们来点更刺激的,把端口过滤器也加上,比如 country u s o s windows ten port 四百四十五,四百四十五是 smb 服务的端口,这意味着我们一键就能找到全美国暴露了 smb 服务的温氏电脑。如果某个高危 smb 漏洞出现,比如当年的 blocky 条指令,就能瞬间筛选出全球所有潜在的靶机。最后我们看它如何与终极武器 madison 的 联动。在 collinus 里启动 madison, 我 们可以直接调用 shoulder 的 搜索模块, use auxiliary gather shoulder search, 设置你的 shoulder api 密钥,然后设置查询关键字,比如 a patch, 再把目标范围 rusty 设为零点零点零点零,斜杠零代表全球执行。 mata split 会直接调用收敛的接口把结果拉取回来,这些 ip 和端口信息可以直接存入 mata split 的 数据库,为下一步的自动化攻击做准备。这就是收敛在信息侦查中的用法,它为你打开了一个上帝视角,让你看到互联网背后那个由无数设备组成的完全透明的世界。这套组合拳效率简直高到离谱。 好了,今天关于收敛的入门就到这里,我们讲解了它的原理,核心过滤器以及如何与 mata split 结合使用。这只是冰山一角,在信息侦查阶段,收敛绝对是个神器。如果你有任何问题,欢迎留言,我们下个视频见。

全网几百亿个网页,他凭什么零点三秒就翻完了?嗯,你肯定收过东西吧?百度也好,谷歌也好,壁印也好,随手一打字,回车一按,零点三秒欻一下 几百万条,结果全出来了。你有没有哪怕愣过那么一秒?我跟你说啊,全世界的网页有多少几百亿?那他,他到底怎么可能在零点几秒里头把这几百亿个网页从头到尾给你翻一遍呢?翻不完的对吧?你掰着指头算算啊,就算一个网页只瞅一毫秒,几百亿个挪一块,那也得熬上好几年。 所以问题就来了,他到底是咋做到的?来,我告诉你一个挺反常识的真相啊,他根本就没翻你搜的那一个网页,都没看那答案,哪来的 嗨?答案这玩意他早就给你准备好了,不信是吧?来,我给你讲个事你就懂了。你想象啊,有这么一个超级大的图书馆,里头搁着几亿本书, 现在你冲进去拽住管理员就问,哎,哪些书里头提到了番茄炒蛋啊?你猜那个笨管理员会咋办?嗨,一本一本翻呗,翻到你头发都白了,他可能还卡在第三排书架那呢。这个就是所谓的搜索时去翻全网,纯纯的找死。 但是啊,聪明的图书馆早就干了另一件事,他提前请了人,把每一本书都先读了一遍,读的时候手边搁个小本本,边读边记。番茄炒蛋这个词啊,出现在三号书第五页,七十八号书第两页,还有九千号书,每一个词对应哪些书,记得清清楚楚,明明白白。 而这个小本本呢,他有个正经名字叫倒排缩影。哎,你别一听这词就觉得玄乎啊, 其实这东西你天天都在用,你想想,你翻一本书,最后那几页是不是有个名词缩影?给你一个词,啪,直接告诉你在哪几页,你压根不用从头翻整本书对不对?搜索引擎查的就是这么个玩意。所以啊,你一搜番茄炒蛋,他真不是吭哧吭哧去翻玩意,他是去查这个小本本 查表吗?那得多快?零点三秒绰绰有余了都。那好问题他就接着来了,这个小本本 是打哪冒出来的呢?总得有谁去把全网这几百亿个网页提前给读一遍吧。哎,还真有这么个东西,它叫蜘蛛,也有人叫它爬虫,它呢,就是个程序干的活,特别轴,打开一个网页,把里头的内容抓回来,然后顺手啊把这页上所有的链接也都给记下来。记完干嘛? 顺着这些链接再去爬下一个网页呗,爬完再记一批,然后接着爬。你想啊,互联网它本来就是一张网,网页跟网页之间全靠链接连着的,这只蜘蛛 就顺着这张网没日没夜的爬,爬一个读一个,往小本本上记一笔。全网的这本大目录就是这么着一点一点给攒出来的,而且它还不能偷懒,得时不时杀个回马枪回来重爬。为啥呀?网页它会变吗?它得跟着更新 好,目录有了,查得也快了。那还剩最后一个问题,你搜一个词,背后可能划地匹配出几百万个网页,那凭什么有的就排在第一个,有的呢?排到第八百页,你这辈子都翻不到他这里头啊。得拆成三层来看,第一层看的是相关, 你搜的这个词在人家网页里出现了几次,在不在标题上是不是人家的核心内容,越相关的自然就越靠前?这个好理解。第二层看的是权威。这有个特别经典的招,名字叫 padlock。 说白了就一句话,一个网页被越多牛网页链接指过去,他自己也就越牛。 哎,这就跟你写论文是一个道理,你的论文要是被一大堆学术大佬反复引用,那你这篇论文的分量是不是一下子就重了?道理一样的,大家伙都说你好,那你大概率是真的好。 第三层呢,看的是人,就是大家搜完之后都爱点哪一个,点进去待了多久,是不是啪一下秒退出来了?你们这些用脚投票的数据啊,回头又被喂回给了排序系统。 所以你记住这个排序,他不是死的,他是活的,一直在悄悄的变。那聊到这你可能要问了,那是不是全网的东西都能搜的到呢?嗨,还真不是有那么一大片地方啊,蜘蛛塔 进不去,比如说得登录才能看的临时动态生成的,还有那种压根就没有任何别人链接只过去的页面,蜘蛛爬不到他,那他自然也就进不了那个小本本。这片蜘蛛够不着的地方也有个名叫暗网,也叫深网。所以这句话你可得记牢了。搜索引擎嘴上说的全网,其实啊,是他能爬的到的那部分网, 他真实的边界比你以为的要小。好,绕了这么一大圈,咱们再回到最开头那个问题,他凭什么 零点三秒就翻完几百亿个网页?答案是他压根就没翻。他把那些最慢最累最熬人的活爬全网,见目录算权重,全都偷偷的赶在你搜索之前给干完了。那留给你的呢?就剩下最轻松的最后那一下查个表。所以啊,你能看到的所有快,他从来 就不是真的快,是有人在你看不见的那个地方,提前替你把那些慢活全扛了。

老大,我们项目里的搜索功能用的是 elastic search, 为什么不能直接用 my sql 的 like 模糊查询? e s 到底是啥?为啥搜索领域它是老大, 这是搜索技术几十年引进的结果。最早人们用 sql 的 like 关键字做搜索,但 like 不 走所引,只能全表扫描 百万级数据就慢成狗,而且只能精确匹配子串搜手机匹配不到智能手机移动电话,更别提按相关性排序分词,同义词容错纠错了。搜索引擎的核心是倒排锁隐和数据库正排。反过来,正排锁隐是文档 id 到文档内容, 倒排锁隐是词项 term 到包含它的所有文档 id 列表。比如手机这个词出现在文档一三五里,智能出现在二三五里。 搜智能手机就取两个倒排表的交集,直接算出文档三和五最相关,瞬间返回到排缩影。建成后,搜索过程就是查词典和求交集或并集,还有相关性排序速度飞快。还要有分词器,把句子切成词,中文要 i k 击,把分词, 英文按空格加词干,提取停用词,过滤同一词,扩展词项归一化,大小写单复数,相关性平分。早期 t f i d f 现代 b m 二十五词频 t f 乘逆文当频率, i d f 乘字段长度归一化。倒排锁瘾这么厉害,那直接自己写个倒排锁瘾不就行了? e s 又是怎么来的?倒排锁瘾自己写太难了,要处理词盘写入断,合并缓存评分 分词。二零零零年开源大神 dot cutting, 就是 后来嗨 dupe 的 作者,用 java 写了个高性能搜索库,叫 lucin, 把倒排锁影、分词、搜索 平分这些脏活累活全封装了,性能非常好。但 lucin 本质只是个 java 库,你想用得自己写 java 代码,调用 api, 自己管理锁影文件, 自己搞集群分片,门槛极高。后来一个叫 shebinon 的 以色列工程师,二零零四年刚结婚,妻子去伦敦学厨师,他待业期间没事干,想给妻子写个菜谱搜索应用, 就基于 lucin 做了个叫 compass 的 框架。但 compass 还是个框架,要集成到 java 项目里,没有独立运行能力,分布式也弱。然后 compass 就 演变成 elastic search 了吗?对,二零一零年, she 彻底重写 compass, 做出了 elastic search, 核心理念就一个,开箱即用的分布式搜索引擎。第一,它不是酷,而是独立服务,启动就能用。 第二, restful json 接口,任何语言发个 h t t p 请求,就能增删改查,不再被 java 绑定。第三,天生分布式, 一个锁影拆成多个分片,即十二的,分散到多台机器,每个分片还能有副本及 riplik, 做高可用和独附载。均衡, e s。 自动处理分片路由副本同步故障,转移节点,发现新增节点,自动加入集群分片自动均衡,某个节点挂了,副本自动升主 底层还是 lucin 做倒排锁引。 e s。 把分布式、高可用 api、 集群管理、运维监控这些 lucin 之外的东西全包了。数据量再大,只要加机器水平扩展,开发人员一行代码都不用改, 且近实时 n r t。 写入后默认一秒就能被搜到。 e s。 后台先写内存 buffer, 加事务日记 translog, 保证不丢数据,每秒 refresh, 把内存 buffer 生成新段 segment, 让搜索可见后台自动合并小段。所以 e s。 既能做搜索,又能做近实时分析。 哦,我还经常听人说 e l k 站又是啥? e s。 做存储和搜索很强,但数据从哪来?怎么采集清洗,怎么可视化。 e l k 就是 三个开源组建起来的全家桶, elastic search 存家搜 logstash, 负责日制采集转换入库,即 e t l 管道 kiba, 提供 web 界面做查询图标仪表盘,后来又加了比特采、日制 metric bit 采指标, 组成完整的日制分析和可观测性平台。如今 e s。 早已不只是搜索引擎日制分析, e l k 是 业界标配, a p m。 性能监控、安全分析及 s i e m。 业务搜索、电商商品、美团点评、 gitap 代码搜索、地理空间搜索、 bi 分 析,甚至向量检测,配合大模型做 rag, 都用它和关系型数据库对比。 index 缩影约等于 data base 库, document 文档约等于 rohahnfield, 字段约等于 column 列。但 e s 是 schema free, 即动态映射加天生分布式加权威剪索能力来。 e s。 不是 一夜冒出来的神仙产品。 coco like 走不了锁引道, 道牌锁引才是搜索核心。到 lucin 把道牌锁引封装成库,但仍是个 java 库态底层到 she 待业期间给媳妇写菜谱搜索,做出 compass, 到重构成开箱即用的分布式 e s。 加 rest 接口,加自动分片副本 到加 lock dash key 那 币乘 elk 全家桶,最终统治搜索领域。搜索这条路,从 like 全表扫描 到 lucin, 到牌锁影库,到 elastic search 开箱即用分布式服务到 elk 全家桶观测平台,一步步引进,全是痛点驱动。好产品从来不是设计出来的,是从真实需求里引进出来的。

你有没有发现,现在遇到问题,第一反应不是打开百度,而是直接问豆包 kimi deepsea。 以前找信息靠搜, 现在找信息靠问,这个变化正在悄悄改变每一个内容创作者的命运。先说一个基础概念, s e o, 全称 search engine optimization, 中文叫搜索引擎优化,说白了就是让你的内容在搜索结果里排得更靠前,从而获得更多免费流量。 这个玩法过去二十年都很有效,你写一篇文章优化关键词,百度、谷歌就会把你推到前面,用户点进来流量就有了。 但问题是,这个逻辑正在失效。以前用户搜索看到的是一排链接,需要自己动手点进去看。现在用户直接问 ai, ai 直接生成一段答案,用户连链接都不需要点,结论就已经有了。意味着什么? 意味着你的内容从被用户点击变成了被 ai 引用。以前抢的是排名,现在抢的是引用资格。 这就是 ai 时代 seo 的 核心变化。那 ai 是 怎么决定引用谁的内容呢?靠一个技术叫 r a g 解锁增强生成,简单理解,用户提问, ai 去全网解锁相关文档,然后基于解锁到的内容生成答案,你的内容就是 ai 答案的原材料。 在解锁环节,有四个关键机制,决定了你能不能被选上。第一,结构匹配结论,前置分点论述的内容更容易被 ai 匹配到。第二,数据提取,有具体数字的内容才能被 ai 直接提取引用。 三,来源权重,发在知乎、公众号、头条这些高权重平台,比发在个人薄客更容易被解锁。到。第四,时效性,新内容优先,旧内容会逐渐沉默,所以老文章记得更新重发。我举个例子就明白了。 传统写法,近年来,随着文化消费升级和城市转型进程的推进,各类城市文化产业呈现出不同程度的发展趋势, ai 剪辑的时候根本抓不到重点。 ai 友好型写法。成都市二零二六年上半年文化产业产值四百八十七点二亿元,同比增长百分之十二点三、三个核心数据,一、工业遗址改造引流年均超八百万人次。二、电竞赛事带动消费二十三点六亿元。三、影视剧组数量同比增长百分之四十七。 结论,成都文化产业处于工业遗存活化、电竞赛事爆发、影视内容回流的三轮驱动期。结论,数字分点一条都不缺, ai 一 眼就能抓取。直接引用 不同的 ai 平台解锁的内容来源是不一样的。 kimi 常引用知乎新闻门户公开 pdf, deep seek, 偏好权威媒体结构化数据豆包深度整合今日头条、抖音内容生态 文心一言明确解锁百家号、百度文库、百度百科、腾讯元宝明确解锁公众号、视频号 通一千问常引用新闻门户和公开网页。核心策略就一句话,想被哪个 ai 引用,就去它可能解锁的地方。发内容 pk 内容不要复制粘贴,要改写适配发不同平台。知乎发完整版,一千五百字以上深度分析加数据图表可能被 kimi 和 deepsea 解锁。公众号发完整版,排版精美,适合收藏转发被腾讯元宝解锁。头条发精简版,一千字 标题抓眼球,可能被豆包解锁。百度文库发 pdf, 原版文件名含关键词被文新一言解锁。 百家号发摘药版,五百字快速阅读,抖音发图文版,三到五张数据图可能被豆包解锁。关键不是复制粘贴,是改写,适配平台不同,阅读习惯不同,写法就不同。最后给大家五个改造要点,写完对照检查,五缺一则重写,第一, 第一句放核心结论,第二用数字说话,第三分点论数,一二三,第四,每段不超过三行,第五结尾给出明确判断,再进行三个常见误区。 误区一,只在一个平台发,只发公众号,只覆盖腾讯元宝,其他 ai 平台可能根本解锁不到你。误区二,内容太散,写散文,讲故事,发感慨, r a g 难以匹配,解锁必须结论,前置数据密集,分点清晰。 误区三,忽视百度系不做百度文库,百家号用户量很大的文新一言可能解锁不到你。 最后一句话总结, ai 时代的 s e o 去 ai 可能解锁的地方,用 ai 容易匹配的结构发 ai 能够提取的内容,增加被 ai 引用的概率。以前你的竞争对手是同类网页, 现在你的竞争对手是所有信息员,抢排名已经成为过去式,抢引用才是未来。我是地水欧云,关注我,理解传播学更多知识!

大家好呀,我是刘大燕,今天下午呢,我在 o p c 社区里面去参加了一个分享,分享的内容主要是关于 geo, 所以 今天也跟大家来讲 一下什么是 geo, 在 ai 时代非常火的一个概念,它的英文全称是 generative and gene optimization 生成式引擎优化。在这个之前大家应该有听说过一另外一个概念叫 seo search and gene optimization 对 搜索引擎优化。在互联网时代, seo 是 非常重要的,如果你今天去百度搜索 或者去淘宝搜索一个产品,你能看到的前面一页或者是一屏的商品,基本上都是经过 seo 优化的。以前你做 seo 是 让搜索引擎来找到你, 那么现在做 geo 的 优化是让 ai 来找到你。很多人越来越开始习惯用 ai 去搜索东西,搜索习惯变了,那么流量结构也随之发生改变,我们一般怎么去做 geo 呢?今天在分享会上得到了一个非常简单的方法,在这里分享给大家。第一步,你直接把你的商品或者是你的公司名丢到 ai 里面, 看 ai 给到你的是什么结果,他是不是认识你呀?他是怎么描述你的?他会把你推荐给用户吗?第二步呢,如果你没有被搜索到,那你就要看看 ai 在 回答和你同类的业务相关的问题的时候,他都引用了哪些内容,引用了哪些品牌,哪些公司,这些被 ai 引用的内容 就是你的参考模板,这个是第二步。第三步,就是按照这个思路重新去写你的产品介绍,去写你的官网介绍,让 ai 在 搜索的时候能够读到你,读懂你,然后愿意推荐你。所以整一个 ceo 的 逻辑是非常简单的,因为 ai 在 回答用户内容的时候,是基于他训练过的内容和实时能解锁到的内容。只有当你的产 品或者你的公司,你的品牌出现在这些内容里的时候,才能够被 ai 搜索到或者是引用到,这个就是做 ceo 的 一个核心了。 ok, 那 你有没有试过在 ai 里面去搜索你自己搜索你的产品,你的公司呢? ai 是 怎么介绍你的呢?回过头来说,这个也就是当时我们为什么要做个人页面的一个原因,把你自己推销出去,这是你走向 ai 的 第一步。 ok, 那 今天就先分享到这里啊,拜拜。

为什么越来越多人先问 ai 再去搜索?因为大家想要的已经不只是找到信息,而是尽快得到理解。过去,我们通常先搜索关键词,打开网页,再自己筛选、比较和判断。现在很多人会先描述自己的真实问题, 让 ai 帮忙理解、规范和组织信息。 ai 的 优势不只是知道更多,而是能把复杂内容整理成更容易理解的路径。但 ai 也不是绝对正确,它的答案质量仍然取决于问题表达、上下文信息来源和内容结构。 所以, ai 时代真正有价值的知识通常具备四个特点,有上下文、有逻辑、有证据,并且能够帮助人做判断。知识获取正在从找到信息逐渐转向获得理解。工具会变化,但思考会留下。

很多人现在搜东西最大的无奈不是搜不到,而是搜出来的东西越来越杂,广告越来越多,追踪越来越重。这个开源项目就是冲着这件事来的,记住这个项目名字,他在给他已经拿下三十四点四 k 的 star, 他 就是 surxing 开源的 聚合搜索引擎。最狠的是他根本不是又做了一个普通搜索框,而是把多个搜索员的结果聚合到一起,而且尽量不追踪。你对信息搜索重度用途来说,这个项目非常有纪念。

你肯定用过百度或者其他搜索工具,但你有没有想过,世界上还存在另一种,他堪称是互联网上最可怕的搜索工具。他搜的不是网页,而是所有连上网的东西。 他搜电梯监控,你能看到某个大楼里电梯的实时画面。他搜工厂控制器,你能知道某个流水线正在生产什么。他甚至能直接搜到一些根本不应该出现在互联网上的设施。 这个搜索工具它不锁影文字,它锁影的是整个互联网的心跳,服务器、摄像头、路由器,甚至是智能冰箱和红绿灯控制系统。只要这些设备联网,并且服务器直接暴露在公网上,就可能被它记录下来。 很多工程师为了方便,会给设备设置一个公开的访问权限,或者说就用出厂密码。他们以为只有内网的人才知道,但在这个搜索引擎里,只需要输入几个语法关键词。全球所有这样暴露的设备,就像地图上的坐标一样被罗列出来。 谁在用这个工具?安全人员好奇的学生,当然也有专门寻找漏洞黑客。他本身不可怕,可怕的是他揭露了一个事实, 我们以为安全的隐藏在网络背后的无数系统和设备,其实正穿着皇帝的新衣,站在一个透明的广场上。 你可以用它做好事,发现风险并预警,但你也无法阻止另一双眼睛用同样的工具找到你家未加密的暴露在公网的摄像头, 或者你们公司没关严的大门。这可能是互联网最矛盾的一面。一个本意用于透明和连接的工具却成了最大阴影的投射器,那么你知道它叫什么?

这个东西要是捅出来,今天得把所有做基友的都得要得罪了。那我们今天做一家烧烤店啊,徐州的烧烤店,今天刚接了业务,看我今天用提示词一步一步的教大家怎么去实操啊。我在徐州开了家烧烤店,从事大排档, 把我客户要找到我所搜的词全部给我找出来,我们等他一步步的走啊。 好,现在已经出来了啊。徐州烧烤店,徐州大排档,徐州大排档推荐本地烧烤店、徐州夜市,你看这个前面的啊,核心搜索词有多少?这是一万,呃,十万 八千八万五,七万二,五万八,他这个搜索量还是很大的啊,相当大,我们继续啊,然后现在开始第二个提示词,让他把前面数字全部去掉,然后留出来后面这个词。词,我们拿到词之后把它保存一下,方便我们后面建那个知识库体系。 我们保存,把它放在 tst 文档里面,然后我们从这些词里面再去找一个搜索量最大,转化率最高的一个词, 然后我们就把那个词作为一个核心的一个关键。徐州哪里有正宗的本地烧烤大排档营营业到凌晨两点,这个搜索量只有五千。徐州正宗本地,你看他给我们解释啊, 五千的月搜索量在所有的完整与一级排名第一,代表着用户需求量最大,这个词是转化率最高的, 这个词我可以把它保存一下。好,那我们再来看一下目前整个行业的一个情况啊,那第三个关键词看,这是目前他给出的一个参考报告。 ok, 我 们把这个做一个时间戳,让他记住我们今天所有的这个问题,然后我们再上前面去找一下这个词啊,把这个词在新的窗口里面再去打开,去搜索一下,看看它出来是什么东西,每一个地区的都不一样,不知道好玩,这些东西你不用太过于在意啊, 好,我们下面用下一个提示词啊,然后让他把所有的语义全部给整理出来,你不用懂这个到底是什么意思,你也不用去懂这个排列的规则,你就按照我这个提示词一步一步的走,走到最后的话,我们会出一个 知识库体系的一个文档,然后我们用这个文档就可以把我们自己店铺的一个信息和文档和这个知识库进行结合,结合以后就可以去生产文章, 生产文章以后,然后就可以在各个平台去发布了,我们把这个词全部与词全部整理出来以后,然后我们用这个提示词,我们让他给我们做一个通用的知识库体系。为什么要做这个通用的知识库体系?是要把这个通用的知识库体系和你自己店铺相结合, 结合完了以后,然后我们再拿着你的关键词和知识不体系,然后再去写我们所需要的这个文章,豆包所喜欢的那种文章写好以后,然后再根据我们上面所找到的那些可以收入到的那个网站,然后去上面发布, 能够解决百分之九十的一个问题。但这里面还有一个前提啊,就是一些写作上的一个要求,这就是他的一个通用的知识库体系,然后我们下一步话就要把这个通用的知识库体系和我们自己店铺的一些信息去相结合, 结合完了之后就是我们店铺里面的知识库体系,然后以后豆包大模型再去抓取你的时候就能够快速的找到。


今天发现搜索引擎必应最好用,最近玩有道龙虾,想搜一下他的官网,就用关键词。有道龙虾官网是用了某度、某狗、某六零, 其他的搜索引擎给我的都是乱七八糟的玩意,就是不给我官网,只有必应直接给了我官网。大家觉得哪个搜索引擎最好用呢?

ai agent 再强,连不上网也是白搭,今天这个项目让你的 ai 真正开窍! vivo ai 编程助手的本地搜索引擎,通过 mcp 协议接入 vs code, 让 ai 实时搜网页,抓内容,做深度研究,免费零配置保护隐私。 今天 github 上一天涨了六百零五星标。它最强的是深度调研模式,不止搜一个网页,能延链接,层层深入,像人类一样做桌面研究,查文档,搜 api, 找 bug, 效率直接拉满。安装一行命令,配置 mcp 到编辑器 之后,让 ai 搜索一下,自动上网查资料,国产替代方案里最轻量的选择,让你的 ai 真正开窍。关注我,每天一个 ai 技能,下期见!