作者mikoto (米抠头)
看板Blog
标题[问题] 我想从搜寻引擎删除我的blog的文章
时间Thu Oct 30 15:31:39 2008
※ [本文转录自 Google 看板]
作者: mikoto (米抠头) 看板: Google
标题: [问题] 我想从搜寻引擎删除我的blog的文章
时间: Wed Oct 29 03:24:30 2008
之前在写一些抒发心得的创作的时候
并没有想太多
只想放在网志上当个纪录
甚至有些是直接在网志上创作
直到有一天朋友传一个网志给我
发现我的创作居然被改了名字之後
里面的文字一个字都没改
感觉很差
後来发现我的所有创作都可以在各大搜寻引擎
当然包括google
都搜寻得到我的网志上的创作
就算我删掉了还有快取的"库页存档"上还是有纪录@.@
後来我找到到了google里头的网路管理工具
然後再参考一些相关网站
似乎可以把自己的这些网页连结从搜寻引擎上删去
但是弄到其中关於验证这个阶段的时候
出现这句话:
复制下列中继标记,然後将它
"贴到网站首页的第一个 <head> 区段"
(第一个 <body> 区段之前)。
这个是什麽意思?我完全找不到哪里有<head>区段
(原始档里头有找到,但是贴上去...又不见,也没效果)
刚才爬过文了...也有板友有这样的问题
之後解决了吗?从哪里跟GOOGLE反应呢?
但是能不能像这个网站一个步骤一个步骤的解释
http://host2.jkes.tyc.edu.tw/wpblog/?p=423
这个网站的确有介绍到「网路管理员工具」
但是他两张图就解说完毕@.@
而且我照他的方法做就是
卡在"我们侦测到您的确认档案在标头中传回 404 (找不到) 状态。"
然後点进去又有更多的解释...
如果您使用 HTML 验证,请务必为不存在的网址传回 4xx 状态码。
这又该怎麽做呢?
感觉绕了好多圈还是不太懂google到底在说什麽
请大家给点方法或意见,可以让我删除搜寻引擎在blog上的相关网页
感谢!!!
--
※ 发信站: 批踢踢实业坊(ptt.cc)
◆ From: 122.116.69.60
※ 编辑: mikoto 来自: 122.116.69.60 (10/29 03:45)
1F:→ scotty007:<head>跟<body>是网页原始码里面的东西 10/29 07:12
2F:推 ybite:请问你是用哪一套网志系统? (这会有差别) 10/29 16:32
3F:→ mikoto:无名...刚才又尝试了网页移除要求工具...结果还是被打回票 10/29 16:48
4F:→ mikoto:请问s大,怎麽样可以编辑网页原始码?要无名的网管吗? 10/30 15:23
--
※ 发信站: 批踢踢实业坊(ptt.cc)
◆ From: 220.135.81.105
5F:→ jxpc:以blogger为例,可在"让搜寻引擎来寻找您的网志"设否,但RSS 10/30 19:11
6F:→ jxpc:会被搜寻到,所以改用FEEDBURNER并追加相关设定, 10/30 19:11
7F:→ jxpc:接着,过去曾经实验过,在<HEAD>标签加上 10/30 19:11
8F:→ jxpc:<META NAME="ROBOTS" CONTENT="NONE">以及 10/30 19:12
9F:→ jxpc:<META NAME="ROBOTS" CONTENT="NOARCHIVE"> ,仅供参考 10/30 19:12
10F:→ jxpc:最近测过FC2,但在社群页面就会被抓资料了,上述head无效 10/30 19:12
11F:→ jxpc:pixnet和某有名似乎不支援改写head标签,故上述方式无效 10/30 19:15
12F:→ jxpc:抱歉,重看文章之後发现是要「删除」而不是「预防被抓取」 10/30 19:31
13F:→ jxpc:抱歉离题太多了! 10/30 19:31