什么是RSS,它可以做什么

快2020年了,RSS日渐式微,我也是去年机缘巧合下才开始使用的,以前只是听说过。RSS,全称Really Simple Syndication,又称简易信息聚合(也叫聚合内容)是一种RSS基于XML标准,在互联网上被广泛采用的内容包装和投递协议。RSS搭建了信息迅速传播的一个技术平台,使得每个人都成为潜在的信息提供者。它简洁直接无广告,只提供内容!

说人话就是采用一种某种标准的信息数据,广泛应用于网上新闻,博客,不用打开相关网站,有新内容就会推送(当然,前提是需要有一个RSS阅读器),其实RSS用途不仅于此,你可以使用RSS订阅一切内容,例如如下场景:

  • 某个资源网站更新了想看的信息,自动推送相关信息给你
  • 喜欢的爱豆在各个平台上有新动态了,第一时间get~
  • 关注的歌手在附近有新演唱会啦,买买买~
  • 淘宝上看中的宝贝降价啦,立马提醒你
  • 明天会下雨,提前温馨通知
  • ......

可以直接食用的订阅源

简单推荐一些官方的源和各位大佬们做好的

网站 简述
FeedX 主要提供国内外新闻平台的RSS源,很良心
RSSHub DIYGod大佬的开源项目,提供了很多RSS源,种类很多,目前还在不断更新中
cnbeta 主要提供科技数码方面的新闻,官方源https://www.cnbeta.com/backend.php,但是不提供全文。
少数派 官方源https://sspai.com/feed

获取全文输出

有的官方源不支持全文输出,只有简述,例如cnbeta,将其转成有全文输出的办法也简单,利用相关网站。以下推荐一些


给指定网站制作RSS源

Feed43 国外老牌RSS定制网站,已运营多年,它能将网页转换为标准格式的 RSS 源。

优点

  • 免费(也有收费套餐,但一般用不上)
  • 容易上手,无需编程基础

缺点

  • 国外服务,不是很稳定
  • 可自定义程度略低
  • 有些网站不能抓取,报403或404
  • 免费版只会每6小时抓取一次

开始炮制

  1. 如果你想以后继续用或者更改你的feed,可以注册一个账号,不注册登录也可以用

  2. 点击create your first rss feed开始

  3. 这里以1905电影网为例,Step 1. Specify source page address (URL)在Address框输入网址,然后点击reload加载,如果出现乱码,试试Encoding框输入UTF-8

  4. 如果不幸显示404 Not Found或者403 Forbid,那么说明该网站无法转换,你可以换个姿势再试试

  5. 如果成功你就可以看到Page Source框里的html代码,Step 2. Define extraction rules,定义抓取规则。

  6. Global Search Pattern是可选的,一般留空即可,重点在Item (repeatable) Search Pattern

  7. 我要抓取1905网里的电影资讯,源代码中的资讯代码形如<a href="https://www.1905.com/news/20191225/1428107.shtml" target="_blank" data-hrefexp="fr=homepc_news_kx">奥斯卡热门影片《别告诉她》聚焦社会话题 文化差异引碰撞</a>

  8. 那么在Item (repeatable) Search Pattern框下输入<a href="{%}" target="_blank" data-hrefexp="fr=homepc_news_kx">{%}</a>

    即可,{%}表示你要获取的内容,点击Extract然后可以看到网页中符合这个模板的内容都会被抓取到。

  9. Step 3. Define output format,定义输出格式,重点在RSS item properties下的Item Title Template(标题)、Item Link Template(链接)、Item Content Template(全文内容),将第二步获取到的内容输入,{%数字}的形式

    最后点击Preview即可,然后你就能看到最后的RSS源

    Feed URL就是RSS源,你还可以修改成简单好记的名称。

全文输出

利用Feed43做的RSS源无法获取到全文内容,那么利用上文提到的相关网站就可以啦,下面我使用freefullrss进行操作。

在输入框输入相关信息,然后点击Creat Full Text RSS,成功就会显示如下成果:

最后将该网页网址复制添加到RSS阅读器即可,大功告成!本文首发于个人博客

利用Feed43为网站自制RSS源的更多相关文章

  1. C#读取RSS源,并利用Solr索引

    折磨我几天的问题今天终于解决了,分享一下近期solr使用的一些经验. 本来是用nutch在爬取页面,可是客户需要爬取RSS,而且可以识别那些页面是通过RSS源抓取出来的.nutch虽然自带解析RSS的 ...

  2. 如何自己烧制全文RSS(打造自己RSS源)

    烧制RSS源 到Feed43注册一个账号,虽说不注册也能用,但是为了方便修改自己烧制的RSS,最好还是注册一个账号来管理 到主页点击Create new feed 输入网址点击reload 可以看到请 ...

  3. windows下利用iis建立网站网站并实现局域共享

    博客园 首页 新随笔 联系 管理 订阅 随笔- 54  文章- 9  评论- 0  Windows下利用IIS建立网站并实现局域网共享 https://blog.csdn.net/qq_4148541 ...

  4. CozyRSS开发记录21-默认RSS源列表

    CozyRSS开发记录21-默认RSS源列表 1.默认列表 在第一次使用CozyRSS的情况下,我们让它内置五个RSS源吧: 2.响应RSS源的更新 先不处理RSS源列表项的点击,响应下下拉菜单里的更 ...

  5. CozyRSS开发记录11-够用的RSS源管理

    CozyRSS开发记录11-够用的RSS源管理 1.分析需求 先随手画个用例图来看看有哪些参与者会访问我们的源管理: 2.搞一个Controller类 根据前面分析得出的用例图,我们就可以来设计实现一 ...

  6. 利用ThinkPHP搭建网站后台架构

    记录一下ThinkPHP搭建网站后台.调整好样式等操作步骤 下载好ThinkPHP(3.2.3),解压后将核心文件夹ThinkPHP以及index.php等文件复制到网站根目录如下图 对index.p ...

  7. 利用Ihttpmodel实现网站缓存,解决Server.Transfer 直接输出HTML源代码的问题

    今天在用.NET利用IHttpModel实现网站静态缓存的时候,不知道最后为什么用 Server.Transfer(html)的时候结果输出的是HTML的源代码. 贴上源代码 using System ...

  8. XML制作RSS源

    什么是RSS源?看到这片文章的人相信都知道.自己博客首页不就是一个吗? 好吧,先来一个简单点的.直接就是死代码:详细如何使用就看RSS使用标准吧! <?xml version = "1 ...

  9. spring mvc: 生成RSS源

    spring mvc: 生成RSS源 准备: 从相同的maven存储库页面下载 Rome 库及其依赖项rome-utils,jdom和slf4j.和所需的依赖关系 <!-- rss源依赖 --& ...

随机推荐

  1. 捕捉WPF应用程序中XAML代码解析异常

    原文:捕捉WPF应用程序中XAML代码解析异常 由于WPF应用程序中XAML代码在很多时候是运行时加载处理的.比如DynamicResource,但是在编译或者运行的过程中,编写的XAML代码很可能有 ...

  2. qt 自定义窗口显示鼠标划过的轨迹

    鼠标事件分为四种: 1.按下 2.抬起 3.移动 4.双击 鼠标事件继承与QWidget void mouseDoubleClickEvent(QMouseEvent *event) void mou ...

  3. Flask学习之九 分页

    英文博客地址:http://blog.miguelgrinberg.com/post/the-flask-mega-tutorial-part-ix-pagination 中文翻译地址:http:// ...

  4. Django之内置组件

    Django组件介绍       分页器的使用       Form       modelForm       orm       cookie和session       中间件       信号 ...

  5. 《C语言深度解剖》学习笔记之指针和数组

    第4章 指针和数组 1. int *p=NULL 和 *p=NULL 有什么区别 int *p = NULL; 第一句代码的意思是:定义一个指针变量p,其指向的内存里面保存的是 int类型的数据:在定 ...

  6. Logtail提升采集性能

    默认性能限制 为防止滥用消耗过多机器资源,我们对默认安装的Logtail进行了一系列的资源限制.默认安装的Logtail最多日志采集速度为20M/s,20个并发发送. 其他资源限制请参考:启动参数 h ...

  7. 独家 | TensorFlow 2.0将把Eager Execution变为默认执行模式,你该转向动态计算图了

    机器之心报道 作者:邱陆陆 8 月中旬,谷歌大脑成员 Martin Wicke 在一封公开邮件中宣布,新版本开源框架——TensorFlow 2.0 预览版将在年底之前正式发布.今日,在上海谷歌开发者 ...

  8. Android Studio(十二):打包多个发布渠道的apk文件

    Android Studio相关博客: Android Studio(一):介绍.安装.配置 Android Studio(二):快捷键设置.插件安装 Android Studio(三):设置Andr ...

  9. java NIO之HelloWorld

    Java NIO(New IO)是从Java 1.4版本开始引入的一个新的IO API,可以替代标准的Java IO API,以便提高传输速度.但实际上,在最新的JDK中旧的I/0包已经使用NIO重新 ...

  10. Java反射机制(二):通过反射取得类的结构

    在反射运用过程中,如果你想得到一个类的完整结构,那么就要使用到java.lang.reflect包中的几个类: · Constructor  表示类中的构造方法 · Field  表示类中的属性 · ...