Anaconda 使用的一些体验与困惑

Channels 使用
需要注意的是做生信分析的童鞋使用 conda 环境时一定要特别注意 conda channels 的设置,滥用 channels 很有可能会导致你的软件升降级(甚至环境)错乱。推荐设置如下(~/.condarc):
channels:
- https://mirrors.tuna.tsinghua.edu.cn/anaconda/cloud/conda-forge
- https://mirrors.tuna.tsinghua.edu.cn/anaconda/cloud/bioconda
- https://mirrors.tuna.tsinghua.edu.cn/anaconda/pkgs/main
- https://mirrors.tuna.tsinghua.edu.cn/anaconda/pkgs/free
- https://mirrors.tuna.tsinghua.edu.cn/anaconda/pkgs/r
- https://mirrors.tuna.tsinghua.edu.cn/anaconda/pkgs/pro
- defaults
show_channels_urls: true
mirrors.tuna.tsinghua.edu.cn/anaconda 是清华大学提供了一个 conda 的镜像;
mirrors.ustc.edu.cn/anaconda 是中科大 conda 镜像,有需要的也可以使用;
mirrors.tuna.tsinghua.edu.cn/anaconda/cloud/bioconda 是生物信息学专用的 channel:
从 2019.04 起清华大学和中科大宣布停止 Anaconda 镜像服务,但是出于教育科研机构使用的前提,在 2019-05-15 清华大学又宣布重新恢复了 Anaconda 镜像!
因此原来使用国内镜像的 conda 可以根据自身需求决定是否需要变更新的 channels:
channels:
- conda-forge
- bioconda
- main
- free
- r
- pro
- defaults
show_channels_urls: true
更多 Anaconda channels,可以参考:https://repo.continuum.io/pkgs/。
软件安装使用
Anaconda 环境下的软件尽量使用 conda、pip 命令去安装。但同时也产生了一个问题,即 conda 中安装了 R,有些使用了 install.packages() , install_github , biocLite 等方式安装的 R 包,在环境迁移的时候,这些包如何迁移?
环境激活
conda 4.6.x 切换环境使用的是:
$ source activate bio-base
conda 4.7.x 后切换环境变成了:
# To activate this environment, use:
> conda activate bio-base
# To deactivate an active environment, use:
> conda deactivate
问题是,conda-4.7.x 使用推荐的命令切换环境,还要你 init 初始化一下 conda,不想 init 的话可以用回 4.6.x 的方式切换环境:
$ conda --version
conda 4.7.5
$ conda activate bio-base
CommandNotFoundError: Your shell has not been properly configured to use 'conda activate'.
To initialize your shell, run
$ conda init <SHELL_NAME>
Currently supported shells are:
- bash
- fish
- tcsh
- xonsh
- zsh
- powershell
See 'conda init --help' for more information and options.
IMPORTANT: You may need to close and restart your shell after running 'conda init'.
$ source activate bio-base
(bio-base) shenweiyan@ecs-steven 10:49:59 /home/shenweiyan
$ which python
/Bioinfo/Pipeline/SoftWare/Anaconda3/envs/bio-base/bin/python
$ source deactivate bio-base
DeprecationWarning: 'source deactivate' is deprecated. Use 'conda deactivate'.
shenweiyan@ecs-steven 11:03:40 /home/shenweiyan
$ source activate bio-base
(bio-base) shenweiyan@ecs-steven 11:03:50 /home/shenweiyan
$ conda deactivate
(bio-base) shenweiyan@ecs-steven 11:03:57 /home/shenweiyan
$
环境导出与恢复
使用 conda 命令安装的包,都可以使用下面的命令导出依赖包/环境并批量恢复:
# To create a requirements.txt file
# Gives you list of packages used for the environment
conda list
# Save all the info about packages to your folder
conda list -e > requirements.txt
# To export environment file
activate <environment-name>
conda env export > <environment-name>.yml
# For other person to use the environment
conda env create -f <environment-name>.yml
# Install via `conda` directly.
# This will fail to install all dependencies. If one fails, all dependencies will fail to install.
conda install --yes --file requirements.txt
# To go around issue above, one can iterate over all lines in the requirements.txt file.
while read requirement; do conda install --yes $requirement; done < requirements.txt
R 与 R 包安装
R Essentials 软件包包含 IRKernel 和 80 多种最流行的数据科学 R 软件包,包括 dplyr,shiny,ggplot2,tidyr,caret 和 nnet 等。
1. R 软件
conda 安装 R 有很多种方法,如可以通过 r=3.6.x,或者 r-base、r-irkernel、r-essentials 都可以。需要注意:
如果需要在 Anaconda 的 Jupyter Notebook 中使用 R,建议使用 conda install -c r r-irkernel 或者 conda install -c r r-essentials 的方式安装,因为 conda install -c r r=3.6.x/r-base 默认不会安装 irkernel,而且先安装的 r=3.6.x/r-base 可能与后安装的 r-irkernel/r-essentials 产生冲突。
2. R 包
通过 conda 安装的 R,在安装 R 包时,最好使用 conda 命令去安装,conda 无法安装的(如 github 的包)再考虑其他的安装方式。
2.1 install.packages
install.packages()安装所有 R 包:
> data = read.table("r-packages.txt", header=T, check.names=F, quote="")
> soft = as.vector(data[,1])
> install.packages(soft)
2.2 bioconductor
Bioconductor 镜像:
Bioconductor 镜像源配置文件之一是
.Rprofile(Linux 下位于~/.Rprofile)。在文末添加如下语句:
#清华大学开源镜像
options(BioC_mirror="https://mirrors.tuna.tsinghua.edu.cn/bioconductor")
也可以在安装过程中指定镜像:
source("http://bioconductor.org/biocLite.R")
#指定一个离你最近的国内镜像
options(BioC_mirror="http://mirrors.ustc.edu.cn/bioc/")
biocLite("包名")
Bioconductor 包安装:
在 R-3.5(Bioconductor-3.7) 前,Bioconductor 都是通过 biocLite 安装相关的 R 包:
> source("http://bioconductor.org/biocLite.R")
> options(BioC_mirror="http://mirrors.tuna.tsinghua.edu.cn/bioconductor")
> data = read.table("r-biocLite.txt", header=T, check.names=F, quote="")
> head(data)
biocLite_Packages_Name
1 RSQLite
2 KEGGREST
3 png
4 Rcpp
5 digest
6 AnnotationDbi
> soft = as.vector(data[,1])
> biocLite(soft)
从 R-3.5(Bioconductor-3.8) 起,Bioconductor 开始使用 BiocManager 安装 R 包:
if (!requireNamespace("BiocManager", quietly = TRUE))
install.packages("BiocManager")
BiocManager::install()
2.3 github_install
GitHub 上的一些最新 R 包,可以使用 devtools 进行安装:
install.packages("devtools")
library(devtools)
install_github("jokergoo/ComplexHeatmap")
特别注意的软件
gcc
对于使用 conda install --yes --file requirements.txt 重装某一个环境的所有软件时,如果软件中包含了 gcc,安装了 R 后,在使用 R 时会可能会引发错误:
/path/to/SoftWare/Anaconda/v2/lib/R/bin/exec/R: /path/to/SoftWare/Anaconda/v2/lib/R/bin/exec/../../lib/../../libgomp.so.1: version `GOMP_4.0' not found (required by /path/to/SoftWare/Anaconda/v2/lib/R/bin/exec/../../lib/libR.so)
glibc
glibc 是 GNU 发布的 libc 库,即 c 运行库。glibc 是 linux 系统中最底层的 api,几乎其它任何运行库都会依赖于 glibc。glibc 除了封装 linux 操作系统所提供的系统服务外,它本身也提供了许多其它一些必要功能服务的实现。由于 glibc 囊括了几乎所有的 UNIX 通行的标准,可以想见其内容包罗万象。而就像其他的 UNIX 系统一样,其内含的档案群分散于系统的树状目录结构中,像一个支架一般撑起整个作业系统。在 GNU/Linux 系统中,其 C 函式库发展史点出了 GNU/Linux 演进的几个重要里程碑,用 glibc 作为系统的 C 函式库,是 GNU/Linux 演进的一个重要里程碑。
有一些软件对于 glibc 的版本会有要求,如 cnvnator-0.3.3 要求 glibc >= 2.14。虽然在 Anaconda 中有很多 channel 都提供了 glibc,但千万注意一定要注意不要轻易去安装,否则有很大的概率会导致整个环境挂掉,甚至会导致当前环境中的 conda、python 出现动态库混乱错误,恢复起来相当麻烦!
我在《一次"胆战心惊"的真实集群运维经历》记录了 gblic 的一些集群吐血经历,感兴趣的可以了解一下。
什么时候使用 Anaconda
对于 Anaconda(conda) 软件安装以及依赖解决的原理,很多人,包括我可能都会对这个黑盒子表示一头雾水。真实的情况是,如果在一个环境中安装了几百个软件(包),再去新装软件,这时候 Anaconda 常常会卡在 Collecting package metadata 和 Solving environment 过程中,甚至一个晚上都没法解决环境的依赖。
conda 官方说他们在 conda-4.7 中花了很多的精力去提升了 conda 的速度(参考官方文章:《How We Made Conda Faster in 4.7》),但从 4.6 升级到 4.7 过程很容易导致环境崩溃,修复起来极其麻烦(反正我折腾了一个晚上都没能把我的 base 给恢复回来,吐血的经历)!
对于新手而言,Anaconda 的确是非常简单易用,如果对于多用户的服务器端,或者是提供公共使用的软件库是否需要采用 Anaconda,个人觉得的确需要慎重考虑一下,最起码需要考虑:
是否需要根据流程划分环境?如果每个流程都需要使用 Python+R+Perl,每个环境都安装这三个软件(包),如何避免空间浪费?
需要考虑如何备份和恢复环境。万一某个环境崩溃,有什么快速替代的方案而不影响业务。
或许还有更多的问题,这里没有列出来,如果大家有什么更好的想法或者建议,也欢迎留言交流。
往期精彩:
——The End——

本文分享自微信公众号 - 生信科技爱好者(bioitee)。
如有侵权,请联系 support@oschina.cn 删除。
本文参与“OSC源创计划”,欢迎正在阅读的你也加入,一起分享。
Anaconda 使用的一些体验与困惑的更多相关文章
- 【初码干货】【Azure系列】1、再次感受Azure,体验Windows Server 2016并部署BlogEngine.NET
上个月末,在某人的建议下,重新注册了一个1元试用账户(包含1个月期限的1500元订阅),并充值了1000元转为了正式账户,相当于1000元得到了2500的订阅,于是又一次开启了Azure之旅. 在这不 ...
- 锤子OneStep及BigBang使用体验
令人期待的Smartisan OS v3.1.2终于推送了,第一时间下载了更新.几乎花了半个小时才升级完毕,捧着还热乎的手机,赶忙体验一下传说中的两大杀器:OneStep以及BigBang. 先说On ...
- 体验Visual Studio 2015 Windows Forms应用程序开发与维护
昨天到半夜还没有等到Visual Studio 2015的下载地址,实在熬不住就先休息了.北美地区的时区比北京时间要晚一些,今天早上到公司就看到Visual Studio 2015的下载地址,迅速的将 ...
- Speed-BI云平台正在公测中,欢迎大家体验!
Speed-BI云平台正在公测中,欢迎大家体验.访问地址:http://speedbi.cn 支持IE(建议IE8以上),Edge,Chrome,Firefox,Safari等任意浏览器,以及采用这几 ...
- 全面产品管理-从细微处认识"用户体验"
转载: 让我以一个故事开始本文,我觉得这个故事能概括大多数人听到“用户体验”这个术语时的想法. 我经常访问的一个财经网站给我发了一封电子邮件,请求我点击里面的一个链接,对一些信息进行审核.所以我就点了 ...
- python编译环境发掘——从IDLE到sublime到pycharm到Anaconda
一个好的编译器对于我们处理日常的科研很关键,好的编译器无论是从界面,字体风格,提示,调试等各方面都能从用户角度出发,提供最好的使用体验.Python本身自带的IDLE或者在CMD里进行操作和调试,对于 ...
- Linux之初体验
预备作业03--我的Linux初体验 学习基于VirtualBox虚拟机安装Ubuntu图文教程在自己笔记本上安装Linux操作系统 一开始以为这个项目很简单,以往也在自己的笔记本上看教程安装过软件, ...
- 转 layout_weight体验(实现按比例显示)
http://www.cnblogs.com/zhmore/archive/2011/11/04/2236514.html 在android开发中LinearLayout很常用,LinearLayou ...
- win10+anaconda+cuda配置dlib,使用GPU对dlib的深度学习算法进行加速(以人脸检测为例)
在计算机视觉和机器学习方向有一个特别好用但是比较低调的库,也就是dlib,与opencv相比其包含了很多最新的算法,尤其是深度学习方面的,因此很有必要学习一下.恰好最近换了一台笔记本,内含一块GTX1 ...
- flutter初体验
flutter初体验 和flutter斗争了两个周末,基本弄清楚了这个玩意的布局和一些常用组件了. 在flutter里面,所有东西都是组件Widget.我们像拼接积木一样拼接Widget,拼接的关键词 ...
随机推荐
- C#实现的网易云音频下载器(白嫖)
链接 下载点这里 主要是想白嫖音乐,但是java gui写的很复杂,python不会写,c#学的也是半吊子,大大佬们勿喷 经测试大部分音乐可以下载,部分会出现路径非法 form.cs的代码 using ...
- Solr 入门配置
大多数搜索引擎应用都必须具有某种搜索功能,问题是搜索功能往往是巨大的资源消耗,并且它们由于沉重的数据库加载而拖垮你的应用的性能.这就是为什么转移负载到一个外部的搜索服务器是一个不错的注意,Apache ...
- Unity绘制圆和缓动雷达图
Unity绘制圆和缓动雷达图 之前在做UI模块的时候遇到过需要做雷达图的效果,所以简单复习了一下 关于网格绘制 我们都知道Unity绘制图形是通过Mesh网格添加顶点进行绘制,那么知道顶点信息后如何实 ...
- 宝塔上部署FastAPI的步骤和一些注意点
为了运维方便,选择直接用宝塔来管理python fastapi的项目,虽然直接部署可能性能更好更灵活,但是我选择了低层本,每个人的选择可能是不一样的,各有 考虑吧. 本文的大逻辑是先写一个hellow ...
- 第一推动|2023年VSCode插件最新推荐(54款)
本文介绍前端开发领域常用的一些VSCode插件,插件是VSCode最重要的组成部分之一,本文列出了我自己在以往工作经验中积累的54款插件,个人觉得这些插件是有用或有趣的,根据它们的作用,我粗略的把它们 ...
- 在 k8s(kubernetes)中使用 Loki 进行日志监控
安装helm环境 [root@hello ~/yaml]# [root@hello ~/yaml]# curl https://baltocdn.com/helm/signing.asc | sudo ...
- modbus_new_rtu
/** * modbus_new_rtu(const char *device, int baud, char parity, int data_bit, int stop_bit); * 这个函数会 ...
- python入门教程之三编码问题
1编码问题 Python文件中如果未指定编码,在执行过程中会出现报错: !/usr/bin/python print ("你好,世界") 以上程序执行输出结果为: 文件" ...
- [ElasticSearch]#解决问题#修改Search Guard密码时 报错:ERR: Seems there is no Elasticsearch running on localhost:9300 - Will exit
问题复现 [root@es2 tools]# ps -ef | grep elasticsearch 9200 22693 1 1 09:31 ? 00:04:54 /usr/bin/java -Xm ...
- kali装机 安装输入法 修改国内源
1-先配置国内源官方kali源 vim /etc/apt/sources.list 插入如下源 deb http://mirrors.aliyun.com/kali sana main non-fre ...