基于 Tauri 2 + Monaco + Milkdown + crossnote 的 Windows Markdown 编辑器:源码/混合/预览三种模式、离线 HTML/PDF/DOCX 导出、原子保存与崩溃恢复、无遥测无账号。
文章
共 56 篇
基于样本 barcode 表的单端/双端 FASTQ demultiplexer:双 barcode 双方向匹配、UMI 提取、Hamming 容错、质量与 adapter 修剪、多线程有序输出,零运行时依赖。
面向 Linux/HPC 的多线程 BAM/CRAM/VCF 处理库:Python 语义不变、热点路径跑在 Rust 上,fetch/count/coverage/depth/pileup 与 pysam 结果对齐、性能对齐 rubam。
PAMlogo:PAM 文库测序分析一站式流水线
面向 Cas9 等基因编辑系统的 PAM 偏好分析命令行工具:从原始 FASTQ 到 WebLogo 图,质控、拆分、PAM 计数、Top-N 筛选、加权出图一条龙。
Rust 实现的 Windows 桌面 + CLI 双形态序列处理工具包,四大核心命令(stats/cat/revcomp/validate),无需 Python/Perl/Conda/WSL。
FretHMM:单分子时间序列 HMM 状态分类工具
介绍开源工具 FretHMM:受 HaMMy 启发、用 Python 重写的单分子轨迹 HMM 分类。覆盖 CLI/GUI、Review Grid、 multi-start + BIC、ON/OFF 与 dwell 动力学,以及 v1.5–v1.6 的批次审查与 Windows 并行更新。
介绍开源工具 microbial-colony-counter:基于 OpenCV 的培养皿菌落自动计数,支持桌面 GUI 与 Web。重点记录 v1.1.1 批次标定与 v1.1.2 多参考盘联合学习,以及从默认参数到少样本校准的开发路径。
用 Rust(eframe + egui)打造的 Windows 优先大文件序列浏览器:内存映射打开数百 MB 到数 GB 的 FASTA/FASTQ,虚拟滚动、增量索引、记录级覆盖编辑与安全导出。
给定野生型 DNA 序列,自动生成带重叠区的饱和突变(NNK)寡核苷酸文库——每个位点突变为其余 19 种氨基酸,使用大肠杆菌优化密码子,兼容 Gibson 组装。
扩增子数据处理中常用的 R 数据清洗套路:长宽转换、分组汇总、列选择与缺失值处理。
使用tidyr包和dplyr包进行数据清洗
最近处理扩增子数据,很多数据需要转化整理,从而适用于ggplot2系列的可视化工作,之前常常在Excel表格中手动整理,今天记录写一下使用tidyr包和dplyr包进行数据整...
处理fasta文件的简单命令
1. 将fasta中的header name替换为对应的fasta文件名 2. 提取fasta文件第一条序列信息 3. 批量修改文件名
将含有两列数据的table转为二进制矩阵数据
1. 修改的需求 2.在R中实现目的
批量修改fasta文件的headers name
在使用一些生信软件前,你需要将你自己的数据整理成软件要求的格式,软件以及流程跑完了产出的文件,也需要整理成你自己想要的格式,以便于你将结果投喂给下一个软件或者进行可视化。我这...
好用的细菌基因组组装与注释软件
1. Spades[https://github.com/ablab/spades] 细菌基因组组装最佳软件(主观感受),可进行二代组装,三代组装以及二代三代混合组装。 2...
堆叠图主要看不同菌群在该样本中的相对比例,把每个样本的情况或者每个处理组的情况展示出来,可以大致看出样本的重复性好坏和不同处理间的某些菌群变化趋势。 1.门水平的堆叠图 2....
最近做细菌比较基因组学分析,跑了一下Roary软件,出来了一些结果和图,看了看Roary软件github上的作图代码,使用的python语言对系统进化树和gene prese...
细菌质粒相比较于细菌染色体基因非常容易发生水平转移,质粒可从环境中获得质粒或丢失掉。质粒的存在往往有利于细菌的生存,,质粒上常常带有抗生素抗性基因,毒力基因以及解毒基因,是细...
数据的分析和可视化工作没有止境! 1. alpha多样性数据导入和整理 数据来自公司给的alpha多样性指数数据表格,主要包括Observe,Chao1,ACE, Shann...
之前绘制热图主要使用pheatmap,开始觉得这个包又简单又美观,但用多了以后自己对热图要求高了,发现这个包不是太灵活,很多细节没有提供参数来调整,一些需求需要自己调用底层的...
细菌质粒组装
pATLAS smaegol/PlasFlow BU-ISCIII/plasmidID phac-nml/mob-suite zhenchengfang/PPR-Meta S...
Python学习的第十天,好些天没有学习python了。4月6号下午回武汉了,从汉口火车站下车,车站弥漫着消毒水的味道,有些疫情防控人员全副武装,有些工作人员引导我们扫码入地...
Python学习的第九天,主要学习如何写自己的函数功能。 1. 从PDB文件中提取fasta序列 2. 写一个极简单的函数 3. 使用struct模块将字符串转为元组 4. ...
Python学习的第八天,主要学习文本挖掘和模式匹配。 生物信息大多数问题都是核酸或氨基酸序列的比对和寻找motif,利用正则表达式显得十分重要。比如一条核酸或氨基酸序列,你...
Python学习的第七天,主要学习数据排序。 1. 表格按指定列排序并写入文件。 2. 字典排序 3. 元组排序 4. 根据DNA序列长度排序 5. 根据两列对逗号分隔的文件...
Python学习的第六天,主要学习处理表格数据。 1. 表格中列的融合 2. ZIP()函数的使用 3. 创建一个表格 4. 用字典展示表格 5. 从文件中读取表格 5. 将...
Python学习的第五天,主要学习数据的过滤。 1. 转录组差异分析数据的过滤 Cuffcompare软件进行了转录组表达量的比较和统计,至少存在于3个生物学重复中的两个样本...
Python学习的第四天,有点懈怠了没坚持每天一更。 1. RNA序列转换成蛋白序列 2. 从fasta序列文件中查找insulin序列 3. 从fasta序列文件中查找不含...
Python学习的第三天。 1. 整合质谱数据到代谢通路中 假设你想确定癌症细胞样品中的一些蛋白属于哪些代谢或调控通路,首先你有一个文件数据包含细胞循环相关通路的蛋白列表,然...
Python学习的第二天。 1.处理数据列 处理ImageJ测量神经树突长度获得的数据。 output.write("total dendritic length ...
趁疫情被封闭在家,学习一下python,之前尝试过看过perl的书,代码看得我一脸懵逼,python乍看上去和蔼可亲多了,再加上有个师兄鼓励和推荐学习python,找了这本书...
从今年1月24号县城封城到现在已经整整一个月了,在家憋得难受,小区不让进出,连小区楼下也不让溜达了,就想出去走走,哎,还是不跟国家添堵了,坚持就是胜利。最近Y叔发布了一个R包...
1.bioconda构建名为py27的虚拟环境并安装checkm 2.checkm数据库设置 (note instructions here are incorrect - ...
1.docker安装 2.docker使用 3.docker安装orthomcl 依然失败,不玩了,认怂!转向orthofinder了。对perl和MySQL不熟悉,实在没办...
二代测序技术的迅速发展大幅度的降低了高通量测序价格且提高了测序质量,同时高通量测序相关的数据处理和分析的软件也是越来越好用。SPAdes在二代测序小基因组的组装上表现优异,使...
最近手里有个非靶向代谢组的数据,通过学习MetaboDiff包来熟悉代谢组分析的思路和流程,接下来的流程来自于MetaboDiff包官方帮助文档。 1. MetaboDiff...
随着高通量测序的迅猛发展,越来越多的物种的基因组被测序解读出来。基因组是分子生物学,遗传学,进化生物学等研究的基石,如果你研究的物种没有好的参考基因组序列,就不容易开展基因功...
该教程来自ampvis2官方网站。 1. ampvis2包的工作流程 2. ampvis2包安装 我是使用的Windows10系统下的R 3.5.3和RStudio,同时...
在Ubuntu 16系统执行 1.安装miniconda wget https://repo.continuum.io/miniconda/Miniconda3-lates...
最近投文章,审稿人问了一个关于系统进化树的问题。 Reviewer: 1 I still don't understand, why authors sequence 486...
Numerical Ecology with R 这本书2018年出了第二版,第一版有中文版的书籍。自己的课题涉及微生物生态学,但时常对生态学中的一些专业名词概念和分析方法不...
对于不同数据集合的比较的可视化,一般用韦恩图来表示,但是数据集合太多了,就不好看了,反而不容易从图中获得信息了。 三个集合看起来最合适。 2012年发表的香蕉基因组文章中的韦...
以下教程中vsearch和usearch部分的操作在虚拟机中的ubuntu18系统下进行。 1. 示例数据的下载 2. 双端reads的合并 3. 引物剔除和数据质控 4. ...
这部分教程来自Happy Belly Bioinformatics网站, 主要比较宏基因组的单样品组装和多样品联合组装这两种组装策略以及宏基因组数据的可视化。 教程简介 一般...
PCA(Principal Component Analysis)主成分分析, 用来考察多个变量间相关性一种多元统计方法,研究如何通过少数几个主成分来揭示多个变量间的内部结构...
1.数据下载 2.数据解压 2.泛基因组数据库的构建 泛基因组分析 后面还可以对其泛基因组功能进行分析,感兴趣的大家去anvio网站学习吧!
Phylogenomics直接翻译是种系基因组学,下面是维基百科上它的解释:Phylogenomics is the intersection of the fields o...
我是个R新手,只会简单的画一些图,还不能随心所欲的画图。Hadley Wickham男神的ggplot2包以及tidyverse超级大包真是让人膜拜!最近实验室留学生让我帮他...
这部分教程依然来自Happy Belly Bioinformatics网站, 主要学习一下使用DADA2获得ASVs数据之后的进一步分析。譬如,微生物群落多样性,样品间的微生...
之前发现了一个网站分享了很多教程,诸如bash,R,16s扩增子和基因组相关的分析教程,网站叫Happy Belly Bioinformatics。今天来学习分享一下。 1....
今天在Cell杂志上发现一篇文章 《Dynamic Human Environmental Exposome Revealed by Longitudinal Persona...
了解基本操作 以下是sed&awk书上的范例 sed基本操作 创建sed&awk文件夹 编辑list文件,将书上的示例内容粘贴进去 将list文本中的MA替换成Massach...
基因组和转录组组装质量评估利器——BUSCO(Benchmarking Universal Single-Copy Orthologs) 一,BUSCO简介 该软件利用Ort...
手里有一个细菌的基因组序列,如何分析和挖掘基因组信息对我是一个头疼的问题!!先依葫芦画瓢吧,看了一些文献,很多做比较基因组学分析,计算了多个基因组之间的平均核酸一致性aver...
Distinct Shifts in Microbiota Composition during Drosophila Aging Impair Intestinal Fun...
今天发现了一个扩增子分析的流程Comeau et al., 2017Microbiome Helper: a Custom and Streamlined Workflow ...