我是一位国产工业软件开发者

Mzkit桌面工作站

Mzkit工作站软件主要是应用于基于核磁共振/质谱数据的化学信息学方面的CAE(计算机辅助工程与计算机辅助分析)数据分析功能。目前已完成对质谱数据以及NMR数据的支持。目前的研发投入主要集中在质谱成像相关功能以及定量计算分析等分析化学相关的功能研发。

Mzkit目前为一款诺米代谢向大家所提供的免费开源的质谱数据分析软件

Latest Articles

我目前所从事的工作是在国内的一家比较大的代谢组学服务公司的高级数据科学家,主要从事一些使用VisualBasic.NET,R/R#语言进行数据科学相关的分析脚本以及流程编写开发工作。如果你对我自己模仿R语言所创建的R#语言做数据分析感兴趣的话,我这个博客网站目前是你进行R#语言学习的最好选择。

估计阅读时长: 19 分钟在前面写了一篇文章来介绍我们可以如何通过KEGG的BHR评分来注释直系同源。在今天重新翻看了下KAAS的帮助文档之后,发现KAAS系统中更新了下面的Assignment score计算公式: We define a score for each ortholog group in order to assign the best fitting K numbers to […]
Computational Analysis of Biochemical Systems
估计阅读时长: 5 分钟将复杂的生物学过程拆解为单元化学反应,是进行定量模拟的基石。转录是基因表达调控的关键环节,决定了细胞在特定时间、特定环境下合成哪些蛋白质,对生命活动至关重要。最近的工作中需要将原本非常粗糙的虚拟细胞转录事件模型拆解为更加细分化的多步骤生物化学过程,以适应针对细胞群落生长的建模计算。下面为我将原核生物的转录过程拆解为一系列可以用化学式表示的单元步骤的结果。 在介绍这些分步骤之前,我们会需要首先来定义一下模型中会用到的各种“化学物质”(分子和复合物): RNAP: RNA聚合酶全酶(包含核心酶和σ因子)。 DNA: 基因组DNA双链。 DNA_P: 包含启动子区域的DNA。 DNA_T: 包含终止子区域的DNA。 NTP: 核糖核苷三磷酸(ATP, UTP, GTP, CTP的统称)。 PPi: 无机焦磷酸。 RNA_n: 长度为n的RNA链。 RNA: […]
估计阅读时长: 27 分钟宏基因组测序直接从环境样本获取所有生物的遗传物质,产生的海量短读序列(reads)需要被快速准确地分类到不同物种或功能类别。然而,宏基因组数据具有复杂性高、物种多样且未知序列多等特点,这给分类算法带来了巨大挑战。传统的序列比对方法虽然准确,但在面对庞大的参考数据库时计算开销巨大,难以满足实时分析的需求。因此,研究者开发了多种基于k-mer(长度为k的子序列)的快速分类方法,其中布隆过滤器(Bloom Filter)作为一种高效的概率数据结构,在针对测序reads做物种上的快速分类这项工作中起到了一些关键作用。 Attachments Capture • 112 kB • 1 click 2025年12月19日

关于创作者

R#语言之父,热衷于各种数据可视化。在代谢组学数据分析和机器学习领域内有着非常丰富的工作经验,大约10年的生物信息学研发工作经验。平时最开心的时候就是可以在工作中重复造各种轮子,并且可以成功的应用于各种商业化项目之中。经过多年的生物信息学和化学信息学领域内的工作,目前手头上已经重复造出了非常多的轮子,积累了大量的代码库,对各种数据分析方法轮子的使用也都非常得心应手。

诺米代谢BioDeep研发中心

谢桂纲 · 高级数据科学家

目前主要从事代谢组学领域内的数据分析方法开发,化学信息学质谱数据分析以及质谱应用研发,生物信息学大数据挖掘,工业软件研发相关的工作。

通过电子邮件联系我:xieguigang@metabolomics.ac.cn