前往小程序,Get更优阅读体验!
立即前往
首页
学习
活动
专区
工具
TVP
发布
社区首页 >专栏 >超量化合物库筛选策略–P3

超量化合物库筛选策略–P3

作者头像
DrugSci
发布2022-05-17 13:22:57
3770
发布2022-05-17 13:22:57
举报
文章被收录于专栏:FindKeyFindKey

上期回顾:

超量化合物库筛选策略–P1

超量化合物库筛选策略–P2

具体步骤:

3. 获取反应库文件并进行分析

  • 这里使用了ORD,开源化合反应物库
  • 同时需要安装相关的包ord-schema
代码语言:javascript
复制
$ git clone git@github.com:open-reaction-database/ord-schema.git
$ pip install -r requirements.txt
$ conda install -c rdkit rdkit
$ python setup.py install
  • 查看ord-data中的反应数据库

这里选取部分予以展示

4. 这里选取了其中的一个反应库用于分析

  • 数据来源:Coley, C. W. et al. A graph-convolutional neural network model for the prediction of chemical reactivity. Chemical Science 10, 370–377 (2019). doi: 10.1039/c8sc04228d
代码语言:javascript
复制
# import everything
import ord_schema
from ord_schema import message_helpers, validations
from ord_schema.proto import dataset_pb2
import math
import pandas as pd
import numpy as np
import matplotlib.pyplot as plt
import os
import wget
from rdkit import Chem
from rdkit.Chem import AllChem
from glob import glob
# 提取化合反应库,并处理反应库
# 这个路径需要注意一下
pb_path = './ord-data/data/48/ord_dataset-488402f6ec0d441ca2f7d6fabea7c220.pb'
data = message_helpers.load_message(pb_path, dataset_pb2.Dataset)
data_l = list(data.reactions)
reactions_l = [i.identifiers[0].value for i in data_l]
# 获取一些合成反应,1+1=2,SMART格式,同时去一下重
reactant_l_2 = list(set([i for i in reactions_l if i.split('>')[0].count('.') == 2]))
reaction_smarts_uni_mols = [AllChem.ReactionFromSmarts(i) for i in reactant_l_2]

参考

[1] Kearnes S M , Maser M R , Wleklinski M , et al. The Open Reaction Database[J]. 2021.

[2] Coley, C. W. et al. A graph-convolutional neural network model for the prediction of chemical reactivity. Chemical Science 10, 370–377 (2019). doi: 10.1039/c8sc04228d

[3] https://github.com/open-reaction-database/ord-schema

[4] https://github.com/open-reaction-database/ord-data

[5] https://www.daylight.com/dayhtml/doc/theory/theory.smarts.html

本文参与 腾讯云自媒体分享计划,分享自微信公众号。
原始发表:2022-04-21,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 DrugSci 微信公众号,前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体分享计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
目录
  • 上期回顾:
  • 超量化合物库筛选策略–P1
  • 超量化合物库筛选策略–P2
    • 具体步骤:
    相关产品与服务
    数据库
    云数据库为企业提供了完善的关系型数据库、非关系型数据库、分析型数据库和数据库生态工具。您可以通过产品选择和组合搭建,轻松实现高可靠、高可用性、高性能等数据库需求。云数据库服务也可大幅减少您的运维工作量,更专注于业务发展,让企业一站式享受数据上云及分布式架构的技术红利!
    领券
    问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档