Upload folder using huggingface_hub
Browse filesThis view is limited to 50 files because it contains too many changes. See raw diff
- README.md +120 -0
- fold_0/logs.models.fold_0.ENCSR282QFE/logfile.modelling.fold_0.ENCSR282QFE.args.json +42 -0
- fold_0/logs.models.fold_0.ENCSR282QFE/logfile.modelling.fold_0.ENCSR282QFE.batch_loss.tsv +0 -0
- fold_0/logs.models.fold_0.ENCSR282QFE/logfile.modelling.fold_0.ENCSR282QFE.bias_formatting.stdout.txt +1 -0
- fold_0/logs.models.fold_0.ENCSR282QFE/logfile.modelling.fold_0.ENCSR282QFE.chrombpnet_data_params.tsv +3 -0
- fold_0/logs.models.fold_0.ENCSR282QFE/logfile.modelling.fold_0.ENCSR282QFE.chrombpnet_formatting.stdout.txt +1 -0
- fold_0/logs.models.fold_0.ENCSR282QFE/logfile.modelling.fold_0.ENCSR282QFE.chrombpnet_model_params.tsv +9 -0
- fold_0/logs.models.fold_0.ENCSR282QFE/logfile.modelling.fold_0.ENCSR282QFE.chrombpnet_no_bias_formatting.stdout.txt +1 -0
- fold_0/logs.models.fold_0.ENCSR282QFE/logfile.modelling.fold_0.ENCSR282QFE.epoch_loss.csv +12 -0
- fold_0/model.bias_scaled.fold_0.ENCSR282QFE.h5 +3 -0
- fold_0/model.bias_scaled.fold_0.ENCSR282QFE.tar +3 -0
- fold_0/model.chrombpnet.fold_0.ENCSR282QFE.h5 +3 -0
- fold_0/model.chrombpnet.fold_0.ENCSR282QFE.tar +3 -0
- fold_0/model.chrombpnet_nobias.fold_0.ENCSR282QFE.h5 +3 -0
- fold_0/model.chrombpnet_nobias.fold_0.ENCSR282QFE.tar +3 -0
- fold_1/logs.models.fold_1.ENCSR282QFE/logfile.modelling.fold_1.ENCSR282QFE.args.json +50 -0
- fold_1/logs.models.fold_1.ENCSR282QFE/logfile.modelling.fold_1.ENCSR282QFE.batch_loss.tsv +0 -0
- fold_1/logs.models.fold_1.ENCSR282QFE/logfile.modelling.fold_1.ENCSR282QFE.bias_formatting.stdout.txt +1 -0
- fold_1/logs.models.fold_1.ENCSR282QFE/logfile.modelling.fold_1.ENCSR282QFE.chrombpnet_data_params.tsv +3 -0
- fold_1/logs.models.fold_1.ENCSR282QFE/logfile.modelling.fold_1.ENCSR282QFE.chrombpnet_formatting.stdout.txt +1 -0
- fold_1/logs.models.fold_1.ENCSR282QFE/logfile.modelling.fold_1.ENCSR282QFE.chrombpnet_model_params.tsv +9 -0
- fold_1/logs.models.fold_1.ENCSR282QFE/logfile.modelling.fold_1.ENCSR282QFE.chrombpnet_no_bias_formatting.stdout.txt +1 -0
- fold_1/logs.models.fold_1.ENCSR282QFE/logfile.modelling.fold_1.ENCSR282QFE.epoch_loss.csv +12 -0
- fold_1/model.bias_scaled.fold_1.ENCSR282QFE.h5 +3 -0
- fold_1/model.bias_scaled.fold_1.ENCSR282QFE.tar +3 -0
- fold_1/model.chrombpnet.fold_1.ENCSR282QFE.h5 +3 -0
- fold_1/model.chrombpnet.fold_1.ENCSR282QFE.tar +3 -0
- fold_1/model.chrombpnet_nobias.fold_1.ENCSR282QFE.h5 +3 -0
- fold_1/model.chrombpnet_nobias.fold_1.ENCSR282QFE.tar +3 -0
- fold_2/logs.models.fold_2.ENCSR282QFE/logfile.modelling.fold_2.ENCSR282QFE.args.json +50 -0
- fold_2/logs.models.fold_2.ENCSR282QFE/logfile.modelling.fold_2.ENCSR282QFE.batch_loss.tsv +0 -0
- fold_2/logs.models.fold_2.ENCSR282QFE/logfile.modelling.fold_2.ENCSR282QFE.bias_formatting.stdout.txt +1 -0
- fold_2/logs.models.fold_2.ENCSR282QFE/logfile.modelling.fold_2.ENCSR282QFE.chrombpnet_data_params.tsv +3 -0
- fold_2/logs.models.fold_2.ENCSR282QFE/logfile.modelling.fold_2.ENCSR282QFE.chrombpnet_formatting.stdout.txt +1 -0
- fold_2/logs.models.fold_2.ENCSR282QFE/logfile.modelling.fold_2.ENCSR282QFE.chrombpnet_model_params.tsv +9 -0
- fold_2/logs.models.fold_2.ENCSR282QFE/logfile.modelling.fold_2.ENCSR282QFE.chrombpnet_no_bias_formatting.stdout.txt +1 -0
- fold_2/logs.models.fold_2.ENCSR282QFE/logfile.modelling.fold_2.ENCSR282QFE.epoch_loss.csv +11 -0
- fold_2/model.bias_scaled.fold_2.ENCSR282QFE.h5 +3 -0
- fold_2/model.bias_scaled.fold_2.ENCSR282QFE.tar +3 -0
- fold_2/model.chrombpnet.fold_2.ENCSR282QFE.h5 +3 -0
- fold_2/model.chrombpnet.fold_2.ENCSR282QFE.tar +3 -0
- fold_2/model.chrombpnet_nobias.fold_2.ENCSR282QFE.h5 +3 -0
- fold_2/model.chrombpnet_nobias.fold_2.ENCSR282QFE.tar +3 -0
- fold_3/logs.models.fold_3.ENCSR282QFE/logfile.modelling.fold_3.ENCSR282QFE.args.json +50 -0
- fold_3/logs.models.fold_3.ENCSR282QFE/logfile.modelling.fold_3.ENCSR282QFE.batch_loss.tsv +0 -0
- fold_3/logs.models.fold_3.ENCSR282QFE/logfile.modelling.fold_3.ENCSR282QFE.bias_formatting.stdout.txt +1 -0
- fold_3/logs.models.fold_3.ENCSR282QFE/logfile.modelling.fold_3.ENCSR282QFE.chrombpnet_data_params.tsv +3 -0
- fold_3/logs.models.fold_3.ENCSR282QFE/logfile.modelling.fold_3.ENCSR282QFE.chrombpnet_formatting.stdout.txt +1 -0
- fold_3/logs.models.fold_3.ENCSR282QFE/logfile.modelling.fold_3.ENCSR282QFE.chrombpnet_model_params.tsv +9 -0
- fold_3/logs.models.fold_3.ENCSR282QFE/logfile.modelling.fold_3.ENCSR282QFE.chrombpnet_no_bias_formatting.stdout.txt +1 -0
README.md
ADDED
|
@@ -0,0 +1,120 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
---
|
| 2 |
+
license: mit
|
| 3 |
+
library_name: chrombpnet
|
| 4 |
+
tags:
|
| 5 |
+
- encode
|
| 6 |
+
- chrombpnet
|
| 7 |
+
- chromatin-accessibility
|
| 8 |
+
- DNASE
|
| 9 |
+
- stomach
|
| 10 |
+
- hg38
|
| 11 |
+
---
|
| 12 |
+
# ENCODE ChromBPNet Atlas
|
| 13 |
+
As part of the ENCODE 4 Project, we trained ChromBPNet models on 1,512 ENCODE DNAse-seq and ATAC-seq across 408 biosamples. Here, we provide all models for open-source use.
|
| 14 |
+
|
| 15 |
+
For more information about the models, see:
|
| 16 |
+
- Main ENCODE 4 Paper
|
| 17 |
+
- [A unified lexicon of predictive DNA sequence motifs from ENCODE transcription factor binding and chromatin accessibility assays](https://doi.org/10.5281/zenodo.17123347) (Deshpande et al., Zenodo 2025)
|
| 18 |
+
- [ChromBPNet: bias factorized, base-resolution deep learning models of chromatin accessibility reveal cis-regulatory sequence syntax, transcription factor footprints and regulatory variants](https://doi.org/10.1101/2024.12.25.630221) (Pampari et al., bioRxiv 2024)
|
| 19 |
+
|
| 20 |
+
## ChromBPNet model: DNASE in stomach (ENCSR282QFE)
|
| 21 |
+
- Model: ChromBPNet
|
| 22 |
+
- Assay: DNASE-seq
|
| 23 |
+
- Experiment: [ENCSR282QFE](https://www.encodeproject.org/experiments/ENCSR282QFE/)
|
| 24 |
+
- Model annotation: [ENCSR781PDD](https://www.encodeproject.org/annotations/ENCSR781PDD/)
|
| 25 |
+
- Biosample: stomach (Full name: Homo sapiens stomach tissue female embryo (121 days))
|
| 26 |
+
- Cell slim(s): None
|
| 27 |
+
- Organ slim(s): stomach
|
| 28 |
+
- Developmental slim(s): endoderm
|
| 29 |
+
- System slim(s): digestive-system
|
| 30 |
+
- Assembly: hg38
|
| 31 |
+
|
| 32 |
+
## Directory structure
|
| 33 |
+
- `fold_0`: Model of 5-fold cross-validation: Fold 0
|
| 34 |
+
- `model.chrombpnet.fold_0.encid.h5`: full chrombpnet model that combines both bias and corrected model in .h5 format
|
| 35 |
+
- `model.chrombpnet_nobias.fold_0.encid.h5`: bias-corrected accessibility model in .h5 format (Use for all biological discovery)
|
| 36 |
+
- `model.bias_scaled.fold_0.encid.h5`: bias model in .h5 format
|
| 37 |
+
- `model.chrombpnet.fold_0.encid.tar`: full chrombpnet model that combines both bias and corrected model in SavedModel format. After being untarred, it results in a directory named "chrombpnet".
|
| 38 |
+
- `model.chrombpnet_nobias.fold_0.encid.tar`: bias-corrected accessibility model in SavedModel format (Use for all biological discovery). After being untarred, it results in a directory named "chrombpnet_wo_bias".
|
| 39 |
+
- `model.bias_scaled.fold_0.encid.tar`: bias model in SavedModel format. After being untarred, it results in a directory named "bias_model_scaled".
|
| 40 |
+
- `logs.models.fold_0.encid`: folder containing log files for training models
|
| 41 |
+
- `fold_1`: Model of 5-fold coss-validation: Fold 1
|
| 42 |
+
- `fold_2`: Model of 5-fold cross-validation: Fold 2
|
| 43 |
+
- `fold_3`: Model of 5-fold cross-validation: Fold 3
|
| 44 |
+
- `fold_4`: Model of 5-fold cross-validation: Fold 4
|
| 45 |
+
|
| 46 |
+
# Instructions
|
| 47 |
+
## 1. Pseudocode for loading models in .h5 format
|
| 48 |
+
|
| 49 |
+
(1) Use the code in python after appropriately defining `model_in_h5_format` and `inputs`. \
|
| 50 |
+
(2) `inputs` is a one hot encoded sequence of shape (N,2114,4). Here N corresponds to the
|
| 51 |
+
number of tested sequences, 2114 is the input sequence length and 4 corresponds to [A,C,G,T].
|
| 52 |
+
|
| 53 |
+
```python
|
| 54 |
+
import tensorflow as tf
|
| 55 |
+
from tensorflow.keras.utils import get_custom_objects
|
| 56 |
+
from tensorflow.keras.models import load_model
|
| 57 |
+
|
| 58 |
+
custom_objects={"tf": tf}
|
| 59 |
+
get_custom_objects().update(custom_objects)
|
| 60 |
+
|
| 61 |
+
model=load_model(model_in_h5_format,compile=False)
|
| 62 |
+
outputs = model(inputs)
|
| 63 |
+
```
|
| 64 |
+
|
| 65 |
+
The list `outputs` consists of two elements. The first element has a shape of (N, 1000) and
|
| 66 |
+
contains logit predictions for a 1000-base-pair output. The second element, with a shape of
|
| 67 |
+
(N, 1), contains logcount predictions. To transform these predictions into per-base signals,
|
| 68 |
+
follow the provided pseudo code lines below.
|
| 69 |
+
|
| 70 |
+
```python
|
| 71 |
+
import numpy as np
|
| 72 |
+
|
| 73 |
+
def softmax(x, temp=1):
|
| 74 |
+
norm_x = x - np.mean(x,axis=1, keepdims=True)
|
| 75 |
+
return np.exp(temp*norm_x)/np.sum(np.exp(temp*norm_x), axis=1, keepdims=True)
|
| 76 |
+
|
| 77 |
+
predictions = softmax(outputs[0]) * (np.exp(outputs[1])-1)
|
| 78 |
+
```
|
| 79 |
+
|
| 80 |
+
## 2. Pseudocode for loading models in .tar format
|
| 81 |
+
|
| 82 |
+
(1) First untar the directory as follows `tar -xvf model.tar`. \
|
| 83 |
+
(2) Use the code below in python after appropriately defining `model_dir_untared` and `inputs`. \
|
| 84 |
+
(3) `inputs` is a one hot encoded sequence of shape (N,2114,4). Here N corresponds to the number
|
| 85 |
+
of tested sequences, 2114 is the input sequence length and 4 corresponds to ACGT.
|
| 86 |
+
|
| 87 |
+
Reference: https://www.tensorflow.org/api_docs/python/tf/saved_model/load
|
| 88 |
+
|
| 89 |
+
```python
|
| 90 |
+
import tensorflow as tf
|
| 91 |
+
|
| 92 |
+
model = tf.saved_model.load('model_dir_untared')
|
| 93 |
+
outputs = model.signatures['serving_default'](**{'sequence':inputs.astype('float32')})
|
| 94 |
+
```
|
| 95 |
+
|
| 96 |
+
The variable `outputs` represents a dictionary containing two key-value pairs. The first key
|
| 97 |
+
is `logits_profile_predictions`, holding a value with a shape of (N, 1000). This value corresponds
|
| 98 |
+
to logit predictions for a 1000-base-pair output. The second key, named `logcount_predictions``,
|
| 99 |
+
is associated with a value of shape (N, 1), representing logcount predictions. To transform these
|
| 100 |
+
predictions into per-base signals, utilize the provided pseudo code lines mentioned below.
|
| 101 |
+
|
| 102 |
+
```python
|
| 103 |
+
import numpy as np
|
| 104 |
+
def softmax(x, temp=1):
|
| 105 |
+
norm_x = x - np.mean(x,axis=1, keepdims=True)
|
| 106 |
+
return np.exp(temp*norm_x)/np.sum(np.exp(temp*norm_x), axis=1, keepdims=True)
|
| 107 |
+
|
| 108 |
+
predictions = softmax(outputs["logits_profile_predictions"]) * (np.exp(outputs["logcount_predictions"])-1)
|
| 109 |
+
```
|
| 110 |
+
|
| 111 |
+
## Docker image to load and use the models
|
| 112 |
+
- https://hub.docker.com/r/kundajelab/chrombpnet-atlas/ (tag:v1)
|
| 113 |
+
|
| 114 |
+
## Code for ChromBPNet
|
| 115 |
+
- https://github.com/kundajelab/chrombpnet/
|
| 116 |
+
|
| 117 |
+
# License & citation
|
| 118 |
+
External data users may freely download, analyze and publish results based on any ENCODE data without restrictions.
|
| 119 |
+
|
| 120 |
+
Released under the [ENCODE data-use policy](https://www.encodeproject.org/about/data-use-policy/). Please cite the ENCODE Project Consortium and the model software: [ChromBPNet](https://github.com/kundajelab/chrombpnet) (Pampari et al., bioRxiv 2024).
|
fold_0/logs.models.fold_0.ENCSR282QFE/logfile.modelling.fold_0.ENCSR282QFE.args.json
ADDED
|
@@ -0,0 +1,42 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"cmd": "pipeline",
|
| 3 |
+
"genome": "/oak/stanford/groups/akundaje/ziwei75/atac_seq_pipeline/hg38/GRCh38_no_alt_analysis_set_GCA_000001405.15.fasta",
|
| 4 |
+
"chrom_sizes": "/oak/stanford/groups/akundaje/ziwei75/atac_seq_pipeline/hg38/GRCh38_EBV.chrom.sizes.tsv",
|
| 5 |
+
"bigwig": "/oak/stanford/groups/akundaje/projects/chromatin-atlas-2022/DNASE/ENCSR282QFE/preprocessing/bigWigs/ENCSR282QFE.bigWig",
|
| 6 |
+
"output_dir": "/oak/stanford/groups/akundaje/ziwei75/chromatin_atlas_bias/DNase_model/bias_threshold_0.4/ENCSR282QFE/fold0/",
|
| 7 |
+
"data_type": "DNASE",
|
| 8 |
+
"peaks": "/oak/stanford/groups/akundaje/ziwei75/chromatin_atlas_bias/DNase_model/bias_threshold_0.4/ENCSR282QFE/fold0/auxiliary/filtered.peaks.bed",
|
| 9 |
+
"nonpeaks": "/oak/stanford/groups/akundaje/ziwei75/chromatin_atlas_bias/DNase_model/bias_threshold_0.4/ENCSR282QFE/fold0/auxiliary/filtered.nonpeaks.bed",
|
| 10 |
+
"chr_fold_path": "/oak/stanford/groups/akundaje/projects/chromatin-atlas-2022/splits/fold_0.json",
|
| 11 |
+
"outlier_threshold": 0.9999,
|
| 12 |
+
"ATAC_ref_path": null,
|
| 13 |
+
"DNASE_ref_path": null,
|
| 14 |
+
"num_samples": 10000,
|
| 15 |
+
"inputlen": 2114,
|
| 16 |
+
"outputlen": 1000,
|
| 17 |
+
"seed": 1234,
|
| 18 |
+
"epochs": 50,
|
| 19 |
+
"early_stop": 5,
|
| 20 |
+
"learning_rate": 0.001,
|
| 21 |
+
"trackables": [
|
| 22 |
+
"logcount_predictions_loss",
|
| 23 |
+
"loss",
|
| 24 |
+
"logits_profile_predictions_loss",
|
| 25 |
+
"val_logcount_predictions_loss",
|
| 26 |
+
"val_loss",
|
| 27 |
+
"val_logits_profile_predictions_loss"
|
| 28 |
+
],
|
| 29 |
+
"architecture_from_file": "/home/groups/akundaje/ziwei75/anaconda3/envs/chrombpnet/lib/python3.8/site-packages/chrombpnet/training/models/chrombpnet_with_bias_model.py",
|
| 30 |
+
"file_prefix": null,
|
| 31 |
+
"html_prefix": "./",
|
| 32 |
+
"bias_model_path": "/oak/stanford/groups/akundaje/ziwei75/chromatin_atlas_bias/DNase_bias_model/bias_threshold_0.4/ENCSR282QFE/models/bias.h5",
|
| 33 |
+
"negative_sampling_ratio": 0.1,
|
| 34 |
+
"filters": 512,
|
| 35 |
+
"n_dilation_layers": 8,
|
| 36 |
+
"max_jitter": 500,
|
| 37 |
+
"batch_size": 64,
|
| 38 |
+
"output_prefix": "/oak/stanford/groups/akundaje/ziwei75/chromatin_atlas_bias/DNase_model/bias_threshold_0.4/ENCSR282QFE/fold0/models/chrombpnet",
|
| 39 |
+
"chr": "chr8",
|
| 40 |
+
"pwm_width": 24,
|
| 41 |
+
"params": "/oak/stanford/groups/akundaje/ziwei75/chromatin_atlas_bias/DNase_model/bias_threshold_0.4/ENCSR282QFE/fold0/logs/chrombpnet_model_params.tsv"
|
| 42 |
+
}
|
fold_0/logs.models.fold_0.ENCSR282QFE/logfile.modelling.fold_0.ENCSR282QFE.batch_loss.tsv
ADDED
|
The diff for this file is too large to render.
See raw diff
|
|
|
fold_0/logs.models.fold_0.ENCSR282QFE/logfile.modelling.fold_0.ENCSR282QFE.bias_formatting.stdout.txt
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
Converting /oak/stanford/groups/akundaje/ziwei75/chromatin_atlas_bias/DNase_model/bias_threshold_0.4/ENCSR282QFE/fold0/models/bias_model_scaled.h5 to /oak/stanford/groups/akundaje/vhecht/chromatin-atlas-2022/DNASE/ENCSR282QFE/fold_0/new_model_format/bias_model_scaled.tar with get_new_tf_model_format.py
|
fold_0/logs.models.fold_0.ENCSR282QFE/logfile.modelling.fold_0.ENCSR282QFE.chrombpnet_data_params.tsv
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
counts_sum_min_thresh 0.0
|
| 2 |
+
counts_sum_max_thresh 1344.0
|
| 3 |
+
trainings_pts_post_thresh 170151
|
fold_0/logs.models.fold_0.ENCSR282QFE/logfile.modelling.fold_0.ENCSR282QFE.chrombpnet_formatting.stdout.txt
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
Converting /oak/stanford/groups/akundaje/ziwei75/chromatin_atlas_bias/DNase_model/bias_threshold_0.4/ENCSR282QFE/fold0/models/chrombpnet.h5 to /oak/stanford/groups/akundaje/vhecht/chromatin-atlas-2022/DNASE/ENCSR282QFE/fold_0/new_model_format/chrombpnet.tar with get_new_tf_model_format.py
|
fold_0/logs.models.fold_0.ENCSR282QFE/logfile.modelling.fold_0.ENCSR282QFE.chrombpnet_model_params.tsv
ADDED
|
@@ -0,0 +1,9 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
counts_loss_weight 4.1
|
| 2 |
+
filters 512
|
| 3 |
+
n_dil_layers 8
|
| 4 |
+
bias_model_path /oak/stanford/groups/akundaje/ziwei75/chromatin_atlas_bias/DNase_model/bias_threshold_0.4/ENCSR282QFE/fold0/models/bias_model_scaled.h5
|
| 5 |
+
inputlen 2114
|
| 6 |
+
outputlen 1000
|
| 7 |
+
max_jitter 500
|
| 8 |
+
chr_fold_path /oak/stanford/groups/akundaje/projects/chromatin-atlas-2022/splits/fold_0.json
|
| 9 |
+
negative_sampling_ratio 0.1
|
fold_0/logs.models.fold_0.ENCSR282QFE/logfile.modelling.fold_0.ENCSR282QFE.chrombpnet_no_bias_formatting.stdout.txt
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
Converting /oak/stanford/groups/akundaje/ziwei75/chromatin_atlas_bias/DNase_model/bias_threshold_0.4/ENCSR282QFE/fold0/models/chrombpnet_nobias.h5 to /oak/stanford/groups/akundaje/vhecht/chromatin-atlas-2022/DNASE/ENCSR282QFE/fold_0/new_model_format/chrombpnet_nobias.tar with get_new_tf_model_format.py
|
fold_0/logs.models.fold_0.ENCSR282QFE/logfile.modelling.fold_0.ENCSR282QFE.epoch_loss.csv
ADDED
|
@@ -0,0 +1,12 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
epoch,logcount_predictions_loss,logits_profile_predictions_loss,loss,val_logcount_predictions_loss,val_logits_profile_predictions_loss,val_loss
|
| 2 |
+
0,1.764390230178833,215.89462280273438,223.1285858154297,0.6212419867515564,209.68362426757812,212.23085021972656
|
| 3 |
+
1,0.6329916715621948,207.59510803222656,210.19061279296875,0.5489194989204407,207.54647827148438,209.79689025878906
|
| 4 |
+
2,0.5873256921768188,205.85357666015625,208.2615966796875,0.5968208909034729,206.69134521484375,209.1383056640625
|
| 5 |
+
3,0.5501824617385864,204.42172241210938,206.67742919921875,0.5137671828269958,206.2063446044922,208.31288146972656
|
| 6 |
+
4,0.521145761013031,203.45944213867188,205.5958251953125,0.4871356785297394,204.81089782714844,206.80816650390625
|
| 7 |
+
5,0.49825698137283325,202.4241485595703,204.46705627441406,0.4812197983264923,204.82058715820312,206.7937469482422
|
| 8 |
+
6,0.47915372252464294,201.67648315429688,203.6410675048828,0.4732673764228821,204.92665100097656,206.86712646484375
|
| 9 |
+
7,0.46679961681365967,200.88116455078125,202.79519653320312,0.4561232626438141,205.26251220703125,207.13262939453125
|
| 10 |
+
8,0.45716509222984314,200.3628692626953,202.23733520507812,0.4712493121623993,205.26939392089844,207.20155334472656
|
| 11 |
+
9,0.4441484212875366,199.7664337158203,201.58729553222656,0.451070636510849,205.37265014648438,207.22195434570312
|
| 12 |
+
10,0.43703362345695496,199.0990753173828,200.89129638671875,0.4340265095233917,206.1925811767578,207.9720916748047
|
fold_0/model.bias_scaled.fold_0.ENCSR282QFE.h5
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:07f38a5ce6622a5b9c267ed320337e41e35063e7256d7e5e5f499bc2363516e2
|
| 3 |
+
size 2691928
|
fold_0/model.bias_scaled.fold_0.ENCSR282QFE.tar
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:4cad37b448bd4fb845c179e1dcc81a59d04427932b1c583eed0f1cae5f81a3e6
|
| 3 |
+
size 1198080
|
fold_0/model.chrombpnet.fold_0.ENCSR282QFE.h5
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:3cb6f2d27b7a2e3b18b7e408243aaf9f9480a221d91d38c4d044ba2487f5ce6f
|
| 3 |
+
size 77538952
|
fold_0/model.chrombpnet.fold_0.ENCSR282QFE.tar
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:c88705764949643086cb773c1df4323a303cf7b1163f1bf5bbe972d93c332d22
|
| 3 |
+
size 27525120
|
fold_0/model.chrombpnet_nobias.fold_0.ENCSR282QFE.h5
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:a55090326e61e051cce8e4a448580695403640474dcac9fb8c9ff5061f284367
|
| 3 |
+
size 25582648
|
fold_0/model.chrombpnet_nobias.fold_0.ENCSR282QFE.tar
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:37cc8509ab28411359ffead31aeb24fbeeb0a02dfd5558a2a5cf83e150e3f14f
|
| 3 |
+
size 26060800
|
fold_1/logs.models.fold_1.ENCSR282QFE/logfile.modelling.fold_1.ENCSR282QFE.args.json
ADDED
|
@@ -0,0 +1,50 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"cmd": "pipeline",
|
| 3 |
+
"genome": "/oak/stanford/groups/akundaje/ziwei75/atac_seq_pipeline/hg38/GRCh38_no_alt_analysis_set_GCA_000001405.15.fasta",
|
| 4 |
+
"chrom_sizes": "/oak/stanford/groups/akundaje/ziwei75/atac_seq_pipeline/hg38/GRCh38_EBV.chrom.sizes.tsv",
|
| 5 |
+
"input_bam_file": "/oak/stanford/groups/akundaje/projects/chromatin-atlas-2022/DNASE/ENCSR282QFE/preprocessing/bigWigs/ENCSR282QFE.bigWig",
|
| 6 |
+
"input_fragment_file": null,
|
| 7 |
+
"input_tagalign_file": null,
|
| 8 |
+
"output_dir": "/oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_1",
|
| 9 |
+
"data_type": "DNASE",
|
| 10 |
+
"peaks": "/oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_1/auxiliary/filtered.peaks.bed",
|
| 11 |
+
"nonpeaks": "/oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_1/auxiliary/filtered.nonpeaks.bed",
|
| 12 |
+
"chr_fold_path": "/oak/stanford/groups/akundaje/projects/chromatin-atlas-2022/splits/fold_1.json",
|
| 13 |
+
"outlier_threshold": 0.9999,
|
| 14 |
+
"ATAC_ref_path": null,
|
| 15 |
+
"DNASE_ref_path": null,
|
| 16 |
+
"num_samples": 10000,
|
| 17 |
+
"inputlen": 2114,
|
| 18 |
+
"outputlen": 1000,
|
| 19 |
+
"seed": 1234,
|
| 20 |
+
"epochs": 50,
|
| 21 |
+
"early_stop": 5,
|
| 22 |
+
"learning_rate": 0.001,
|
| 23 |
+
"trackables": [
|
| 24 |
+
"logcount_predictions_loss",
|
| 25 |
+
"loss",
|
| 26 |
+
"logits_profile_predictions_loss",
|
| 27 |
+
"val_logcount_predictions_loss",
|
| 28 |
+
"val_loss",
|
| 29 |
+
"val_logits_profile_predictions_loss"
|
| 30 |
+
],
|
| 31 |
+
"architecture_from_file": "/home/users/vhecht/chrombpnet/chrombpnet/chrombpnet/training/models/chrombpnet_with_bias_model.py",
|
| 32 |
+
"file_prefix": null,
|
| 33 |
+
"html_prefix": "./",
|
| 34 |
+
"bsort": false,
|
| 35 |
+
"tmpdir": null,
|
| 36 |
+
"no_st": false,
|
| 37 |
+
"bias_model_path": "/oak/stanford/groups/akundaje/ziwei75/chromatin_atlas_bias/DNase_bias_model/bias_threshold_0.4/ENCSR282QFE/models/bias.h5",
|
| 38 |
+
"negative_sampling_ratio": 0.1,
|
| 39 |
+
"filters": 512,
|
| 40 |
+
"n_dilation_layers": 8,
|
| 41 |
+
"max_jitter": 500,
|
| 42 |
+
"batch_size": 64,
|
| 43 |
+
"output_prefix": "/oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_1/models/chrombpnet",
|
| 44 |
+
"bigwig": "/oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_1/auxiliary/data_unstranded.bw",
|
| 45 |
+
"plus_shift": null,
|
| 46 |
+
"minus_shift": null,
|
| 47 |
+
"chr": "chr12",
|
| 48 |
+
"pwm_width": 24,
|
| 49 |
+
"params": "/oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_1/logs/chrombpnet_model_params.tsv"
|
| 50 |
+
}
|
fold_1/logs.models.fold_1.ENCSR282QFE/logfile.modelling.fold_1.ENCSR282QFE.batch_loss.tsv
ADDED
|
The diff for this file is too large to render.
See raw diff
|
|
|
fold_1/logs.models.fold_1.ENCSR282QFE/logfile.modelling.fold_1.ENCSR282QFE.bias_formatting.stdout.txt
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
Converting /oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_1/models/bias_model_scaled.h5 to /oak/stanford/groups/akundaje/vhecht/chromatin-atlas-2022/DNASE/ENCSR282QFE/fold_1/new_model_format/bias_model_scaled.tar with get_new_tf_model_format.py
|
fold_1/logs.models.fold_1.ENCSR282QFE/logfile.modelling.fold_1.ENCSR282QFE.chrombpnet_data_params.tsv
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
counts_sum_min_thresh 0.0
|
| 2 |
+
counts_sum_max_thresh 1382.67
|
| 3 |
+
trainings_pts_post_thresh 173829
|
fold_1/logs.models.fold_1.ENCSR282QFE/logfile.modelling.fold_1.ENCSR282QFE.chrombpnet_formatting.stdout.txt
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
Converting /oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_1/models/chrombpnet.h5 to /oak/stanford/groups/akundaje/vhecht/chromatin-atlas-2022/DNASE/ENCSR282QFE/fold_1/new_model_format/chrombpnet.tar with get_new_tf_model_format.py
|
fold_1/logs.models.fold_1.ENCSR282QFE/logfile.modelling.fold_1.ENCSR282QFE.chrombpnet_model_params.tsv
ADDED
|
@@ -0,0 +1,9 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
counts_loss_weight 4.1
|
| 2 |
+
filters 512
|
| 3 |
+
n_dil_layers 8
|
| 4 |
+
bias_model_path /oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_1/models/bias_model_scaled.h5
|
| 5 |
+
inputlen 2114
|
| 6 |
+
outputlen 1000
|
| 7 |
+
max_jitter 500
|
| 8 |
+
chr_fold_path /oak/stanford/groups/akundaje/projects/chromatin-atlas-2022/splits/fold_1.json
|
| 9 |
+
negative_sampling_ratio 0.1
|
fold_1/logs.models.fold_1.ENCSR282QFE/logfile.modelling.fold_1.ENCSR282QFE.chrombpnet_no_bias_formatting.stdout.txt
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
Converting /oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_1/models/chrombpnet_nobias.h5 to /oak/stanford/groups/akundaje/vhecht/chromatin-atlas-2022/DNASE/ENCSR282QFE/fold_1/new_model_format/chrombpnet_nobias.tar with get_new_tf_model_format.py
|
fold_1/logs.models.fold_1.ENCSR282QFE/logfile.modelling.fold_1.ENCSR282QFE.epoch_loss.csv
ADDED
|
@@ -0,0 +1,12 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
epoch,logcount_predictions_loss,logits_profile_predictions_loss,loss,val_logcount_predictions_loss,val_logits_profile_predictions_loss,val_loss
|
| 2 |
+
0,7.8775153160095215,216.23876953125,248.53675842285156,0.729199230670929,245.9403076171875,248.93002319335938
|
| 3 |
+
1,0.6713060140609741,207.54135131835938,210.29348754882812,0.6648525595664978,240.88589477539062,243.61181640625
|
| 4 |
+
2,0.6151524782180786,205.4316864013672,207.95425415039062,0.7582173943519592,239.40806579589844,242.51669311523438
|
| 5 |
+
3,0.5815772414207458,203.6693115234375,206.0537567138672,0.6458671689033508,238.29257202148438,240.94082641601562
|
| 6 |
+
4,0.5491306781768799,203.0899658203125,205.3413848876953,0.5313110947608948,236.41896057128906,238.59718322753906
|
| 7 |
+
5,0.5266153216362,202.29661560058594,204.45570373535156,0.5161783695220947,235.8554229736328,237.97177124023438
|
| 8 |
+
6,0.5026134252548218,201.4513397216797,203.51220703125,0.5343489050865173,237.18533325195312,239.37620544433594
|
| 9 |
+
7,0.4883872866630554,200.66192626953125,202.66465759277344,0.5028143525123596,236.80282592773438,238.86427307128906
|
| 10 |
+
8,0.4744170606136322,199.7510223388672,201.69618225097656,0.5352035760879517,236.30238342285156,238.49664306640625
|
| 11 |
+
9,0.4631701409816742,199.15887451171875,201.057861328125,0.49074721336364746,237.67559814453125,239.68765258789062
|
| 12 |
+
10,0.4515138268470764,198.61944580078125,200.4708251953125,0.48178067803382874,237.00555419921875,238.98097229003906
|
fold_1/model.bias_scaled.fold_1.ENCSR282QFE.h5
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:d1faa9aa9354a1c5fd62691ebc2c0388c6d8fa47be862704aac8af567f17d5bd
|
| 3 |
+
size 2691928
|
fold_1/model.bias_scaled.fold_1.ENCSR282QFE.tar
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:f55b5476795eae10d260c72932cec3f48b55d7dd6a9bf750b7ea1f6c40dd2b8a
|
| 3 |
+
size 1198080
|
fold_1/model.chrombpnet.fold_1.ENCSR282QFE.h5
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:5bc893def867ba5023e24b8c99f40654ee79260f14465a35dbe99e5375c2f86f
|
| 3 |
+
size 77538840
|
fold_1/model.chrombpnet.fold_1.ENCSR282QFE.tar
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:aa087c21f2b3eecf38b33d7d5a75f6a8aa8dc1f5029dd3b34dd15296e0583826
|
| 3 |
+
size 27525120
|
fold_1/model.chrombpnet_nobias.fold_1.ENCSR282QFE.h5
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:0aa405d87a39ab90ad5ff8a32f40e8856ad5412f0a5c908016ff4e1fcf061fdc
|
| 3 |
+
size 25582648
|
fold_1/model.chrombpnet_nobias.fold_1.ENCSR282QFE.tar
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:f26e351f5b97236a72413cacecd7433679014741aeaf9629ba043c5f86456672
|
| 3 |
+
size 26060800
|
fold_2/logs.models.fold_2.ENCSR282QFE/logfile.modelling.fold_2.ENCSR282QFE.args.json
ADDED
|
@@ -0,0 +1,50 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"cmd": "pipeline",
|
| 3 |
+
"genome": "/oak/stanford/groups/akundaje/ziwei75/atac_seq_pipeline/hg38/GRCh38_no_alt_analysis_set_GCA_000001405.15.fasta",
|
| 4 |
+
"chrom_sizes": "/oak/stanford/groups/akundaje/ziwei75/atac_seq_pipeline/hg38/GRCh38_EBV.chrom.sizes.tsv",
|
| 5 |
+
"input_bam_file": "/oak/stanford/groups/akundaje/projects/chromatin-atlas-2022/DNASE/ENCSR282QFE/preprocessing/bigWigs/ENCSR282QFE.bigWig",
|
| 6 |
+
"input_fragment_file": null,
|
| 7 |
+
"input_tagalign_file": null,
|
| 8 |
+
"output_dir": "/oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_2",
|
| 9 |
+
"data_type": "DNASE",
|
| 10 |
+
"peaks": "/oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_2/auxiliary/filtered.peaks.bed",
|
| 11 |
+
"nonpeaks": "/oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_2/auxiliary/filtered.nonpeaks.bed",
|
| 12 |
+
"chr_fold_path": "/oak/stanford/groups/akundaje/projects/chromatin-atlas-2022/splits/fold_2.json",
|
| 13 |
+
"outlier_threshold": 0.9999,
|
| 14 |
+
"ATAC_ref_path": null,
|
| 15 |
+
"DNASE_ref_path": null,
|
| 16 |
+
"num_samples": 10000,
|
| 17 |
+
"inputlen": 2114,
|
| 18 |
+
"outputlen": 1000,
|
| 19 |
+
"seed": 1234,
|
| 20 |
+
"epochs": 50,
|
| 21 |
+
"early_stop": 5,
|
| 22 |
+
"learning_rate": 0.001,
|
| 23 |
+
"trackables": [
|
| 24 |
+
"logcount_predictions_loss",
|
| 25 |
+
"loss",
|
| 26 |
+
"logits_profile_predictions_loss",
|
| 27 |
+
"val_logcount_predictions_loss",
|
| 28 |
+
"val_loss",
|
| 29 |
+
"val_logits_profile_predictions_loss"
|
| 30 |
+
],
|
| 31 |
+
"architecture_from_file": "/home/users/vhecht/chrombpnet/chrombpnet/chrombpnet/training/models/chrombpnet_with_bias_model.py",
|
| 32 |
+
"file_prefix": null,
|
| 33 |
+
"html_prefix": "./",
|
| 34 |
+
"bsort": false,
|
| 35 |
+
"tmpdir": null,
|
| 36 |
+
"no_st": false,
|
| 37 |
+
"bias_model_path": "/oak/stanford/groups/akundaje/ziwei75/chromatin_atlas_bias/DNase_bias_model/bias_threshold_0.4/ENCSR282QFE/models/bias.h5",
|
| 38 |
+
"negative_sampling_ratio": 0.1,
|
| 39 |
+
"filters": 512,
|
| 40 |
+
"n_dilation_layers": 8,
|
| 41 |
+
"max_jitter": 500,
|
| 42 |
+
"batch_size": 64,
|
| 43 |
+
"output_prefix": "/oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_2/models/chrombpnet",
|
| 44 |
+
"bigwig": "/oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_2/auxiliary/data_unstranded.bw",
|
| 45 |
+
"plus_shift": null,
|
| 46 |
+
"minus_shift": null,
|
| 47 |
+
"chr": "chr22",
|
| 48 |
+
"pwm_width": 24,
|
| 49 |
+
"params": "/oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_2/logs/chrombpnet_model_params.tsv"
|
| 50 |
+
}
|
fold_2/logs.models.fold_2.ENCSR282QFE/logfile.modelling.fold_2.ENCSR282QFE.batch_loss.tsv
ADDED
|
The diff for this file is too large to render.
See raw diff
|
|
|
fold_2/logs.models.fold_2.ENCSR282QFE/logfile.modelling.fold_2.ENCSR282QFE.bias_formatting.stdout.txt
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
Converting /oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_2/models/bias_model_scaled.h5 to /oak/stanford/groups/akundaje/vhecht/chromatin-atlas-2022/DNASE/ENCSR282QFE/fold_2/new_model_format/bias_model_scaled.tar with get_new_tf_model_format.py
|
fold_2/logs.models.fold_2.ENCSR282QFE/logfile.modelling.fold_2.ENCSR282QFE.chrombpnet_data_params.tsv
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
counts_sum_min_thresh 0.0
|
| 2 |
+
counts_sum_max_thresh 1344.39
|
| 3 |
+
trainings_pts_post_thresh 178246
|
fold_2/logs.models.fold_2.ENCSR282QFE/logfile.modelling.fold_2.ENCSR282QFE.chrombpnet_formatting.stdout.txt
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
Converting /oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_2/models/chrombpnet.h5 to /oak/stanford/groups/akundaje/vhecht/chromatin-atlas-2022/DNASE/ENCSR282QFE/fold_2/new_model_format/chrombpnet.tar with get_new_tf_model_format.py
|
fold_2/logs.models.fold_2.ENCSR282QFE/logfile.modelling.fold_2.ENCSR282QFE.chrombpnet_model_params.tsv
ADDED
|
@@ -0,0 +1,9 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
counts_loss_weight 4.1
|
| 2 |
+
filters 512
|
| 3 |
+
n_dil_layers 8
|
| 4 |
+
bias_model_path /oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_2/models/bias_model_scaled.h5
|
| 5 |
+
inputlen 2114
|
| 6 |
+
outputlen 1000
|
| 7 |
+
max_jitter 500
|
| 8 |
+
chr_fold_path /oak/stanford/groups/akundaje/projects/chromatin-atlas-2022/splits/fold_2.json
|
| 9 |
+
negative_sampling_ratio 0.1
|
fold_2/logs.models.fold_2.ENCSR282QFE/logfile.modelling.fold_2.ENCSR282QFE.chrombpnet_no_bias_formatting.stdout.txt
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
Converting /oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_2/models/chrombpnet_nobias.h5 to /oak/stanford/groups/akundaje/vhecht/chromatin-atlas-2022/DNASE/ENCSR282QFE/fold_2/new_model_format/chrombpnet_nobias.tar with get_new_tf_model_format.py
|
fold_2/logs.models.fold_2.ENCSR282QFE/logfile.modelling.fold_2.ENCSR282QFE.epoch_loss.csv
ADDED
|
@@ -0,0 +1,11 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
epoch,logcount_predictions_loss,logits_profile_predictions_loss,loss,val_logcount_predictions_loss,val_logits_profile_predictions_loss,val_loss
|
| 2 |
+
0,1.4175190925598145,213.96170043945312,219.7732696533203,0.6327287554740906,215.33782958984375,217.93194580078125
|
| 3 |
+
1,0.5989771485328674,206.58197021484375,209.03802490234375,0.5691025853157043,213.32789611816406,215.66134643554688
|
| 4 |
+
2,0.5459723472595215,204.8137969970703,207.05245971679688,0.5279128551483154,212.16529846191406,214.32980346679688
|
| 5 |
+
3,0.5197831988334656,203.37782287597656,205.50900268554688,0.5160208940505981,211.83255004882812,213.94818115234375
|
| 6 |
+
4,0.49252375960350037,202.12045288085938,204.1398468017578,0.48822107911109924,211.89939880371094,213.9010772705078
|
| 7 |
+
5,0.47481003403663635,201.62823486328125,203.57510375976562,0.47861459851264954,212.11190795898438,214.0741424560547
|
| 8 |
+
6,0.45915693044662476,200.83592224121094,202.71807861328125,0.47098308801651,212.75682067871094,214.6878662109375
|
| 9 |
+
7,0.45016714930534363,200.08633422851562,201.9322509765625,0.47949111461639404,212.90963745117188,214.87545776367188
|
| 10 |
+
8,0.44311830401420593,199.59556579589844,201.412109375,0.46766361594200134,212.4846649169922,214.40203857421875
|
| 11 |
+
9,0.43127867579460144,198.93692016601562,200.70501708984375,0.4718685746192932,212.1318817138672,214.06654357910156
|
fold_2/model.bias_scaled.fold_2.ENCSR282QFE.h5
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:8fcf0487ba781a78fc1115e1a68e747039788becf32a94ddd955a905a1ff6fb3
|
| 3 |
+
size 2691928
|
fold_2/model.bias_scaled.fold_2.ENCSR282QFE.tar
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:929b7038ab30752a10b12eb666d43c17868023ba9ef93a98e54c2d16cc4ead20
|
| 3 |
+
size 1198080
|
fold_2/model.chrombpnet.fold_2.ENCSR282QFE.h5
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:0a26350dda566ecf80ade93bce2652821dafdef71d0ab9fb3510f7727379c246
|
| 3 |
+
size 77538840
|
fold_2/model.chrombpnet.fold_2.ENCSR282QFE.tar
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:4fc30310be53c8326b257452a646604f0b2148082c95b4307dc7ef3d59a7ec2a
|
| 3 |
+
size 27525120
|
fold_2/model.chrombpnet_nobias.fold_2.ENCSR282QFE.h5
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:4cd4f9091aa79753b79ff13fedd4e88a32b80436cba1296a48bb8e8f19e8416b
|
| 3 |
+
size 25582648
|
fold_2/model.chrombpnet_nobias.fold_2.ENCSR282QFE.tar
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:e8d07d2d6889300d909e7595248e104e3f4b7068f51ca6f26febd7ae711e182f
|
| 3 |
+
size 26060800
|
fold_3/logs.models.fold_3.ENCSR282QFE/logfile.modelling.fold_3.ENCSR282QFE.args.json
ADDED
|
@@ -0,0 +1,50 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"cmd": "pipeline",
|
| 3 |
+
"genome": "/oak/stanford/groups/akundaje/ziwei75/atac_seq_pipeline/hg38/GRCh38_no_alt_analysis_set_GCA_000001405.15.fasta",
|
| 4 |
+
"chrom_sizes": "/oak/stanford/groups/akundaje/ziwei75/atac_seq_pipeline/hg38/GRCh38_EBV.chrom.sizes.tsv",
|
| 5 |
+
"input_bam_file": "/oak/stanford/groups/akundaje/projects/chromatin-atlas-2022/DNASE/ENCSR282QFE/preprocessing/bigWigs/ENCSR282QFE.bigWig",
|
| 6 |
+
"input_fragment_file": null,
|
| 7 |
+
"input_tagalign_file": null,
|
| 8 |
+
"output_dir": "/oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_3",
|
| 9 |
+
"data_type": "DNASE",
|
| 10 |
+
"peaks": "/oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_3/auxiliary/filtered.peaks.bed",
|
| 11 |
+
"nonpeaks": "/oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_3/auxiliary/filtered.nonpeaks.bed",
|
| 12 |
+
"chr_fold_path": "/oak/stanford/groups/akundaje/projects/chromatin-atlas-2022/splits/fold_3.json",
|
| 13 |
+
"outlier_threshold": 0.9999,
|
| 14 |
+
"ATAC_ref_path": null,
|
| 15 |
+
"DNASE_ref_path": null,
|
| 16 |
+
"num_samples": 10000,
|
| 17 |
+
"inputlen": 2114,
|
| 18 |
+
"outputlen": 1000,
|
| 19 |
+
"seed": 1234,
|
| 20 |
+
"epochs": 50,
|
| 21 |
+
"early_stop": 5,
|
| 22 |
+
"learning_rate": 0.001,
|
| 23 |
+
"trackables": [
|
| 24 |
+
"logcount_predictions_loss",
|
| 25 |
+
"loss",
|
| 26 |
+
"logits_profile_predictions_loss",
|
| 27 |
+
"val_logcount_predictions_loss",
|
| 28 |
+
"val_loss",
|
| 29 |
+
"val_logits_profile_predictions_loss"
|
| 30 |
+
],
|
| 31 |
+
"architecture_from_file": "/home/users/vhecht/chrombpnet/chrombpnet/chrombpnet/training/models/chrombpnet_with_bias_model.py",
|
| 32 |
+
"file_prefix": null,
|
| 33 |
+
"html_prefix": "./",
|
| 34 |
+
"bsort": false,
|
| 35 |
+
"tmpdir": null,
|
| 36 |
+
"no_st": false,
|
| 37 |
+
"bias_model_path": "/oak/stanford/groups/akundaje/ziwei75/chromatin_atlas_bias/DNase_bias_model/bias_threshold_0.4/ENCSR282QFE/models/bias.h5",
|
| 38 |
+
"negative_sampling_ratio": 0.1,
|
| 39 |
+
"filters": 512,
|
| 40 |
+
"n_dilation_layers": 8,
|
| 41 |
+
"max_jitter": 500,
|
| 42 |
+
"batch_size": 64,
|
| 43 |
+
"output_prefix": "/oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_3/models/chrombpnet",
|
| 44 |
+
"bigwig": "/oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_3/auxiliary/data_unstranded.bw",
|
| 45 |
+
"plus_shift": null,
|
| 46 |
+
"minus_shift": null,
|
| 47 |
+
"chr": "chr6",
|
| 48 |
+
"pwm_width": 24,
|
| 49 |
+
"params": "/oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_3/logs/chrombpnet_model_params.tsv"
|
| 50 |
+
}
|
fold_3/logs.models.fold_3.ENCSR282QFE/logfile.modelling.fold_3.ENCSR282QFE.batch_loss.tsv
ADDED
|
The diff for this file is too large to render.
See raw diff
|
|
|
fold_3/logs.models.fold_3.ENCSR282QFE/logfile.modelling.fold_3.ENCSR282QFE.bias_formatting.stdout.txt
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
Converting /oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_3/models/bias_model_scaled.h5 to /oak/stanford/groups/akundaje/vhecht/chromatin-atlas-2022/DNASE/ENCSR282QFE/fold_3/new_model_format/bias_model_scaled.tar with get_new_tf_model_format.py
|
fold_3/logs.models.fold_3.ENCSR282QFE/logfile.modelling.fold_3.ENCSR282QFE.chrombpnet_data_params.tsv
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
counts_sum_min_thresh 0.0
|
| 2 |
+
counts_sum_max_thresh 1392.76
|
| 3 |
+
trainings_pts_post_thresh 173004
|
fold_3/logs.models.fold_3.ENCSR282QFE/logfile.modelling.fold_3.ENCSR282QFE.chrombpnet_formatting.stdout.txt
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
Converting /oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_3/models/chrombpnet.h5 to /oak/stanford/groups/akundaje/vhecht/chromatin-atlas-2022/DNASE/ENCSR282QFE/fold_3/new_model_format/chrombpnet.tar with get_new_tf_model_format.py
|
fold_3/logs.models.fold_3.ENCSR282QFE/logfile.modelling.fold_3.ENCSR282QFE.chrombpnet_model_params.tsv
ADDED
|
@@ -0,0 +1,9 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
counts_loss_weight 4.1
|
| 2 |
+
filters 512
|
| 3 |
+
n_dil_layers 8
|
| 4 |
+
bias_model_path /oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_3/models/bias_model_scaled.h5
|
| 5 |
+
inputlen 2114
|
| 6 |
+
outputlen 1000
|
| 7 |
+
max_jitter 500
|
| 8 |
+
chr_fold_path /oak/stanford/groups/akundaje/projects/chromatin-atlas-2022/splits/fold_3.json
|
| 9 |
+
negative_sampling_ratio 0.1
|
fold_3/logs.models.fold_3.ENCSR282QFE/logfile.modelling.fold_3.ENCSR282QFE.chrombpnet_no_bias_formatting.stdout.txt
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
Converting /oak/stanford/groups/akundaje/vhecht/chromatin_atlas_bias_corrected/DNASE_model/ENCSR282QFE/fold_3/models/chrombpnet_nobias.h5 to /oak/stanford/groups/akundaje/vhecht/chromatin-atlas-2022/DNASE/ENCSR282QFE/fold_3/new_model_format/chrombpnet_nobias.tar with get_new_tf_model_format.py
|