martes, 22 de febrero de 2022

Vaya porra de reunión!!!

El pasado lunes tuvimos una reunión…. Cómo diría… una reunión de despropósitos…

Lo que tenía que ser una “clase” aclaratoria de conceptos, resultó debido a problemas varios (de Internet pero no sólo) “todo confusión”… Todo???

No, todo no. Descubrimos lo complejo de la labor en la que andamos embarcados… Y es que los programas de plegamiento de los ácidos nucléicos (RNA-fold) no siempre aciertan… . Y es que Paco nos explicó que el plegamiento final de un ARN depende tb de interacciones con otras proteínas, presencia de iones, conocimiento de otras estructuras parecidas, etc. Sin embargo, los “algoritmos” de plegamiento de los ordenadores se basan exclusivamente en encontrar el plegamiento “energéticamente más estable” para una determinada secuencia. Y por tanto a veces hay que corregirlo…

Pero corregirlo … cómo???

Para que entendamos a lo que me refiero debemos de adentrarnos en todas las estructuras de las secuencias del grupo D. Debemos de analizar… cual es la estructura que sale con cada una de las secuencias y compararla con la estructura que muestra cuando subimos el alineamiento (examinad vuestras notas) y enviadme los pantallazos correspondientes.

Que nos sale??? Que estructura nos da la secuencia 1341?? Que nos da cuando subimos todo el alineamiento 1342-1336 ¿?. (mirad la figura 1).

 
 
Figura 1: A estructura de la secuencia 1341 frente a B la de todo el alineamiento 1336-1342. Las flechas rojas indican la posición - probable en B, mal predicha en A - de las famosas dos “G”s que definen el comienzo del cDNA (ADN complementario del retrón).

Si logramos entender lo que sucede … ya estamos muy cerca de nuestro objetivo!!!

Para ello os aconsejo que miréis la nomenclatura viena de ambas secuencias… Observareis que en el caso B es fácil encontrar las Gs de nuestro retron y menos fácil (imposible) en el caso de la 1341 aislada

Esta es la base de nuestra manera de enfrentarnos al problema de corregir los plegamientos. Y entender lo que pretendemos en nuestro trabajo.

Para corregirlo es super importante que entendamos la “nomenclatura Viena”. Que no es otra que una nomenclatura que predice las interacciones de bases en una molécula de RNA a base de “.” : no interacción y paréntesis”(   )” : interacción.

Figura 2: Nomenclatura Viena ejemplo.

Y usar un programa (gratuito) para visualizar de estructuras. El programa es VARNAv3-93.jar nos lo podemos descargar desde: http://varna.lri.fr/index.php?lang=en&page=downloads&css=varna

 

Este programa nos permite proponer una determinada interacción, aunque ésta no haya sido predicha por los algoritmos de RNAfold.

Figura 4: Visualización de estructuras con el programa VARNAv3-93


El próximo día entenderemos como manejarla… . Aunque a lo mejor ya podeis ir haciendo probatinas… .

Aunque no lo parezca estamos ya muy cerca de alcanzar nuestro objetivo…

Jo!!!! Que dura es la ciencia!!!

lunes, 14 de febrero de 2022

Ya aparecen estructuras!!!

En la última sesión (el pasado Viernes 11 Febrero), descubrimos como se puede inferir la presencia de los retrones en nuestras secuencias de Clone Manager.

Claro que para ello, tenemos que tener claro cómo se forman este tipo de estructuras (Figura 1).

Figura 1: Esquema de los distintos pasos que tienen lugar para la formación de la molécula hibrida DNA-RNA que constituye el retrón.

Paco (nuestro investigador) nos puso que analizáramos el ejemplo del Grupo D.

Figura 2: El grupo D consistía en 7 locus (1336-1342) ordenadas según la matriz comparativa elaborada por las alumnas.

El alineamiento de las zonas intergénicas de las 7 secuencias ordenado de mayor a menor resultó ser muy informativo para determinar el grado de conservación de esta zona.

Figura 3: Alineamiento de las regiones intergenicas entre los genes efector y RTs de las secuencias 1337-1342 del grupo D 

Guardando este alineamiento desde el clone-manager como documento “.align” conseguimos disponer de la secuencia consenso de todos los alineamientos que nos permitirá obtener una posible estructura secundaria común a los 7 loci usando la aplicación http://rna.tbi.univie.ac.at/cgi-bin/RNAWebSuite/RNAalifold.cgi . 

El resultado es una estructura que recuerda y mucho a la esperada:

Figura 4: (A) la estructura consenso esperada (B) la estructura determinada para el msRNA codificante del retrón del grupo D de nuestras secuencias.

Esta estructura tiene a su vez el formato Viena; formato lineal donde se señalan las interacciones mediante códigos de paréntesis sobre la secuencia. 

Figura 5: La nomenclatura Viena de nuestra secuencia es indicativa de las interacciones del RNA “escondidas” en nuestra estructura.

Esa nomenclatura nos permitirá encontrar “inicialmente las dos Guaninas (‘G’s, branching y opposing) como base primera de determinar la estructura de nuestro retrón…

Figura 6: Localización de las Gs críticas en el grupo D de secuencias. 

Y claro, Paco quiere que para cada uno de los grupos seamos capaces de realizar una figura tal que así:

Que será nuestro primer paso para habiendo deducido la estructura secundaria (folding) de nuestro msRNA describir con todo detalle cada uno de nuestros retrones, que ya sabemos que son moléculas híbridas DNA-RNA.


¡¡¡¡¡¡Ya tenemos nuestro trabajo casi finalizado!!!!!


Hip, Hip, Hurra!!!

jueves, 27 de enero de 2022

Enfrentándonos a la descripción de “nuestros retrones”

La sesión del pasado Miércoles 26 no dejó de ser una reunión “extraña”. Paco, nuestro investigador se empeñó en que entendiéramos la Biología escondida que hay detrás de lo que estamos haciendo y lo que nos queda por hacer…

De nuevo ha hecho hincapié en que debemos de tener muy bien identificados la proteína efectora (PrtAse-WH) y la Reverso Transcriptasa (RT) de cada uno de nuestros sistemas. Esa identificación nos debe permitir ordenarlas en una “matriz de distancias” que nos va a permitir ponernos en la tarea de encontrar el “retrón escondido” en nuestras secuencias.

Lo habíamos hecho pero incluyendo en todas las comparaciones la 1352 (ver Figura 1). Esto lo que hacía era perder información entre la distancia y/o parecido de nuestras secuencias en cada grupo.

Figura 1: Ejemplo de la comparativa del grupo B realizada por las alumnas, en la que se ha incluido nuestra secuencia “modelo” la 1352.

Lo debemos de repetir y ordenar todos contra todos cada uno de los grupos con objeto de tener la  “mejor comparativa ordenada”. Esto es una matriz de distancias.

Figura 2: Ejemplo de la matriz de distancias a llevar a cabo en cada grupo.  Debe de haber cierto paralelismo entra ambas comparativas la de la RT y la de la proteína efectora (la PRTase_WH).
 

Esto nos pondrá un orden preferente para alinear de cada una de las entradas la región intergénica entre nuestros dos marcos abiertos de lectura (donde presumiblemente debemos de encontrar la estructura del retrón… .

Figura 3: Esa estructura deberá estar “escondida” en la secuencia de nucleótidos entre los dos marcos abiertos de lectura.

Para ello debemos seleccionar en cada entrada (1325, 1326, ….) Una sección de secuencia que contenga sólo 25 nt del final de la ORF (correspondiente al efector y 25 nucleótidos del principio de la RT. Y llevar a cabo los alineamientos que nos permitirán inferir la existencia de una estructura secundaria que definirá el retrón (Figura 4).

Figura 4: Ejemplo de los alineamientos que deberemos de llevar a cabo para empezar a definir el retrón en cada uno de los subgrupos (A-D).

Quizás, un buen comienzo podría ser el encontrar inicialmente las dos ‘G’ críticas en la función de todo retrón.

Figura 5: Ejemplo de lo que debemos encontrar, primeramente.
 

Que como vemos no es como buscar una aguja en un pajar pero se parece bastante.

Para ello, vamos a utilizar una herramienta online desarrollada por la Universidad de Viena en Austria (http://rna.tbi.univie.ac.at/cgi-bin/RNAWebSuite/RNAfold.cgi) que nos dará la estructura “secundaria” de todo ácido Nucleico.

Figura 6: El plegamiento de los acidos nucleicos está en la base de la función de todo retrón.

Ánimo!!!!!

que ya estamos en la tarea de describir al completo el nuevo sistema de retrones!!!!

Hip, Hip, Hurra!!!

miércoles, 19 de enero de 2022

El pasado lunes 17 (II)

La herramienta Blast, 

de donde provienen nuestras secuencias


Otra de las tareas que descubrimos el pasado lunes 17 fue entender el origen de nuestras secuencias … que no es otro que la base de datos del NCBI donde se encuentra depositado todo (o casi todo) lo secuenciado hasta la fecha… (y anotado): https://www.ncbi.nlm.nih.gov/

Interfaz de la web del NCBI y su herramienta comparativa y de búsqueda “Blast” que puede utilizar secuencias de nucleótidos y de proteínas para la búsqueda…

 
 
Tras introducir la secuencia de la proteína RT de nuestro locus modelo el 1352 de Salmonella enterica.
 
 
 Obtuvimos este resultado:
 

Donde analizando “grafic summary”, alignment results, “distance tree results” podemos entender lo conservado y el número de genes que hay como el nuestro (que son muchos)… . Y entre ellas, está por supuesto la primera que es nuestro gen (nuestra proteína).

Por tanto, es tb una buena herramienta de chequeo del tamaño de genes adecuado que estamos “anotando”.


Una vez identificados los genes debemos de ordenarlos de mayor a menor parecido y confirmar el paralelismo en distancia entre el gen efector y el gen RT… Algo parecido se ha realizado en el artículo del año anterior (fijaros en la figura 5 del artículo del año pasado en recursos: Nidame-Rodriguez y col 2021). Para ello hemos aprendido a utilizar dentro de la herramienta “align del clone manager cómo ordenar nuestras comparaciones (de mayor a menor parecido con nuestro locus modelo (la entrada 1352)

Comparativa de las proteínas estudiadas el año pasado y ordenadas de mayor a menor parecido… Se observa el paralelismo entre dos grupos de genes. Resultado que esperamos obtener tb en nuestro sistema de retrones.

Nuevas tareas nos esperan: terminar de ordenar toda la comparativa del grupo A y anotar e identificar los otros 3 grupos: B, C y D.


Esta labor va a ser importante ya que nos centrará en:

la identificación de la estructura del retrón de este sistema, que como ya hemos visto

nadie ha descrito todavía!!!!

Nos vamos a cercando a nuestra meta!!


martes, 18 de enero de 2022

La primera sesión del nuevo año (2022)

El pasado Lunes 17 de Enero, tuvimos una jornada “rápida” en la que ya vislumbramos la importancia biológica de lo que va a ser nuestra tarea: la descripción completa de un sistema de retrones no descrito hasta la fecha: el sistema III-A3.

Figura 1: Esquema del sistema de retrones tipo III-A3.

Para ello, nos vamos a servir de 4 “subgrupos” de ejemplos (A-D) que tendremos que analizar “conjuntamente y por separado …

Figura 2: Grupos que vamos a estudiar según la filogenia de las RTs. Son grupos de genes relacionados entre sí de manera significativa (valor de relación muy cercano al 1).
 
En este sentido Celia se preguntaba el porqué de esta selección. Si tenemos unos 143 candidatos por que hemos seleccionado sólo estos subgrupos?? El motivo no es otro que intentar encontrar un patrón de parecidos y divergencias que nos ayuden a establecer las características especiales que pueden tener los retrones de este tipo y por tanto describirlos… .
De hecho, ya hemos realizado un primer análisis y la anotación de los locus genéticos de los sistemas del tipo A-modelo.
 

Y hemos realizado las comparaciones de los dos genes: el efector (PRTaseWH) y la propia reverso transcriptasa (RT). Observando algunas peculiaridades (Figura 3)

Figura 3: Comparativa de las 5 proteínas más relacionadas con nuestro locus modelo (1352 de Salmonella enterica).
 
Así, observamos que una de las proteínas efectoras parece de menor tamaño que las otras (sólo 171 aa).

En realidad, se debe a un error en nuestra interpretación, la proteína (el gen) efectora del locus 155 tiene un tamaño semejante a las otras. Entonces, ¿por qué el clone manager nos la identifica más pequeña?

Figura 4: la herramienta “find ORFs” (búsqueda de marcos abiertos de lectura) del clone manager.

Como podemos observar en el programa la búsqueda de marcos abiertos de lectura no comienza siempre con el triplete ATG… . De hecho, aunque es el mayoritario y más eficiente, no es el único.

Os recomiendo que le echemos un vistazo a este trabajo:

Hecht A, Glasgow J, Jaschke PR, Bawazer LA, Munson MS, Cochran JR, Endy D, Salit M. Measurements of translation initiation from all 64 codons in E. coli. Nucleic Acids Res. 2017 Apr 20;45(7):3615-3626. doi: 10.1093/nar/gkx070. PMID: 28334756; PMCID: PMC5397182.

Que nos lo hemos descargado en recursos (enlace).

En él miden y comparan la eficiencia de comienzo de la traducción de todos y cada uno de los tripletes de nucleótidos (que son 64) (Figura 5).

Figura 5: la traducción puede comenzar por tres tripletes: AUG, GUG y UUG, aunque destaca mayoritariamente AUG.
 
En resumen, el gen efector de nuestro locus 1355, parece comenzar en TTG (UUG) en vez de en ATG (AUG), lo cual aunque no es frecuente, parece suceder en la naturaleza… .

Nuevos subgrupos nos quedan por analizar… esta semana debemos anotarlos todos y “ordenarlos” según su parecido a nuestro sistema modelo: el 1352 de Salmonella entérica.

Primero, los 9 representantes del grupo B (1325-1333), continuaremos por los del C y el D.

¡Confío en que los tengamos todos identificados para la próxima reunión!!!!

Hip, hip hurra


Aupa DNA team!!!!

jueves, 23 de diciembre de 2021

Nuestra reunión antes de Navidad

El pasado 20 de Diciembre tuvimos nuestra última reunión del año (que no la última del proyecto… jejeje).

En ella, vuestros padres conocieron donde andáis ya metidas. Creo que será bueno que también nos sigan en nuestro blog, verdad???

Tras una breve introducción de nuestro centro de investigación y los distintos proyectos caos de este año, de una manera somera les expliqué hasta donde queríamos llegar…

Figura resumen del artículo que nos servirá como modelo a seguir en el análisis de nuestras secuencias… .
Y es que el proyecto ya va cobrando forma. Es más ya sabemos que vamos a estudiar un grupo particular de retrones para los que todavía no hay una forma de RNA identificada (en recursos se ha subido la presentación correspondiente a este día). Y por tanto nuestro análisis permitirá validar su posible función biológica.

Figura 2: Arbol filogenético con todos los tipos de retrones que existen en la naturaleza. Se señalan las 143 secuencias sobre las que echaremos un ojo que representan a los retrones del tipo III-A3.


De momento tenemos como tarea el análisis de un subgrupo muy particular de retrones que hemos denominado como subgrupo A, correspondiente a 5 regiones del genoma de estas 5 bacterias (species strain en la tabla)

 
Tabla I de trabajo: entradas de secuencias correspondientes al subgrupo A.
 
En estas entradas deberemos ser capaces de:
-Identificar la unidad y conocer en lo que estamos trabajando.
-Usar nuestro sistema modelo (la referencia en rojo de la tabla) como referencia de identificación.
-Aprenderemos a Anotar los genes
-Identificar todos los locis…, de momento 5.

Y me consta que ya le habéis echado un ojo!!!!! 


 

lunes, 13 de diciembre de 2021

Noticias que nos afectan

El pasado 2 de diciembre salió publicado en la prensa un análisis de la importancia de la secuenciación masiva en la pandemia que venimos sufriendo.

https://elpais.com/tecnologia/2021-12-02/las-nuevas-armas-genomicas-contra-la-variante-omicron-eso-tambien-es-tecnologia.html

Si podéis acceder a la noticia os recomiendo su lectura en detalle. Está llena de guiños sobre lo que pretendemos hacer y que deriva entre otras cosas de la cantidad de secuencias de DNA (las famosas letras GATC) vertidas a las bases de datos que es nuestra fuente de trabajo. 

La secuenciación del ADN actual está en la base del conocimiento y desarrollo de herramientas frente a este virus. Como ejemplo en Dinamarca – uno de los países de referencia en el COVID-  se analizan semanalmente 10.000 secuencias nuevas del virus. Esto sí que es un seguimiento a tiempo real, verdad??

La facilidad de la secuenciación actual ha sido la base de la detección (PCR) de la generación de vacunas (RNA), etc…

Hasta sería interesante que pudiéramos comentar un día de este tipo de noticias, aunque, a lo mejor ya lo haceis en clase…

Saludos 

DNA team!!!!

Una nueva sorpresa más!!

Efectivamente, todavía sigue deparando nuevas sorpresas nuestro proyecto de retrones.    El pasado Sábado 11 de Noviembre tuvo lugar la gala...