Скачать презентацию
Идет загрузка презентации. Пожалуйста, подождите
Презентация была опубликована 11 лет назад пользователемДенис Шумбасов
1 Биоинформатика Исследование информационных процессов в биологических системах (клетках, органах, организме, популяции). Изучение и внедрение в компьютерную науку «биологических» методов анализа информации (нейросетей, генетических алгоритмов, нечеткой логики и др.). Применение компьютерных методов для решения биологических задач. Телепатия, парапсихология, информационные поля и т.п.
2 Структура курса
3 Примеры задач биоинформатики Разработка алгоритмов для анализа большого объема биологических данных –Алгоритм поиска генов в геноме Анализ и интерпретация биологических данных таких, как нуклеотидные и аминокислотные последовательности, структура молекул белков, структура комплексов молекул белков с другими молекулами. –Изучение структуры активного центра белка Разработка программного обеспечения для управления и быстрого доступа к биологическим данным –Создание банка данных аминокислотных последовательностей
4 Итак... Биоинформатика = вычислительная молекулярная биология Почему так сузился смысл термина?
5 В конце 1970-х годов был изобретён относительно быстрый и дешёвый метод экспериментального определения последовательности оснований в ДНК Организм ДНК «в пробирке»Последовательность выделение секвенирование...TGCCACAAATCAC...
6 Для хранения все возрастающей информации о последовательностях ДНК в 1982 году был основан GenBank GenBank хранилище последовательностей нуклеиновых кислот в виде компьютерных файлов Объем GenBankа: 1982: букв в 606 последовательностях 1992: букв в последовательностях 2002: букв в последовательностях 2004: букв в последовательностях 2005: букв в последовательностях (из ~ организмов) Размер файлов 196 Gb
7 Первый банк данных Атлас белковых последовательностей и их структур Первая версия атласа содержала описание 65 (!) последовательностей белков
8 Банки данных Архивные (примеры: PDB, GenBank) за содержание каждой записи отвечает её автор-экспериментатор Курируемые за содержание записей отвечают специальные люди кураторы Автоматические записи генерируются компьютерными программами
9 Pfam, ProSite, InterPro,... Банки структурной биологической информации GenBank, EMBL, DDBJ RefSeq Архивные базы последовательностей нуклеиновых кислот Автоматическая база различных последовательностей НК SwissProt Курируемая база последовательностей белков TrEMBL Автоматическая база предсказаний последовательностей белков PDB Архивная база пространственных структур макромолекул И многие другие... Банки семейств белков
10 Поля и записи
11 Банк данных Swiss-Prot 1986 Swiss-Prot – база знаний о белковых последовательностях Курируемая база данных Золотой стандарт аннотации
12 Банк данных Swiss-Prot Амос Байрох Руководитель группы Swiss-Prot в Швейцарском Институте Биоинформатики С 1987 поддерживается в сотрудничестве между Swiss Institute of Bioinformatics (SIB) European Bioinformatics Institute (EBI)
13 Банк данных Swiss-Prot Статистика роста количества документов Текущий релиз 51.6 (6 февраля 2007) содержит документа
14 Банк данных TrEMBL Формальная трансляция всех кодирующих нуклеотидных последовательностей из банка EMBL Автоматическая классификация и аннотация TrEMBL (Translated EMBL) Текущий релиз 34.6 (6 февраля 2007) содержит документ
15 Тенденция объединения 2002
16 Банк данных UniProt UniProt (Universal Protein Resource) UniProt Knowlegebase – SwissProt+TrEMBL UniProt Archive – UniParc UniProt Reference – UniRef
17 ~ последовательностей DDBJEMBL GenBank ttttacctctttttagtgatattgtgatatagagcaaaaatcccgacattgtgtcgggattgtttttaaactcttgttgattttaatttttcaatcgcttctttattaaagaagtagtgtgtgcc acaacactcacattgcatatcaatacggcctttatgttcggctaatatttcgtcaatttcttcatcagagatgagcagtagatgcagaactagaacgctcagcagagcagccaca gaaaaattgtacatcttgtgctggataaagattaacggtttcttcgtgatataaacgataggagtaactcttctgcagggagaccaaataattcttcatcttttactgttgctgcgagc gtagttaaatgctcaaaatcttctggtgtaccagaaccatcaggcataatttgtaataacatacctgctgccactggcttgccttcatattctccagtacgaataattaattgagtttg aagactcatattttcagtgaagtttcgatcgcccttaggaggggccgcgctttctctttcaa компьютерный поиск гена, трансляция и компьютерная аннотация UniRef (UniProt non-redundant Reference databases) PIR-PSD UniParc (UniProt Archive) последовательностей Экспертиза Базы данных научной литературы
18 Соотношение числа белков, представленных в разных банках Последовательностей во много раз больше, чем структур! Большинство последовательностей не аннотированы!
19 Документ банка данных Swiss-Prot Описание документа: идентификатор, имя, дата создания и модификации Аннотация последовательности Последовательность
20 Основные поля записи SwissProt ID AC DE OS OC И сама последовательность, конечно.
Еще похожие презентации в нашем архиве:
© 2024 MyShared Inc.
All rights reserved.