Что такое генетический код. Как генетический код влияет на характер и судьбу

Каждый живой организм обладает особым набором белков. Определенные соединения нуклеотидов и их последовательность в молекуле ДНК образуют генетический код. Он передает информацию о строении белка. В генетике была принята определенная концепция. Согласно ей, одному гену соответствовал один фермент (полипептид). Следует сказать, что исследования о нуклеиновых кислотах и белках проводились в течение достаточно продолжительного периода. Далее в статье подробнее рассмотрим генетический код и его свойства. Будет также приведена краткая хронология исследований.

Терминология

Генетический код - это способ зашифровки последовательности белков аминокислот с участием нуклеотидной последовательности. Этот метод формирования сведений характерен для всех живых организмов. Белки - природные органические вещества с высокой молекулярностью. Эти соединения также присутствуют в живых организмах. Они состоят из 20 видов аминокислот, которые называются каноническими. Аминокислоты выстроены в цепочку и соединены в строго установленной последовательности. Она определяет структуру белка и его биологические свойства. Встречается также несколько цепочек аминокислот в белке.

ДНК и РНК

Дезоксирибонуклеиновая кислота - это макромолекула. Она отвечает за передачу, хранение и реализацию наследственной информации. ДНК использует четыре азотистых основания. К ним относятся аденин, гуанин, цитозин, тимин. РНК состоит из тех же нуклеотидов, кроме того из них, в составе которого находится тимин. Вместо него присутствует нуклеотид, содержащий урацил (U). Молекулы РНК и ДНК представляют собой нуклеотидные цепочки. Благодаря такой структуре образовываются последовательности - "генетический алфавит".

Реализация информации

Синтез белка, который кодируется геном, реализовывается при помощи объединения мРНК на матрице ДНК (транскрипции). Также происходит передача генетического кода в последовательность аминокислот. То есть имеет место синтез полипептидной цепи на мРНК. Для зашифровки всех аминокислот и сигнала окончания белковой последовательности достаточно 3-х нуклеотидов. Эта цепь называется триплетом.

История исследования

Изучение белка и нуклеиновых кислот проводилось длительное время. В середине 20 века, наконец, появились первые идеи о том, какую природу имеет генетический код. В 1953 году выяснили, что некоторые белки состоят из последовательностей аминокислот. Правда, тогда еще не могли определить их точное количество, и по этому поводу велись многочисленные споры. В 1953 году авторами Уотсоном и Криком было опубликовано две работы. Первая заявляла о вторичной структуре ДНК, вторая говорила о ее допустимом копировании при помощи матричного синтеза. Кроме того, был сделан акцент на то, что конкретная последовательность оснований - это код, несущий наследственную информацию. Американский и советский физик Георгий Гамов допустил гипотезу кодирования и нашел метод ее проверки. В 1954 году была опубликована его работа, в ходе которой он выдвинул предложение установить соответствия между боковыми аминокислотными цепями и "дырами", имеющими ромбообразную форму, и использовать это как механизм кодирования. Потом его назвали ромбическим. Разъясняя свою работу, Гамов допустил, что генетический код может являться триплетным. Труд физика стал одним из первых среди тех, которые считались близкими к истине.

Классификация

По истечении нескольких лет предлагались различные модели генетических кодов, представляющие собой два вида: перекрывающиеся и неперекрывающиеся. В основе первой было вхождение одного нуклеотида в состав нескольких кодонов. К ней принадлежит треугольный, последовательный и мажорно-минорный генетический код. Вторая модель предполагает два вида. К неперекрывающимся относятся комбинационный и "код без запятых". В основе первого варианта лежит кодировка аминокислоты триплетами нуклеотидов, и главным является его состав. Согласно "коду без запятых", определенные триплеты соответствуют аминокислотам, а остальные нет. В этом случае считалось, что при расположении любых значащих триплетов последовательно другие, находящиеся в иной рамке считывания, получатся ненужными. Ученые полагали, что существует возможность подбора нуклеотидной последовательности, которая будет удовлетворять этим требованиям, и что триплетов ровно 20.

Хотя Гамов с соавторами ставили под сомнение такую модель, она считалась наиболее правильной на протяжении следующих пяти лет. В начале второй половины 20-го века появились новые данные, которые позволили обнаружить некоторые недочеты в "коде без запятых". Было выявлено, что кодоны способны провоцировать синтез белка в пробирке. Ближе к 1965 году осмыслили принцип всех 64 триплетов. В результате обнаружили избыточность некоторых кодонов. Другими словами, последовательность аминокислот кодируется несколькими триплетами.

Отличительные особенности

К свойствам генетического кода относятся:

Вариации

Впервые отклонение генетического кода от стандартного было обнаружено в 1979 году во время изучения генов митохондрий в организме человека. Далее выявили еще подобные варианты, в том числе множество альтернативных митохондриальных кодов. К ним относятся расшифровка стоп-кодона УГА, используемого в качестве определения триптофана у микоплазм. ГУГ и УУГ у архей и бактерий нередко применяются в роли стартовых вариантов. Иногда гены кодируют белок со старт-кодона, отличающийся от стандартно используемого этим видом. Кроме того, в некоторых белках селеноцистеин и пирролизин, которые являются нестандартными аминокислотами, вставляются рибосомой. Она прочитывает стоп-кодон. Это зависит от последовательностей, находящихся в мРНК. В настоящее время селеноцистеин считается 21-ой, пирролизан - 22-ой аминокислотой, присутствующей в составе белков.

Общие черты генетического кода

Однако все исключения являются редкостью. У живых организмов в основном генетический код имеет ряд общих признаков. К ним относятся состав кодона, в который входят три нуклеотида (два первых принадлежат к определяющим), передача кодонов тРНК и рибосомами в аминокислотную последовательность.

ГЕНЕТИЧЕСКИЙ КОД , способ записи наследственной информации в молекулах нуклеиновых кислот в виде последовательности образующих эти кислоты нуклеотидов. Определённой последовательности нуклеотидов в ДНК и РНК соответствует определённая последовательность аминокислот в полипептидных цепях белков. Код принято записывать с помощью заглавных букв русского или латинского алфавита. Каждый нуклеотид обозначается буквой, с которой начинается название входящего в состав его молекулы азотистого основания: А (А) – аденин, Г (G) – гуанин, Ц (С) – цитозин, Т (Т) – тимин; в РНК вместо тимина урацил – У (U). Каждую кодирует комбинация из трёх нуклеотидов – триплет, или кодон. Кратко путь переноса генетической информации обобщён в т. н. центральной догме молекулярной биологии: ДНК ` РНК f белок.

В особых случаях информация может переноситься от РНК к ДНК, но никогда не переносится от белка к генам.

Реализация генетической информации осуществляется в два этапа. В клеточном ядре на ДНК синтезируется информационная, или матричная, РНК (транскрипция). При этом нуклеотидная последовательность ДНК «переписывается» (перекодируется) в нуклеотидную последовательность мРНК. Затем мРНК переходит в цитоплазму, прикрепляется к рибосоме, и на ней, как на матрице, синтезируется полипептидная цепь белка (трансляция). Аминокислоты с помощью транспортной РНК присоединяются к строящейся цепи в последовательности, определяемой порядком нуклеотидов в мРНК.

Из четырёх «букв» можно составить 64 различных трёхбуквенных «слова» (кодона). Из 64 кодонов 61 кодирует определённые аминокислоты, а три отвечают за окончание синтеза полипептидной цепи. Так как на 20 аминокислот, входящих в состав белков, приходится 61 кодон, некоторые аминокислоты кодируются более чем одним кодоном (т. н. вырождённость кода). Такая избыточность повышает надёжность кода и всего механизма биосинтеза белка. Другое свойство кода – его специфичность (однозначность): один кодон кодирует только одну аминокислоту.

Кроме того, код не перекрывается – информация считывается в одном направлении последовательно, триплет за триплетом. Наиболее удивительное свойство кода – его универсальность: он одинаков у всех живых существ – от бактерий до человека (исключение составляет генетический код митохондрий). Учёные видят в этом подтверждение концепции о происхождении всех организмов от одного общего предка.

Расшифровка генетического кода, т. е. определение «смысла» каждого кодона и тех правил, по которым считывается информация, осуществлена в 1961–1965 гг. и считается одним из наиболее ярких достижений молекулярной биологии.

Нуклеотиды ДНК и РНК Пуриновые: аденин, гуанин Пиримидиновые: цитозин, тимин (урацил)	Кодон - триплет нуклеотидов, кодирующих определенную аминокислоту.
таб. 1. Аминокислоты, которые обычно встречаются в белках
Название	Сокращенное обозначение
1. Аланин	Ala
2. Аргинин	Arg
3. Аспарагин	Asn
4. Аспарагиновая кислота	Asp
5. Цистеин	Cys
6. Глутаминовая кислота	Glu
7. Глутамин	Gln
8. Глицин	Gly
9. Гистидин	His
10. Изолейцин	Ile
11. Лейцин	Leu
12. Лизин	Lys
13. Метионин	Met
14. Фенилаланин	Phe
15. Пролин	Pro
16. Серии	Ser
17. Треонин	Thr
18. Триптофан	Trp
19. Тирозин	Tyr
20. Валин	Val

Генетический код, который еще называют аминокислотным кодом, - это система записи информации о последовательности расположения аминокислот в белке с помощью последовательности расположения нуклеотидных остатков в ДНК, которые содержат одно из 4-х азотистых оснований: аденин (А), гуанин (G), цитозин (C) и тимин (Т). Однако, поскольку двунитчатая спираль ДНК не принимает непосредственного участия в синтезе белка, который кодируется одной из этих нитей (т.е. РНК), то код записывается на языке РНК, в котором вместо тимина входит урацил (U). По этой же причине принято говорить, что код - это последовательность нуклеотидов, а не пар нуклеотидов.

Генетический код представлен определенными кодовыми словами, - кодонами.

Первое кодовое слово было расшифровано Ниренбергом и Маттеи в 1961 г. Они получили из кишечной палочки экстракт, содержащий рибосомы и прочие факторы, необходимые для синтеза белка. Получилась бесклеточная система для синтеза белка, которая могла бы осуществлять сборку белка из аминокислот, если в среду добавить необходимую мРНК. Добавив в среду синтетическую РНК, состоящую только из урацилов, они обнаружили, что образовался белок, состоящий только из фенилаланина (полифенилаланин). Так было установлено, что триплет нуклеотидов УУУ (кодон) соответствует фенилаланину. В течение последующих 5-6 лет были определены все кодоны генетического кода.

Генетический код - своеобразный словарь, переводящий текст, записанный с помощью четырех нуклеотидов, в белковый текст, записанный с помощью 20 аминокислот. Остальные аминокислоты, встречающиеся в белке, являются модификациями одной из 20 аминокислот.

Свойства генетического кода

Генетический код имеет следующие свойства.

Триплетность - каждой аминокислоте соответствует тройка нуклеотидов. Легко подсчитать, что существуют 4 3 = 64 кодона. Из них 61 является смысловым и 3 - бессмысленными (терминирующими, stop-кодонами).
Непрерывность (нет разделительных знаков между нуклеотидами) - отсутствие внутригенных знаков препинания;
Внутри гена каждый нуклеотид входит в состав значащего кодона. В 1961г. Сеймур Бензер и Френсис Крик экспериментально доказали триплетность кода и его непрерывность (компактость) [показать]

Суть эксперимента: "+" мутация - вставка одного нуклеотида. "-" мутация - выпадение одного нуклеотида.
Одиночная мутация ("+" или "-") в начале гена или двойная мутация ("+" или "-") - портит весь ген.
Тройная мутация ("+" или "-") в начале гена портит лишь часть гена.
Четверная "+" или "-" мутация опять портит весь ген.
Эксперимент был проведен на двух рядом расположенных фаговых генах и показал, что
1. код триплетен и внутри гена нет знаков препинания
2. между генами есть знаки препинания
Наличие межгенных знаков препинания - наличие среди триплетов инициирующих кодонов (с них начинается биосинтез белка), кодонов - терминаторов (обозначают конец биосинтеза белка);
Условно к знакам препинания относится и кодон AUG - первый после лидерной последовательности. Он выполняет функцию заглавной буквы. В этой позиции он кодирует формилметионин (у прокариот).
В конце каждого гена, кодирующего полипептид, находится, по меньшей мере, один из 3-х терминирующих кодонов, или стоп-сигналов: UAA, UAG, UGA. Они терминируют трансляцию.
Колинеарность - соответствие линейной последовательности кодонов мРНК и аминокислот в белке.
Специфичность - каждой аминокислоте соответствуют только определенные кодоны, которые не могут использоваться для другой аминокислоты.
Однонаправленность - кодоны считываются в одном направлении - от первого нуклеотида к последующим
Вырожденность, или избыточность ,- одну аминокислоту может кодировать несколько триплетов (аминокислот – 20, возможных триплетов – 64, 61 из них смысловой, т. е. в среднем каждой аминокислоте соответствует около 3 кодонов); исключение составляет метионин (Met) и триптофан (Trp).
Причина вырожденности кода состоит в том, что главную смысловую нагрузку несут два первых нуклеотида в триплете, а третий не так важен. Отсюда правило вырожденности кода : если два кодона имеют два одинаковых первых нуклеотида, а их третьи нуклеотиды принадлежат к одному классу (пуриновому или пиримидиновому), то они кодируют одну и ту же аминокислоту.
Однако из этого идеального правила есть два исключения. Это кодон АUА, который должен соответствовать не изолейцину, а метионину и кодон UGА, который является терминирующим, тогда как должен соответствовать триптофану. Вырожденность кода имеет, очевидно, приспособительное значение.

Универсальность - все перечисленные выше свойства генетического кода характерны для всех живых организмов.

Кодон	Универсальный код	Митохондриальные коды
Кодон	Универсальный код	Позвоночные	Беспозвоночные	Дрожжи	Растения
UGA	STOP	Trp	Trp	Trp	STOP
AUA	Ile	Met	Met	Met	Ile
CUA	Leu	Leu	Leu	Thr	Leu
AGA	Arg	STOP	Ser	Arg	Arg
AGG	Arg	STOP	Ser	Arg	Arg

В последнее время принцип универсальности кода был поколеблен в связи c открытием Береллом в 1979 г. идеального кода митохондрий человека, в котором выполняется правило вырожденности кода. В коде митохондрий кодон UGA соответствует триптофану, а AUA - метионину, как того требует правило вырожденности кода.

Возможно, в начале эволюции у всех простейших организмов был такой же код, как и у митохондрий, а затем он претерпел небольшие отклонения.

Неперекрываемость - каждый из триплетов генетического текста независим друг от друга, один нуклеотид входит в состав только одного триплета; На рис. показана разница между перекрывающимся и неперекрывающимся кодом.
В 1976г. была секвенирована ДНК фага φХ174. У него одноцепочечная кольцевая ДНК, состоящая из 5375 нуклеотидов. Было известно, что фаг кодирует 9 белков. Для 6 из них были определены гены, располагающиеся друг за другом.
Выяснилось, что есть перекрывание. Ген Е полностью находится внутри гена D. Его инициирующий кодон появляется в результате сдвига считывания на один нуклеотид. Ген J начинается там, где кончается ген D. Инициирующий кодон гена J перекрывается с терминирующим кодоном гена D в результате сдвига на два нуклеотида. Конструкция называется "сдвиг рамки считывания" на число нуклеотидов, некратное трем. На сегодняшний день перекрывание показано только для нескольких фагов.
Помехоустойчивость - отношение числа консервативных замен к числу радикальных замен.
Мутации замен нуклеотидов, не приводящие к смене класса кодируемой аминокислоты, называют консервативными. Мутации замен нуклеотидов, приводящие к смене класса кодируемой аминокислоты, называют радикальными.
Так как одна и та же аминокислота может кодироваться разными триплетами, то некоторые замены в триплетах не приводят к замене кодируемой аминокислоты (например UUU -> UUC оставляет фенилаланин). Некоторые замены меняют аминокислоту на другую из того же класса (неполярный, полярный, основной, кислотный), остальные замены меняют и класс аминокислоты.
В каждом триплете можно провести 9 однократных замен, т.е. выбрать, какую из позиций меняем - можно тремя способами (1-я или 2-я или 3-я), причем выбранную букву (нуклеотид) можно поменять на 4-1=3 других буквы (нуклеотида). Общее количество возможных замен нуклеотидов - 61 по 9 = 549.
Прямым подсчетом по таблице генетического кода можно убедиться, что из них: 23 замены нуклеотидов приводят к появлению кодонов - терминаторов трансляции. 134 замены не меняют кодируемую аминокислоту. 230 замен не меняют класс кодируемой аминокислоты. 162 замены приводят к смене класса аминокислоты, т.е. являются радикальными. Из 183 замен 3-его нуклеотида, 7 приводят к появлению терминаторов трансляции, а 176 - консервативны. Из 183 замен 1-ого нуклеотида, 9 приводят к появлению терминаторов, 114 - консервативны и 60 - радикальны. Из 183 замен 2-го нуклеотида, 7 приводят к появлению терминаторов, 74 - консервативны, 102 - радикальны.

При необходимости синтеза белков перед клеткой возникает одна серьезная проблема – информация в ДНК хранится в виде последовательности, закодированной 4 символами (нуклеотидами), а белки состоят из 20 различных символов (аминокислот). Если попытаться использовать сразу все четыре символа для кодировки аминокислот, то получится всего 16 сочетаний, в то время как протеиногенных аминокислот насчитывается 20. Не хватает...

На этот счет существует пример гениального мышления:

"Возьмем, например, колоду игральных карт, в которой мы обращаем внимание только на масть карты. Сколько триплетов одного и того же вида можно получить? Четыре, конечно: трое червей, трое бубен, трое пик и трое треф. Сколько триплетов с двумя картами одной и той же масти и одной другой? Пусть мы имеем четыре выбора для третьей карты. Поэтому мы имеем 4x3 = 12 возможностей. В дополнение мы имеем четыре триплета со всеми тремя различными картами. Итак, 4+12+4=20, а это и есть точное число аминокислот, которое мы хотели получить" (Георгий Гамов, англ. George Gamow, 1904-1968г, советский и американский физик-теоретик, астрофизик и популяризатор науки).

Действительно, экспериментами доказано, что для каждой аминокислоты имеется по два обязательных нуклеотида и третий вариабельный, менее специфичный ("эффект качания "). В случае, если брать три символа из четырех, то получится 64 комбинации, что намного перекрывает число аминокислот. Таким образом выяснено, что любая аминокислота кодируется тремя нуклеотидами. Эта тройка получила название кодон . Их, как уже сказано, существует 64 варианта. Три из них не кодируют никакой аминокислоты, это так называемые "нонсенс-кодоны " (франц. non-sens - бессмыслица) или "стоп-кодоны".

Генетический код

Генетический (биологический) код – это способ кодирования информации о строении белков в виде нуклеотидной последовательности. Он предназначен для перевода четырехзначного языка нуклеотидов (А, Г, У, Ц) в двадцатизначный язык аминокислот. Он обладает характерными особенностями:

Триплетность – три нуклеотида формируют кодон, кодирующий аминокислоту. Всего насчитывают 61 смысловой кодон.
Специфичность (или однозначность ) – каждому кодону соответствует только одна аминокислота.
Вырожденность – одной аминокислоте может соответствовать несколько кодонов.
Универсальность – биологический код одинаков для всех видов организмов на Земле (однако в митохондриях млекопитающих есть исключения).
Колинеарность – последовательность кодонов соответствует последовательности аминокислот в кодируемом белке.
Неперекрываемость – триплеты не накладываются друг на друга, располагаясь рядом.
Отсутствие знаков препинания – между триплетами нет дополнительных нуклеотидов или каких-либо иных сигналов.
Однонаправленность – при синтезе белка считывание кодонов идет последовательно, без пропусков или возвратов назад.

Однако ясно, что биологический код не может проявить себя без дополнительных молекул, которые выполняют переходную функцию или функцию адаптора .

Адапторная роль транспортных РНК

Транспортные РНК являются единственным посредником между 4-х буквенной последовательностью нуклеиновых кислот и 20-ти буквенной последовательностью белков.

Каждая транспортная РНК имеет определенную триплетную последовательность в антикодоновой петле (антикодон ) и может присоединить только такую аминокислоту, которая соответствует этому антикодону. Именно от наличия того или иного антикодона в тРНК зависит, какая аминокислота включится в белковую молекулу, т.к. ни рибосома, ни мРНК не узнают аминокислоту.

Таким образом, адапторная роль тРНК заключается:

в специфичном связывании с аминокислотами,
в специфичном, согласно кодон-антикодоновому взаимодействию, связывании с мРНК,
и, как результат, во включении аминокислот в белковую цепь в соответствии с информацией мРНК.

Присоединение аминокислоты к тРНК осуществляется ферментом аминоацил-тРНК-синтетазой , имеющей специфичность одновременно к двум соединениям: какой-либо аминокислоте и соответствующей ей тРНК. Для реакции требуется две макроэргические связи АТФ. Аминокислота присоединяется к 3"-концу акцепторной петли тРНК через свою α-карбоксильную группу, и связь между аминокислотой и тРНК становится макроэргической . α-Аминогруппа остается свободной.

Реакция синтеза аминоацил-тРНК

Так как существует около 60 различных тРНК, то некоторым аминокислотам соответствует по две или более тРНК. Различные тРНК, присоединяющие одну аминокислоту, называют изоакцепторными .

Сегодня ни для кого не секрет, что программа жизнедеятельности всех живых организмов записана на молекуле ДНК. Проще всего представить молекулу ДНК в виде длинной лестницы. Вертикальные стойки этой лестницы состоят из молекул сахара, кислорода и фосфора. Вся важная рабочая информация в молекуле записана на перекладинах лестницы — они состоят из двух молекул, каждая из которых крепится к одной из вертикальных стоек. Эти молекулы — азотистые основания — называются аденин, гуанин, тимин и цитозин, но обычно их обозначают просто буквами А, Г, Т и Ц. Форма этих молекул позволяет им образовывать связи — законченные ступеньки — лишь определенного типа. Это связи между основаниями А и Т и между основаниями Г и Ц (образованную таким образом пару называют «парой оснований» ). Других типов связи в молекуле ДНК быть не может.

Спускаясь по ступенькам вдоль одной цепи молекулы ДНК, вы получите последовательность оснований. Именно это сообщение в виде последовательности оснований и определяет поток химических реакций в клетке и, следовательно, особенности организма, обладающего данной ДНК. Согласно центральной догме молекулярной биологии , на молекуле ДНК закодирована информация о белках , которые, в свою очередь, выступая в роли ферментов (см. Катализаторы и ферменты), регулируют все химические реакции в живых организмах.

Строгое соответствие между последовательностью пар оснований в молекуле ДНК и последовательностью аминокислот, составляющих белковые ферменты, называется генетическим кодом. Генетический код был расшифрован вскоре после открытия двуспиральной структуры ДНК. Было известно, что недавно открытая молекула информационной , или матричной РНК (иРНК, или мРНК), несет информацию, записанную на ДНК. Биохимики Маршалл Уоррен Ниренберг (Marshall W. Nirenberg) и Дж. Генрих Маттеи (J. Heinrich Matthaei) из Национального института здравоохранения в городке Бетезда под Вашингтоном, округ Колумбия, поставили первые эксперименты, которые привели к разгадке генетического кода.

Они начали с того, что синтезировали искусственные молекулы иРНК, состоявшие только из повторяющегося азотистого основания урацила (который является аналогом тимина, «Т», и образует связи только с аденином, «А», из молекулы ДНК). Они добавляли эти иРНК в тестовые пробирки со смесью аминокислот, причем в каждой пробирке лишь одна из аминокислот была помечена радиоактивной меткой. Исследователи обнаружили, что искусственно синтезированная ими иРНК инициировала образование белка лишь в одной пробирке, где находилась меченая аминокислота фенилаланин. Так они установили, что последовательность «—У—У—У—» на молекуле иРНК (и, следовательно, эквивалентную ей последовательность «—А—А—А—» на молекуле ДНК) кодирует белок, состоящий только из аминокислоты фенилаланина. Это было первым шагом к расшифровке генетического кода.

Сегодня известно, что три пары оснований молекулы ДНК (такой триплет получил название кодон ) кодируют одну аминокислоту в белке. Выполняя эксперименты, аналогичные описанному выше, генетики в конце концов расшифровали весь генетический код, в котором каждому из 64 возможных кодонов соответствует определенная аминокислота.