配列から構造へ

はじめてのタンパク質構造比較 ― 5本の動画でたどる入門コース

← 動画でワークフロー 一覧へ

アミノ酸配列を調べるところまではできる。でも「構造で調べる」って、どこから手をつければいいのだろう——。このコースは、そんな方のための入門コースです。UniProt で配列と機能情報を調べるところから出発して、構造検索・構造比較・モチーフ検索まで、5本の動画を順番に体験していきます。立体構造解析の専門知識は前提としていません。1本ずつ進めば、最後には「構造で探す」という発想が自分の道具になっているはずです。

ワークフロー

公開から年数が経っている動画です。ツールの画面や手順が現行版と異なる場合があります(更新予定)。

  1. 1

    UniProt

    すべての出発点 ― まず、そのタンパク質が何者かを知る

    UniProt はタンパク質のアミノ酸配列と機能情報を集めた基本のデータベースで、この先のどのツールを使うときも「入口」になります。アクセッション番号の読み方、配列の取得、機能アノテーションの見方をここで押さえておくと、次のステップ以降がぐっと分かりやすくなります。まずはここから。

    UniProtを使って、タンパク質のアミノ酸配列とその機能情報を横断的・網羅的に調べる 8:03

  2. 2

    Foldseek

    配列が似ていなくても、構造なら見つかる ― を体験する

    構造検索の第一歩です。ここでいきなり新しいサイトを開く必要はありません。ステップ1で使った UniProt のエントリ画面には構造ビューアがあり、そこから 構造検索ツール「Foldseek」を直接呼び出せます。使い慣れた画面の続きとして構造検索を体験できるので、最初の一歩として最適です。「配列相同性では引っかからないのに、構造は似ている」という感覚を、ここで確かめてください。

    UniProtからFoldseekを使って高速にタンパク質構造の類似性を検索する 11:31

  3. 3

    AFDB Clusters

    見つけた類似性は、タンパク質情報の全体の中でどう位置づくのか

    ステップ2で「似た構造が見つかる」ことは分かりました。では、その類似性は特別なものなのでしょうか、それともありふれたものなのでしょうか。AFDB Clusters は約2億1400万件の予測構造を構造ベースでクラスタリングしたもので、いわばタンパク質構造の世界地図です。自分が見つけた類似性が地図のどこに位置するのかが分かると、結果の受け止め方が変わります。個別の検索結果から一歩引いて、興味をもったタンパク質の全体からの位置づけを知りましょう。

    AlphaFold Protein Structure Database Clustersを使ってタンパク質構造が類似するクラスターを検索する 13:52

  4. 4

    FoldMason

    2つの比較から、たくさんの比較へ

    ここまでは基本的に「1対1」の比較でした。次は複数の構造をまとめて扱います。FoldMason は多数の立体構造を高速に多重構造アライメントできるツールで、系統関係や構造の共通点・相違点を一望できます。並べてみてはじめて「どこがグループ共通で保存されているか」が見えてくる——この感覚が、最後のステップへの橋渡しになります。

    FoldMasonを使ってタンパク質構造のマルチプルアライメントを高速に行う (2026版) 11:14

  5. 5

    Folddisco

    全体ではなく、機能を担う一部分に注目するという発想

    コースの締めくくりは、視点の転換です。ここまで扱ってきたのはタンパク質「全体」の構造でした。Folddisco が検索するのは、機能を担う局所的な三次元配置=モチーフです。全体としては似ていないタンパク質どうしでも、活性部位まわりの数残基の配置だけは共通している——そのような部分的な類似性を掘り出せます。ステップ4で「複数のタンパク質の共通部分が見えてくる」体験をした後だからこそ、この発想の意味がよく分かるはずです。

    Folddiscoを使って、タンパク質のモチーフの検索をする(2026年版) 10:04

まとめ

配列 → 構造検索 → 全体像 → 多重比較 → モチーフ、と5本を追いかけてきました。ここまでくれば、「配列だけでは分からないことを構造で調べる」という選択肢が、具体的な手順として頭に入っているはずです。次は自分が扱っているタンパク質で、同じ順路をなぞってみてください。より実践的な流れを見たい方は「タンパク質の構造の“遠縁”を追い詰める」ワークフローへどうぞ。

さらに学ぶ