Skip to content

Article image
UniProt dan Basis Data Sekuens Protein

May 16, 2026

Gambaran Umum

UniProt (Universal Protein Resource) adalah repositori terkemuka dunia untuk informasi sekuens dan fungsi protein. Ini dikelola oleh konsorsium yang mencakup Institut Bioinformatika Eropa (EMBL-EBI), Institut Bioinformatika Swiss (SIB), dan Sumber Daya Informasi Protein (PIR). UniProt mengintegrasikan data dari proyek sekuensing genom, kurasi literatur, dan prediksi komputasional untuk menyediakan tampilan tunggal dan komprehensif dari setiap protein yang diketahui. Tiga komponen utamanya, UniProtKB, UniRef, dan UniParc, melayani kebutuhan analitis yang berbeda.

Konsep Kunci

UniProt Knowledgebase (UniProtKB) dibagi menjadi dua bagian: Swiss-Prot berisi entri yang dikurasi secara manual dan ditinjau dengan anotasi terperinci yang berasal dari literatur; TrEMBL berisi entri yang dianalisis secara komputasional menunggu tinjauan manual. UniRef mengelompokkan sekuens protein pada berbagai tingkat identitas (100%, 90%, 50%) untuk mengurangi redundansi dan mempercepat pencarian kesamaan sekuens. UniParc adalah arsip komprehensif non-redundan yang melacak semua sekuens protein dari basis data sumber utama. Setiap entri UniProtKB mencakup sekuens, informasi fungsi, lokasi subseluler, modifikasi pasca-translasi, domain dan situs, serta referensi silang ke basis data lain.

Aplikasi

UniProt berfungsi sebagai referensi protein utama untuk sebagian besar alur kerja bioinformatika. Peneliti menggunakannya untuk mengambil sekuens untuk prediksi struktur protein, mengidentifikasi protein dalam eksperimen proteomik dan spektrometri massa melalui pencarian basis data, dan mencari anotasi fungsional seperti klasifikasi dan tata nama enzim untuk studi jalur metabolisme.

Protokol Praktis

Untuk mengambil sekuens protein tertentu dari UniProtKB, navigasi ke uniprot.org dan masukkan nama gen, nama protein, atau akses (mis., TP53 atau P04637) di bilah pencarian. Halaman hasil menampilkan entri yang cocok dengan skor anotasi. Klik entri untuk melihat catatan lengkap: sekuens muncul di bagian “Sequence” dengan format FASTA tersedia melalui satu klik. Untuk pengambilan batch, gunakan alat “Retrieve/ID mapping”, tempel daftar akses atau nama gen, pilih basis data sumber (mis., UniProtKB AC/ID), dan pilih format target (FASTA, tab-separated, atau GFF). Alat ini juga memetakan pengenal ke lebih dari 200 basis data eksternal. Untuk analisis domain konservasi, ambil sekuens FASTA yang diperoleh dan kirimkan ke InterProScan (terintegrasi dalam UniProt) atau NCBI CD-Search. Hasilnya akan menyorot domain konservasi, situs aktif, dan daerah pengikatan, memberikan wawasan fungsional bahkan untuk protein yang tidak dikarakterisasi. Sebagai contoh, mengirimkan protein hipotetis dari sampel metagenomik ke BLAST UniProt dapat mengungkapkan homologi dengan lipase yang diketahui, dengan InterProScan mengkonfirmasi lipatan alfa/beta hidrolase dan triad katalitik, segera menyarankan fungsi biokimianya. Alur kerja pengambilan-dan-analisis gabungan ini mengubah UniProt dari repositori sekuens statis menjadi platform penemuan untuk anotasi fungsional protein baru. Contoh penggunaan nyata: selama pandemi COVID-19, peneliti menggunakan UniProt untuk mengakses sekuens protein lonjakan SARS-CoV-2 dengan cepat dan memetakan domain pengikatan reseptornya, mempercepat studi struktural dan desain vaksin, menunjukkan bagaimana UniProt berfungsi sebagai titik awal yang kritis untuk penelitian respons pandemi cepat.