7W1M: Human cohesin-CTCF-DNA complex

Cryo-EM structure of human cohesin-CTCF-DNA complex. Determined by electron microscopy at 6.5 Å resolution. Released 31 May 2023.

Method
Electron microscopy
Resolution
6.5 Å
Organism
Homo sapiens
Chains
8
Atoms
34,251
Mol. weight
826.7 kDa
Ligands
ADP, BEF, ZN
Released
31 May 2023

Explore 7W1M in 3D Show helices and sheets RCSB PDB PDBe

Secondary structure: helices and β-sheets

7W1M contains 176 α-helices and 60 β-strands across 6 chains. Residue ranges use author residue numbering, as in the PDB file, from PDBe. To see them in 3D, choose the Cartoon representation with Secondary structure coloring: helices, sheets and coils get different colors.

Chain A: 13 helices, 15 β-strands

ElementResiduesLengthSheet
β-strand3-1081
β-strand1212
β-strand18-2031
α-helix21-233
β-strand29-3133
α-helix39-4911
α-helix53-564
β-strand6512
β-strand78-8691
β-strand90-99101
β-strand102-10761
β-strand111-11221
α-helix114-12411
α-helix140-1445
α-helix148-15811
α-helix162-1643
α-helix165-20036
α-helix1028-108861
β-strand1096-110054
β-strand1111-111554
α-helix1125-11273
α-helix1130-114718
β-strand1152-115653
α-helix1164-118118
β-strand1183-118863
α-helix1191-11955
β-strand1199-120683
β-strand1212-121983
Chain B: 18 helices, 12 β-strands
ElementResiduesLengthSheet
β-strand2-985
β-strand27-3156
α-helix39-4911
α-helix52-554
α-helix58-625
α-helix72-732
β-strand76-8385
β-strand95-10285
β-strand107-11155
β-strand11515
α-helix120-1289
α-helix146-1494
α-helix152-16211
α-helix168-25588
α-helix916-93520
α-helix939-9468
α-helix952-9543
α-helix964-97815
α-helix986-104762
β-strand1051-105777
β-strand1096-110277
α-helix1117-113418
β-strand1139-114356
α-helix1151-116414
β-strand1169-117356
α-helix1178-11814
β-strand1185-119286
β-strand1195-120176
α-helix1203-12075
α-helix1208-12125
Chain C: 15 helices, 6 β-strands
ElementResiduesLengthSheet
α-helix15-184
α-helix19-235
α-helix29-346
α-helix38-458
α-helix53-8533
β-strand33118
α-helix334-3429
α-helix345-3473
β-strand34819
β-strand353110
α-helix354-3552
α-helix358-3647
α-helix369-3724
α-helix383-3908
α-helix559-57416
β-strand579-580211
α-helix581-5844
α-helix590-60516
β-strand609-612411
α-helix619-6202
β-strand621-624411
Chain D: 51 helices, 3 β-strands
ElementResiduesLengthSheet
α-helix87-926
α-helix98-11114
α-helix113-12715
α-helix136-1405
α-helix144-15310
α-helix169-18820
α-helix193-1953
α-helix199-21113
α-helix216-25641
α-helix261-29131
α-helix292-2965
α-helix297-2993
β-strand30218
α-helix305-32117
α-helix329-33810
α-helix344-35815
α-helix365-3739
α-helix375-3828
β-strand38419
α-helix387-40317
α-helix410-41910
β-strand422110
α-helix425-43814
α-helix462-47413
α-helix482-4876
α-helix493-4964
α-helix499-5046
α-helix519-53719
α-helix554-58128
α-helix586-5927
α-helix595-5984
α-helix602-6076
α-helix610-62617
α-helix630-64314
α-helix651-67626
α-helix685-70319
α-helix713-72513
α-helix731-75020
α-helix760-78122
α-helix785-80117
α-helix804-8074
α-helix820-8223
α-helix823-83614
α-helix858-87720
α-helix884-8907
α-helix897-91418
α-helix916-93823
α-helix947-96216
α-helix970-98516
α-helix9981
α-helix1003-10119
α-helix1018-10269
α-helix1032-10365
α-helix1043-10508
Chain E: 67 helices, 6 β-strands
ElementResiduesLengthSheet
α-helix1200-121516
α-helix1235-124511
α-helix1249-12524
α-helix1258-127518
α-helix1295-131824
α-helix1330-134314
α-helix1344-13485
α-helix1349-13524
α-helix1381-140323
α-helix1408-141912
α-helix1420-14234
α-helix1428-144417
α-helix1449-145810
α-helix1460-14623
β-strand1471-1473312
β-strand1487-1488212
α-helix1489-150012
α-helix1525-155026
α-helix1559-157113
β-strand1575113
β-strand1578113
α-helix1581-159616
α-helix1603-162725
α-helix1647-166519
α-helix1670-168920
α-helix1709-172820
α-helix1750-176314
α-helix1767-17693
α-helix1770-177910
α-helix1786-180217
α-helix1810-182011
α-helix1825-184117
α-helix1850-18556
α-helix1863-187816
α-helix1885-18917
α-helix1893-18953
α-helix1900-191314
α-helix1923-193917
α-helix1946-195813
α-helix1966-198520
α-helix1999-201517
α-helix2028-20325
α-helix2038-205720
α-helix2063-207816
α-helix2082-209615
α-helix2103-212624
α-helix2132-21354
α-helix2137-215317
α-helix2169-218113
α-helix2187-220216
α-helix2204-22085
α-helix2210-222011
α-helix2228-225326
α-helix2259-22613
α-helix2270-228920
α-helix2295-231117
α-helix2320-23256
α-helix2326-23283
α-helix2332-234615
α-helix2352-23554
α-helix2358-237114
α-helix2393-23997
α-helix2403-241614
α-helix2425-243713
β-strand2442114
α-helix2444-247027
α-helix2534-255724
α-helix2561-25666
α-helix25781
β-strand2579114
α-helix2580-25812
α-helix2589-260012
α-helix2608-262619
Chain H: 12 helices, 18 β-strands
ElementResiduesLengthSheet
α-helix224-2263
β-strand266-267215
β-strand274-275215
α-helix278-28912
β-strand294-295216
β-strand302-303216
α-helix306-31611
β-strand322-323217
β-strand330-331217
α-helix334-34411
β-strand351-352218
β-strand359-360218
α-helix363-37412
β-strand380119
β-strand387119
α-helix391-40212
α-helix419-42911
β-strand437-438220
β-strand445-446220
α-helix449-45911
β-strand462-468721
β-strand475-478421
α-helix479-48911
β-strand495-496222
β-strand503-504222
α-helix507-51711
β-strand523-524223
β-strand531-532223
α-helix537-54610
α-helix567-5759

Molecules and chains

MoleculeChainsTypeLengthOrganismUniProt
Structural maintenance of chromosomes protein 1AAprotein1233Homo sapiensQ14683 (AlphaFold model)
Structural maintenance of chromosomes protein 3Bprotein1217Homo sapiensQ9UQE7 (AlphaFold model)
Double-strand-break repair protein rad21 homologCprotein631Homo sapiensO60216 (AlphaFold model)
Cohesin subunit SA-1Dprotein1258Homo sapiensQ8WVM7 (AlphaFold model)
Nipped-B-like proteinEprotein1467Homo sapiensQ6KC79
DNA (118-mer)FDNA118Homo sapiens
DNA (118-mer)GDNA118Homo sapiens
Transcriptional repressor CTCFHprotein727Homo sapiensP49711
Sequence of entity 1 (A), FASTA
>7W1M_1 Structural maintenance of chromosomes protein 1A (chains A)
MGFLKLIEIENFKSYKGRQIIGPFQRFTAIIGPNGSGKSNLMDAISFVLGEKTSNLRVKT
LRDLIHGAPVGKPAANRAFVSMVYSEEGAEDRTFARVIVGGSSEYKINNKVVQLHEYSEE
LEKLGILIKARNFLVFQGAVESIAMKNPKERTALFEEISRSGELAQEYDKRKKEMVKAEE
DTQFNYHRKKNIAAERKEAKQEKEEADRYQRLKDEVVRAQVQLQLFKLYHNEVEIEKLNK
ELASKNKEIEKDKKRMDKVEDELKEKKKELGKMMREQQQIEKEIKEKDSELNQKRPQYIK
AKENTSHKIKKLEAAKKSLQNAQKHYKKRKGDMDELEKEMLSVEKARQEFEERMEEESQS
QGRDLTLEENQVKKYHRLKEEASKRAATLAQELEKFNRDQKADQDRLDLEERKKVETEAK
IKQKLREIEENQKRIEKLEEYITTSKQSLEEQKKLEGELTEEVEMAKRRIDEINKELNQV
MEQLGDARIDRQESSRQQRKAEIMESIKRLYPGSVYGRLIDLCQPTQKKYQIAVTKVLGK
NMDAIIVDSEKTGRDCIQYIKEQRGEPETFLPLDYLEVKPTDEKLRELKGAKLVIDVIRY
EPPHIKKALQYACGNALVCDNVEDARRIAFGGHQRHKTVALDGTLFQKSGVISGGASDLK
AKARRWDEKAVDKLKEKKERLTEELKEQMKAKRKEAELRQVQSQAHGLQMRLKYSQSDLE
QTKTRHLALNLQEKSKLESELANFGPRINDIKRIIQSREREMKDLKEKMNQVEDEVFEEF
CREIGVRNIREFEEEKVKRQNEIAKKRLEFENQKTRLGIQLDFEKNQLKEDQDKVHMWEQ
TVKKDENEIEKLKKEEQRHMKIIDETMAQLQDLKNQHLAKKSEVNDKNHEMEEIRKKLGG
ANKEMTHLQKEVTAIETKLEQKRSDRHNLLQACKMQDIKLPLSKGTMDDISQEEGSSQGE
DSVSGSQRISSIYAREALIEIDYGDLCEDLKDAQAEEEIKQEMNTLQQKLNEQQSVLQRI
AAPNMKAMEKLESVRDKFQETSDEFEAARKRAKKAKQAFEQIKKERFDRFNACFESVATN
IDEIYKALSRNSSAQAFLGPENPEEPYLDGINYNCVAPGKRFRPMDNLSGGEKTVAALAL
LFAIHSYKPAPFFVLDEIDAALDNTNIGKVANYIKEQSTCNFQAIVISLKEEFYTKAESL
IGVYPEQGDCVISKVLTFDLTKYPDANPNPNEQ
Sequence of entity 2 (B), FASTA
>7W1M_2 Structural maintenance of chromosomes protein 3 (chains B)
MYIKQVIIQGFRSYRDQTIVDPFSSKHNVIVGRNGSGKSNFFYAIQFVLSDEFSHLRPEQ
RLALLHEGTGPRVISAFVEIIFDNSDNRLPIDKEEVSLRRVIGAKKDQYFLDKKMVTKND
VMNLLESAGFSRSNPYYIVKQGKINQMATAPDSQRLKLLREVAGTRVYDERKEESISLMK
ETEGKREKINELLKYIEERLHTLEEEKEELAQYQKWDKMRRALEYTIYNQELNETRAKLD
ELSAKRETSGEKSRQLRDAQQDARDKMEDIERQVRELKTKISAMKEEKEQLSAERQEQIK
QRTKLELKAKDLQDELAGNSEQRKRLLKERQKLLEKIEEKQKELAETEPKFNSVKEKEER
GIARLAQATQERTDLYAKQGRGSQFTSKEERDKWIKKELKSLDQAINDKKRQIAAIHKDL
EDTEANKEKNLEQYNKLDQDLNEVKARVEELDRKYYEVKNKKDELQSERNYLWREENAEQ
QALAAKREDLEKKQQLLRAATGKAILNGIDSINKVLDHFRRKGINQHVQNGYHGIVMNNF
ECEPAFYTCVEVTAGNRLFYHIVDSDEVSTKILMEFNKMNLPGEVTFLPLNKLDVRDTAY
PETNDAIPMISKLRYNPRFDKAFKHVFGKTLICRSMEVSTQLARAFTMDCITLEGDQVSH
RGALTGGYYDTRKSRLELQKDVRKAEEELGELEAKLNENLRRNIERINNEIDQLMNQMQQ
IETQQRKFKASRDSILSEMKMLKEKRQQSEKTFMPKQRSLQSLEASLHAMESTRESLKAE
LGTDLLSQLSLEDQKRVDALNDEIRQLQQENRQLLNERIKLEGIITRVETYLNENLRKRL
DQVEQELNELRETEGGTVLTATTSELEAINKRVKDTMARSEDLDNSIDKTEAGIKELQKS
MERWKNMEKEHMDAINHDTKELEKMTNRQGMLLKKKEECMKKIRELGSLPQEAFEKYQTL
SLKQLFRKLEQCNTELKKYSHVNKKALDQFVNFSEQKEKLIKRQEELDRGYKSIMELMNV
LELRKYEAIQLTFKQVSKNFSEVFQKLVPGGKATLVMKKGDVEGSQSQDEGEGSGESERG
SGSQSSVPSVDQFTGVGIRVSFTGKQGEMREMQQLSGGQKSLVALALIFAIQKCDPAPFY
LFDEIDQALDAQHRKAVSDMIMELAVHAQFITTTFRPELLESADKFYGVKFRNKVSHIDV
ITAEMAKDFVEDDTTHG
Sequence of entity 3 (C), FASTA
>7W1M_3 Double-strand-break repair protein rad21 homolog (chains C)
MFYAHFVLSKRGPLAKIWLAAHWDKKLTKAHVFECNLESSVESIISPKVKMALRTSGHLL
LGVVRIYHRKAKYLLADCNEAFIKIKMAFRPGVVDLPEENREAAYNAITLPEEFHDFDQP
LPDLDDIDVAQQFSLNQSRVEEITMREEVGNISILQENDFGDFGMDDREIMAEGSAFEDD
DMLVSTTTSNLLLESEQSTSNLNEKINHLEYEDQYKDDNFGEGNDGGILDDKLISNNDGG
IFDDPPALSEAGVMLPEQPAHDDMDEDDNVSMGGPDSPASVDPVEPMPTMTDQTTLVPNE
EEAFALEPIDITVKETKAKRKRKLIVDSVKELDSKTIRAQLSDYSDIVTTLDLAPPTKKL
MMWKETGGVEKLFSLPAQPLWNNRLLKLFTRCLTPLVPEDLRKRRKGGEADNLDEFLKEF
ENPEVPREDQQQQHQQRDVIDEPIIEEPSALQESVMEASRTNIDESAMPPPPPQGVKRKA
GQIDPEPVMPPQQVEQMEIPPVELPPEEPPNICQLIPELELLPEKEKEKEKEKEDDEEEE
DEDASGGDQDQEERRWNKRTQQMLHGLQRALAKTGAESISLLELCRNTNRKQAAAKFYSF
LVLKKQQAIELTQEEPYSDIIATPGPRFHII
Sequence of entity 4 (D), FASTA
>7W1M_4 Cohesin subunit SA-1 (chains D)
MITSELPVLQDSTNETTAHSDAGSELEETEVKGKRKRGRPGRPPSTNKKPRKSPGEKSRI
EAGIRGAGRGRANGHPQQNGEGEPVTLFEVVKLGKSAMQSVVDDWIESYKQDRDIALLDL
INFFIQCSGCRGTVRIEMFRNMQNAEIIRKMTEEFDEDSGDYPLTMPGPQWKKFRSNFCE
FIGVLIRQCQYSIIYDEYMMDTVISLLTGLSDSQVRAFRHTSTLAAMKLMTALVNVALNL
SIHQDNTQRQYEAERNKMIGKRANERLELLLQKRKELQENQDEIENMMNSIFKGIFVHRY
RDAIAEIRAICIEEIGVWMKMYSDAFLNDSYLKYVGWTLHDRQGEVRLKCLKALQSLYTN
RELFPKLELFTNRFKDRIVSMTLDKEYDVAVEAIRLVTLILHGSEEALSNEDCENVYHLV
YSAHRPVAVAAGEFLHKKLFSRHDPQAEEALAKRRGRNSPNGNLIRMLVLFFLESELHEH
AAYLVDSLWESSQELLKDWECMTELLLEEPVQGEEAMSDRQESALIELMVCTIRQAAEAH
PPVGRGTGKRVLTAKERKTQIDDRNKLTEHFIITLPMLLSKYSADAEKVANLLQIPQYFD
LEIYSTGRMEKHLDALLKQIKFVVEKHVESDVLEACSKTYSILCSEEYTIQNRVDIARSQ
LIDEFVDRFNHSVEDLLQEGEEADDDDIYNVLSTLKRLTSFHNAHDLTKWDLFGNCYRLL
KTGIEHGAMPEQIVVQALQCSHYSILWQLVKITDGSPSKEDLLVLRKTVKSFLAVCQQCL
SNVNTPVKEQAFMLLCDLLMIFSHQLMTGGREGLQPLVFNPDTGLQSELLSFVMDHVFID
QDEENQSMEGDEEDEANKIEALHKRRNLLAAFSKLIIYDIVDMHAAADIFKHYMKYYNDY
GDIIKETLSKTRQIDKIQCAKTLILSLQQLFNELVQEQGPNLDRTSAHVSGIKELARRFA
LTFGLDQIKTREAVATLHKDGIEFAFKYQNQKGQEYPPPNLAFLEVLSEFSSKLLRQDKK
TVHSYLEKFLTEQMMERREDVWLPLISYRNSLVTGGEDDRMSVNSGSSSSKTSSVRNKKG
RPPLHKKRVEDESLDNTWLNRTDTMIQTPGPLPAPQLTSTVLRENSRPMGDQIQEPESEH
GSEPDFLHNPQMQISWLGQPKLEDLNRKDRTGMNYMKVRTGVRHAVRGLMEEDAEPIFED
VMMSSRSQLEDMNEEFEDTMVIDLPPSRNRRERAELRPDFFDSAAIIEDDSGFGMPMF
Sequence of entity 5 (E), FASTA
>7W1M_5 Nipped-B-like protein (chains E)
SLSEVARKMKKKEKQKKRKAYEPKLTPEEMMDSSTFKRFTASIENILDNLEDMDFTAFGD
DDEIPQELLLGKHQLNELGSESAKIKAMGIMDKLSTDKTVKVLNILEKNIQDGSKLSTLL
NHNNDTEEEERLWRDLIMERVTKSADACLTTINIMTSPNMPKAVYIEDVIERVIQYTKFH
LQNTLYPQYDPVYRLDPHGGGLLSSKAKRAKCSTHKQRVIVMLYNKVCDIVSSLSELLEI
QLLTDTTILQVSSMGITPFFVENVSELQLCAIKLVTAVFSRYEKHRQLILEEIFTSLARL
PTSKRSLRNFRLNSSDMDGEPMYIQMVTALVLQLIQCVVHLPSSEKDSNAEEDSNKKIDQ
DVVITNSYETAMRTAQNFLSIFLKKCGSKQGEEDYRPLFENFVQDLLSTVNKPEWPAAEL
LLSLLGRLLVHQFSNKSTEMALRVASLDYLGTVAARLRKDAVTSKMDQGSIERILKQVSG
GEDEIQQLQKALLDYLDENTETDPSLVFSRKFYIAQWFRDTTLETEKAMKSQKDEESSEG
THHAKEIETTGQIMHRAENRKKFLRSIIKTTPSQFSTLKMNSDTVDYDDACLIVRYLASM
RPFAQSFDIYLTQILRVLGENAIAVRTKAMKCLSEVVAVDPSILARLDMQRGVHGRLMDN
STSVREAAVELLGRFVLCRPQLAEQYYDMLIERILDTGISVRKRVIKILRDICIEQPTFP
KITEMCVKMIRRVNDEEGIKKLVNETFQKLWFTPTPHNDKEAMTRKILNITDVVAACRDT
GYDWFEQLLQNLLKSEEDSSYKPVKKACTQLVDNLVEHILKYEESLADSDNKGVNSGRLV
ACITTLFLFSKIRPQLMVKHAMTMQPYLTTKCSTQNDFMVICNVAKILELVVPLMEHPSE
TFLATIEEDLMKLIIKYGMTVVQHCVSCLGAVVNKVTQNFKFVWACFNRYYGAISKLKSQ
HQEDPNNTSLLTNKPALLRSLFTVGALCRHFDFDLEDFKGNSKVNIKDKVLELLMYFTKH
SDEEVQTKAIIGLGFAFIQHPSLMFEQEVKNLYNNILSDKNSSVNLKIQVLKNLQTYLQE
EDTRMQQADRDWKKVAKQEDLKEMGDVSSGMSSSIMQLYLKQVLEAFFHTQSSVRHFALN
VIALTLNQGLIHPVQCVPYLIAMGTDPEPAMRNKADQQLVEIDKKYAGFIHMKAVAGMKM
SYQVQQAINTCLKDPVRGFRQDESSSALCSHLYSMIRGNRQHRRAFLISLLNLFDDTAKT
DVTMLLYIADNLACFPYQTQEEPLFIMHHIDITLSVSGSNLLQSFKESMVKDKRKERKSS
PSKENESSDSEEEVSRPRKSRKRVDSDSDSDSEDDINSVMKCLPENSAPLIEFANVSQGI
LLLLMLKQHLKNLCGFSDSKIQKYSPSESAKVYDKAINRKTGVHFHPKQTLDFLRSDMAN
SKITEEVKRSIVKQYLDFKLLMEHLDP
Sequence of entity 6 (F), FASTA
>7W1M_6 DNA (118-MER) (chains F)
GATAAATTCTTGTTTTCATATCCTAAAATTAAAGGGAAAATAAACAATACATAACAAAAC
ATATAAAAACCACCTCACTAGCGCCCCCTGCTGGCCTCTGTGGGCACTGCAATCTTGC
Sequence of entity 7 (G), FASTA
>7W1M_7 DNA (118-MER) (chains G)
GCAAGATTGCAGTGCCCACAGAGGCCAGCAGGGGGCGCTAGTGAGGTGGTTTTTATATGT
TTTGTTATGTATTGTTTATTTTCCCTTTAATTTTAGGATATGAAAACAAGAATTTATC
Sequence of entity 8 (H), FASTA
>7W1M_8 Transcriptional repressor CTCF (chains H)
MEGDAVEAIVEESETFIKGKERKTYQRRREGGQEEDACHLPQNQTDGGEVVQDVNSSVQM
VMMEQLDPTLLQMKTEVMEGTVAPEAEAAVDDTQIITLQVVNMEEQPINIGELQLVQVPV
PVTVPVATTSVEELQGAYENEVSKEGLAESEPMICHTLPLPEGFQVVKVGANGEVETLEQ
GELPPQEDPSWQKDPDYQPPAKKTKKTKKSKLRYTEEGKDVDVSVYDFEEEQQEGLLSEV
NAEKVVGNMKPPKPTKIKKKGVKKTFQCELCSYTCPRRSNLDRHMKSHTDERPHKCHLCG
RAFRTVTLLRNHLNTHTGTRPHKCPDCDMAFVTSGELVRHRRYKHTHEKPFKCSMCDYAS
VEVSKLKRHIRSHTGERPFQCSLCSYASRDTYKLKRHMRTHSGEKPYECYICHARFTQSG
TMKMHILQKHTENVAKFHCPHCDTVIARKSDLGVHLRKQHSYIEQGKKCRYCDAVFHERY
ALIQHQKSHKNEKRFKCDQCDYACRQERHMIMHKRTHTGEKPYACSHCDKTFRQKQLLDM
HFKRYHDPNFVPAAFVCSKCGKTFTRRNTMARHADNCAGPDGVEGENGGETKKSKRGRKR
KMRSKKEDSSDSENAEPDLDDNEDEEEPAVEIEPEPEPQPVTPAPPPAKKRRGRPPGRTN
QPKQNQPTAIIQVEDQNTGAIENIIVEVKKEPDAEPAEGEEEEAQPAATDAPNGDLTPEM
ILSMMDR

Ligands and cofactors

IDNameFormulaCopies
ADPAdenosine-5'-diphosphateC10 H15 N5 O10 P22
BEFBeryllium trifluoride ionBe F32
ZNZinc ionZn11

Primary citation

CTCF and R-loops are boundaries of cohesin-mediated DNA looping. Zhang, H., Shi, Z., Banigan, E.J. et al. Mol Cell (2023) 83:2856-2871.e8. DOI 10.1016/j.molcel.2023.07.006 · PubMed

Other PDB entries of the same protein (UniProt Q14683 (AlphaFold model), which also has an AlphaFold model), best resolution first:

Browse structure collections

About this viewer

MolViewer shows 7W1M directly in your browser with nothing to install. Switch between cartoon, ball-and-stick, spacefill and surface views, color by chain, secondary structure or B-factor, measure distances, angles and dihedrals, and share or embed the view.