DNA : 데 옥시 리보 핵 ASCII


22

염기 Adenine, Cytosine, Guanine 및 Thymine (으로 인코딩 됨 ACGT) 의 염기 서열이 주어지면 상응하는 이중 가닥 DNA의 ASCII 예술 표현을 생성해야합니다.

스트랜드는 수직으로 연장됩니다. 왼쪽 스트랜드는 입력으로 주어진 것입니다. 오른쪽 가닥이 그 보완 물이됩니다. DNA에 익숙하지 않은 사람들을 위해, A함께 짝 TC함께 짝을 G. 또한, 이중 가닥의 양쪽에는 모든 염기에 대해 동일한 골격 구조가 있습니다. 따라서 입력을 받았다 TAGCAT면 ASCII 아트의 대규모 구조는 다음과 같습니다.

BTAB
BATB
BGCB
BCGB
BATB
BTAB

여기서 B백본을 나타냅니다. 이제 각 글자는 전체 분자를 나타내며 실제 분자 구조 를 재현합니다 .

기지

각 염기에 대해 다음 템플릿 1 을 사용하십시오 (각각 상보성 염기 및 2 개의 골격 분자와 함께 표시됨).

1 ASCII 레이아웃에 도움을 준 Peter Taylor에게 감사의 말을 전합니다.

아데닌

 O    O
  \\ /
    P
   / \
--O   O
     /                                         |
    <            N      NH2 ..... O      *     |
     \         // \    /           \\   /      |
      +--O    //   ----             ----       |
      |   \   |   //  \\           /   \\      |
      |    >--N--<      N ...... HN      >  ---+
      |   /       \    /           \    /  /   |
      +---         N===             ---N--<    |
      |                            //      \   |
      |                           O         O--+
      |                                         \
      |                                          >
      |                                         /
                                               O   O--
                                                \ /
                                                 P
                                                / \\
                                               O    O

시토신

 O    O
  \\ /
    P
   / \
--O   O            NH2 ..... O      N
     /            /           \\   / \\        |
    <         ----             ----   \\    ---+
     \       //  \\           /   \\   |   /   |
      +--O  <      N ...... HN      >--N--<    |
      |   \  \    /           \    /       \   |
      |    >--N---             ===N         O--+
      |   /      \\           /                 \
      +---         O ..... H2N                   >
      |                                         /
                                               O   O--
                                                \ /
                                                 P
                                                / \\
                                               O    O

구아닌

 O    O
  \\ /
    P
   / \
--O   O
     /                                         |
    <            N      O ..... H2N            |
     \         // \   //           \           |
      +--O    //   ----             ----       |
      |   \   |   //   \           //  \\      |
      |    >--N--<      NH ...... N      >  ---+
      |   /       \    /           \    /  /   |
      +---         N===             ---N--<    |
      |                \           //      \   |
      |                 NH2 ..... O         O--+
      |                                         \
      |                                          >
      |                                         /
                                               O   O--
                                                \ /
                                                 P
                                                / \\
                                               O    O

티민

 O    O
  \\ /
    P
   / \
--O   O     *      O ..... H2N      N
     /       \   //           \    / \\        |
    <         ----             ----   \\    ---+
     \       //   \           //  \\   |   /   |
      +--O  <      NH ...... N      >--N--<    |
      |   \  \    /           \    /       \   |
      |    >--N---             ===N         O--+
      |   /      \\                             \
      +---         O                             >
      |                                         /
                                               O   O--
                                                \ /
                                                 P
                                                / \\
                                               O    O

이중 가닥 구성

이들은 수직 방향으로 반복되므로 백본 구조에 틈이 없습니다. 즉,이 네 가지 템플릿의 경계 상자가 겹치게됩니다.

권리 백본의 왼쪽과 상단의 하단은 연결됩니다 OOH.

무료 O권리 백본의 왼쪽 하단의 맨 끝에서 무료 본드가는 안쪽에 의해 표시를해야합니다 --.

ATG

 O    O--
  \\ /
    P
   / \
--O   O                                        OH
     /                                         |
    <            N      NH2 ..... O      *     |
     \         // \    /           \\   /      |
      +--O    //   ----             ----       |
      |   \   |   //  \\           /   \\      |
      |    >--N--<      N ...... HN      >  ---+
      |   /       \    /           \    /  /   |
      +---         N===             ---N--<    |
      |                            //      \   |
      |                           O         O--+
      |                                         \
      |                                          >
      |                                         /
 O    O                                        O   O--
  \\ /                                          \ /
    P                                            P
   / \                                          / \\
--O   O     *      O ..... H2N      N          O    O
     /       \   //           \    / \\        |
    <         ----             ----   \\    ---+
     \       //   \           //  \\   |   /   |
      +--O  <      NH ...... N      >--N--<    |
      |   \  \    /           \    /       \   |
      |    >--N---             ===N         O--+
      |   /      \\                             \
      +---         O                             >
      |                                         /
 O    O                                        O   O--
  \\ /                                          \ /
    P                                            P
   / \                                          / \\
--O   O                                        O    O
     /                                         |
    <            N      O ..... H2N            |
     \         // \   //           \           |
      +--O    //   ----             ----       |
      |   \   |   //   \           //  \\      |
      |    >--N--<      NH ...... N      >  ---+
      |   /       \    /           \    /  /   |
      +---         N===             ---N--<    |
      |                \           //      \   |
      |                 NH2 ..... O         O--+
      |                                         \
      |                                          >
      |                                         /
      OH                                       O   O--
                                                \ /
                                                 P
                                                / \\
                                             --O    O

더 많은 예 :

다음은 몇 가지 더 많은 예제의 MD5 해시입니다 (외부 선행 또는 후행 공백 없음).

ATG      2e4a906c44a96fe84134bf4346adf11c (this is the above example)
C        e3648b8960967463784818c3eee57246
TTT      6028a90b05775905ef1a00e7a45463c5
TAGCAT   3b834d2b7b9adc4113ffabd52d354c41
GATTACA  a19463f965c641d071e07da59d64a418

이 중 하나라도 잘못 생각하면 알려주십시오.

결과의 해시를 확실하게 확인하는 방법을 잘 모를 경우이 온라인 MD5 생성기를 사용해보십시오 . 후행 줄 바꿈이 없는지 확인하십시오.

추가 사항

적합하다고 생각되는대로 앞뒤 공백을 사용할 수 있습니다 . 물론 선행 공백을 사용하는 경우 각 줄에서 동일한 양이어야합니다.

화학 구조를 복사 할 때 실수를 한 경우에도 위의 템플릿은이 과제의 목적을위한 규범입니다.

STDIN을 통해 입력 문자열 을 매개 변수, 명령 행 인수로 사용하거나 변수에 저장 될 것으로 예상 되는 함수 또는 프로그램을 작성할 수 있습니다 . 결과 ASCII 아트를 STDOUT에 씁니다.

이것은 코드 골프이므로 가장 짧은 대답 (바이트)이 이깁니다.


놀라운 도전!
Ray

9
GATTACA가 필요합니다
Kevin

1
@Kevin 나는 심지어 그것에 대해 이전에 생각 했으므로 지금 추가했습니다. ;) TTT문자열에 후행 줄 바꿈이 포함되어 있기 때문에 해시도 수정했습니다 .
Martin Ender

md5 체크섬은 어떻게 얻습니까? ATG출력을 복사 하고 다른 체크섬을 얻었습니다. 그리고 다른 OS는 다른 체크섬을 얻습니다. 당신은 이것들을 사용해 볼 수 있습니다 unix2dos, unix2mac....
Ray

@ Ray 나는 Digest::MD5.hexdigest()유닉스 스타일 라인 엔딩과 함께 Ruby를 사용했습니다 . 또한 그들 중 어느 것도 후행 줄이 없습니다. 여기에 붙여 넣으십시오 -이 온라인 MD5 생성기는 내 해시에 동의합니다.
Martin Ender

답변:


2

펄 5 (510)

Perl은 널 바이트로도 충분하므로이를 실행하기 위해 제공된 16 진 덤프를 사용하십시오.

이것은 DNA 가닥의 다른 부분을 인쇄하여 작동하며 부분은 하나 이상의 선입니다. 유효한 출력을 보장하기 위해 각 구성 요소의 맨 위에 O 또는 H가 추가됩니다.

입력이 변수에 있다고 가정합니다 $_.

골프 버전 :

use Compress::Zlib;@f=(eval uncompress q+xœÍUËnà ¼ó{³””¬”slqäù |xšÅ<
MÔv¤(1b¼;Ì„]8× `?CÐË×ÂÜ/¥À—¼ÃÍ"6p!ÇvDÿ@k
‘®^ÝÀ
²>ÈB$ì¡ÌHBýi`ã\qþˆRn^‚¢6WéJ±íRCXÀ\Cj[­ëzÖKg-µ€˜*Rt®abš3‘ª¤°È†"]ÖSX‰G2ôœÂV<<#9_ÐŽG´8Oa3uE'ÇC%…¹—tLºšÂBCQ‹¡NÈ»*/
V×AÛVÔÖAr©KûÊhát°DÃÁZÿÁ>;       kM‚2(9áýIP
t'A”¿žg
q­= Š[~y̲ùNÇsNsŽŽGל:IÏqŠÙl)˜ùð
ì…çÎÁ«:eôu?<(-  é æ ŽRxNSÜAM1• —)š—%+);s/./$y.=$f[$u?8:9].$f[$q=(-65+ord$&)%15].($u++?"    O":H).$f[$q+1]/ge;($y.=$f[10])=~s/@/\\/g;print$y

언 골프 버전 :

use Compress::Zlib;
# load parts to @f; see below for list of parts
@f=(eval uncompress q+ .... +);
# for each chracater in input ($_)
s/./
    # append either the one or two backbone molecules
    # then append most of the first line of the base, followed by an O or H
    # then append the rest of the base
    $y .= $f[$u?8:9] . $f[$q = (-65+ord$&)%15] . ($u++?"    O":H) . $f[$q+1]
/ge;
# append the last backbone molecule, then replace
#  @ with \
($y .= $f[10])=~s/@/\\/g;
print $y

(-65+ord$&)%15A=>0, C=>2, T=>4, G=>6프로그램은 각 문자에 대해 배열에 두 개의 요소가 필요하므로 완벽 하게 결과를 얻습니다.

가운데 부분, 위쪽 부분 및 아래쪽 부분은 8-10순서대로 색인 으로 저장됩니다 .

부품 목록 (이탈을 피하기 위해 \ 대신 @ 사용) :

'--O   O                                        O',
'
     /                                         |
    <            N      NH2 ..... O      *     |
     @         // @    /           @@   /      |
      +--O    //   ----             ----       |
      |   @   |   //  @@           /   @@      |
      |    >--N--<      N ...... HN      >  ---+
      |   /       @    /           @    /  /   |
      +---         N===             ---N--<    |
      |                            //      @   |
      |                           O         O--+
      |                                         @
      |                                          >
',
'--O   O            NH2 ..... O      N          O',
'
     /            /           @@   / @@        |
    <         ----             ----   @@    ---+
     @       //  @@           /   @@   |   /   |
      +--O  <      N ...... HN      >--N--<    |
      |   @  @    /           @    /       @   |
      |    >--N---             ===N         O--+
      |   /      @@           /                 @
      +---         O ..... H2N                   >
',
'--O   O     *      O ..... H2N      N          O',
'
     /       @   //           @    / @@        |
    <         ----             ----   @@    ---+
     @       //   @           //  @@   |   /   |
      +--O  <      NH ...... N      >--N--<    |
      |   @  @    /           @    /       @   |
      |    >--N---             ===N         O--+
      |   /      @@                             @
      +---         O                             >
',
'--O   O                                        O',
'
     /                                         |
    <            N      O ..... H2N            |
     @         // @   //           @           |
      +--O    //   ----             ----       |
      |   @   |   //   @           //  @@      |
      |    >--N--<      NH ...... N      >  ---+
      |   /       @    /           @    /  /   |
      +---         N===             ---N--<    |
      |                @           //      @   |
      |                 NH2 ..... O         O--+
      |                                         @
      |                                          >
',
'      |                                         /
 O    O                                        O   O--
  @@ /                                          @ /
    P                                            P
   / @                                          / @@
',
' O    O--
  @@ /
    P
   / @
',
'      |                                         /
      OH                                       O   O--
                                                @ /
                                                 P
                                                / @@
                                             --O    O'

16 진 덤프 :

0000000 7375 2065 6f43 706d 6572 7373 3a3a 6c5a
0000010 6269 403b 3d66 6528 6176 206c 6e75 6f63
0000020 706d 6572 7373 7120 782b cd9c cb55 c36e
0000030 1020 f3bc 7b15 94b3 ac94 7394 716c 04e4
0000040 20f9 7c7f 9a78 3cc5 4d0a 76d4 28a4 6231
0000050 3bbc 84cc 385d 00d7 3f60 d043 d7cb dcc2
0000060 1c2f c0a5 08ee ba0f c2a4 bc97 cdc3 3622
0000070 2170 1004 76c7 ff44 6b40 910a 0216 ae01
0000080 8d5e 0fdd 0dc0 3eb2 42c8 ec24 cca1 481e
0000090 9042 08fd 8169 6012 5ce3 fe71 5288 5e6e
00000a0 0c82 36a2 e957 084a edb1 4352 c058 435c
00000b0 5b6a ebad d67a 4b10 2d67 80b5 2a98 108d
00000c0 1052 ae74 0c61 9a62 1b01 9133 a4aa c8b0
00000d0 2286 d65d 5853 4789 f432 c29c 3c56 233c
00000e0 1839 d05f 478e 38b4 614f 1e33 0775 2745
00000f0 c71e 2543 b985 1306 7497 ba4c c29a 4342
0000100 510e a18b 4e0e bbc8 082a 0715 0d2f d756
0000110 db41 5616 7fd4 41d6 a972 4b10 0efb 68ca
0000120 7fe1 b074 c344 1ec1 ff5a 1ec1 3b3e 1a09
0000130 6b09 824d 2832 e139 49fd 0f50 740a 4127
0000140 9411 9ebf 6704 710d 3dad 8a09 175b 797e
0000150 cc12 90b2 4ef9 73c7 4e0b 7311 8e8e d747
0000160 1b9c 493a 71cf d98a 296c f998 0df0 85ec
0000170 cee7 abc1 1a3a f465 3f75 283c 2d07 0907
0000180 a0e9 20e6 528e 7813 534e 41dc 314d 95c2
0000190 97a0 2917 979a 2b25 3b29 2f73 2f2e 7924
00001a0 3d2e 6624 245b 3f75 3a38 5d39 242e 5b66
00001b0 7124 283d 362d 2b35 726f 2464 2926 3125
00001c0 5d35 282e 7524 2b2b 223f 2020 2020 224f
00001d0 483a 2e29 6624 245b 2b71 5d31 672f 3b65
00001e0 2428 2e79 243d 5b66 3031 295d 7e3d 2f73
00001f0 2f40 5c5c 672f 703b 6972 746e 7924
00001fe

한 번에 모든 백 슬래시를 이스케이프 된 버전으로 바꿀 수 있습니까? @로 가득 차면 출력을 판단하기가 어렵습니다.
trichoplax

@githubphagocyte s/@/\\/g는 인쇄하기 전에 정확히 그렇게합니다. 압축 된 데이터가 무엇인지 보여주기 위해 부품 목록 만 제공됩니다.
es1024

5

파이썬 3, 1008

작은 블록으로 분해 한 다음 파이썬의 zlib을 사용하여 압축하고 asii85 인코딩으로 이진 데이터를 인코딩하십시오. 압축하기 전에 크기는 629이고 압축 및 인코딩 후에 크기는 260입니다.

작은 블록 :

    N      NH2            NH2 ...   *      O .....      N      O ..     O    O              ---+        
  // \    /              /           \   //           // \   //          \\ /              /   |        
 //   ----           ----             ----           //   ----             P            --<    |        
 |   //  \\         //  \\           //   \          |   //   \           / \              \   |        
 N--<      N ..    <      N .....   <      NH ....   N--<      NH .    --O   O              O--+        
     \    /         \    /           \    /              \    /             /                   \       
      N===           N---             N---                N===             <                     >      
                        \\               \\                   \             \                   /       
                          O .....          O                   NH2           +--O              O   O--  
                                                                             |   \              \ /     
                                                                             |    >--            P      
                                                                             |   /              / \\    
                                                                             +---              O    O   

프로그램은 STDIN에서 읽습니다. 각 줄의 끝에 후행 공백이있을 수 있으며 끝에 빈 줄이있을 수 있습니다.

import zlib,base64
D=input()
B=b'GasbU3tfFR$q,H5@dA9CAl@Bd?/ZcRUN$!!66MJ3&IN+RbL6[r)7K,3-8;3.^a\'7XZD_Lh;(7`.g>%[1,o(<9L\\neaPK"9^lCg7teknAd\\HXFNbL!)l/pG]YNpRS-C]sXR5A[A[#C&pnT;I-Q$Bj@n$L"ODZk8M_YcM#\\5PaLq3@UfJmfm[)$+#H,A\\B+b`mL9^OQ/cET-@`YRD_DJ6mXMD">9HHep\\%LnL8&\\G?fDdbs20%[J\'jMG[Qp'
B=[b.split('\n')for b in zlib.decompress(base64.a85decode(B)).decode().split('\n\n')]
C=dict(zip('/\\<>', '\\/><'))
a=[(6,14),(6,28),(10,40)]
b=[(4,12),(4,26),(6,40)]
P=[a,b,b,a]
H=[18,14,14,18]
J=''.join
R=range
L=len
F=[[' ']*54 for _ in R(5+18*L(D))]
e=enumerate
y=0
def t(b,p):
 for i,r in e(b):
  for j,c in e(r):
   if' '!=c:F[y+p[0]+i][p[1]+j]=c
O=['OH']
U=['--']
t(O,(4,47))
t(U,(0,7))
for i in map('ACTG'.index,D):
 a,b,c=P[i];t(B[4],(0,0));t(B[i],a);q=B[(i+2)%4];t([J(C.get(z,z)for z in l[::-1]).replace('2HN', 'H2N')for l in[r+' '*(max(map(L,q))-L(r))for r in q]],b);t(B[5],c)
 for j in R(y+13,y+H[i]):F[j][6]='|'
 for j in R(y+5,y+c[0]):F[j][47]='|'
 y+=H[i]
t(O,(0,6))
t(U,(4,45))
for l in F:print(J(l))

이 스크립트를 사용하여 일치하는 체크섬

그리고 ungolfed 버전은 다음과 같습니다.

import zlib, base64

flip_char_map = dict(zip('/\\<>', '\\/><'))

def flip_char(c):
    return flip_char_map.get(c, c)

def pad(block):
    w = max(map(len, block))
    return [line + ' ' * (w - len(line)) for line in block]

def flip(block):
    return [''.join(map(flip_char, line[::-1])).replace('2HN', 'H2N') for line in pad(block)]

blocks = b'GasbU3tfFR$q,H5@dA9CAl@Bd?/ZcRUN$!!66MJ3&IN+RbL6[r)7K,3-8;3.^a\'7XZD_Lh;(7`.g>%[1,o(<9L\\neaPK"9^lCg7teknAd\\HXFNbL!)l/pG]YNpRS-C]sXR5A[A[#C&pnT;I-Q$Bj@n$L"ODZk8M_YcM#\\5PaLq3@UfJmfm[)$+#H,A\\B+b`mL9^OQ/cET-@`YRD_DJ6mXMD">9HHep\\%LnL8&\\G?fDdbs20%[J\'jMG[Qp'
blocks = [b.split('\n') for b in zlib.decompress(base64.a85decode(blocks)).decode().split('\n\n')]

poss = [
    [(6, 14), (6, 28), (10, 40)],
    [(4, 12), (4, 26), (6, 40)],
    [(4, 12), (4, 26), (6, 40)],
    [(6, 14), (6, 28), (10, 40)],
]

heights = [18, 14, 14, 18]

get_id = 'ACTG'.index
dna = input()
height = sum(heights[get_id(x)] for x in dna)
field = [[' '] * 54 for _ in range(height + 5)]

def put(block, pos):
    i, j = pos
    for di, row in enumerate(block):
        for dj, c in enumerate(row):
            if c != ' ': field[y + i + di][j + dj] = c

y = 0
put(['OH'], (4, 47))
put(['--'], (0, 7))
for p in dna:
    i = get_id(p)
    h = heights[i]
    pos = poss[i]
    put(blocks[4], (0, 0))
    put(blocks[i], pos[0])
    put(flip(blocks[(i + 2) % 4]), pos[1])
    put(blocks[5], pos[2])
    for j in range(y + 13, y + h):
        field[j][6] = '|'
    for j in range(y + 5, y + pos[2][0]):
        field[j][47] = '|'
    y += h
put(['OH'], (0, 6))
put(['--'], (4, 45))

for line in field: print(''.join(line).rstrip())

from hashlib import md5
import sys
result = '\n'.join(map(str.rstrip, map(''.join, field))).encode()
print(md5(result).hexdigest(), file=sys.stderr)
당사 사이트를 사용함과 동시에 당사의 쿠키 정책개인정보 보호정책을 읽고 이해하였음을 인정하는 것으로 간주합니다.
Licensed under cc by-sa 3.0 with attribution required.