기초 이론 편 · 2부 AI는 어떻게 학습하는데? — 2.1
뉴런과 가중치 — AI는 어떻게 판단할까
단서마다 숫자를 붙이고, 점수를 더해서 판단합니다. 이게 인공 뉴런의 전부입니다.
앞 장에서 머신러닝은 단서마다 숫자를 하나씩 붙여서 판단한다고 했습니다. 이번엔 그 숫자를 직접 정해보겠습니다.
같은 스팸 문자 12개를 쓰는데, 이번엔 단서를 세 가지로 바꿨습니다.
- 광고성 단어: 광고, 무료, 당첨, 할인 같은 말이 들어 있나
- 모르는 번호: 저장 안 된 번호에서 왔나
- 뭔가 하라고 시킴: 연락해, 가입하세요, 확인하세요처럼 행동을 요구하나
각 문자에 이 단서가 있으면 1, 없으면 0입니다. 판단 방법은 이렇습니다.
- 단서마다 숫자(가중치) 를 정합니다. 스팸 쪽으로 강한 단서일수록 큰 숫자.
- 문자에 있는 단서의 숫자를 전부 더해서 점수를 냅니다.
- 점수가 기준 이상이면 스팸, 아니면 정상.
단서마다 숫자(가중치)를 정하고, 몇 점부터 스팸으로 볼지(기준)를 정해보세요. 12개를 다 맞히는 조합을 찾을 수 있을까요?
광고성 단어
모르는 번호
뭔가 하라고 시킴
6 / 12 맞힘 · 문자를 누르면 위에 계산이 나와요
해보면 보이는 것
단서 하나로는 부족합니다. “모르는 번호”에만 숫자를 줘도 11개까지는 맞습니다. 그런데 “택배 기사입니다” 같은 정상 문자도 모르는 번호에서 오기 때문에, 하나가 꼭 틀립니다.
단서를 조합해야 합니다. “엄마 나 폰 고장나서 이 번호로 연락해”는 모르는 번호이면서 행동을 시킵니다. 단서 하나하나는 정상 문자에도 있지만, 둘이 같이 있으면 점수가 기준을 넘습니다. 앞 장의 단어 규칙 (“이 단어가 있으면 무조건 스팸”)으로는 못 하던 일입니다.
기준도 중요합니다. 가중치를 그대로 두고 기준만 올리거나 내려도 결과가 바뀝니다. 기준을 낮추면 스팸을 더 많이 잡는 대신 정상 문자도 더 많이 막습니다.
이게 뉴런입니다
방금 만든 게 인공 뉴런 하나입니다. 이름은 거창하지만 하는 일은 이게 전부입니다.
| 이 장에서 부른 이름 | 정식 이름 |
|---|---|
| 단서 (있으면 1, 없으면 0) | 입력 |
| 단서마다 붙인 숫자 | 가중치 |
| 기준 | 편향 (아래 “더 깊게” 참고) |
| 스팸 / 정상 | 출력 |
가중치는 음수일 수도 있습니다. 슬라이더를 왼쪽으로 끝까지 밀어보세요. 그 단서가 있으면 오히려 정상 쪽으로 끌어당기는 것입니다. 예를 들어 “저장된 번호에서 옴” 같은 단서가 있었다면 음수 가중치가 어울렸을 것입니다.
손으로 맞추면 생기는 문제
단서가 3개라서 손으로도 맞출 수 있었습니다. 그런데 요즘 큰 LLM에는 이런 가중치가 수천억 개씩 들어 있기도 합니다. ChatGPT나 Claude는 정확한 개수를 공개하지 않지만, 가중치를 공개한 모델들만 봐도 그 정도예요(아래 “요즘 소식” 참고). 손으로 정하는 건 불가능하죠.
그래서 컴퓨터에게 시킵니다. 틀린 문자를 보고 “이 가중치를 조금 올리면 덜 틀리겠다”를 스스로 찾아서, 조금씩 고치는 걸 반복하게 합니다. 이게 학습이고, 다음 장에서 보겠습니다.
더 깊게 · 수식으로 쓰면, 그리고 '편향'이라는 이름
단서를 , 가중치를 라고 하면, 이 뉴런이 하는 일은 이것입니다.
점수가 0 이상이면 스팸입니다. 여기서 가 편향(bias) 인데, 위젯의 “기준”에 마이너스를 붙인 값입니다. “점수 ≥ 기준”과 “점수 − 기준 ≥ 0”은 같은 말이니까요. 기준을 따로 두는 대신 더하는 숫자 하나로 바꿔 놓으면, 편향도 가중치와 똑같이 “조금씩 고치는” 대상이 됩니다.
주의할 점이 하나 있습니다. 여기서 말하는 “편향”은 계산에 더하는 숫자 하나일 뿐입니다. 6부에서 다룰 “AI가 편향되어 있다”(데이터의 치우침을 배운다)와는 이름만 같고 전혀 다른 뜻입니다.
정리
- 인공 뉴런은 입력 × 가중치를 전부 더하고, 기준과 비교하는 계산입니다.
- 가중치가 클수록 그 단서가 중요하다는 뜻이고, 음수면 반대쪽으로 끌어당깁니다.
- 단서 하나보다 여러 단서의 조합으로 판단할 수 있다는 게 단어 규칙과의 차이입니다.
- 실제 모델에는 가중치가 수천억 개라서, 사람이 아니라 컴퓨터가 학습으로 정합니다.
이 장을 복사합니다. ChatGPT나 Claude 같은 AI에 붙여넣고 그대로 보내면 AI가 다 읽었다고 답합니다. 그다음 궁금한 걸 물어보세요.