vsMars의 모든 제품은 0–100의 Mars Score를 단다. 그것은 느낌이 아니다. 공식은 우리 방법론에 발표돼 있고 카테고리별 가중치는 저장소에 버전 관리된다. 그 가중치가 어떻게 선택되는지는 다음과 같다.
Mars Score 공식
카테고리 C의 모든 제품 P에 대해:
MarsScore(P) = Σ_i (weight_i × normalize(spec_i(P), category_C))
각 카테고리는 (1) 어떤 스펙 키를 점수화할지, (2) 각각의 가중치, (3) 정규화 곡선(선형, 로그, 임계값, 구간별)을 정의한다.
가중치가 어떻게 선택되나
각 카테고리에 대해 우리는:
- 리뷰어 합의를 조사한다. 카테고리 플래그십의 전문 리뷰 30개 이상을 읽고, 어떤 스펙이 "결정적 결함", "중요", "있으면 좋음"으로 묘사되는지 집계한다.
- 구매자 후회 데이터를 조사한다. Reddit 스레드, Amazon 리뷰, 반품률 설문 — 구매자가 더 높이 가중했더라면 하고 바라는 것은 무엇인가?
- 민감도 분석을 돌린다. 카테고리의 제품 20개 표본에 대해 각 가중치를 ±20% 변동시키고, 순위가 합의에 모순되는 방식으로 바뀌는지 확인한다.
- 가중치를 잠그고, 발표하고, 피드백을 받는다. 플래그십의 점수가 합의와 의미 있게 어긋나게 느껴지면, 그 불일치는 누락된 스펙이나 잘못 보정된 가중치를 드러낸다.
예시: 스마트폰 (2026년 5월)
| 스펙 키 | 가중치 | 근거 |
|---|---|---|
| battery_life_hours | 0.18 | 설문 최상위 후회 동인 |
| chipset_score | 0.14 | 다년 수명 예측력 |
| camera_main_score | 0.13 | 주요 구매 동인 |
| display_score | 0.11 | 매일 높은 가시성 |
| build_water_resistance | 0.07 | 비대칭 하방 |
| update_years_promised | 0.07 | 중기 가치 |
| charging_w_wired + wireless | 0.06 | 편의성이나 천장 효과 |
| price_value | 0.10 | 등급 간 정규화 |
| 기타 (12개 스펙) | 0.14 | 롱테일 |
이 가중치는 2026년에 두 번 바뀌었다: iPhone 17 Pro Max 열 스로틀링 사건 이후 chipset_score 가중치가 올랐고(지속 성능이 다년 경험에 피크보다 더 예측력 있음이 입증됐다), 모든 플래그십이 80W+에 도달한 후 충전 가중치가 떨어졌다(더는 차별화 요소가 아님).
정규화 곡선 — 공식의 나머지 절반
가중치는 스펙이 얼마나 중요한지 알려준다. 정규화 곡선은 주어진 스펙 값이 어떻게 0–100 하위 점수로 매핑되는지 알려준다. 우리는 네 가지 곡선을 쓴다:
- 선형(minmax): 카테고리의 최소-최대를 0–100으로 선형 매핑. 주사율, 응답 시간, 피크 밝기 — 개선 단위마다 대략 동등한 스펙 — 에 사용.
- 로그: 저장 용량, RAM — 점진적 이득보다 배가가 더 중요한 — 에 사용.
- 임계값(이진): 불리언 스펙(has_anc, supports_dolby_vision) — 있음 또는 없음 — 에 사용.
- 구간별: 카메라 메가픽셀처럼 비선형 가치를 가진 스펙(12–48 MP는 중요, 48 MP 초과는 수확 체감)에 사용.
정규화 곡선은 가중치와 함께 버전 관리된다. 변경은 score-recompute 워커의 감사 로그에 문서화된다.
카테고리별 가중치 예시
헤드폰 (2026년 5월):
- ANC 효과: 0.17
- 음질(드라이버 크기 + 주파수 응답): 0.16
- 배터리 수명: 0.12
- 코덱 지원: 0.10
- 멀티포인트: 0.08
- 착용감(무게 + 클램프): 0.07
- 마감 / 방수: 0.06
- 기타: 0.24
노트북 (2026년 5월):
- CPU/SoC 점수: 0.16
- 배터리 수명(실환경): 0.15
- 디스플레이 품질(패널 + 해상도 + 밝기): 0.13
- 마감 품질 + 무게: 0.10
- 메모리(RAM): 0.08
- 저장(SSD): 0.07
- 포트 구성(USB-C, Thunderbolt): 0.06
- 기타: 0.25
우리가 명시적으로 하지 않는 것
- 리뷰어 감성 점수 없음. "느낌"은 공식에 들어가지 않는다. 주관적 평가는 점수를 재현 불가능하게 만든다.
- 인기 보너스 없음. 백만 대 팔린 플래그십이 틈새의 더 나은 제품을 이기지 못한다. 판매 속도는 시장 신호이지 품질 신호가 아니다.
- 브랜드 편향 없음. 브랜드는 스펙이 아니다. Mars Score는 기기가 Apple, Samsung, 또는 무명 OEM의 것인지 모른다.
- 카테고리 정규화를 실질적으로 바꾸지 않는 한 가격 할인 없음. 가격은 price_value 가중치로 포함되지만 카테고리 내에서 정규화된다. $200 폰은 가격/스펙 비율이 더 나아도 절대 점수에서 $1,200 폰을 이기지 못한다.
92.4 → 87.1이 "훨씬 나쁨"이 아닌 이유
Mars Score는 주어진 카테고리의 생산 중 제품에 대해 60에서 95 사이에 군집한다. 5점 격차는 의미 있고(다른 하위 등급), 1.3점 격차는 방법론 노이즈 안(사실상 동점)이다. 숫자를 순위 진리가 아니라 정렬 키로 다뤄라. 87.1 제품은 92.4 제품보다 "5.7% 나쁜" 것이 아니다 — 그들은 같은 동네에 있으며, 특정 트레이드오프로 구별된다.
우리가 수학을 공개하는 이유
다른 비교 사이트는 불투명한 "전문가 평점"을 발표한다. Mars Score는 의도적으로 그 반대다: 모든 가중치, 모든 정규화 곡선, 모든 스펙 키가 버전 관리에 있다. 누구나 저장소를 포크하고, 가중치를 바꾸고, 점수를 다시 돌려, 순위가 어떻게 바뀌는지 볼 수 있다. 그것이 비교 플랫폼을 하는 유일하게 정직한 방법이다 — 당신 가중치는 우리 것과 다르고, 그래도 괜찮다. 수학은 당신 것을 대입할 수 있을 만큼 충분히 열려 있어야 한다.
전체 카테고리별 가중치는 src/lib/score/mars.ts에 있다. 누구나 그 수학을 감사하고, 재현하고, 비판할 수 있다. 더 넓은 테스트·점수화 접근은 우리 방법론 페이지를 참고하라.