블로그하는개발자
개발하면서 배운 것, 실험한 것, 정리한 것을 기록하는 공간입니다. 이 사이트는 자체 호스팅 2호점이며, 한국어 SEO와 검색 유입의 본진은 티스토리에 그대로 둡니다.
왜 2호점인가?
- 티스토리 (본진) — 네이버·구글 한국어 검색, 기존 독자층 유지
- 이 사이트 (2호점) — Markdown/MDX, Git 버전 관리, CI 빌드, RSS·사이트맵
- 마이그레이션 없음. 본진 글은 그대로 두고, 2호점에는 새 글·실험·아카이브를 올립니다.
티스토리 본진: https://donggrri.tistory.com
최근 글
-
Temperature와 Top-p란? LLM 답변이 매번 달라지는 이유
LLM의 temperature와 top-p는 다음 토큰을 고르는 방식을 조절하는 파라미터입니다. temperature는 확률 분포의 모양을, top-p·top-k는 후보 범위를 바꾸며, 샘플링을 쓰면 같은 질문에도 답이 달라질 수 있습니다.
-
DMA란? CPU 복사와 차이, 임베디드·펌웨어 면접에서 어떻게 답하나?
DMA는 주변장치와 메모리 사이 전송을 DMA 컨트롤러가 대신 수행하고, CPU는 설정과 완료 처리만 담당하게 하는 방식입니다. 면접에서는 CPU 복사와의 차이와 캐시 일관성까지 짚는 것이 핵심입니다.
-
양자화(Quantization)란? FP16·INT8·INT4 차이와 LLM 메모리가 줄어드는 이유
LLM 양자화는 가중치를 더 적은 비트로 근사해 메모리와 읽어야 할 데이터량을 줄입니다. FP16·INT8·INT4의 바이트 차이와, Decode가 memory-bound일 때 그 효과가 커지는 이유를 정리합니다.
-
로컬 AI 박스와 API 구독, 비용 부담은 언제 갈리나?
사람 속도의 반복 업무이고 데이터가 나가도 되며 한도를 기다려도 되면 API 구독으로 충분합니다. 데이터가 남거나, 왕복 지연이 루프를 깨거나, 같은 호출이 한도에 반복해서 막힐 때 로컬 박스가 후보입니다. 하드웨어 전에 재시도와 긴 컨텍스트부터 줄입니다.
-
마이크론 HBM4 커스텀(NVHBM), JEDEC 표준과 공급망에서 뭐가 다른가?
JEDEC 표준 HBM4 스택과 NVIDIA 커스텀 NVHBM(베이스 다이·컨트롤러·PHY)이 공급망에서 구조적으로 어떻게 다른지, 마이크론 IR·NVIDIA 개발자 블로그 기준으로 정리합니다. 양산 단정·점유율·주가는 다루지 않습니다.