Seonjin`s Tech Blog
Data & AI Engineer at OKESTRO
홈
카테고리
태그
아카이브
정보
홈
태그
inference
태그
취소
inference
3
LLM 응답 속도 이해하기 — 첫 답변이 늦는 이유와 생성이 느린 이유
2026/09/14
LLM 양자화 이해하기 — 4bit로 줄이면 용량·품질·속도는 어떻게 달라질까?
2026/09/12
LLM용 GPU 용량 산정 — 모델 크기부터 동시 사용자까지
2026/09/11
최근 업데이트
RAG 검색 결과는 있는데 답변은 왜 틀릴까? — 실패 지점별 진단 방법
TypeSafe AI Jev 이해하기 — 문장을 생성하지 않는 AI는 무엇이 다를까?
Go RESTFul API(식품영양성분 API)
Go 언어란?
미니버젼 MLOps 플랫폼 구축하기
인기 태그
llm
bigdata
kubernetes
mlops
devops
Spark
agent
hadoop
inference
architecture
인기 태그
llm
bigdata
kubernetes
mlops
devops
Spark
agent
hadoop
inference
architecture