[sLLM 비교 ④] Claude Haiku vs GPT-4o mini — API 비용 대비 성능, 비즈니스에 최적은
API로 AI를 붙일 때 개발자들이 가장 많이 비교하는 두 모델. 빠르고, 저렴하고, 충분히 똑똑하다. 이번 편은 실제 업무 시나리오로 비교한다. 📋핵심 요약 API 비용은 GPT-4o mini($0.15/$0.60)가 Claude 3.5
Filed under
💡
API로 AI를 붙일 때 개발자들이 가장 많이 비교하는 두 모델. 빠르고, 저렴하고, 충분히 똑똑하다. 이번 편은 실제 업무 시나리오로 비교한다. 📋핵심 요약 API 비용은 GPT-4o mini($0.15/$0.60)가 Claude 3.5
📋핵심 요약 sLLM 비교 시리즈 3편 — 사내 서버 CPU-only 환경에서 Gemma 2 9B와 Phi-3 Mini 3.8B를 비교했다. Phi-3는 가볍고(4GB RAM, ~25 tok/s) 라이선스도 MIT로 자유롭지만 한글 처리가 아쉽고, Gemma 2는 더
📋핵심 요약 sLLM 비교 시리즈 2편 — 장문 처리에서 Llama 3.3(70B, MMLU 86.0%)이 Mistral Large(123B 추정, MMLU 89.2%)보다 50페이지 기술 문서 요약 정확도가 높았다. 반대로 한글 자연스러움은 Mistral
📋핵심 요약 sLLM 비교 시리즈 1편 — 코딩은 DeepSeek V3(HumanEval 88.4%)가 Qwen 2.5(85.0%)를 앞서고, API 비용도 절반 수준이다. 추론에서는 수치 추론이 중요한 재무·회계 업무엔 DeepSeek(MATH 90.
📋핵심 요약 RVS(Repo Vitality Score) = Momentum 30% + Freshness 20% + Health 25% + Engagement 15% + Contemporary 10%로 구성된, GitHub Star를 대신할 평가 지표다. Momentum은 "지금 성장 중인가", Freshness는 "현재 살아있는가"
📋핵심 요약 PoC에 3,000만원을 부르는 컨설팅 제안과 달리, 중소기업 실사례를 보면 AI 도입은 월 20~60만원으로도 시작할 수 있다. 경기도 소재 전자부품 유통사(직원 45명)는 초기 셋업 비용 0원으로 전표 자동 분류
📋핵심 요약 한 중견 제조업체 IT팀장의 "ERP 모듈이 7개인데 어디부터 AI를 붙여야 할지 모르겠다"는 고민에서 출발해, 모듈별 ROI를 표로 정리했다. 재고 관리는 월 50~100만원 절감에 ROI 1개월로 가장 빠르고, 재무·
📋핵심 요약 5부작 시리즈의 마지막 편 — dev.to의 "AI summaries need receipts"(13 reactions)처럼, AI 결과물을 맹신하지 말고 판단 근거를 항상 함께 제시해야 신뢰가 쌓인다. Reddit r/sre에 따르면 AIOps 솔루션
📋핵심 요약 Reddit r/shopify에서는 아마존의 AWS Agentic Shopping Assistant가 단순 추천 엔진을 넘어 고객 의도를 이해하고 구매까지 대신 결정하는 "진정한 에이전트"라는 평가가 나왔다. Reddit r/sre의 KubeCon Europe 참관기에 따르면
📋핵심 요약 McKinsey의 2025년 보고서에 따르면 AI 도입 실패 원인의 80%는 조직 문화·변화 관리·인력 역량 등 '사람'에게서 비롯되고, 기술 자체의 문제는 20%에 불과하다. Python Korea 커뮤니티에서 공유된