전체 글

AI

RAG Pipeline 설계 및 구축

RAG(Retrieval-Augmented Generation) Pipeline 설계 및 구축 — 개념 정리1. RAG란 무엇인가*RAG(Retrieval-Augmented Generation)**는 사용자의 질문에 대해 외부 데이터베이스나 문서를 검색한 후, 이를 바탕으로 답변을 생성하는 기법이다.Retrieval: 사용자의 질문을 기반으로 관련 문서를 데이터베이스에서 검색Augmented: 검색한 문서를 모델 입력(프롬프트)에 추가하여, 검색된 지식을 활용할 수 있도록 보완Generation: 사용자 질의 + 검색 문서로 자연어 생성 모델이 답변 생성RAG가 필요한 이유비즈니스 관점: 기업들은 방대한 내부 문서를 보유하고 있지만 LLM은 그 데이터로 사전학습되지 않았다. 비즈니스에 적용하려면 기업 내..

AI

데이터 분석 및 AIOps - Feature Engineering

머신러닝 프로젝트를 시작하면 어떤 알고리즘을 사용할지부터 고민하기 쉽다. 하지만 실제 모델의 성능을 크게 좌우하는 것은 알고리즘보다 데이터의 품질과 표현 방식인 경우가 많다.흔히 “Garbage In, Garbage Out”이라고 한다. 품질이 나쁜 데이터를 사용하면 좋은 예측 결과를 얻기 어렵다는 뜻이다. 그런데 데이터가 깨끗하다고 해서 반드시 좋은 모델을 만들 수 있는 것은 아니다. 결측치나 오류가 없는 데이터라도 문제를 설명하는 정보가 부족하다면 모델의 예측력에는 한계가 있다.결국 중요한 것은 “Better Features In, Better Predictions Out”이다. 모델이 학습하기 좋은 피처를 만들어야 더 좋은 예측 결과를 얻을 수 있다. 1. Feature Engineering이란?F..

AI

LangChain으로 LLM Agent 서비스 개발

1. AI Application 개발은 전통적인 SW 개발과 무엇이 다른가가장 먼저 짚고 넘어가야 할 건 패러다임 자체가 다르다는 점이다.전통적 SW: 규칙 기반(Rule-based), 개발자가 짜놓은 IF-THEN 로직대로만 동작한다. 자율성이 없다.AI 모델 개발: 데이터 기반(Data-driven)으로 패턴을 학습하고, 통계적 추론으로 확률적 결과를 낸다.AI Application 개발: 문맥 기반(Context-based)으로, 프롬프트와 RAG로 외부 지식을 결합해 답을 만든다. 여기까지는 아직 "수동적"이다.AI Agent 개발: 목표 기반(Goal-oriented)으로, 스스로 계획을 세우고(Plan) 도구를 골라 쓰며(Act) 실패하면 대안을 찾는다(Reflect). 자율성의 수준이 완전히..

AI

쿠버네티스 - 3. 셀프 정리

1. 쿠버네티스란? -> 수많은 컨테이너를 관리하는 시스템.서버를 다수 운영한다면, 서로 다른 서버에서 작동하는 수많은 컨테이너를 한번에 관리하는 것이 어렵기 때문에 쿠버네티스를 사용하면 여러 개의 컨테이너를 쉽게 생성하고 관리할 수 있습니다. 2. 클러스터쿠버네티스 클러스터는 다수의 노드로 이루어져있습니다. 마스터 노드, 워커 노드로 크게 구분이 되고, 개발자는 주로 마스터 노드와 통신하여 사용자는 인터넷을 통해 워커 노드와 통신하게 됩니다. 3. 마스터 노드API 서버 쿠버네티스 작업은 kubectl 명령어를 통해 마스터 노드의 kube-apiserver 에게 api 요청을 보냄으로써 이루어집니다. API 서버는 쿠버네티스 컨트롤 플레인에서의 프론트엔드 역할을 합니다. etcd 쿠버네티스 클러..

AI

쿠버네티스 - 2. 실전

8. Deployment와 롤아웃Deployment·ReplicaSet·Pod, 왜 세 층인가Deployment는 버전을 관리하고, ReplicaSet은 개수를 관리합니다. 새 버전을 배포하면 새 ReplicaSet이 생기고 옛 ReplicaSet은 개수가 0으로 줄어들 뿐 지워지지 않습니다 — 이것이 롤백이 가능한 이유입니다. 배포 전 Deployment → RS(v1)=3 → Pod 3개배포 중 Deployment → RS(v1)=1, RS(v2)=2 → Pod 3개배포 후 Deployment → RS(v1)=0, RS(v2)=3 → Pod 3개Pod 이름 가운데 토막이 ReplicaSet 해시입니다. kubectl get deploy,rs,pod로 세 계층을 한 번에 확인할 수 있습니다...

AI

쿠버네티스 - 1. 아키텍쳐, kubectl

목차왜 쿠버네티스인가컨테이너와 이미지쿠버네티스 아키텍처클러스터 내부 동작kubectl 기본 문법kubectl 실무Pod 1. 왜 쿠버네티스인가배포 방식은 세 번 바뀌었다물리 서버 → 가상 머신 → 컨테이너. 매번 '한 대에 몇 개를 안전하게 올릴 수 있나'가 바뀌었다. 격리 단위가 작아질수록 부팅이 빨라지고 밀도가 올라간다. 컨테이너는 커널을 공유하므로 OS 부팅 시간이 통째로 사라진다.시대격리 단위기동 시간한 대당 개수약점물리 서버서버 1대=앱 1개수 분~수십 분1~2개자원 낭비, 증설에 수 주가상 머신게스트 OS 통째로30초~2분10~20개OS 중복, 이미지 수 GB컨테이너프로세스+네임스페이스0.1~2초50~200개커널 공유, 격리가 약함참고: 컨테이너는 VM보다 안전하지 않다. 커널을 공유하므로 ..

orange_mj
programing