- Today
- Total
| 일 | 월 | 화 | 수 | 목 | 금 | 토 |
|---|---|---|---|---|---|---|
| 1 | 2 | 3 | 4 | 5 | ||
| 6 | 7 | 8 | 9 | 10 | 11 | 12 |
| 13 | 14 | 15 | 16 | 17 | 18 | 19 |
| 20 | 21 | 22 | 23 | 24 | 25 | 26 |
| 27 | 28 | 29 | 30 |
- 머신러닝
- sql
- data
- 회고록
- 변수
- 1주차
- ML
- error
- 모두의연구소
- 딕셔너리
- 데이터사이언티스트
- bigquery
- 빅쿼리
- AI
- 파이썬문법
- python
- github
- 딥러닝
- 2주차
- 회고
- 주피터노트북
- Jupyter Notebook
- 데이터
- 파이썬
- 개념정리
- 깃허브
- 데이터사이언스
- 프로젝트
- 함수
- 부트캠프
목록전체 글 (64)
부트캠프에 참여하게 된 동기 부트캠프를 시작하기 전, 가장 큰 고민은 직무 선택이었다.나는 컴퓨터공학과를 전공하여 프론트엔드 역량이 있었지만, AI/DATA 부트캠프를 선택했다.당장의 취업에 도움이 되지 않더라도 10년 후의 경쟁력을 위함이었다.AI와 데이터에 대한 이해 없이는 장기적으로 개발자로서 생존하기 어렵다고 판단했다. 이루고 싶은 목표 이 부트캠프를 통해 내가 이루고 싶은 것은 최신 트렌드 기술을 배우고 실무적인 기술과 툴을 익혀 IT관련 직무로 취업하는 것이다. "모두의 연구소 데이터사이언티스트 4기"교육 기간: 2025.03.24 - 2025.09.19교육 방식: 100% 온라인포함된 주요 커리큘럼: 데이터 분석 및 전처리, 통계, ML, DL, LLM, NLP, 추천시스템, ..
클라우딩 컴퓨팅 환경은 현대 IT 산업에서 필수적인 요소다. 특히 한국에서는 AWS, GCP, Microsoft Azure 이 세 가지 주요 클라우드 플랫폼이 많이 사용된다.강사님께서는 여러 클라우드 플랫폼 중에서도 GCP를 다루었다. 그 이유는, GCP가 머신러닝에 특화된 강력한 기능을 자체적으로 다수 보유하고 있어 MLOps 학습에 가장 적합하다고 하신다. GCP의 BigQuery나 Vertex AI 같은 도구들은 머신러닝 모델을 개발하고 운영하는 전 과정에서 큰 도움을 주어, 많은 AI 엔지니어들이 선호하는 플랫폼이 되고 있다. 이번 글에서는 다음과 같은 내용을 다루어보았다. 학습 목표 Google Cloud Platform(GCP) 이해 데이터 웨어하우스(DW)와 OLAP 이해 BigQuer..
MLOps 과정이 커리큘럼에 포함된 데이터 부트캠프는 ‘모두의 연구소’가 유일했고, 이는 내가 이곳을 선택한 결정적인 이유였다.2025년 상반기 데이터 직무 채용 공고를 살펴보면, 특히 ‘MLOps 실무 역량’을 우대하는 공고가 눈에 띄게 많았다.이를 보며 MLOps 역량은 물론, AI를 잘 다룰 수 있는 개발자로 성장해야겠다는 필요성을 느껴 부트캠프에 참여하게 되었다.부트캠프에서 다룬 MLOps 강의 내용을 중심으로, 관련 직무로 나아가기 위해 꼭 알아야 할 핵심 개념과 기술을 정리해보았다.우선, MLOps가 무엇인지 소개하는 글로 시작해보려 한다. ML/DL, 비즈니스를 만나 MLOps가 되기까지의 여정 인공지능 시대가 가속화되면서 머신러닝(ML)과 딥러닝(DL) 기술은 우리 삶 깊숙이..
아이펠톤[기업 프로젝트] 회고 (2025.07.22~09.18)아이펠톤은 약 두 달간 특정 도메인 기업의 현직자와 함께 실제 과업을 해결하는 팀 프로젝트다.그동안 부트캠프 과정에서 배운 다양한 이론과 기술을 직접 적용해 볼 수 있으며, 현직자 멘토링을 통해 특정 도메인을 이해하고 실무 기술을 배울 수 있다.이 글은 그 과정에서 무엇을 고민했고, 어떻게 풀어나갔는지, 그리고 느낀 점들을 되돌아보기 위한 회고이다.# 긴 글 주의 1. 프로젝트 소개누설자속탐상기의 장비 교정 시기 탐지 - 예지보전 ( Predictive Maintenance, PdM)생산설비의 고장은 제조라인 전체를 정지시키는 요소다.이로 인한 생산 손실, 납기 지연, 품질 불량은 제조 기업의 신뢰도와 수익성을 크게 훼손할 수 있다.이를 해결..
Git Large File Storage (Git LFS) 사용법 정리Git은 기본적으로 대용량 파일 관리에 적합하지 않아서, 일정 용량(보통 100MB)을 초과하면 push 시 에러가 발생한다.이때 Git LFS (Large File Storage)를 사용하면 대용량 파일을 효율적으로 관리할 수 있다.아래에서는 Windows 환경에서 Git LFS 설치 및 설정 방법을 정리해 보겠다.✨ 1. Git LFS 다운로드 & 설치👉 https://git-lfs.com/ 접속 후 Windows 버전 다운로드 설치가 끝나면 PowerShell을 열고 아래 명령어 실행: git lfs install 2. 관리할 파일 유형 지정예를 들어 .zip, .xlsx, .csv 같은 대용량 파일을 Git LFS..
✅ 새로 알게 된 개념이나 학습 내용🧠📘💡https://jpocket.tistory.com/59 발표)랭체인톤은 3일 동안 자유 주제로 RAG기반 LLM 모델을 이용하여 하나의 프로젝트로 완성한 뒤 발표를 진행한다.이번 랭체인톤은 KDT 해커톤 팀원들로 꾸렸" data-og-host="jpocket.tistory.com" data-og-source-url="https://jpocket.tistory.com/59" data-og-url="https://jpocket.tistory.com/59" data-og-image="https://blog.kakaocdn.net/dna/kASdD/hyZjdEs5df/AAAAAAAAAAAAAAAAAAAAALFYfkNdCyIPM8-GNvijpiEre2MiHRrqE4cjAIiKwLN4/img.png?credential=yqXZFxpELC7KVnFOS48ylbz2pIh7yKj8&expires=1790780399&allow_ip=&allow_referer=&signature=EsV6ANrEc4j7tCbJXIluKkdNlYk%3D
랭체인톤 회고 (2025.06.30~07.02, 0703-> 발표)랭체인톤은 3일 동안 자유 주제로 RAG기반 LLM 모델을 이용하여 하나의 프로젝트로 완성한 뒤 발표를 진행한다.이번 랭체인톤은 KDT 해커톤 팀원들로 꾸렸고, 4명이 한 팀으로 총 3일간 개발하였다.이 글은 그 과정에서 무엇을 고민했고, 어떤 방식으로 문제를 풀어나갔는지, 그리고 느낀 점들을 되돌아보기 위한 회고이다. 프로젝트 소개쓰RAG실수를 저지른 내가 얼마나 쓰레기인지 판별해 주는 RAG 기반 서비스라 언어유희로 위와 같은 이름을 짓게 되었다. 프로젝트 개요 및 배경작은 실수에도 자기 비난이 심하고 자책하는 사람들에게 군중 판결과 타인의 '대참사'와 비교하게 함으로써 사회적 공유와 하향 사회 비교 효과를 통해 "내 건 별..
✅ 새로 알게 된 개념이나 학습 내용🧠📘💡https://jpocket.tistory.com/52 [DATATHON] 데이터톤 2015년 11월 매출을 예측(실적 관리, 상품 개발, 매장 운영 개선 지원)데이터톤 회고 (2025.05.31 ~ 06.04) 데이터톤은 짧은 기간 동안 팀을 이루어 데이터를 분석하고, 인사이트를 도출해 하나의 프로젝트로 완성한 뒤 발표를 진행한다.각자 관심있는 도메인으로 팀을jpocket.tistory.comhttps://jpocket.tistory.com/54 [딥러닝] 딥러닝 알아보기1 - 인공 신경망, 퍼셉트론, 은닉층, 딥러닝 문제점 및 해결 방법📌[참고문헌]- https://todayisbetterthanyesterday.tistory.com/42- 모두의 연구..
머신러닝 모델이 텍스트를 이해하고 잘 분석하기 위해서, 전처리 과정에서 텍스트를 숫자 벡터로 변환하는 벡터화 과정을 거친다.벡터화 방법으로는 1. 통계와 머신 러닝을 활용한 방법2. 인공 신경망을 활용하는 방법 두 가지로 나눌 수 있다.이 글에서는 1번에 대한 내용을 담고 있다. 1. 🛠 Bag of Words (BoW)개념: 문서 내 단어들의 등장 횟수를 기반으로 문서를 표현하는 매우 간단한 방법.단어 가방: 단어들의 순서나 문법적 구조는 무시하고, 단순히 단어의 유무 및 빈도만 고려. 등장 횟수 기록: 각 단어가 문서에 나타난 횟수를 기록 ({"movies": 2}).단어장(Vocabulary): 중복을 제거한 모든 단어들의 집합.활용 도구:1) Keras Tokenizer: 단어와 빈도수를 ..
1. 텍스트 데이터를 문자열로 저장하기1) 인코딩과 디코딩2) 문자열 다루기3) 정규 표현식 2. 파일과 디렉터리 다루기1) 파일 다루기2) 디렉터리 다루기3) 모듈과 패키지 3. 여러 가지 파일 포맷 다루기1) CSV 파일2) XML파일3) JSON 파일 1-1) 인코딩과 디코딩문자열 데이터를 변수에 저장하면 컴퓨터는 주기억장치 메모리 RAM에 저장한다.RAM에 저장될 때 컴퓨터는 0과 1 즉, 이진 데이터로만 표현되기 때문에 이 데이터도 0과 1로 변환돼 저장된다. 어떻게 문자열을 이진수로 표현할까?전 세계 문자를 모두 숫자로 표시할 수 있는 표준 코드인, 유니코드로 표현한다. ord() : 해당 문자에 대응하는 유니코드 숫자 반환chr() : 해당 유니코드 숫자에 대응하는 문자를 반환 ..