Go로 만드는 실시간 객체 인식 서버
Github: sungjin-code/stream-yolo Frontend: Flutter Backend: FastAPI, net/http, OpenCV, ONNX DevOps: Docker, Prometheus, Grafana, AWS EC2, Nginx, Github Actions Tools: Claude Code, Gemini...
Github: sungjin-code/stream-yolo Frontend: Flutter Backend: FastAPI, net/http, OpenCV, ONNX DevOps: Docker, Prometheus, Grafana, AWS EC2, Nginx, Github Actions Tools: Claude Code, Gemini...
Github: sungjin-code/dev-roo Tistory: dev-roo.tistory.com 티스토리 스킨 dev-roo를 만들고 배포한 지 거의 2년이 되었어요. 지금까지 총 4번의 업데이트를 했고 4,450명 이상이 블로그를 방문했어요. 누적 조회수도 15,720회를 넘었어요. 오늘은 블로그 스킨을 왜 개발했고, 개발과 관리...
SMC(삼성서울병원) 의료진과 챗봇 개발을 진행하며, 일부 내용이 논문으로 공개 되었어요. 이 글에서는 논문에서 다루지 못했던 고민을 함께 나누고자 해요. 삼성서울병원과 문제를 공유해요 연구실 인턴으로 SMC와 함께 의료 챗봇 개발에 참여하게 되었어요. 의료진과의 미팅을 통해 임종을 앞둔 말기암 환자분들을 돕는 시스템이 필요하다는 의견이 나왔어요....
😎 서비스를 이해하고 싶어요 이번 해의 목표는 명확했답니다. “기획부터 배포까지 모든 단계를 경험하자.” 저는 이론적 연구보다는 실제 서비스를 통해 사회적 임팩트를 만들고 사용자로부터 피드백을 받는 일에 더 큰 흥미를 느껴요. 그래서 리서치-기획-디자인-개발-테스트-배포로 이어지는 전 과정을 모두 경험해 보고 싶었어요. 기획 단계를 배우기 위해...
Github: Hateful-Meme Multi-modal과 Reasoning 학기 중에 수업 기말 프로젝트로 컴퓨터비전 기술을 이용한 무언가를 만들어야 했어요. 하지만 거창한 비전 모델을 학습할 GPU가 없었고, 최근 논문으로만 접했던 ‘멀티모달’과 ‘reasoning’을 모두 구현하면서 GPU 자원을 적게 사용하는 과제를 찾다가 Faceboo...
Github: Jin-A-Park/Speak2UI Demo: speak2ui_demo.mp4 Paper: ‘Speak2UI: 모바일 접근성을 위한 음성 보조 기술’ 이 프로젝트는 실시간으로 음성 명령을 입력받아 LLM으로 사용자 명령을 분석하고, Android A11y API를 통해 동작을 실행해요. 안드로이드 단에서 정보를 불러오고...
Agent의 변화와 정의 ReAct: Synergizing Reasoning and Acting in Language Models, 2023. Counterfactual Multi-Agent Policy Gradients, 2024. Agent는 전통적으로 policy를 가지고 자율적으로 판단하고 행동하는 모델을 말해요. 이는 강화학습...