| 일 | 월 | 화 | 수 | 목 | 금 | 토 |
|---|---|---|---|---|---|---|
| 1 | 2 | 3 | 4 | |||
| 5 | 6 | 7 | 8 | 9 | 10 | 11 |
| 12 | 13 | 14 | 15 | 16 | 17 | 18 |
| 19 | 20 | 21 | 22 | 23 | 24 | 25 |
| 26 | 27 | 28 | 29 | 30 | 31 |
- 인공지능
- 일론 머스크
- 오픈소스
- 멀티모달
- 음성합성
- 자동화
- 메타
- 감정 표현
- 우분투
- XAI
- LLM
- 이미지 편집
- PYTHON
- 바이브코딩
- 생성형AI
- diffusion transformer
- OpenAI
- ChatGPT
- AI 기술
- AI
- gaussian splatting
- tts
- 확산 모델
- 딥러닝
- 오블완
- 이미지 생성
- 티스토리챌린지
- 강화학습
- 오픈AI
- 트랜스포머
- Today
- Total
목록전체 글 (942)
AI 탐구노트
1.Reicon이란? Reicon은 웹사이트와 애플리케이션 제작에 사용할 수 있는 오픈소스 SVG 아이콘 라이브러리입니다.모든 아이콘이 일정한 24×24픽셀 그리드를 기준으로 제작되어 있으며, 하나의 아이콘을 두 가지 스타일로 제공합니다.Outline: 1.5px 두께의 선으로 표현한 아이콘Filled: 내부가 채워진 아이콘공식 사이트에서는 2,700개 이상의 아이콘을 제공한다고 소개하고 있습니다. 세부적으로는 최신 v1.1.1 릴리스 기준으로는 38개 카테고리, 2,674개 아이콘이 포함되어 있으며, 각 아이콘이 Outline과 Filled 두 가지 형태로 제공되므로 실제 SVG 변형은 5,300개 이상이 됩니다. 2. 주요 특징일관성 있는 아이콘 디자인 :24×24 그리드와 통일된 모서리 처리 방..
로봇이 물건을 안전하게 다루려면 단순히 물체가 보이는 것만으로는 부족합니다. 언제 닿았는지, 어느 부분이 닿았는지, 접촉이 얼마나 넓게 퍼졌는지도 알아야 하죠. 지금까지 널리 사용되고 있는 촉각 센서는 부드러운 표면이 눌리거나 찌그러지는 모습을 카메라로 관찰해서 접촉을 판단했습니다. 하지만, 이런 방식은 단단한 물체를 힘 있게 누를 때는 효과적이지만, 물이나 크림처럼 형태가 일정하지 않은 물질에서는 뚜렷한 변형이 생기지 않기 때문에 효과가 떨어지게 됩니다. 이 문제에 대한 해결책은 음식, 화장품, 의료 시료처럼 약한 힘으로 다뤄야 하는 제품을 생산하는 산업에서 더 중요하게 됩니다. 얇은 필름이나 매우 부드러운 재료를 세게 누르면 물체가 손상될 수 있고, 액체는 누르는 힘만으로 접촉 상태를 설명하기 어렵..
바이브코딩으로 만든 3D 미로 게임입니다. 퀴즈 영상을 만드느라 예전에 만들어뒀던 미로 퀴즈 코드를 그대로 이용하되, 실제로 돌아다니는 것은 3D로 구현해서 시각적인 효과를 주는 방식으로 접근했습니다. 미로에서 몇 가지 응용해서 만들어 본 다른 게임들은 다음과 같은 것들이 있습니다. 모바일폰의 자이로스코르를 이용해 공을 기울여서 미로의 목적지를 찾아가는 게임미로 내에서 서로 술래잡기를 하는 다인용 게임실제 3D 미로 게임 이것들도 다음에 기회가 되면 소개를 해 보겠습니다. 1.개요간단한 미로 게임입니다. 주어진 미로 통로에 맞춰 3D 로 돌아다닐 수 있는 공간이 표시되고 사용자가 좌우 이동 등을 해서 목적지를 찾아가는 게임이죠. 2.게임룰 미로가 자동으로 생성되어 맵이 주어집니다. (맵의 크기 등..
1. FossFLOW 개요FossFLOW은 서버, 네트워크, 클라우드 인프라 구성을 아이소메트릭(Isometric, 2.5D) 스타일로 시각화하는 오픈소스 다이어그램 편집기입니다. 일반적인 사각형 중심의 순서도 도구보다 AWS/Azure/서버/데이터베이스/네트워크 장비 등을 입체적인(2.5D) 형태로 배치해, 기술 아키텍처를 보기 좋게 설명하는 데 초점을 둡니다. React와 Isoflow 기반으로 개발된 PWA이며, 브라우저 내부에서 실행되고 오프라인 사용도 지원합니다. PWA (Progressive Web App) : 웹 기술로 구축되지만 네이티브 앱처럼 작동하는 애플리케이션 2. 어떤 기능을 제공하나?FossFLOW의 주요 기능은 다음과 같습니다.아이소메트릭 형태의 노드와 구성요소 배치드래그 앤드 ..
날짜 별로 변하는 달 모양을 볼 수 있는 웹 서비스를 만들어 봤습니다. 실제로 만들어놓은 것은 한참 전인데 자주 사용하지 않다보니 잊고 있다가 최근에 아이가 버그가 있다고 알려줘서 다시 보게 됐네요. ^^; 1.앱 개요'달모양'은 달의 모양을 날짜 별로 보여주는 웹 앱입니다. 궁금하면 직접 보면 되지 않느냐고 할 수도 있겠습니다. 맞죠... 하지만, 구름이 낀다거나 눈이 어두워서(-_-;) 제대로 볼 수 없다거나, 혹은 오늘이 아니라 다른 날짜에는 어떻게 보일까, 다른 곳에서는 어떻게 보일까 하는 생각을 하는 분이 있다면 필요할 수도 있다고 생각합니다. 2.기능한가지 목적에 특화했기 때문에 많은 기능을 담고 있지는 않습니다. 대략 다음과 같습니다. 관찰자 위치 등록 : 위도/경도달력 UI와 달 이미지 결..
최근 인공지능은 단순히 이미지를 분석하거나 영상을 요약하는 수준을 넘어서 사람처럼 주변 상황을 실시간으로 이해하고 반응하는 방향으로 발전하고 있는 것 같습니다. 워낙 영상 입력장치가 다양하게 산업적으로 활용할 수 있을만한 영역들이 많이 나오고 있기 때문이죠. 예를 들어 메타가 주로 밀고 있는 스마트 글래스나 테슬라 등의 자율 주행차량, 서비스 산업에서의 서빙 로봇, 라이브 방송 보조 시스템 등등이 있겠네요. 그러다보니 주변 환경이 계속 변하는 상황에서는 영상을 모두 본 후 답하는 방식만으로는 뭔가 충분하지 않다는 생각을 가지게 되빈다. 사용자가 질문하는 순간에도 새로운 장면은 계속 나타나고 있기 때문입니다. 새로운 정보를 즉시 반영하면서 바로 답을 수정할 수 있는 능력이 이 때문에 더욱 더 중요해지고 있..
X에 ClearCam이라는 것을 소개한 글이 올라왔습니다. 일상에서 손쉽게 활용할 수 있겠다 싶어서 간단하게 요약해서 소개합니다. 혹시나 개인적으로 응용해 보실 분들께는 도움이 될 것 같습니다. 1. ClearCam이란?ClearCam은 기존 CCTV / IP 카메라에 전송된 영상을 AI를 이용해 분석하는 기능을 추가한 오픈소스 NVR(Network Video Recorder) 소프트웨어입니다. 최근 사용되는 CCTV는 대부분 IP 기반으로 되어 있고, RTSP 프로토콜을 이용하는 방식이 대부분입니다. 물론 다양한 자체 제공 기능을 제공하도록 차별화하기 위해 전용 프로토콜로 되어 있어 RTSP가 지원되지 않는 것들이 있긴 하지만, 쇼핑몰에서는 여전히 RTSP를 지원하는 IP 카메라를 쉽게 찾아볼 수 ..
최근 생성형 AI는 단순히 글을 쓰거나 이미지를 만드는 수준을 넘어 사람과 자연스럽게 대화하는 단계로 빠르게 발전하고 있습니다. 특히 음성과 영상을 동시에 이해하고 사람처럼 반응하는 멀티모달 AI가 새로운 흐름으로 자리 잡고 있습니다. 하지만 실제 서비스를 만들 때는 생각보다 어려운 문제가 있는데 그것은 아무리 좋은 영상을 만들어도 반응이 조금만 늦어지면 사람은 어색함을 느낀다는 것입니다. 결국 실시간 AI에서는 품질과 속도를 동시에 만족시키는 것이 가장 중요한 과제가 됩니다. 영상 생성 모델도 같은 문제를 안고 있습니다. 해상도를 높이면 더 선명한 영상을 만들 수 있지만 계산량이 크게 증가하면서 응답 속도가 느려집니다. 반대로 빠른 응답을 위해 해상도를 낮추면 얼굴 이외의 자세나 손동작, 주변 환경을..
최근에는 사진 몇 장만으로 실내 공간을 3D로 만드는 기술이 빠르게 발전하고 있습니다. 이러한 기술은 게임 제작, 디지털 트윈, AR·VR, 로봇 등 다양한 분야에서 활용되고 있죠. 하지만 기존 기술은 카메라에 보이지 않는 공간이나 가려진 물체를 제대로 복원하는 것은 잘 안 되는 경우가 많았습니다. 이번에 소개하는 GenRecon은 이러한 문제를 해결하기 위해 생성형 AI를 활용한 새로운 3D 복원 기술입니다. 단순히 보이는 부분만 이어 붙이는 것이 아니라, AI가 학습한 공간 정보를 활용해 자연스럽고 완성도 높은 3D 모델을 만들어 냅니다. 1) 기존 방식의 문제점 기존의 3D 복원 기술은 여러 장의 사진에서 같은 위치를 찾아 입체 구조를 계산하는 방식이었습니다. 하지만 이 경우, 사진이 부족하거..
최근 X나 유튜브에 올라오는 영상들을 보면, 일반적인 사진을 넘어 가상현실(VR), 메타버스, 디지털 트윈과 같은 분야에서 활용할 수 있는 360도 파노라마 콘텐츠에 대한 것들이 많습니다. 뿐만 아니라 처음부터 360도 영상을 촬영할 수 있는 기기를 사용한 것이 아니라, AI를 이용해 생성된 이미지들을 이용해서 만들어지는 경우도 있죠. 이 경우, 평면 이미지를 기준으로 설계가 되기 때문에 360도 파노라마에서 좌우와 위/아래가 하나의 구면으로 이어지는 환경에서 경계가 끊기거나 형태가 왜곡되는 경우가 발생합니다. 최근에는 기존 생성 모델을 최대한 그대로 활용하면서 새로운 환경에 적용하려는 연구가 활발하게 진행되고 있죠. 특히 모델을 다시 학습하지 않고 추론 과정만 수정하는 Training-free 방식의..
