Notice
Recent Posts
Recent Comments
Link
| 일 | 월 | 화 | 수 | 목 | 금 | 토 |
|---|---|---|---|---|---|---|
| 1 | 2 | 3 | 4 | |||
| 5 | 6 | 7 | 8 | 9 | 10 | 11 |
| 12 | 13 | 14 | 15 | 16 | 17 | 18 |
| 19 | 20 | 21 | 22 | 23 | 24 | 25 |
| 26 | 27 | 28 | 29 | 30 | 31 |
Tags
- 우분투
- 자동화
- 멀티모달
- PYTHON
- XAI
- LLM
- 딥러닝
- 오픈소스
- 이미지 생성
- 일론 머스크
- 바이브코딩
- 감정 표현
- OpenAI
- gaussian splatting
- 트랜스포머
- 인공지능
- 티스토리챌린지
- 오픈AI
- 음성합성
- AI
- diffusion transformer
- 메타
- 강화학습
- tts
- 확산 모델
- 오블완
- 생성형AI
- AI 기술
- 이미지 편집
- ChatGPT
Archives
- Today
- Total
목록Video DropLoss (1)
AI 탐구노트
요즘 AI는 사진 한 장을 보고 '자동차다', '사람이다'라고 맞히는 수준을 넘어, 이제는 영상 속에서 무엇이 어디에 있는지, 그리고 그 대상이 다음 장면에서 어디로 움직였는지도 알아야 하는 것이 당연하게 여겨지고 있습니다. 예를 들어 자율주행차라면 앞에 있는 자동차, 길을 건너는 사람, 도로와 인도, 건물과 하늘을 모두 구분해야 하는 것처럼 말이죠. 사람에게는 자연스러운 일이지만 AI에게는 꽤 복잡한 일이라고 알려져 있고, 그러다보니 이에 대한 연구가 계속 이어져 왔습니다. 문제는 이런 AI를 학습시키려면 보통 사람이 직접 정답을 붙인 데이터가 많이 필요하다는 점입니다. 특히 비디오는 이미지보다 더 어렵습니다. 한 장면만 표시하면 끝나는 것이 아니라, 같은 사람이 다음 장면에서도 같은 사람인지 계속 이..
AI 기술
2026. 6. 6. 12:41
