Notice
Recent Posts
Recent Comments
Link
| 일 | 월 | 화 | 수 | 목 | 금 | 토 |
|---|---|---|---|---|---|---|
| 1 | 2 | 3 | 4 | |||
| 5 | 6 | 7 | 8 | 9 | 10 | 11 |
| 12 | 13 | 14 | 15 | 16 | 17 | 18 |
| 19 | 20 | 21 | 22 | 23 | 24 | 25 |
| 26 | 27 | 28 | 29 | 30 | 31 |
Tags
- AI 기술
- diffusion transformer
- 이미지 생성
- tts
- 오픈AI
- 오픈소스
- PYTHON
- 인공지능
- 바이브코딩
- 이미지 편집
- 티스토리챌린지
- 오블완
- 메타
- 생성형AI
- 음성합성
- 강화학습
- gaussian splatting
- 멀티모달
- 감정 표현
- ChatGPT
- LLM
- 딥러닝
- AI
- 우분투
- XAI
- 자동화
- 트랜스포머
- 일론 머스크
- 확산 모델
- OpenAI
Archives
- Today
- Total
목록RVOS (1)
AI 탐구노트
여러분이 영상 편집 소프트웨어를 쓴다고 상상해 보세요. 만약 '화면 왼쪽에서 오른쪽으로 이동하는 원숭이'를 자동으로 잘라내고 싶다면, 지금까지의 AI는 어떻게 처리했을까요? 대부분의 시스템은 먼저 원숭이의 위치를 찾고(locate), 그 다음 해당 영역을 픽셀 단위로 잘라내는(segment) 의 두 단계를 거쳤을 겁니다. 직관적으로는 합리적인 방법처럼 보입니다. 그리고 이제까지 대부분 실제로 이런 과정을 거쳐서 작업을 해왔습니다. 그런데 여기서 발생할 수 있는 문제는 이 두 단계 사이에 정보 손실이 생기면서 복잡한 언어 표현이나 빠른 움직임에는 실수가 잦다는 것입니다. 2026년 ICLR에 발표된 FlowRVS는 이 문제를 완전히 다른 방식으로 접근합니다. 영상 자체를 마스크로 '흘려보내는(flow)' ..
AI 기술
2026. 3. 25. 16:27
