AI 시대, 입력은 한 문장뿐.
탕이의 시선
최신 글
생성형 AI, 영상 제작, 독립 개발의 실전 기록
AI 성장을 선見하라:브랜드 바이럴의 마지막 열쇠
영상 제작, 생성형 AI 영상, 앱·시스템 개발 — 한 팀이 끝까지 맡습니다.
- GPT-6 Astra로 바꾸고 나서야, 그동안 타협해 왔다는 걸 알았다
새 AI 램프라면 버그 몇 개 더 찾는 정도일 줄 알았다. 그런데 GPT-6 Astra는 우리 웹사이트와 앱의 누락을 찾아내고, Blender 장면도 디자인에 가깝게 만들었다. 의심하기 시작한 것은 너무 일찍 “이 정도면 됐다”고 받아들인 나 자신이었다.
- 엣지 위의 파티: 한 사람과 하나의 AI로 파티 게임을 Cloudflare Workers에 올리기
카드 1,428 장, 17 개 테이블, 실시간 멀티플레이가 있는 출시된 앱을 Cloudflare Workers와 Claude로 만든 기록. 아무도 미리 알려주지 않는 함정 네 가지와 AI가 자신 있게 틀리는 지점. 모든 숫자는 실측입니다.
- AI가 앱을 만들어줬다, 그리고 수십 번 틀렸다
이건 불평 글이 아니다. 그 수십 번의 오류는 오히려 한 가지를 증명한다: 이 시대에 가장 값진 능력은 '코딩할 줄 아는 것'이 아니라 '어디가 잘못됐는지 알아보는 것'이라는 사실을. 그리고 그 능력, 당신은 이미 갖고 있을 가능성이 크다.
- AI 램프 대전: Fable 5.1 vs GPT-6 Astra, 어느 쪽을 문질러야 하나?
새 AI 램프 두 개가 동시에 나왔지만, 정말 물어야 할 건 누가 점수가 높은지가 아니다. Claude Code냐 Codex냐, $20으로 실제 얼마나 버티는지, 그리고 아무도 알려주지 않는 업그레이드 순서.
- OpenRouter 데이터 공개: AI 에이전트 사용량은 인간의 5배, 7.3조 토큰이 말해 주는 것
반년 만에 에이전트가 태운 토큰은 0.51조에서 7.3조로, 인간 직접 사용량의 5배다. AI를 쓴다고 생각하지만 당신은 첫 버튼을 누른 사람일 뿐. 에이전트는 왜 이렇게 많이 쓰는지, AI가 AI의 최대 사용자가 됐을 때 방향은 누가 정하는지.
- Qwen3.8-Max와 Qwen3.8-27B는 25배 차이, 우리는 한 번 잘못 골랐다
로컬에서 모델을 돌릴 땐 숫자 두 개만 본다: 파일 몇 GB, 그래픽카드 몇 GB. 독자에게 2.4조 파라미터 모델을 받으라고 할 뻔한 해프닝에서 시작해, 27B의 어떤 압축판을 고를지, RAG 설정법, AI가 지어내지 않았는지 확인하는 법까지.
- 저작권 소송에서 Studio 2.0까지: Suno는 뽑기 기계에서 워크스테이션으로 자신을 개조하고 있다
워너는 합의했고, 소니와 유니버설은 아직 소송 중이며, GEMA는 독일에서 이겼고, BMG는 연합을 맺었다 — 2026년 8월의 Suno는 이렇다. 같은 달 Studio 2.0 출시: MIDI, 스템, 오토메이션, 세션 전체를 보는 어시스턴트. 영상 만드는 사람이 어떻게 써야 하는지 정리했다.
- '배경 프레임 시퀀스 애니메이션' 시스템을 만들고, 무료로 오픈소스 공개했다
tangyi.mx 홈페이지에서 스크롤을 따라 움직이는 배경은 영상이 아니다. 535줄, 의존성 0의 scroll-frame-sequence다. 모바일 메모리 계산법, 3층 로딩 순서, 이어지지 않는 AI 소재 처리법을 전부 실측 숫자로.
- 혼자서 석 달 만에 카드게임 App을 0에서 개발해 출시하기까지
7년 전 인터뷰가 썰렁해지지 않게 만든 질문 카드 한 벌이 App Store 심사를 통과한 게임이 됐다. 그 사이 엔지니어는 없었다. 왜 굿즈가 아니라 앱인지, 석 달을 어떻게 보냈는지, Apple에 세 번 거절당한 구덩이들.
- Qwen3.6-Plus와 Seedance 2.0: 하나는 코드, 하나는 영상 — 같은 비교표에 올리지 마라
첫 버전은 언어 모델과 영상 모델을 같은 표에서 비교했다. 틀렸다. 다시 써서 진짜 쓸모 있는 이야기를 한다: 대만 중소기업이 일을 '텍스트 뇌'와 '영상 뇌' 두 더미로 나누고, 기밀은 집에서 돌리고 보기 좋은 건 밖에서 빌리는 법.
- Seedance 2.5: 프롬프트 하나로 30초 4K, 참조 소재는 50개까지
바이트댄스가 6월 말 발표한 Seedance 2.5: 30초 네이티브 4K, 참조 소재 최대 50개, 10-bit, 음성과 화면 동기 생성. 영상 만드는 사람에게 핵심은 화질이 아니라 '캐릭터가 드디어 이어진다'는 것.