시키는 대로 그리는 모델, 더 잘 그리는 모델 — 같은 프롬프트 4장면 대결

“대체 무슨 프롬프트로 뽑은 거지?” 페이스북 피드에 가끔 뜨는 계정의 그림을 볼 때마다 속으로 되뇐 말이다. 올라오는 그림이 늘 비슷한 결인데, 폐허 같은 돌기둥 옆에서 작은 여성이 거대한 코끼리를 올려다보는 이미지가 오늘 본 최신 이미지였다. 실사 질감 위로 펜 스케치 선이 겹쳐 있고 하늘에는 설계도 격자선이 깔려 있다. 색도 아이보리와 베이지, 흐린 하늘색 정도로 절제돼 … 더 읽기

1편 가설이 깨졌다, Qwen-Image 2.1 한글은 자음이 아니라 글씨체 문제였다

📌 3줄 요약 1. 같은 시드에서 프롬프트를 길게 쓰면 구도는 그대로 두고 적은 소품과 배경만 채워진다. 작은 디테일은 해상도가 좌우했다. 2. 스타일 10가지에 한글 문구 9개를 심었더니 첫 생성에서 8개가 정확했다. 3. “거센소리·된소리가 잘 틀린다”는 1편의 가설은 깨끗한 간판 20개 테스트에서 19개가 맞으면서 사실상 깨졌다. 프롬프트는 길게 쓸수록 좋을까? 짧게 던지고 나머지는 모델에 맡기는 게 … 더 읽기

5070 TI 16GB 카드로 실행해 봤다, Qwen-Image 2.1 한글 테스트

Qwen-Image 2.1로 만든 한글 제목 블로그 썸네일

📌 3줄 요약 1. 짧은 한글 문구는 한 번에 정확하게 나온다. 긴 제목은 줄마다 따옴표로 끊어줘야 맞게 나온다. 2. RTX 5070 Ti 16GB에 bf16을 올리면 1024×1024 한 장에 25초 안팎, 2752×1536은 2분 가까이 걸린다. 3. 모델은 비상업 라이선스지만, 만든 이미지의 권리는 사용자에게 있다고 Qwen이 공식 답변했다. “AI한테 한글 포스터를 맡겨도 될까?” 이미지 모델이 새로 나올 … 더 읽기

AI 영상 어색해서 접었다면, 애니풍으로 다시 해보자

바로 써도 되는 조건 vs 촘촘히 써야 하는 조건

📌 한 줄 답 Krea 2로 플랫한 애니풍 첫 프레임을 만들고, MiniMax H3에 1초 안팎의 빠른 컷으로 넣으면 지금 바로 쓸 만한 15초 영상이 나온다. ✅ 잘 되는 조건: 플랫 벡터 애니 · 15초에 13컷 · 그래픽이 화면의 80% ⚠️ 롱테이크·클로즈업도 되지만, 틀리는 지점을 문장으로 하나씩 막아야 한다 🔑 핵심 요령: 첫 프레임을 보고 나서 … 더 읽기

타지마 자수기에 무선 USB 메모리 달기, 라즈베리파이 제로 W로 4만 원에 해결한 이야기

PC, 라즈베리파이, 타지마 자수기를 잇는 자수기 무선 USB 구조도

⚡ 3줄 요약 문제 — 타지마 자수기 뒤에 랜 포트가 달려 있지만 전용 소프트웨어(DG16 by Pulse)를 사야만 쓸 수 있다. 윌컴이 파는 무선 USB 장치(EmbroideryConnect)는 국내에서 살 수 없고, 윌컴 정품 소프트웨어가 있어야 동작한다. 방법 — 라즈베리파이 제로 W를 “WiFi 달린 USB 메모리”로 위장시켰다. 자수기에는 USB 메모리로 보이고, PC에는 공유 폴더로 보인다. 폴더에 DST를 넣으면 … 더 읽기

한국어를 중국어로 알아듣는 AI 비서, app.asar 세 줄 고쳐서 살렸다

스트림독 Komi 한국어 음성이 서버에서 막혀 중국어로 돌아오는 구조

⚡ 3줄 요약 증상 — 스트림독(MiraBox Stream Dock)에 들어 있는 AI 비서 Komi에게 타이핑으로 한국어를 치면 잘 알아듣는다. 그런데 마이크에 대고 말하면 중국어(일본어 같기도 함)로 받아적는다. 원인 — 음성 인식을 내 PC가 아니라 MiraBox 서버가 한다. 앱은 언어값으로 zh 아니면 en만 보내는데, 서버는 그 값마저 무시하고 알아서 언어를 감지한다. 그러다 보니 짧은 한국어 발화를 중국어(일본어 … 더 읽기

맥미니 M4 Pro 로컬 TTS 4종 비교 — 숫자는 Qwen3가 이겼는데, 결국 쓰는 건 Higgs Audio v3다

“맥미니로 로컬 TTS 되나요?” 이 질문에 답이 달린 글은 많다. 그런데 이상하게 결론이 다 다르다. 어떤 글은 Qwen3-TTS가 최고라 하고, 어떤 글은 Fish Audio 아니면 안 된다고 한다. 왜일까? 🤔 샘플 문장이 다르고, 참조 음성이 다르고, 결정적으로 음량이 다르기 때문이다. 사람 귀는 큰 소리를 더 좋게 듣는다. 그러니 조건이 제각각인 비교는 애초에 비교가 아니다. 그래서 … 더 읽기

같은 ‘편집’이 아니다 – Krea 2 레퍼런스가 들어가는 네 가지 경로

한 줄 요약. Krea 2에서 “편집”이라 부르는 워크플로우는 네 갈래이고 서로 호환되지 않는다. 노드는 레퍼런스가 들어갈 자리만 만들고 그 자리를 어떻게 읽을지는 로라가 정하는 것이다. 그래서 편집 로라를 아무거나 받아 물리면 에러 없이 결과만 이상하게 나오게 된다. 설치법은 이미 널려 있으니 여기서는 그다음을 다루려고 한다. 워크플로우가 왜 갈라졌는지 구조로 풀고 RTX 5070 Ti 16GB에서 직접 … 더 읽기

같은 스토리보드를 줬는데, 한 놈만 그대로 그려냈다 — MiniMax H3 vs LTX-2.5 실사용 비교

요즘 로컬에서 동영상을 만들 수 있는 AI 모델을 검토하고 있다. 예전보다 성능이 향상된 모델들이 나오고 있고, 속도로 봐도 간단하게 사용할 만한 수준에는 올라왔다고 판단했기 때문이다. 그런데 캐릭터 이미지와 샷별 모션 프롬프트를 던져주고 “이대로 움직이게 해줘”라고 했을 때, 정말 그대로 나오는 모델이 몇이나 될까? 🤔 2026년 8월에 열흘 간격으로 가중치가 풀린 두 모델, MiniMax H3와 LTX-2.5를 … 더 읽기

바이브코딩으로 다 만드는데, 아직도 n8n을 쓰는 이유

요즘 커서나 클로드 코드 켜놓고 “이런 거 만들어줘” 한 줄 던지면 30분 만에 돌아가는 게 나온다. 사이트 긁어서 시트에 넣고 메일 쏘는 스크립트? 이제 진짜 뚝딱이다. 그러다 보면 자연스럽게 이런 생각이 든다. 그럼 n8n은 이제 뭐 하러 쓰지? 나도 요즘 그 생각을 많이 했다. 노드 드래그하는 시간에 코드 짜는 게 빠른데 굳이 캔버스를 켜야 하나 … 더 읽기