TL;DR
이번 포스트에서는 DeepSeek-V4-Flash-Vision-Exp의 멀티모달 API와 이미지 재사용용 Files API가 공개됐고, Qwen3.8-27B용 NVFP4·DFlash2 레시피가 SGLang cookbook에 추가됐습니다. Fine-tuning 분야에서는 LoRA부터 GRPO·RLVR·RULER까지 학습 신호와 파라미터를 줄이는 방법이 정리됐으며, RULER는 judge LLM의 상대 순위를 GRPO 보상 입력으로 사용합니다. Tencent의 HyCreator는 장편 영상 생성과 실시간 편집을 결합한 agent harness로 제시됐습니다. Claude Code 사례에서는 Tiger Cloud의 TimescaleDB와 Tiger CLI MCP를 연결해 시계열 날씨 대시보드의 백엔드·데이터 파이프라인·프런트엔드를 한 세션에 구성했습니다.
𝕏 실시간 트렌드 토픽
🔥 DeepSeek-V4-Flash-Vision-Exp의 멀티모달 API 공개포스트 3
DeepSeek가 텍스트 능력을 유지하면서 이미지 입력과 멀티모달 에이전트 평가를 지원하는 실험 모델을 API Platform에 올렸습니다. 이미지 토큰 과금, Files API 재사용, Chat Completions·Messages·Responses 연동이 함께 제공됐습니다.
세부 내용 보기
- DeepSeek-V4-Flash-Vision-Exp는 DeepSeek-V4-Flash와 agents·reasoning·world knowledge를 포함한 텍스트 능력이 같다고 안내됐고, 멀티모달 에이전트 벤치마크에서는 V4-Flash보다 성능이 크게 향상돼 Opus-4.8에 가까워졌다고 게시됐습니다.
- API는 텍스트와 이미지를 함께 입력받으며 이미지를 base64, 외부 URL 또는 Files API로 전달합니다. 이미지는 이미지당 최대 384 tokens로 토큰화돼 과금되고, Files API는 이미지를 한 번 업로드한 뒤 file_id를 재사용해 반복 요청의 전송량을 줄입니다.
- DeepSeek Harness 0.1.1이 새 모델을 기본 지원하고, 모델 지정에는 model='deepseek-v4-flash-vision-exp'를 사용합니다. 관련 포스트의 조회 수는 모델 공개 글 10,816회, 멀티모달 API 안내 글 1,510회, Files API 안내 글 1,321회였습니다.
원문 트윗 2개 보기
DeepSeek
DeepSeek-V4-Flash-Vision-Exp is now live on the DeepSeek API Platform! This experimental multimodal model matches DeepSeek-V4-Flash on text capabilities—including agents, reasoning, and world knowledge. On multimodal agent benchmarks, V4-Flash-Vision-Exp makes a major leap over V4-Flash, bringing multimodal agent performance close to Opus-4.8. Try it with model='deepseek-v4-flash-vision-exp'. DeepSeek Harness 0.1.1 was released today with out-of-the-box support for the new model. 1/n
DeepSeek
Multimodal API support Set model='deepseek-v4-flash-vision-exp' Images are tokenized for billing: up to 384 tokens each, at V4-Flash pricing Supports Chat Completions, Messages & Responses Supports mixed text + image input; images can be provided via base64, external URLs, or the Files API. Docs: https:// api-docs.deepseek.com/guides/vision 3/n
📈 Qwen3.8-27B의 NVFP4·DFlash2 실행 레시피포스트 1
Qwen3.8-27B를 위한 NVFP4와 DFlash2 조합이 SGLang cookbook에 추가됐습니다. 커뮤니티 결과를 바탕으로 해당 조합을 직접 시험할 수 있는 실행 출발점이 마련됐습니다.
세부 내용 보기
- Alibaba_Qwen은 Qwen3.8-27B용 NVFP4 + DFlash2 레시피가 SGLang cookbook에 추가됐다고 알렸고, SGLang 측 게시물은 커뮤니티가 이 조합에서 좋은 결과를 얻고 있다고 전했습니다.
- 레시피는 Qwen3.8-27B를 대상으로 NVFP4와 DFlash2를 함께 적용하는 설정을 제공해 사용자가 같은 추론 조합을 재현하고 조정할 수 있게 합니다. 게시물은 추가 Qwen3.8 27B 업데이트도 예고했습니다.
- 현재 포스트는 좋아요 19회, 조회 2,598회, 답글 2개를 기록했습니다. 모델과 실행 엔진 설정이 cookbook 형태로 공개되면서 양자화·추론 최적화 실험의 진입 경로가 구체화됐습니다.
➖ LoRA부터 RULER까지 Fine-tuning 보상 신호 확장포스트 1
LLM Fine-tuning 기법을 파라미터 효율화와 선호·검증 보상이라는 축으로 묶은 정리가 공유됐습니다. 특히 정답 라벨이 없는 RAG·지원 답변·요약 작업에서 RULER가 judge LLM의 상대 순위를 GRPO 입력으로 바꾸는 절차를 제시했습니다.
세부 내용 보기
- 정리된 12개 기법은 LoRA·QLoRA·Prefix tuning·Adapter tuning·Instruction tuning·P-tuning·BitFit과 RLHF·RLAIF·DPO·GRPO·RLVR·Federated fine-tuning으로 구성됩니다. LoRA는 base weights를 고정하고 두 개의 low-rank matrices만 학습해 Fine-tuning 파라미터를 약 95~99% 줄입니다.
- GRPO는 프롬프트마다 여러 응답을 샘플링하고 그룹 안에서 보상을 정규화해 응답마다 하나의 scalar reward를 필요로 합니다. RLVR는 수학·코드 답변을 checker나 compiler에 통과시켜 검증 가능한 점수를 만들지만, RAG 답변·지원 답변·요약처럼 정답과 직접 대조하기 어려운 작업에는 적용이 제한됩니다.
- RULER는 학습 중 N개의 sampled trajectories를 judge LLM에 전달하고 agent의 system prompt를 기준으로 서로 상대 순위를 매겨 점수를 반환합니다. OpenPipe의 open-source ART에 구현됐으며, 상대 순위가 절대 점수보다 안정적이고 GRPO의 그룹 내 정규화와 바로 연결된다는 설명입니다.
📈 HyCreator의 장편 영상 생성과 실시간 편집포스트 1
Tencent의 HyCreator는 장편 영상 생성을 처음부터 끝까지 수행하는 agent harness로 공개됐습니다. 10분 규모 영상을 자동 생성한 뒤 필요할 때 실시간 대화형 편집으로 전환하는 구조입니다.
세부 내용 보기
- HyCreator는 일반적인 영상 모델처럼 하나의 클립을 반환하는 대신 전체 생성 흐름을 end-to-end로 처리하고, 프롬프트를 다시 실행하지 않고도 제작 중간에 사용자가 개입할 수 있도록 구성됐습니다.
- End2end Auto Mode에서는 사람의 개입 없이 10-minute scale 영화를 생성하고, 사용자는 원하는 시점에 real-time interactive editing으로 전환할 수 있습니다. 영상 생성과 수정 단계를 하나의 harness 안에서 이어 붙이는 방식입니다.
- 게시물은 HyCreator의 early access 신청을 안내했으며, 해당 포스트는 조회 76회, 좋아요 3회, 답글 1개를 기록했습니다.
➖ Claude Code와 Tiger Cloud로 구성한 시계열 날씨 대시보드포스트 1
Claude Code가 백엔드·데이터베이스·데이터 파이프라인·프런트엔드를 한 세션에 구성한 사례가 공유됐습니다. Tiger Cloud의 TimescaleDB와 Tiger CLI MCP를 연결해 시간축 데이터 조회와 사전 집계를 처리했습니다.
세부 내용 보기
- 사례의 대시보드는 NASA 위성 이미지, 낮·밤 주기, 도시별 날씨 아이콘, 10일 시간 이동 슬라이더, 이상 고온·저온 표시를 포함하며 3일 예측 레이어를 갖췄습니다. Claude Code가 애플리케이션 전체 구성 요소를 한 세션에서 만들었습니다.
- Tiger CLI MCP 서버를 통해 Claude Code가 Tiger Cloud의 관리형 TimescaleDB에 연결하고 데이터베이스 서비스 프로비저닝, 시간 기준 hypertables 생성, continuous aggregates 설정, 시간별 날씨 데이터 수집 파이프라인, NextJS + ThreeJS 프런트엔드를 구성했습니다.
- 슬라이더가 움직일 때마다 수천 행을 조회하므로 일반 Postgres 테이블에서는 수동 파티셔닝과 인덱스 조정이 필요하지만, TimescaleDB는 timestamp 기준으로 데이터를 자동 분할해 관련 시간 청크만 조회합니다. Continuous aggregates는 원시 데이터를 매번 재스캔하지 않고 추세 차트·예측·이상 탐지 기준값을 사전 집계 결과로 반환합니다.
- Tiger CLI는 Apache 2.0 라이선스의 open-source 도구이며 Claude Code, Cursor, Codex, Gemini CLI, VS Code와 연동됩니다. 게시물은 Tiger Cloud에 $1,000 free credits가 제공되고 카드가 필요 없다고 안내했으며, 설치 명령과 MCP 등록 명령도 함께 공유했습니다.
➖ Switch Transformers의 희소 라우팅과 스케일링 법칙포스트 1
Switch Transformers의 과거 실험을 통해 활성화 파라미터와 전체 파라미터가 서로 다른 역할을 가질 수 있다는 관점이 다시 인용됐습니다. 토큰별 전문가 라우팅으로 계산량과 모델 규모를 분리하는 구조입니다.
세부 내용 보기
- 인용된 Switch Transformers 실험은 각 토큰을 2,048개 전문가 중 하나에만 라우팅하는 희소 구조를 사용했습니다. 이 방식은 모든 전문가를 매번 활성화하지 않고 토큰별 선택 경로를 두어 계산에 참여하는 파라미터 수를 제한합니다.
- 해당 모델은 활성화 파라미터가 3B 미만이었지만 전체 파라미터는 1.6T였다고 전해졌습니다. 게시물은 이를 바탕으로 FLOPs를 intelligence, parameters를 knowledge와 연결하는 짧은 관점을 덧붙였습니다.
- 인용문은 2020년에 sparsity의 한계를 탐색한 실험으로 이 선택을 설명하며, 희소 전문가 구조가 실제 연산량과 저장된 전체 지식 규모를 별도 축으로 다룬다는 점을 환기합니다.
용어 해설
- 멀티모달 에이전트 벤치마크(Multimodal Agent Benchmark)
- — 텍스트뿐 아니라 이미지 같은 여러 입력을 처리하는 에이전트의 성능을 측정하는 평가 방식입니다. DeepSeek-V4-Flash-Vision-Exp는 이 평가에서 기존 V4-Flash보다 성능을 높였다고 제시됐습니다.
- Files API
- — 이미지를 한 번 업로드한 뒤 file_id로 여러 요청에서 재사용하는 API 기능입니다. 같은 이미지를 반복 전송하지 않아 요청 대역폭을 줄이는 방식으로 작동합니다.
- NVFP4
- — Qwen3.8-27B 추론 조합에 사용된 수치 표현 방식입니다. DFlash2와 함께 SGLang cookbook의 실행 레시피로 제공됐습니다.
- DFlash2
- — Qwen3.8-27B를 위한 SGLang 실행 레시피에 NVFP4와 함께 포함된 기술입니다. 게시된 레시피는 커뮤니티가 해당 조합을 시험할 출발점으로 활용하도록 구성됐습니다.
- RULER
- — 샘플링한 여러 에이전트 궤적을 judge LLM으로 서로 비교해 상대 순위를 보상 신호로 만드는 방법입니다. 절대 점수 대신 그룹 내 순위를 사용해 GRPO 학습 과정에 연결합니다.
- Continuous Aggregates
- — 원시 시계열 데이터를 요청마다 다시 계산하지 않고 미리 집계한 결과를 제공하는 데이터베이스 기능입니다. 날씨 대시보드의 추세 차트와 예측·이상 탐지 기준값 조회에 사용됐습니다.
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.
