AI타임스주목
딥시크, 멀티모달 에이전트 'V4-플래시-비전' 공개...'오퍼스 4.8'에 도전
딥시크가 이미지·텍스트를 함께 이해하고 에이전트 작업까지 수행하는 'V4-플래시-비전'을 공개해 클로드 오퍼스 4.8에 도전했다.
사서의 짚기
딥시크가 비전 이해와 에이전트 수행 능력을 함께 갖춘 모델을 유료 API로 먼저 내놓았다는 점이 눈에 띈다. 오픈소스 진영이 성능 격차뿐 아니라 에이전틱 워크플로우 대응 속도에서도 상업 모델을 바짝 뒤쫓고 있음을 보여주는 신호다. 멀티모달 에이전트 도입을 검토하는 개발자나 비용 대비 성능을 비교하는 실무자가 참고할 만하다.
원문 발췌
딥시크가 이미지와 텍스트를 동시에 이해하고 에이전트 작업까지 수행할 수 있는 실험적 멀티모달 모델을 공개하며 앤트로픽의 '클로드 오퍼스 4.8'에 도전장을 던졌다.딥시크는 API 플랫폼에 ‘딥시크-V4-플래시-비전-Exp(DeepSeek-V4-Flash-Vision-Exp)’를 출시했다고 21일 밝혔다.이 모델은 기존 텍스트 중심의 '딥시크 V4-플래시'에 이미지 이해 기능을 결합한 것으로, 에이전트 작업과 추론, 일반적인 세계 지식 등 텍스트 영역에서는 V4-플래시와 동일한 수준의 성능을 유지하면서 시각 정보 처리 능력을 추가한