DeepSeek, 이미지도 읽을 수 있는 오픈 웨이트 인공지능 모델 V4.1-Flash 공개
인공지능 기업 DeepSeek가 2026년 9월 10일 DeepSeek-V4.1-Flash를 공개했습니다. 모델을 작동하게 하는, 학습으로 얻은 숫자인 가중치(weights)는 상업적 이용을 허용하는 MIT License에 따라 Hugging Face에서 내려받을 수 있습니다. 이 모델은 DeepSeek의 API로도 이용할 수 있습니다.
이 모델의 파라미터(학습으로 얻은 숫자)는 모두 5,520억 개지만, 한 번에 모델의 일부만 켜지는 전문가 혼합(mixture-of-experts) 구조를 씁니다. DeepSeek에 따르면 입력을 읽을 때는 80억 개, 출력을 쓸 때는 160억 개의 파라미터만 작동하며, 이는 비용을 낮게 유지하는 데 도움이 됩니다. 이 모델은 텍스트뿐 아니라 이미지도 이해합니다. VentureBeat에 따르면 한 번에 최대 100만 토큰까지 입력받을 수 있는데, 토큰은 인공지능 모델이 처리하는 작은 텍스트 조각을 말합니다.
DeepSeek는 시험 결과 V4.1-Flash가 성능, 비용, 속도에서 자사의 V4-Pro 모델을 앞섰다며, 9월 14일부터 V4-Pro로 들어오는 요청을 새 모델로 보낸다고 밝혔습니다. VentureBeat는 기사에서 소개한 벤치마크 결과가 DeepSeek의 자체 평가에서 나온 것이라고 짚었습니다.
왜 중요할까요? 가중치가 공개된 오픈 웨이트 모델이 있으면 학생, 연구자, 작은 기업도 몇몇 제공 업체에게서 빌려 쓰기만 하는 대신, 성능 좋은 인공지능을 직접 내려받아 연구하고 실행할 수 있습니다.
출처: DeepSeek — https://api-docs.deepseek.com/news/news260910/
출처: VentureBeat — https://venturebeat.com/technology/deepseek-v4-1-flash-debuts-with-0-003-1m-off-peak-cached-input-rate-and-benchmarks-eclipsing-gpt-5-6-sol-claude-opus-5
评论 0
还没有评论。来写下第一条评论吧。