#deepseek-v4
- DeepSeek V4: официальный open-source релиз с Day-0 адаптацией под Huawei Ascend DeepSeek models-llm
- DeepSeek открыл исходный код DSpark: ускорение инференса V4 на 57–85% в продакшне DeepSeek tools
- Стабильный релиз DeepSeek V4 запланирован на середину июля с первым почасовым API-ценообразованием DeepSeek models-llm
- DeepSeek подтверждает официальный выпуск V4 в середине июля и вводит пиковое ценообразование API DeepSeek models-llm
- DeepSeek V4 перешла из превью в общий доступ с тарификацией API по часам пиковой нагрузки DeepSeek models-llm
- DeepSeek вводит тарификацию пиковых/внепиковых часов на V4-Pro с 16:00 UTC 16 августа DeepSeek tools
- DeepSeek выпускает экспериментальную мультимодальную модель V4-Flash-Vision-Exp DeepSeek models-llm
- SLAI T-Rex: полнопараметрический post-training семейства DeepSeek-V4 на Ascend SuperPOD SLAI research
- vLLM v0.24.0: Model Runner V2 по умолчанию, Rust-фронтенд, ускорение SM90 FP8 vLLM tools
- SLAI T-Rex: полнопараметрическое пост-обучение семейства DeepSeek-V4 на Ascend SuperPOD SLAI research
- llama.cpp v0.3.0 — первый помеченный стабильный релиз ночного b10621; мультимодальность dots3-note, MTP для GLM-4.5-Air, tensor-split DeepSeek 4, ggml v0.22.0 ggml-org tools
- DeepSeek V4 — снижение цен в API DeepSeek models-llm
- vLLM v0.20.1 устраняет критическую нестабильность DeepSeek V4 под производственными нагрузками vLLM Project tools
- Cline выпускает v4.1.13/14/15 с обновлением каталога моделей, фиксом MCP auto-approve и командами `cline hub` drain/upgrade Cline tools
- llama.cpp b10603-b10615 — GLM-4.5-Air MTP, Deepseek 4 -sm tensor, тюнинг Metal flash-attn vec для M1 Pro/M2 Ultra/M5 Max ggml-org tools