Представляем @huggingface/kernels: более 200 ядер WebGPU для локального ИИ
Представляем @huggingface/kernels: более 200 ядер WebGPU для локального ИИ
47 новостей · все источники
Представляем @huggingface/kernels: более 200 ядер WebGPU для локального ИИ
Открытый рейтинг ASR пополнился первым языком Глобального Юга
Обучение и дообучение многовекторных моделей эмбеддингов с помощью Sentence Transformers
Большие языковые модели Granite 4.2: как они созданы
Сверхбыстрая и точная транскрипция с Granite Speech 5.0 Turbo CTC
Восстановление с учётом квантизации: сжатая 4-битная модель превосходит свой полноточный оригинал
Свяжите, запустите, разверните: рабочие процессы ИИ в Gradio
Измерение оптимизации по бенчмаркам в распознавании речи
До 3,2 раза более быстрый инференс с LFM2.5-DSpark
Чекпойнты LFM2.5 Q4_0, полученные в результате дистилляции с учетом квантизации
Сколько памяти на самом деле нужно вашему агенту?
Многовекторные модели эмбеддингов (с поздним взаимодействием) с Sentence Transformers