home.social

#веса — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #веса, aggregated by home.social.

fetched live
  1. Как измеряют LLM: параметры, бенчмарки и тесты на коленке

    В комментариях к моей предыдущей статье о тестировании трех флагманских LLM моделей были примерно такие мысли и вопросы:

    habr.com/ru/companies/bothub/a

    #эмбеддинг #llm #тест #MoE #LMArena #OpenRouter #GPQAD #Opus #Fable #веса

  2. Как измеряют LLM: параметры, бенчмарки и тесты на коленке В комментариях к моей предыдущей статье о тестирова...

    #fable #GPQA-D #llm #lmarena #openrouter #Opus #веса #тест #эмбеддинг

    Origin | Interest | Match
  3. Тернарный KAN: не баг, а фича — почему дискретные веса работают лучше Это продолжение поста “Две нейросети п...

    #KAN #Kolmogorov-Arnold #Networks #тернарные #веса #квантование #QAT #TinyML #Edge #AI #MNIST

    Origin | Interest | Match
  4. Как я экономлю на инференсе LLM-модели в облаке и не теряю в качестве

    Если вы читаете этот текст, скорее всего, вы уже пробовали запустить LLM самостоятельно. И, вполне вероятно, столкнулись с одной из типичных проблем: «Заказал GPU, загрузил модель, а она не влезла, хотя по расчетам памяти должно было хватить». «Платим за A100, а реально используем лишь 30% ее мощности». Привет, я Павел, ML-инженер в

    habr.com/ru/companies/cloud_ru

    #VLLM #LLM #инференс_моделей #gpu #веса #vram #квантовые_модели #kvcache #большие_языковые_модели

  5. Как я экономлю на инференсе LLM-модели в облаке и не теряю в качестве Если вы читаете этот текст, скорее все...

    #VLLM #LLM #инференс #моделей #gpu #веса #vram #квантовые #модели #kv-cache #большие

    Origin | Interest | Match
  6. Как я экономлю на инференсе LLM-модели в облаке и не теряю в качестве Если вы читаете этот текст, скорее все...

    #gpu #kv-cache #llm #vllm #VRAM #большие #языковые #модели #веса #инференс #моделей

    Origin | Interest | Match
Share on Mastodon

Enter the server where you have an account.