home.social

#whisper — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #whisper, aggregated by home.social.

  1. Étude du consortium ARIANE sur la transcription via IA générative avec le LLM Whisper : « Whisper : transcription automatique de sources sonores » hal.science/hal-05706209 #Whisper #LLM #ESR

  2. LLM 改变了很多,比如 Agent 概念上半年爆火后,大厂们都争前恐后推出 CLI 产品,知乎,微信,网易云等等,这在几年前是完全无法想象的,那时想让 Linux 用上微信都很难,需要折腾一大堆 Wine 的组件,有时还会面临封号的风险。反观现在拥抱全平台的吃相,让人忍俊不禁。

    但真正改变的,其实很有限,因为爆火的原因不是厂商良心,拥抱开源,而是发现这个市场有的赚,本质还是逐利的,Agent 让厂商发现开放生态有的赚。工具功能很全,很方便,但我却更加担心了,工具会一直免费下去吗?我猜不会,等到官方的生态建立起来,我想就是回血的时候了。

    值得高兴的是,这些工具还很烂,如果真的要用,还太早,比如 npmjs.com/package/@music163/nc

    我无法相信官方的 TUI 居然吹能播放一半不到的歌,真是充满恶意的设计

    #whisper #netease #cli #llm

  3. LLM 改变了很多,比如 Agent 概念上半年爆火后,大厂们都争前恐后推出 CLI 产品,知乎,微信,网易云等等,这在几年前是完全无法想象的,那时想让 Linux 用上微信都很难,需要折腾一大堆 Wine 的组件,有时还会面临封号的风险。反观现在拥抱全平台的吃相,让人忍俊不禁。

    但真正改变的,其实很有限,因为爆火的原因不是厂商良心,拥抱开源,而是发现这个市场有的赚,本质还是逐利的,Agent 让厂商发现开放生态有的赚。工具功能很全,很方便,但我却更加担心了,工具会一直免费下去吗?我猜不会,等到官方的生态建立起来,我想就是回血的时候了。

    值得高兴的是,这些工具还很烂,如果真的要用,还太早,比如 npmjs.com/package/@music163/nc

    我无法相信官方的 TUI 居然吹能播放一半不到的歌,真是充满恶意的设计

    #whisper #netease #cli #llm

  4. LLM 改变了很多,比如 Agent 概念上半年爆火后,大厂们都争前恐后推出 CLI 产品,知乎,微信,网易云等等,这在几年前是完全无法想象的,那时想让 Linux 用上微信都很难,需要折腾一大堆 Wine 的组件,有时还会面临封号的风险。反观现在拥抱全平台的吃相,让人忍俊不禁。

    但真正改变的,其实很有限,因为爆火的原因不是厂商良心,拥抱开源,而是发现这个市场有的赚,本质还是逐利的,Agent 让厂商发现开放生态有的赚。工具功能很全,很方便,但我却更加担心了,工具会一直免费下去吗?我猜不会,等到官方的生态建立起来,我想就是回血的时候了。

    值得高兴的是,这些工具还很烂,如果真的要用,还太早,比如 npmjs.com/package/@music163/nc

    我无法相信官方的 TUI 居然吹能播放一半不到的歌,真是充满恶意的设计

    #whisper #netease #cli #llm

  5. LLM 改变了很多,比如 Agent 概念上半年爆火后,大厂们都争前恐后推出 CLI 产品,知乎,微信,网易云等等,这在几年前是完全无法想象的,那时想让 Linux 用上微信都很难,需要折腾一大堆 Wine 的组件,有时还会面临封号的风险。反观现在拥抱全平台的吃相,让人忍俊不禁。

    但真正改变的,其实很有限,因为爆火的原因不是厂商良心,拥抱开源,而是发现这个市场有的赚,本质还是逐利的,Agent 让厂商发现开放生态有的赚。工具功能很全,很方便,但我却更加担心了,工具会一直免费下去吗?我猜不会,等到官方的生态建立起来,我想就是回血的时候了。

    值得高兴的是,这些工具还很烂,如果真的要用,还太早,比如 npmjs.com/package/@music163/nc

    我无法相信官方的 TUI 居然吹能播放一半不到的歌,真是充满恶意的设计

    #whisper #netease #cli #llm

  6. LLM 改变了很多,比如 Agent 概念上半年爆火后,大厂们都争前恐后推出 CLI 产品,知乎,微信,网易云等等,这在几年前是完全无法想象的,那时想让 Linux 用上微信都很难,需要折腾一大堆 Wine 的组件,有时还会面临封号的风险。反观现在拥抱全平台的吃相,让人忍俊不禁。

    但真正改变的,其实很有限,因为爆火的原因不是厂商良心,拥抱开源,而是发现这个市场有的赚,本质还是逐利的,Agent 让厂商发现开放生态有的赚。工具功能很全,很方便,但我却更加担心了,工具会一直免费下去吗?我猜不会,等到官方的生态建立起来,我想就是回血的时候了。

    值得高兴的是,这些工具还很烂,如果真的要用,还太早,比如 npmjs.com/package/@music163/nc

    我无法相信官方的 TUI 居然吹能播放一半不到的歌,真是充满恶意的设计

    #whisper #netease #cli #llm

  7. Was für eine Sch*** !

    Ständig zerlegt sich die Whisper-Integration in KDEnlive. Kaum hat man die wieder geflickt, zerschießt das nächste Update sie wieder.

    Mal eben Untertitel erzeugen, wird so zur Qual.

    Ich prangere das an!

    Danke für Ihre Aufmerksamkeit für dieses Thema!

    #kdenlive #whisper #captions

  8. Was für eine Sch*** !

    Ständig zerlegt sich die Whisper-Integration in KDEnlive. Kaum hat man die wieder geflickt, zerschießt das nächste Update sie wieder.

    Mal eben Untertitel erzeugen, wird so zur Qual.

    Ich prangere das an!

    Danke für Ihre Aufmerksamkeit für dieses Thema!

    #kdenlive #whisper #captions

  9. Was für eine Sch*** !

    Ständig zerlegt sich die Whisper-Integration in KDEnlive. Kaum hat man die wieder geflickt, zerschießt das nächste Update sie wieder.

    Mal eben Untertitel erzeugen, wird so zur Qual.

    Ich prangere das an!

    Danke für Ihre Aufmerksamkeit für dieses Thema!

    #kdenlive #whisper #captions

  10. **Personal Vault #015 — Subtitles**

    I wanted to add Polish subtitles to movies and TV series in Personal Vault, but OpenSubtitles doesn't have Polish subtitles for everything in my library.

    I could connect another subtitle service, but that would mean relying on yet another external provider.

    So what's the alternative?

    Transcribe the dialogue myself, translate it, and generate the subtitles locally.

    Bingo! Or is it?

    I decided to test the idea using **Whisper** for multilingual transcription and timestamps, and **NLLB-200** for translation. I sent Codex a prompt and left it installing components and running tests while I explored Mastodon.

    Then I heard a sound coming from my laptop.

    I only had Codex and three Firefox tabs open.

    What on Earth is making THAT SOUND??

    Then I remembered: Codex has a built-in browser.

    I opened it.

    **Codex was watching Tron.**

    NOOOOO.

    Of all the movies to let an AI coding agent watch...

    Unfortunately, the choice wasn't much better. It was either **Tron** or **Terminator 2**.

    Neither seems like responsible viewing material for an AI agent.

    Codex was only testing the generated subtitles, but still...

    I sincerely hope I haven't accidentally created the Master Control Program or Skynet. 😛

    As for the experiment itself: technically, it worked.

    The transcription and subtitle generation were surprisingly good. Translation was the weak point.

    And that taught me something useful: **context is king**. Translating isolated subtitle lines is very different from understanding a conversation, a joke, a character, or what was said thirty seconds earlier. Without that context, even a very capable translation model can produce perfectly reasonable translations that are completely wrong for the scene.

    So I'm calling the experiment a successful failure.

    The idea works. The translation isn't good enough yet. I'll probably revisit it later.

    Assuming Codex hasn't taken over the world by then.

    #PersonalVault #DigitalIndependence #SelfHosting #Whisper #AI

  11. 🎙️ #IA | Transcription de la voix

    🔶 Pour une transcription entièrement en local, l’application #Scribéo, dans la Forge des #CommunsNumériques, propose de télécharger et faire tourner dans le navigateur plusieurs versions du modèle #Whisper

    👉 scribeo.forge.apps.education.f

  12. Разговорили гуманоида: как за месяц мы построили русскоязычный голосовой стек для китайского робота

    Можно ли управлять гуманоидом Walker Tienkung через свой голосовой ассистент по-русски? Мы решили проверить — и быстро выяснили, что ответ сложнее, чем кажется. Штатная система понимала только китайский, Whisper ошибался на коротких командах, LLM добавляла задержку, а динамик съедал начало фразы после паузы. «Беги» превращалось в «begin», а «встань» — в «Таня». Рассказываем, как нам удалось построить свой собственный модульный русскоязычный стек, разделить команды и диалог, ускорить синтез речи, и добиться реакции за доли секунды. С архитектурой, тестами и новыми нерешёнными задачами. Полный гайд как заставить робота ростом 173 см и весом 75 кг слушать вас и понимать! Читать гайд

    habr.com/ru/companies/361robot

    #распознавание_речи #синтез_речи #whisper #silero #vosk #голосовой_ассистент #робототехника #гуманоид #llm #эмбеддинги

  13. Вики из 48 часов видео: конвейер, который не даёт LLM выдумывать

    У меня было 48 часов видеозаписей учебного курса и простая мысль: пересматривать это я не буду никогда. Сырой транскрипт немногим лучше — болото на сотни страниц. Я собрал конвейер, который превратил записи в Obsidian-вики: 47 связанных статей, и каждое утверждение в любой из них — в двух кликах от места в записи, где это было сказано.

    habr.com/ru/articles/1069706/

    #LLM #Whisper #Obsidian #RAG #база_знаний #structured_output

  14. 🗣️ Captions run on-device via #Whisper (whisper.cpp) — model downloaded on first use, no cloud, no account, then styled and burned into preview and export

    🎨 Backgrounds, gradients, padding, corner radius, shadow, blur, round or rectangular face cam, plus named editor presets that save look, cursor, captions and export settings

  15. We at @parchlinux have started building something we've wanted for a long time: a full accessibility layer baked into the distro itself, not bolted on as an afterthought. Persian voice support, offline speech recognition, and a design that treats every desktop environment the same way. 🧵👇

    blog.parchlinux.com/a-linux-di

    #Linux #Accessibility #OpenSource #FOSS #a11y #ParchLinux #Persian #ScreenReader #Whisper #Privacy

  16. Голосовой ввод в любое окно Windows за секунду. Офлайн, на CPU, без единого гигабайта torch

    Голосовой ввод для Windows за ~1 секунду | Полностью локально • CPU • Open Source Как заставить Whisper распознавать речь почти в 4 раза быстрее на обычном CPU без GPU и без облака. Разбираю архитектуру WhisperType, сужение окна энкодера, потоковую обработку аудио, оптимизацию faster-whisper и подводные камни WinAPI.

    habr.com/ru/articles/1068154/

    #Whisper #WhisperType #fasterwhisper #CTranslate2 #SpeechtoText #распознавание_речи #Windows #Python #CPU #Open_Source

  17. Я печатаю медленнее, чем думаю: локальная диктовка на Whisper для Windows, телефона и Telegram

    Я диктую постоянно: сообщения, заметки, постановку задач — говорить в разы быстрее, чем печатать, а мысль не успевает остыть. Проблема в том, что удобной диктовки, которая не гонит звук в чужое облако, я не нашёл. Так появился PasteTalk: локальная диктовка для Windows по горячей клавише, а вокруг неё — собственный сервер, приложение для телефона и Telegram-бот. Отдельным требованием стала мама: из-за слабого зрения печатать на телефоне она почти не может, и телефонная часть проектировалась под самый жёсткий случай — одна кнопка на весь экран, крупный шрифт, ошибки словами. Забегая вперёд: правки «для мамы» сделали приложение удобнее и для всех остальных. Под катом — архитектура, цифры и четыре бага, каждый из которых молча съедал наговорённый текст. Как это устроено →

    habr.com/ru/articles/1068152/

    #whisper #диктовка #распознавание_речи #speechtotext #selfhosted #telegramбот #локальные_нейросети #fasterwhisper

  18. Как сжать 300+ часов D&D сериала в пересказ для актеров

    Я давно играю в ДнД и почти с самого начала смотрю «Грядут приключения» - ребята снимают настольные ролевые игры как сериалы: живая партия актеров за столом, постоянный каст, сквозной сюжет, серии по пять-шесть часов. Нравится у них всё, но больше всего - «Архипелаг» и «Эндемия». В какой-то момент несравненный Мастер Гоша Воронин кинул в своём канале клич: проекту нужна помощь с пересказом сериала. Нужен был текст, по которому актёры смогут прочитать всё случившееся за 55 серий. Обычно такие вещи делают руками. Энтузиасты берут источник, сами его пересматривают, сами расписывают сценарий, сами переводят всё в текст. Работа адская даже когда в источнике пара часов записи, а тут триста. Я решил попробовать по-новому и написал в комментах, что могу помочь: работаю с ИИ и большими данными, сделаю это в разы быстрее, чем руками, и никому не придётся месяцами сидеть над расшифровками. Так я и взялся разобрать все 55 серий в базу знаний и написать по ней текст видеопересказа для актеров на 30-60 минут.

    habr.com/ru/articles/1065794/

    #GigaAM #Whisper #ASR #распознавание_речи #диаризация #Claude #Opus #LLM #база_знаний #транскрибация

  19. Keine Angst vor Spracherkennung. Auf einem aktuellen MacBook transkribiert #Whisper superschnell und vollständig lokal. Eine Stunde Besprechung ist in wenigen Minuten verschriftlicht, ohne Netzwerkverbindung. mrak.at/transkription-ohne-umw

  20. Я ошибался: бенчмарк 23 ASR-нейросетей для русской айтишной диктовки

    В марте я советовал Whisper Large v3 для голосовой диктовки и ошибался дважды: в методе (выбирал модель «на ощупь») и в самой модели. Пересобрал всё по-научному: 23 ASR-модели в 60+ конфигурациях, больше 100 000 прогонов на русско-английском IT-корпусе, 120+ часов инференса на одной RTX 5070 Ti. Мерил не только WER, но и сохранение английских терминов латиницей и пунктуацию. Внутри — полный лидерборд, разбор каждого сюрприза, вклад тюнинга и промптов, cloud-против-open по деньгам и инструкция, как поставить победителя за 10 минут.

    habr.com/ru/articles/1066528/

    #whisper #breezeasr #распознавание_речи #ASR #voicetotext #whisper_large_v3 #whisper_turbo #gigaam_v3 #faster_whisper #codeswitching

  21. Tired of per-minute cloud transcription bills? Self-host OpenAI Whisper on your own dedicated server instead — full privacy, no metering, full control over the model.

    New guide covers 4 setup paths: faster-whisper (production), whisper.cpp , whisper-asr-webservice , and WhisperX (speaker diarization) — plus a hardware/VRAM table so you buy the right GPU.

    Read it here: fitservers.com/tutorials/howto

    #Whisper #SelfHosted #OpenSource #AI #MachineLearning #DevOps #Ubuntu #DedicatedServers

  22. I made this #YouTube video for work using #OpenSource. #Audacity with #OpenVINO to clean up the #Audio #Inkscape for the lower thirds and #Kdenlive to edit everything. Oh, and #Whisper to automatically create the #subtitles, which is did an amazing job, better than Audacity and OpenVINO did. Only would have been better if I did it on my home #kubuntu desktop but open source #software is the best and all ran on my Windows workstation.

    youtu.be/YEkgv__LgGw?si=C73y62

  23. Claude Code в Telegram голосом: свой мост, когда официальный канал выключен

    MCP-сервер отвечает Connected. Инструменты работают: бот сам присылает мне сообщения. Мои сообщения до бота доходят, я вижу их в очереди Telegram. А в сессию Claude Code они не попадают. Ни ошибки, ни предупреждения. Полтора часа я искал не там. Меня зовут Сол ГудКод, и обычно я вытаскиваю людей из ситуаций, в которые они сами себя загнали, но на этот раз клиентом оказался я сам: мне нужен был бот, которому можно наговорить задачу голосом из дороги, чтобы он сделал её на моей машине и в моих проектах. У Anthropic такое есть официально, и именно поэтому история вышла длиннее, чем я рассчитывал. Внутри: как отличить эту тишину от своей ошибки за минуту и чем я заменил официальный канал. Плюс восемь мест, где я наступил на грабли Windows. В том числе на те, куда уже наступал в этом же проекте. И на ту, где Claude вежливо попросил меня договорить мысль.

    habr.com/ru/articles/1063578/

    #claude_code #телеграмбот #anthropic #ииагенты #llm #whisper #fasterwhisper #powershell #голосовое_управление #mcp

  24. Azul, bonjour ☕

    Sunbird a publié le 04 juillet un modèle nommé "Whisper large for 51 African languages" qui prend en charge le #kabyle.

    Ce modèle est une adaptation de whisper-large-v3.

    Plus d'info sur : huggingface.co/Sunbird/asr-whi

    #whisper #taqbaylit #asr #STT #Africa

  25. 56 минут созвона → текст за 5 минут на M4 без OBS и облака

    У меня от трёх до пяти созвонов в день, почти все в браузере: Meet, Яндекс Телемост, ktalk, реже всего Zoom. Детали встреч мне нужны в тексте, иначе договорённости расползаются. Писал я звонки через OBS с захватом экрана, и на самих звонках началось веселье: звук временами жёстко квакал, всё чуть-чуть подвисало. Причину до конца не выяснял, моё предположение - процессор зажирался захватом и перебивал сам разговор; ktalk и браузер тут ни при чём. А экран, как потом дошло, мне вообще был не нужен. Дальше вторая серия. Расшифровку я гонял своими Python-скриптами: конвертация → транскрибация → диаризация (разметка, кто когда говорил). На встрече с пятью участниками диаризация расставляла голоса крайне плохо, половину фраз всё равно восстанавливал по памяти. Пошёл искать вариант, чтобы запись не мешала звонку, результат был приличный и всё крутилось локально: не хотелось ни отдавать записи в облако, ни платить подписку за минуты. Нашёл платный Audio Hijack , он подкупил лёгкостью и простотой настройки. Потом узнал, что на M-чипе быстрее всего у меня отрабатывает mlx-whisper на MLX : веса large-v3-turbo с Hugging Face, инференс на GPU Mac. Это архитектура Whisper, но рантайм — пакет mlx-whisper и бинарь mlx_whisper , не pip install openai-whisper и не репозиторий openai/whisper . Так собрался стек: Hijack пишет один mp3, mlx_whisper делает VTT, pyannote раскладывает по SPEAKER_XX. На 56-минутном звонке транскрипция заняла около пяти минут. Платный только Hijack — разовая лицензия, без подписки (цену смотрите на сайте Rogue Amoeba). Скрипты выложил в mac-call-transcribe под MIT. Ниже сборка, замеры с двух реальных звонков и грабли; повторяется на любом Mac с M-чипом.

    habr.com/ru/articles/1062068/

    #whisper #mlx #pyannote #speaker_diarization #расшифровка_звонков #python #apple_silicon #транскрибация_звонков

  26. La dettatura vocale arriva su Linux con un progetto open source che punta tutto su privacy, velocità e semplicità d'uso. Scopri come funziona Vocalinux e perché potrebbe diventare uno strumento indispensabile. #Linux #OpenSource #VoiceTyping #Privacy #Wayland #Whisper

    linuxeasy.org/vocalinux-porta-

  27. After tracking down the reflecting pool vandals (a cabal of communist squirrels), Detective Whisper turned her attention to the Case of the Torn Curtain Panel.

    #caturday #whisper #whisperthewonderpuss #cats #northdakota

  28. Vocalinux is an open-source voice dictation app for Linux that works entirely offline.

    It supports Whisper.cpp, OpenAI Whisper, and VOSK, letting you dictate into almost any application without sending your audio to the cloud. It also includes GPU acceleration, customizable hotkeys, and Wayland/X11 support.

    More details: digitalescapetools.com/tools/t

    #OpenSource #Linux #Privacy #SpeechToText #Whisper #Productivity

  29. SpeechAnalyzer : un benchmark confirme que la transcription d’Apple bat le Whisper d'OpenAI dlvr.it/TTX1p1 #Apple #Whisper

  30. New article on my website: Transcribing voice memos locally in 2026 (on Windows)

    tomfichtner.com/article/transc

    A practical guide to turning voice recordings into text without uploading them to the cloud. Written for beginners, I focus on ease-of-use and reliability. Also covers a bit of technical background and what else may lie ahead in human-machine voice interaction.

    Also available in German: tomfichtner.com/article/de/tra

    #whisper #ai #opensource #transcription #work

  31. Fairly valid use of #AI, near realtime voice to text #estonian -> English translation tool. I have spent about 2 hours gluing together OpenAI #whisper and Google Gemma 4 e2b and WebRTC VAD (voice activity detection) in Python. Both whisper and Gemma are running on GPU together utilizing about 50% of my Radeon.

  32. Qwen3.5 на двух V100, reverse SSH вместо Cloudflare в Telegram Mini App: собираю AI-репетитора английского

    У меня в углу комнаты стоит сервер с двумя Tesla V100 32GB. Они доcтались мне для другой задачи, которая отвалилась, и полгода стояли мёртвым грузом. Параллельно я в очередной раз пробовал заниматься английским — Simpler, Doalingo, ещё пара продуктов. Хорошие, но мне не подходил формат: я хотел сценарий «открыл телефон дома на семь минут, поговорил, закрыл». Без расписания, без камеры, без поиска тьютора, который понимает мой акцент с пятого раза. Сошлось. Идея: Telegram Mini App, в нём кнопка «говорить», за ней — AI-репетитор, который слышит, что я сказал, отвечает голосом, помнит контекст разговора, тыкает в мои повторяющиеся ошибки и подбрасывает слова, которые я пытаюсь выучить. Полностью бесплатно. Модель Qwen3.5 вышла 25 февраля , я её гоняю всего несколько недель, продукт сырой. Эта статья — про архитектурные решения и про то, на какие грабли я уже успел наступить.

    habr.com/ru/articles/1042166/

    #vllm #qwen35 #telegram_bot #telegram_mini_apps #aiogram_3 #fastapi #selfhosted_llm #kokoro_tts #whisper #tesla_v100

  33. Qwen3.5 на двух V100, reverse SSH вместо Cloudflare в Telegram Mini App: собираю AI-репетитора английского

    У меня в углу комнаты стоит сервер с двумя Tesla V100 32GB. Они доcтались мне для другой задачи, которая отвалилась, и полгода стояли мёртвым грузом. Параллельно я в очередной раз пробовал заниматься английским — Simpler, Doalingo, ещё пара продуктов. Хорошие, но мне не подходил формат: я хотел сценарий «открыл телефон дома на семь минут, поговорил, закрыл». Без расписания, без камеры, без поиска тьютора, который понимает мой акцент с пятого раза. Сошлось. Идея: Telegram Mini App, в нём кнопка «говорить», за ней — AI-репетитор, который слышит, что я сказал, отвечает голосом, помнит контекст разговора, тыкает в мои повторяющиеся ошибки и подбрасывает слова, которые я пытаюсь выучить. Полностью бесплатно. Модель Qwen3.5 вышла 25 февраля , я её гоняю всего несколько недель, продукт сырой. Эта статья — про архитектурные решения и про то, на какие грабли я уже успел наступить.

    habr.com/ru/articles/1042166/

    #vllm #qwen35 #telegram_bot #telegram_mini_apps #aiogram_3 #fastapi #selfhosted_llm #kokoro_tts #whisper #tesla_v100

  34. Qwen3.5 на двух V100, reverse SSH вместо Cloudflare в Telegram Mini App: собираю AI-репетитора английского

    У меня в углу комнаты стоит сервер с двумя Tesla V100 32GB. Они доcтались мне для другой задачи, которая отвалилась, и полгода стояли мёртвым грузом. Параллельно я в очередной раз пробовал заниматься английским — Simpler, Doalingo, ещё пара продуктов. Хорошие, но мне не подходил формат: я хотел сценарий «открыл телефон дома на семь минут, поговорил, закрыл». Без расписания, без камеры, без поиска тьютора, который понимает мой акцент с пятого раза. Сошлось. Идея: Telegram Mini App, в нём кнопка «говорить», за ней — AI-репетитор, который слышит, что я сказал, отвечает голосом, помнит контекст разговора, тыкает в мои повторяющиеся ошибки и подбрасывает слова, которые я пытаюсь выучить. Полностью бесплатно. Модель Qwen3.5 вышла 25 февраля , я её гоняю всего несколько недель, продукт сырой. Эта статья — про архитектурные решения и про то, на какие грабли я уже успел наступить.

    habr.com/ru/articles/1042166/

    #vllm #qwen35 #telegram_bot #telegram_mini_apps #aiogram_3 #fastapi #selfhosted_llm #kokoro_tts #whisper #tesla_v100

  35. macOS 15 SequoiaでのCoreMLアップデートにより音声書き起こし速度が最大20%向上し、DeepLに加えAppleのローカル翻訳機能をサポートした「Whisper Transcription」がリリース。
    applech2.com/archives/20240917

    #applech2 #macOS_15_Sequoia #Apple_Silicon #CoreML #Mac #macOS_15 #OpenAI #Sequoia #Whisper #アプリ #レビュー #仕事効率化