home.social

#opencv — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #opencv, aggregated by home.social.

fetched live
  1. Сшивка кадров с микроскопа: как собрать большое изображение из видео

    Рассматривать предметный образец под микроскопом — всё равно что пытаться увидеть концертный зал через замочную скважину: в поле зрения попадает только небольшой фрагмент, а общей картины не видно. Поэтому предметное стекло постепенно перемещают под камерой, а система записывает видео и собирает отдельные кадры в одно большое изображение, которое можно сохранить и использовать для исследования. Сделать это простым наложением кадров нельзя: во время движения они могут смазываться, освещение меняется, а похожие участки легко перепутать. Мы сравнили несколько подходов к совмещению соседних кадров.

    habr.com/ru/articles/1067168/

    #сшивка_изображений #обработка_изображений #компьютерное_зрение #микроскопия #OpenCV #оптический_поток #фазовая_корреляция #видеопоток #DICOM #GeoTIFF

  2. Интеграция компьютерного зрения в АСУ ТП. IEC 61499 + python + CV = OpenFb

    В июле вышла новая версия OpenFB - открытой среды исполнения для IEC 61499, позволяющая вести разработку на python. OpenFB предназначена для разработки и интеграции приложений компьютерного зрения и ML алгоритмов в АСУ ТП. В статье рассмотрен пример включения базовых алгоритмов компьютерного зрения в систему управления.

    habr.com/ru/articles/1044138/

    #асутп #iec_61499 #openfb #4diac #opencv #python #opcua

  3. How to compile your own version of with CUDA and CuDNN libraries on Ubuntu Linux. Especially if you’re like me running a few generations old GPUs that run an older version of CUDA.

    selectiveintellect.net/blog/20

  4. Превращаем китайский домофон за 400 рублей в Telegram-звонок с фото и видео

    Несколько лет у меня лежал недорогой китайский видеодомофон Doorbell M8 , работающий через приложение Ulooka . Покупал я его на одном из маркетплейсов примерно за 400 рублей — скорее из любопытства, чем из реальной необходимости.

    habr.com/ru/articles/1060478/

    #Doorbell_M8 #Ulooka #MikroTik #RouterOS #RTSP #Python #OpenCV #Telegram_Bot_API #умный_дом #видеодомофон

  5. Оценка быстродействия детекторов YOLO на Raspberry Pi 5 HAT+

    В предыдущей статье я описал процесс компиляции модели yolo8n в HEF-файл для нейрочипа HAILO-8L в модуле HAT+. В этой работе я оцениваю быстродействие инференса нескольких моделей YOLO для этого же чипа.

    habr.com/ru/articles/1058804/

    #raspberry_pi #hailo #hailo8l #yolo #mlops #ai #computervision #computer_vision #detection #opencv

  6. Ускоряем обработку изображений в OpenCV на RISC-V: алгоритмическая, низкоуровневая и компиляторная оптимизация

    Привет, Хабр! Меня зовут Роман Кузьмин, я занимаюсь развитием фреймворков искусственного интеллекта в YADRO. В этой статье я расскажу о работе по оптимизации алгоритма компьютерного зрения — детекторе углов, основанном на глобальных и локальных свойствах кривизны, который реализован с помощью библиотеки OpenCV под архитектуру RISC-V. С коллегами из НГТУ им. Р. Е. Алексеева мы добились лучшей эффективности алгоритма за счет подхода, включающего алгоритмические оптимизации и ручную векторизацию с использованием RVV. Я подробно опишу, что и где мы изменили, а в конце статьи оценю прогресс с помощью тестов на плате Lichee Pi 4a.

    habr.com/ru/companies/yadro/ar

    #riscv #opencv #компьютерное_зрение

  7. Создание манипулятора на Arduino с openCV

    Здравствуй, читатель! Меня зовут Алексей Морозов, и в этой статье мы разберём полный путь по созданию автономного манипулятора, от выбора компонентов до интеграции с компьютерным зрением и моделями YOLO! Приступим к работе. Изучить

    habr.com/ru/articles/1054922/

    #роботы #робототехника_своими_руками #ардуино #opencv #компьютерное_зрение #3дпечать

  8. 🎆 Independence Day Sale — 50% off ALL courses at OpenCV University, today only.
    Learn Computer Vision, Deep Learning, PyTorch, TensorFlow, and Generative AI from the team behind OpenCV itself. Hands-on projects. No prior CV/ML experience required.
    Today's the day to start → opencv.org/university/
    #ComputerVision #DeepLearning #MachineLearning #AI #OpenCV

  9. Cloud Optimized OpenCV Library (COOL) is a high-performance build of OpenCV, enabling faster computation of core computer vision operations at AWS scale. Join our live stream to see how we pack great performance into a package that won't break the bank. opencv.org/cloud-optimized-ope #OpenCV

  10. In case you missed it: We had a great talk about DroneBlocks, an affordable, comprehensive, drone kit for STEM. Some great audience questions, and a pretty deep look at how they keep costs down and quality up. youtube.com/live/P5eingrUQFk #OpenCV #ComputerVision #AI #Robotics #Drones

  11. Радикальный Дельфизм в эпоху AI: подключаем ИИ-ассистентов к OpenCV и FFmpeg через MCP

    Технологии ушли вперёд, и теперь мы живём в эру больших языковых моделей и автономных AI-агентов. В настоящее время существует несколько агентных систем, работающие с компьютерным зрением и камерами. Интеллектуальные видеоагенты обрабатывают видеопотоки в реальном времени, распознают объекты, анализируют поведение людей, фиксируют нарушения и действуют автономно. В основном – это готовые коммерческие ИИ-платформы для видеонаблюдения (например, Lumana, VisionPlatform.ai , Spot AI). Для создания собственных решений можно настроить захват кадров (через Frame Forwarder ) и передать их в визуальные модели обработки. Можно создавать логику на базе Amazon Bedrock Agents или фреймворков для ИИ-агентов (LangChain, CrewAI, AutoGen), где камера выступает как "инструмент" ( take_snapshot() ) восприятия. Есть еще более специализированные решения – VisionAgent (от Landing AI), Microsoft AutoGen, LlamaIndex (Multimodal Agents). А можно как-то по проще? Да еще из подручных средств? Да еще в «бытовые» агентные системы? А давайте попробуем...

    habr.com/ru/articles/1051210/

    #Агенты #FFMPEG #delphi #opencv #onvif #onvifdm #ai

  12. DroneBlocks provides a complete educational platform for STEM educators, combining drones and robotics to bring cutting-edge technology into the classroom. See how you can elevate the learning experience for students on this episode of OpenCV Live. opencv.org/live-revolutionary- #OpenCV

  13. I've been rescuing old robot code from the archives — skittlebot (2017), armBot (2014), and a MicroPython music project are now on GitHub. Nearly 12 years of history recovered from zip files and broken git repos 🤖

    orionrobots.co.uk/2026/06/18/1

  14. RF-DETR,​ the real-time state-of-the-art object detector, has taken the computer vision world by storm. The new ​preview​ is available now, and its speed and accuracy is above YOLO pareto curve. Learn about it on our live stream at 9am Pacific! youtube.com/live/fLCe1eOF_Bg #OpenCV

  15. OpenCV 5.0 is the library's first major release since 2018, and it's not a tidy-up. The layer-by-layer DNN path is replaced by a graph-based engine with shape inference, constant folding, and operator fusion. ONNX operator coverage rose from ~22% to over 80%, and the DNN module can now run language and vision-language models like Qwen 2.5, Gemma 3, and PaliGemma. The legacy C API is gone, C++17 is the floor. Does running LLMs belong inside a computer-vision library?

    #OpenCV #OpenSource

  16. Foi lançada uma nova versão do OpenCV 5, que incorpora um motor avançado de inteligência artificial. Esta atualização traz melhorias significativas em termos de capacidades de processamento e análise de imagem. 🤖

    🔗 tugatech.com.pt/t85316-nova-ve

    #artificial #motor #opencv 

  17. Release of OpenCV version 5: a major Update to the open-source Computer Vision Library - Rewritten deep neural network (DNN) engine, ONNX coverage surpassing 80%, built-in large language model (LLM) and vision language model (VLM) support #OpenCV opencv.org/opencv-5/

  18. OpenCV 5.0 debuts a new DNN engine, broader ONNX support, VLM inference, C++17 requirements, and legacy API cleanup.
    linuxiac.com/opencv-5-0-comput

    #opencv #opensource

  19. Жесты вместо горячих клавиш: подключаем ИИ к веб-камере

    Наткнулся на старую веб-камеру, которая валялась без дела. Дешевый вариант с посредственным качеством. С такой камерой не стать звездой онлифанс. Но выкидывать жалко. Пришла в голову мысль — почему не соорудить управление жестами для компьютера? Полноценное управление компьютером, как в фильмах с Томом Крузом, пока остаётся фантастикой: руки затекают, случайные движения превращаются в случайные команды. А вот привязать к жестам пару действий — выключить звук, свернуть окна, прокрутить ленту — реально и за один вечер. Понадобится старая веб-камера, Python и готовые модели Google. В статье — пошаговая сборка, разбор кода и инструкция, как обучить модель реагировать на жесты.

    habr.com/ru/companies/first/ar

    #python #opencv #mediapipe #машинное_обучение #жесты #нейронные_сети #нейросети #искусственный_интеллект

  20. (more Linux and FOSS news in previous posts of thread)

    Some FosseryWeb updates:
    In the announcement post of last week's major update I asked whether the original site should have rounded, slighly rounded, or edged corners, all three options received one vote, so I decided to go with the middleground, the slightly rounded corners. I also updated the Timeline page to include last week's major update and the design change, fixed metadata on the Min site's cheatsheet pages (where the title said FosseryWeb instead of FosseryWeb Min), updated the "tools I use" section on About page.
    fosseryweb.codeberg.page/
    fosseryweb-min.codeberg.page/
    (The site is a bit slow at the moment, seems like Codeberg servers have some performance issues, probably a bit much load due to a bunch of FOSS projects leaving GitHub, the majority of them going to Codeberg. Luckily you can run the site(s) offline too, see instructions in README: codeberg.org/fosseryweb/pages)

    Minor update to my Joplin config:
    Joplin recently got an update where F11 got mapped to toggling fullscreen by default, which conflicted with my setting of toggling the note list, so I decided to modify toggling sidebar (notebook list) to F2 and toggling note list to F3, to ensure the two keys are next to each other, and don't conflict with any default setting.
    codeberg.org/fossery-tech/jopl

    Zed Editor 1.5.3 Brings Faster Mermaid Diagrams and Better Agent Controls to Developer Workflows:
    linuxcompatible.org/story/zed-

    Vim Classic is a Vim Fork for People Who Want Their Editor AI-Free:
    feed.itsfoss.com/link/24361/17

    Node.js 26.3.0 Update Delivers Faster Buffers, Stricter Security, and Clear macOS Warnings:
    linuxcompatible.org/story/node

    The New OpenCV 5.0: Added Features, Performance Improvements and Future Directions:
    edge-ai-vision.com/2025/08/the

    Intel Preps GCC Function Multi-Versioning To Support APX & AVX10.2:
    phoronix.com/news/GCC-FMV-Patc

    (more FOSS news in comments)

    #WeeklyNews #OpenSource #FOSSNews #OpenSourceNews #FOSS #News #FosseryWeb #FosseryWebMin #Zed #VimClassic #Vim #NodeJS #OpenCV #GCC #Dev #FosseryTech