#тесты — Public Fediverse posts
Live and recent posts from across the Fediverse tagged #тесты, aggregated by home.social.
-
3. Bonsai-27B на рекурсивном форке llama.cpp: полный запуск и реальный бенчмарк на RTX 3050
В этой статье я расскажу, как запустить Bonsai-27B на обычной видеокарте и как мой форк llama.cpp делает модель умнее прямо на инференсе. Показываю реальный тест: на одной и той же задаче базовая модель зависла и не смогла решить, а рекуррентная довела до ответа. Объясняю, что происходит внутри, сколько это стоит по скорости, и даю команды, чтобы повторить всё у себя на железе. Ну давай посомтрим
https://habr.com/ru/articles/1067216/
#ии #ии_и_машинное_обучение #тесты_производительности #тесты
-
Я собрал кнопку, которая сотрёт прогресс всех моих игроков. И до сих пор боюсь её нажать
Два года по вечерам в одиночку пилю текстовую MMORPG в Telegram. Сейчас в ней 1111 аккаунтов и 586 выживших, которые бродят по мрачному острову. И где-то в админке ждёт кнопка, которая сотрёт их прогресс до нуля. Сезонный вайп, как в Rust. Я собрал её, проверил на тестовом сервере и до сих пор не нажал на проде. Рассказываю, почему «стереть всех» это не DELETE FROM, как один разработчик не держит в голове 99 таблиц, и какой тест блокирует мне деплой, если я забыл про новую таблицу.
https://habr.com/ru/articles/1056972/
#mmorpg #вайп #wipe #php #mysql #миграции #тесты #рефакторинг #telegram #бот
-
10 вещей, которые бы я хотел услышать в первый год работы. Опыт Java разработчика. Часть 1: не только лишь код
Читатели хабра, категорически вас приветствую! Я прошел путь от стажера до разработчика Java с опытом в 5+ лет. За это время было принято не мало хороших решений, но плохие тоже не отставали, о последних и возможном способе их решения я хочу рассказать, и возможно кому то это поможет не наступить на те же грабли что и я, или же менее болезненно “отодрать” их от своих ног, если вы уже попали на них. В самом начале я думал: « Вряд ли есть что-то настолько же важное как сам код », а как оказалось вокруг есть еще очень много важных аспектов, которых было бы здорово услышать заранее. Материал будет разбит на две части, в этой: люди, задачи и код: онбординг, работа с задачами, код-ревью, тесты и чистые код и архитектура. 1. Онбординг: не бояться спрашивать и просить помощи. Многие люди боятся спрашивать, потому что кажется: « Я и так должен сам разобраться ». В итоге вы можете сидеть часами множить неудачные попытки с чем-то разобраться, и винить себя в некомпетентности, хотя очень вероятно, что проблема не в вас. На самом деле никто не ждет от вновь прибывшего сотрудника, тем более у которого еще нет многолетнего опыта за спиной, что он с ходу разберется во всем. Задача онбординга – с наибольшим комфортом и за наименьшее время помочь вам влиться в процессы компании и команды. Поэтому смело задавайте вопросы и просите помощи при необходимости у ответственных лиц. В вашем быстром и комфортном онбординге заинтересован бизнес, вы имеете полное право на него. Например когда я пришел начинающим разработчиком в одну из компаний, где я работал, мне в первый день дали древнюю документацию, и сказали пройти по ней тестирование по знанию продукта, а после развернуть его, с тестированием я сходу справился, а вот с разверткой проекта возникла трудность, проект никак не стартовал. Я несколько часов штудировал доку и пытался найти чего же мне не хватает для поднятия проекта. Ведь мне дали большую доку, где, казалось бы, все необходимое уже точно есть, ведь люди наверняка поддерживают актуальность доки, но, к сожалению, я ошибался. Оказалось, что конфиги для поднятия проекта не актуальные, и я никак не смог бы сделать это самостоятельно. И прежде, чем корить себя после долгих неудачных попыток, лучше пойти и задать вопрос ответственному коллеге, ведь во многих компаниях может быть очень много своих процессов, политик, правил и тому подобного, и вы чисто физически не можете их знать заранее, и нет ничего зазорного в том, чтобы о них спрашивать.
https://habr.com/ru/articles/1044436/
#советы_для_начинающих #первая_работа #стажер #джун #онбординг #код_ревью #тесты #технический_долг #карьера #советы_новичкам
-
Тестирование случайности самодельного ГПСЧ и сравнение с эталонами
Самодельный генератор псевдослучайных чисел (ГПСЧ) стал побочным продуктом работы над любительским шифром, а шифры для меня всего лишь хобби и поле для творчества и экспериментов. Поскольку в своём шифре я делал упор на заранее непредсказуемые динамические связи, которые зависят от промежуточных состояний шифра, сама собой напросилась идея о применении этой непредсказуемости для генерации псевдослучайных чисел. Нужно было лишь оценить степень случайности полученного генератора. Как выполнялась оценка, что показали тесты NIST и сравнение с известными «эталонами» — далее в статье.
-
Синергия E2E и скриншотных тестов: создание надежной системы тестирования iOS с помощью XCTest
Всем привет! Меня зовут Артур Поляков, я инженер по тестированию в отделе мобильной разработки в компании iSpring. Наша команда работает над iSpring LMS — мобильным приложением для дистанционного обучения сотрудников. В этой статье я поделюсь опытом автоматизации ручных проверок регресса в iOS-приложении. Хотя материалов об автотестах для iOS на Хабре достаточно, наш подход обладает уникальными особенностями, о которых я подробно расскажу дальше.
https://habr.com/ru/companies/ispring/articles/1031692/
#тестирование #тесты #qa #автоматизация_тестирования #скриншотное_тестирование #uiтестирование #мобильное_тестирование #ios #надежные_тесты #стабильные_тесты
-
Работает ли ГАТО лучше монетки? Критическая оценка графического ассоциативного теста отношений в исследованиях
В последние годы в российских агенствах по маркетинговым исследованиям, среди социологов и политических опросах активно обсуждается и заказывается проекты с применением в таких массовых опросах Графического Ассоциативного Теста Отношений (ГАТО), позиционируемого как функциональный аналог Имплицитного Ассоциативного Теста (IAT), но более технологичный для полевых исследований. В основе ГАТО лежит идея замены цветовых стимулов теста Эткинда набором абстрактных графических фигур К. Маркерта, призванных не иметь прямых ассоциаций. Однако основа этих подходов намертво прикреплена к цветовому тесту Люшера, который в современной психодиагностике демонстрирует отсутствие приемлемой прогностической ценности и валидности результатов, что было показано ещё в 1970х годах и подтверждено крупными выборочными исследованиями в 2000х. Это ставит под вопрос механический перенос логики тестирования на новые графические материалы, такие как фигуры Маркерта, используемые в ГАТО. На основе своей многолетней работы по анализу опубликованных материалов проверки тестов Люшера, Эткинда и ГАТО и примеров эмпирических данных я попытался оценить обоснованность заявок на валидность теста ГАТО и оказалось, что в ряде случаев получаемые показатели не превосходят по информативности случайное угадывание результата. Дополнительно рассмотрю новые работы посвящённые проверке надёжности и валидности ГАТО.
https://habr.com/ru/articles/1032604/
#методология #валидность #прогноз #прогнозирование #прогнозная_аналитика #тесты
-
DeepSeek V4: Обзор нейросети, бенчмарки и тесты
Нейросети не стоят на месте и постоянно развиваются. Так, 23 апреля мир увидел ChatGPT 5.5. Но лично я с большим нетерпением ждал именно DeepSeek V4 . Сколько времени прошло с того момента, как появились первые слухи о будущем релизе от китайской компании? Предыдущая версия запомнилась мне хорошим показателем в повседневных задачах и, что немаловажно, полной бесплатностью . Кто-то уже успел протестировать новую модель, кто-то пришёл к выводу, что она лучше того же ChatGPT 5.5. Ну, по крайней мере по цене точно. Про остальное говорить не буду, всё же у каждого свои вкусы и предпочтения. Да и не заглядывал я в слишком сложные задачи, чтобы по достоинству оценить, кто серьёзнее. Сегодня у нас обзор DeepSeek V4 . Пробежимся по самой модели, посмотрим на бенчмарки и, конечно же, протестируем в моих повседневных задачах, с которыми сталкивалась предыдущая версия. Чего-то сложного и высокотехнологичного тут вы не увидите, достаточно рядовые задания и моё мнение о самой модели по их итогам. Устраивайтесь поудобнее, ну а я начинаю своё повествование.
https://habr.com/ru/companies/bothub/articles/1029040/
#AI #ИИ #нейросеть #deepseek #бенчмарки #модель #тесты #математика #генерация_текста #генерация_кода
-
DeepSeek V4: Обзор нейросети, бенчмарки и тесты Нейросети не стоят на месте и постоянно развиваются. Так, 23 апреля...
#AI #ИИ #нейросеть #deepseek #бенчмарки #модель #тесты #математика #генерация #текста #генерация
Origin | Interest | Match -
Код без автора
Открыл MR на ревью. 847 строк. Тесты зелёные. Линтер чистый. Не понимаю ни одной строчки. GitClear проанализировали 211 миллионов строк - и нашли проблему, которую не видно ни в каких метриках.
https://habr.com/ru/articles/1021068/
#AI #техдолг #comprehension_debt #code_review #качество_кода #рефакторинг #тесты
-
# 10 ошибок рефакторинга
Рефакторинг — это не уборка, это хирургия на живом коде. Большинство провалов здесь не технические: смешали рефакторинг с улучшениями, сделали один огромный коммит, затянули релиз — и три недели работы ушли в мусор. Собрал 10 ошибок из реальных проектов: с примерами кода, разбором механики и способами не наступить на те же грабли.
https://habr.com/ru/articles/1011794/
#рефакторинг #java #scala #тесты #coverage #featureflag #команда #перфекционизм
-
Как заставить Android Studio ругаться на код по вашим правилам: создаем пользовательские Lint и Detekt
Привет, Хабр! На связи Алина, старший Android-разработчик в команде Инвестиций «Совкомбанк Технологии». Сегодня поговорим о том, как заставить Android Studio самостоятельно следить за порядком в коде – без ручных проверок и без вечных напоминаний в командном чате. В этой статье мы создадим практические правила для инструментов статического анализа кода и разберем, как внедрить их в проект. На примере lint рассмотрим контроль архитектуры пакетов и обязательную документацию с QuickFix, а на примере detekt – проверку неизменяемого состояния представления без Android-зависимостей и миграцию с RxJava на Coroutines.
https://habr.com/ru/companies/sovcombank_technologies/articles/1005922/
#Lint #Detekt #Android #QuickFix #Анализ_кода #Правила #Kotlin #Java #Suppress #Тесты
-
От «Турнира» до Гоблина: тест по истории видеоигр
История российской видеоигровой индустрии – это путь от экспериментов в вычислительных центрах и пиратских переводов «на коленке» до создания собственных движков и признания киберспорта на государственном уровне. Сегодня я решил вспомнить славные страницы прошлого и проверить вашу память. Насколько вы хорошо ориентируетесь в российских играх? Помните, какую игру забрендировал Disney и где в саундтреке можно встретить «Кино»? Наливайте чай, устраивайтесь поудобнее и проверяйте свою эрудицию!
https://habr.com/ru/companies/miip/articles/1003940/
#видеоигры #история #тесты #компьютерные_игры #игровые_приставки #российские_игры #викторина_по_играм #рви
-
Юнит-тестирование для веб-разработчиков: концепции и аспекты, которых не найти в документации
Что должен делать разработчик, чтобы проект, над которым он работает, не имел проблем? Очевидно — нужно просто исправить все баги и больше не писать новых. Хорошая попытка, но в реальности и для существующего сервиса скорее всего потребуется ещё несколько шагов, чтобы радикально уменьшить количество открытых багов. В том числе нелюбимое многими разработчиками — начать писать тесты. Зачем этим должны заниматься сами программисты, почему нельзя всё переложить на AI, с чего начать и каким принципам следовать, расскажу в статье.
https://habr.com/ru/companies/habr_rutube/articles/991330/
#тестирование #тестирование_сайтов #юниттестирование #vue_testing #premier #тесты #вебприложения #вебразработка #качество_кода
-
Я сгенерировал 1000 авто, FLUX.2 как инструмент дизайнера
Представьте, что вы дизайнер. Вам предлагают сделать концепт авто и показывают фотографии BMW, но вы ужасно рисуете автомобили и вообще учились не для этого. Но таск уже закреплен за вами, что же делать? Пора тестировать нейросети, а конкретно FLUX.2. Я сгенерировал более 1000 авто в различных тестах, по которым мы и пройдемся в этом посте, а в конце придумаем менее уродливую семерку BMW.
https://habr.com/ru/articles/991194/
#flux #flux2 #автомобильный_дизайн #дизайн #автомобили #нейросети #генерация_изображений #концепт_дизайн #comfyui #тесты
-
Открытие дня. Хватит строить из себя англосакса. Пишешь тесты на русском (спецификации) и получаешь дикий буст во всем.
Теперь это описание можно перенести в документацию (желательно автоматически). А ее можно отдавать в компанию на изучение и просвещение.
Коллеги не ржут над твоим английским косноязычием, а получают больше деталей и понимания.
Конечно ты лучше меня знаешь инглишь, но не получается на нем у меня доносить.
P.S. с иностранцами не работаем и видимо не будем (мне — ок, обойдусь)
-
Как попарное тестирование спасло нас ещё до первой строчки кода
Обычно о том, что тестов стало слишком много, задумываются уже после нескольких релизов, когда регресс превращается в мучение. У меня всё произошло наоборот. Я только получил первые прототипы экранов новой заявки на нецелевой кредит под залог недвижимости — без API, без фронта, только макеты и схемы. Уже на этом этапе было понятно, что калькулятор кредита получится перегруженным по параметрам. Поэтому я сразу заложил попарное тестирование в фундамент новой функциональности. Наш продукт позволяет клиенту подать заявку на нецелевой кредит под залог недвижимости.
-
Ваш IQ в жизни намного меньше чем в тесте
Средний IQ по миру ровно 100, но когда вы проходили тест у вас было 110-120 или больше. Получается, вы умнее чем средний человек на земле? Нет. В реальности у вас на 10-20 баллов меньше, вы как раз на уровне среднего человека. Почему средний человек 100 лет назад имел 80 IQ, но не проиграл бы нам по интеллекту? Почему тесты завышают результаты IQ, и влияют ли эти тесты на интеллект и успех в жизни
https://habr.com/ru/companies/femida_search/articles/984754/
-
Проверь свою игровую эрудицию: новогодний тест для настоящих геймеров
Наверняка вы сталкивались с моими постами на тему истории. В том числе видеоигровой. Пока я только собираюсь с силами, чтобы написать книгу на тему рекламы технологий от электромобилей до портативных приставок, вместе с друзьями из MWS мы решили сделать интересный новогодний тест-опрос. Что общего у российского актера и GTA? Какой игры не было в советском цветном телевизоре «Рубин»? С чего начиналась Nintendo? Какая связь между красным Ferrari и раскладкой WASD? Пока гирлянды мигают, а в доме пахнет мандаринами и праздником, время отложить все дела, сделать перерыв от работы (а ведь праздники и каникулы — самое время ударно поработать, пока никто не мешает) и устроить небольшую интеллектуальную разминку перед Новым годом! Проверять себя придется самостоятельно. Список правильных ответов спрятан под спойлером. Посмотрите, сколько раз вы попали в цель, какие ответы стали неожиданностью, а какие — оказались слишком легкими, и напишите об этом в комментариях!
https://habr.com/ru/companies/ru_mts/articles/981892/
#видеоигры #история #тесты #компьютерные_игры #игровые_приставки
-
[Перевод] Новости разработки: исправление тестовых наборов ReactOS
На протяжении многих лет тестовые наборы ReactOS оставались без должного внимания. Они представляли собой случайный набор: - собственных тестов проекта; - старых тестов Wine, которые проверялись только на Windows Server 2003 иногда — на случайных более новых версиях Windows (на усмотрение участника). Импортированные тесты Wine были сильно модифицированы, а внесённые изменения не всегда хорошо документировались. Я взялся навести порядок в этом хаосе.
-
[Перевод] Ваша работа — выпускать код, который доказанно работает
Во всех обсуждениях ценности ИИ-помощников в разработке ПО мне встречается одна печальная история: разработчик-джун, вооружившийся каким-нибудь LLM-инструментом, создаёт для своих коллег или мейнтейнеров опенсорс-проекта огромный нетестированный PR, ожидая, что всё остальное решится благодаря процессу код-ревью. Такое поведение грубо, оно заставляет других людей впустую тратить время и идёт вразрез с долгом разработчика ПО. Ваша задача — выпускать код, который доказанно работает. Мы, разработчики ПО, не просто производим код; сегодня даже можно сказать, что для этого предназначены LLM. Мы должны выпускать код, который работает , и приложить к нему доказательство его работы. Если вы этого не делаете, то просто сбрасываете бремя настоящей работы на того, кто должен будет проверять ваш код.
-
В ReactOS внесены улучшения, исправляющие ряд проблем с USB
Здравствуйте, дорогие друзья! Кто давно следит за развитием проекта, помнит, что одним из больных мест ReactOS была поддержка USB. При тестировании на реальном железе с большой вероятностью система выпадала в BSOD из-за USB-драйверов. Даже если вы использовали PS/2 мыши/клавиатуры, то простое подключение/отключение флешки могло "уронить" систему. Но, недавно, разработчик @The_DarkFire __ внёс ряд исправлений в USB-драйвера, которые исправляют данные проблемы с USB в ReactOS на реальном оборудовании!
https://habr.com/ru/companies/reactos/articles/973432/
#reactos #тесты #usb #реальное_оборудование #real_hardware #улучшение #багфикс
-
Monkey patching? В Go? Серьёзно? Или ка писать тесты и не сойти сума
На днях подходит ко мне коллега с вопросом: «Слушай, а как в Go сделать замену логики функции в тесте?» Я уточняю, что он имеет в виду. А он такой: «Ну, хочу monkey patching, чтобы подменять функции из коробки. Типа time.Now возвращала фиксированное время, uuid.New конкретный ID. Чтобы удобно тестироваться». И тут я, конечно, немного завис :D Да, технически в Go есть способы делать monkey patching (еще и есть библиотека ) через unsafe, через подмену указателей на функции в рантайме. Но это настолько хрупкое и непредсказуемое решение, что я бы не советовал тащить его в продакшен-код. Особенно когда есть нормальный, идиоматичный способ решить эту задачу.
-
Метрики в тестировании: как в Рунити перешли от ручного сбора данных к автоматизации
Привет, Хабр! Сегодня с вами Анна Асабина, главный инженер по тестированию, и Ольга Султанова, руководитель направления тестирования в Рунити. Мы расскажем о нашем опыте внедрения метрик в тестировании: какие метрики для нас работают, зачем мы автоматизировали их сбор и что в итоге изменилось.
https://habr.com/ru/companies/runity/articles/963166/
#тест #тестирование #тесты #тестировщик #метрики_тестирования #метрики_качества #сборка #алертинг #алерты #автоматизация_тестирования
-
DIY Observability для автотестов, используя Pytest, ClickHouse и Grafana
Всем привет! Меня зовут Андрей, я инженер по автоматизации тестирования в команде Озон Банка, занимающейся разработкой и поддержанием инструментов тестирования, которыми пользуется весь банк. Сегодня я хотел бы поделиться опытом сбора технических метрик pytest и их анализа в целях выявления узких мест и ускорения выполнения тестов.
https://habr.com/ru/companies/ozonbank/articles/956834/
#pytest #python #testing #тестирование #тесты #testing_tools #metrics #grafana #питон #метрики_тестирования
-
Kotlin QA: как перейти с Java и писать тесты в 2 раза быстрее
С момента официального объявления Kotlin как предпочтительного языка для Android‑разработки в 2017 году язык стремительно завоевал популярность не только в мобильной сфере, но и в автоматизации тестирования. Многие команды QA-инженеров сталкиваются с выбором: остаться на привычном Java‑стеке или перейти на Kotlin. В этой статье мы рассмотрим некоторые ключевые различия, преимущества и практические аспекты перехода на Kotlin в контексте автоматизации тестирования.
https://habr.com/ru/companies/otus/articles/950864/
#kotlin #Java #автоматизация_тестирования #QA #тесты #лаконичность_кода #вывод_типов #var_и_val #неизменяемые_переменные
-
ЕС1849: «золотая двойка» на процессоре INTEL Harris 80286
Здравствуйте уважаемые почитатели ретротехники! Сегодня речь пойдёт об интереснейшей вычислительной машине — ЕС1849, собранной на отечественной элементной базе практически полностью, за исключением процессора и чипсета. Эта АТ-машина — почти венец творения отечественной компьютерной промышленности, разработанной и реализованной в СССР. Версия БУСВВ (BIOS) датируется 1989–1992 годами. Статья содержит детальные фото материнской и периферийных плат, любопытного ртутно-цинкового элемента питания, кейкапа клавиатуры в деталях, а также видео работы самого компьютера — демонстрации, тесты и запуск оболочки Windows. За мной, читатель(c)!
https://habr.com/ru/companies/timeweb/articles/932088/
#ретроспектива #ретрокомпьютинг #ретрокомпьютер #тесты #игры #демонстрации #windows_30 #timeweb_статьи
-
Код, не боящийся изменений
В этой статье вы найдете немного личных наблюдений и советов о том, как сохранить проект живым и здоровым с течением лет. Без иллюзий всезнания. С лёгким, здоровым цинизмом. Мой личный опыт связан с разработкой сервисов в рамках продуктовой разработки. В данной статье я говорю именно о такой разработке, а не о создании библиотек, фреймворков, баз данных и других замечательных вещей. Также я не касаюсь проектной разработки, где код пишется на заказ и передаётся в поддержку другим.
-
Зачем мы сделали тесты по ИТ-навыкам (и кому они помогут)
Меня зовут Никита Сбитнев, я — продакт hh.ru. И сегодня я расскажу, зачем и для кого мы запустили тесты по ИТ-навыкам, кто их разрабатывал, как устроены задания и какие результаты уже получили.
https://habr.com/ru/companies/hh/articles/931958/
#навыки #резюме #поиск_работы #карьера #рынок_труда #тесты #диагностика
-
Grok 4 — самая умная модель? Обзор новой нейросети от Илона Маска
В июле этого года Илон Маск и команда xAI выпустили Grok 4 — свою новую «самую умную модель в мире». Компания называет Grok 4 флагманской моделью с «непревзойденной производительностью в языке, математике и рассуждениях». По словам Маска, 4-я версия разумнее, чем учёные в степени кандидата наук: «Многие обладатели PhD завалились бы там, где Grok справился». В этом обзоре — всё об особенностях Grok 4, его характеристики и рекорды в бенчмарках, а также информация, где воспользоваться моделью.
-
[Перевод] В ReactOS заключен контракт для улучшения набора тестов
Фонд ReactOS Deutschland eV заключил контракт с одним из участников сообщества и разработчиком проекта, Карлом Дж. Бялоруцким. Он начал участвовать в проекте внеся несколько улучшений в оболочку ReactOS. В мае 2024 года он вступил в основную команду разработчиков, а в марте 2025 года возглавил выпуск релиза ReactOS 0.4.15 после того, как предыдущий релиз-менеджер не смог продолжить работу над проектом. В мае 2025 года с ним был заключен контракт, рассчитанный до августа 2025 года.