#gpt2 — Public Fediverse posts
Live and recent posts from across the Fediverse tagged #gpt2, aggregated by home.social.
-
Ah, yes, because what the world really needed was to implement GPT-2 in pure #CMake. 😂 It's like trying to cook gourmet meals using only a toaster and a refrigerator box. Next up: reinventing the wheel using only a rock and sheer willpower! 🙄
https://github.com/AlpinDale/gpt2.cmake #GPT2 #Innovation #Humor #CodingFails #TechSatire #HackerNews #ngated -
Implementation of GPT-2 in pure CMake
https://github.com/AlpinDale/gpt2.cmake
Comments: https://news.ycombinator.com/item?id=49412909
#HackerNews #GPT2 #CMake #Implementation #CMake #CProgramming #AIDevelopment #OpenSource
-
Где LLM хранит факты, или как перенести Эйфелеву башню из Парижа в Рим
Помните, как в «Матрице» Нео загрузили боевые навыки прямо в мозг? Раз, и человек, который раньше не умел драться, говорит: «Я знаю кунг-фу». Попробуем повторить этот трюк с языковой моделью. Но так как мы далеки от единоборств, возьмем простой факт: Эйфелева башня находится в Париже. Попробуем заменить в GPT-2 XL Париж на Рим без полного переобучения модели. Для этого используем ROME, метод точечного редактирования весов. После правки зададим модели тот же вопрос в нескольких формулировках, проверим другие факты об Эйфелевой башне, а потом вернем исходные веса.
-
----------------
🛠️ Tool
===================Conversation Stenography is a proof of concept tool that hides secret messages inside normal-looking chat text using local AI models.
🔹 Key Features
• Generates innocent cover text for encrypted messages
• Works across any messaging platform like WhatsApp or Signal
• Uses local GPT-2 model for generation and decoding🔹 Technical Implementation
The tool is written in Go. It clones from GitHub, builds a binary, and downloads a recommended local AI model on first run. It encrypts the message and then uses the local model to generate a cover text that looks like a normal conversation. A local simulation mode allows testing with two users on one device.
🔹 Use Cases
• Educational demonstration of LLM-based steganography
• Covert communication research against message scanning🔹 Limitations
The author explicitly states this is a proof of concept with multiple issues. Techniques are already being developed to detect hidden content in text. The author notes they are 18 and not the first to explore this, acknowledging LLM-based steganography has existed for years and may already operate at scale.
🔹 steganography #llm #privacy #tool #gpt2
🔗 Source: https://github.com/nethical6/conversation-steganography
-
Fascinating to look at this post on #HackerNews 7 years later.
-
NanoEuler – GPT-2 scale model in pure C/CUDA from scratch
-
Слишком опасный, чтобы его продавать: почему Fable (он же Mythos) всё-таки выйдет, и почему я выиграю спор
«Сначала Mythos был „слишком опасен, чтобы продавать“. Потом стал Fable „только до 22 июля“. Потом тихо исчез, сославшись на регулятора. Я поспорил с друзьями, что модель всё равно выйдет, и скоро. И жульничаю: это не утечка секретной мощи, а приём из учебника Чалдини. Разбираю по слоям, зачем так делают и почему это работает.»
https://habr.com/ru/articles/1049308/
#Anthropic #Fable #Mythos #искусственный_дефицит #психология_влияния #Чалдини #GPT2 #маркетинг_ИИ #FOMO #дефицит
-
RT @DJLougen: Hive v0.6 ist verfügbar 🐝
mehr auf Arint.info
#Agenten #AI #GPT2 #Hive #MachineLearning #OpenSource #arint_info
-
GPT-2: Too Dangerous To Release (2019)
-
Claude Mythos, Java 26 и пещерный человек с 16 000 звёзд на GitHub
Девятый выпуск еженедельных IT-новостей от OpenIDE. Милла Йовович выложила свой проект в open-source, Claude Code нашел баг в Linux, которому 23 года, Anthropic показали Claude Mythos и сразу закрыли доступ. А Skill Caveman внезапно оказался самым простым и самым эффективным инструментом недели.
https://habr.com/ru/companies/haulmont/articles/1023450/
#Claude_Mythos #Claude_Code #Java_26 #opensource #ИИагенты #токены #CaveMan #GPT2 #бенчмарки #vibecoding
-
AI doomsday cultist throws Molotov at Sam Altman’s house
-
🚨🤖 Oh no, OpenAI's GPT-2 is so perilous it's locked away like an AI supervillain! Because clearly, a rogue algorithm is the new Godzilla. 🌪️🥴
https://slate.com/technology/2019/02/openai-gpt2-text-generating-algorithm-ai-dangerous.html #OpenAI #GPT2 #AIrisks #Supervillain #TechnologyTrends #HackerNews #ngated -
Running GPT-2 in WebGL: Rediscovering the Lost Art of GPU Shader Programming
https://nathan.rs/posts/gpu-shader-programming/
#HackerNews #Running #GPT-2 #in #WebGL #Rediscovering #the #Lost #Art #of #GPU #Shader #Programming #GPU #Shader #Programming #WebGL #GPT2 #MachineLearning
-
GPT-2 implemented using graphics shaders
https://github.com/nathan-barry/gpt2-webgl
#HackerNews #GPT2 #GraphicsShaders #AIImplementation #WebGL #HackerNews
-
Moore’s Law for AI agents: the length of tasks that AIs can do is doubling about every 7 months.
These results appear robust. The authors were able to retrodict back to GPT-2. They further ran experiments on SWE-bench Verified and found a similar trend.
Read more: https://metr.org/blog/2025-03-19-measuring-ai-ability-to-complete-long-tasks
#AIBoom #AI #AIAgents #AIAgent #ArtificialIntelligence #GPT2 #MooreLaw #Tasks #DL #ML #Pustam #Raut #AIRevolution
-
Дообучаем языковую модель GPT2 с помощью Torch
Дообучаем языковую модель GPT2 с помощью Torch Доброго времени суток, в этой статье я хочу поговорить о дообучения языковых моделей. В интернете уже много информации на эту тему, но большинство подобных статей затрагивают ее поверхностно. Сегодня я попробую разобраться в этом подробнее.
https://habr.com/ru/articles/859250/
#языковые_модели #python #python3 #pytorch #дообучение #gpt #gpt2 #языковая_модель
-
KI verstehen mit Excel: Diese Excel-Tabelle zeigt dir, wie GPT-2 funktioniert
https://t3n.de/news/ki-verstehen-mit-excel-tabelle-gpt-2-1614586/ #KI #GPT2 #Excel -
Действительно ли большие языковые модели галлюцинируют? Эксперимент
Существует мнение, что основная проблема больших языковых моделей — в склонности к галлюцинациям. Когда нейросеть генерирует текст с информацией, не связанной с запросом. Меня зовут Полина, я инженер по разработке ПО искусственного интеллекта в YADRO. Вместе с коллегами я разрабатываю системы на базе генеративных моделей, в том числе вопросно-ответных ассистентов. В рамках одного из проектов мы вместе с экспертом команды Андреем Соколовым задались вопросом: действительно ли проблема галлюцинаций так актуальна для современных предобученных LLM в вопросно-ответном сценарии. Для этого мы провели эксперимент на собранном датасете. Попутно рассказали про модели-трансформеры и дали строгое определение понятию «галлюцинации LLM». Все подробности — под катом.
https://habr.com/ru/companies/yadro/articles/837744/
#машинное_обучение #искусственный_интеллект #обучение #галлюцинации #llm #большие_языковые_модели #gpt2
-
Дообучение модели GPT-2 (RUS) для генерации описаний заведений на основании названия, рубрики и оценки
В данной работе представлен процесс дообучения модели генерации текста на основе архитектуры GPT-2. Целью работы является демонстрация возможностей применения дообученной модели для генерации текстов, соответствующих определённым наименованиям заведений, рубрикам и оценкам, выставленных пользователями. Используя предварительно подготовленный датасет, который включал названия заведений, отношение к определённым рубрикам и рейтинг, мы обучили модель на генерацию описательных текстов, которые могли бы отражать характер и уровень заведений в зависимости от их оценочной характеристики.
https://habr.com/ru/articles/823952/
#finetuning #gpt #gpt2 #natural_language_processing #text_generation #русский_язык #дообучение #языковая_модель
-
The next chapter in Karpathy's tutorial explains how to reproduce a model closely resembling #OpenAI's original #GPT2.
...but I'm *NOT* trying this on a desktop with a single GPU. The README informs us that this training takes about 4 days on a beefy node with 8 x A100 40GB. Nope!
https://github.com/karpathy/nanoGPT?tab=readme-ov-file#reproducing-gpt-2
#AI #LLM #GPT -
Before launching, GPT-4o broke records on chatbot leaderboard under a secret name - Enlarge (credit: Getty Images)
On Monday, OpenAI employee Will... - https://arstechnica.com/?p=2024084 #largelanguagemodels #multimodalmodels #machinelearning #simonwillison #chatbotarena #gpt2-chatbot #gpt-4-turbo #aivibes #chatgpt #chatgtp #biz #gpt-4o #openai #gpt-4 #lmsys #ai
-
"#llm.c takes a simpler approach by implementing the neural network training algorithm for #GPT2 directly [in a single file of 1,000 lines of #C]" https://hackaday.com/2024/04/28/train-a-gpt-2-llm-using-only-pure-c-code/