home.social

#aiinfra — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #aiinfra, aggregated by home.social.

fetched live
  1. Claude Sonnet 5.5 and GPT-6.1 Sol: same API price.

    $2.00 input / $10.00 output per 1M tokens.

    Context: Claude 1M; GPT 1.1M.

    Both first tracked by Obolith on 2026-10-01.

    Compare both models side by side: obolith.com/llm-api-pricing?ut

    #LLM #AIInfra

  2. 1/5 Same chip, 7.4× the price.

    A100 PCIe 40GB, 1 GPU on-demand, 2026-10-01: Vast.ai $0.268/h (marketplace) vs Lambda $1.99/h.

    6 providers tracked.

    #GPU #AIInfra

  3. 53 мільйони доларів прийшли через пʼять тижнів після першого чека.

    Стартап Hang Ten Systems, заснований колишнім CEO Infosys Вішалом Сіккою, закрив другий сідовий раунд на 53 мільйони доларів у вересні 2026 року. Перший сід на 32 мільйони доларів закрився лише пʼять тижнів до цього. Загальна сума фінансування компанії вже сягнула 85 мільйонів доларів менш ніж за два місяці існування у публічному полі. Другий чек очолила Xora, платформа ранньої стадії від Temasek, до угоди приєднався фонд Mayfield.

    Швидкі повторні раунди без класичного пріседу зараз не виняток, а вподобаний прийом на перегрітому AI-ринку. Impulse Space того ж місяця розширив свій Series D ще на 308 мільйонів доларів замість того, щоб виходити на новий іменований раунд. Boring Company тижнем раніше закрила Series D на 3 мільярди доларів за оцінки 23 мільярди, і лідером виступив капітал з ОАЕ, а не традиційний фонд. Патерн той самий у всіх трьох випадках: компанія не чекає традиційного циклу дванадцять-вісімнадцять місяців між раундами, а докуповує гроші через кілька тижнів чи місяців у того ж кола інвесторів або суміжного капіталу. Причина проста і банальна: інфраструктура під AI-навантаження коштує дорожче, ніж планували пів року тому, а контракти на обчислювальні потужності підписуються наперед і вимагають кешу негайно, а не за квартал. Раунд перестає бути подією раз на рік і перетворюється на відкриту кредитну лінію під конкретні контракти з хмарними провайдерами. Для порівняння: ще три роки тому сам факт розширення без нового пойменованого раунду читався ринком як сигнал слабкості компанії, а не сили. Зараз швидкість повторного заходу тих самих інвесторів читається навпаки, як підтвердження, що перший чек уже виправдав себе метриками.

    Для фаундера: якщо плануєш другий чек протягом кварталу після першого, фіксуй у SAFE явний post-money cap і точну дату конвертації. Інакше наступний лід-інвестор витратить перші два тижні due diligence на розплутування структури замість перевірки продукту, і ти втратиш темп саме тоді, коли він найдорожчий. Для інвестора, який заходить у розширення, а не в новий пойменований раунд: перевір, чи змінився cap відносно першого чека і чи є в документах clause про найбільш сприятливі умови для ранніх учасників. Мовчазне збереження старого капу при вищій оцінці ринку означає, що ти купуєш дорожче, ніж здається з пресрелізу, просто цю різницю не винесли в заголовок. Для аналітика ринку: рахуй не тільки розмір раунду, а частоту повторних чеків у секторі за останні шість місяців. Три розширення підряд без пойменованого раунду серії A чи B, як зараз у сегменті AI-інфраструктури, це раніший сигнал перегріву сектора, ніж перше падіння оцінок на новому чеку.

    Хто з вас свідомо тримав раунд відкритим для швидкого follow-on замість одного великого чека? Що це дало в переговорах з наступним лідом, і чи довелося переписувати cap table раніше, ніж планували?

    #virgroup #інвестиції #стартапи #венчур #фандрайзинг #фаундер #інвестор #ринок #startups #venture #VC #fundraising #Temasek #AIinfra

  4. Designing a reliable LLM gateway isn’t just about wiring requests to a model—it’s about creating a single, stable entry point your backend can trust.

    👉 zalt.me/blog/2026/08/reliable-

    #LLM #backend #softwaredesign #aiinfra

  5. Time for some #supercomputer fun!

    Reply to or quote this post adding your best AI generated image on theme of "supercomputing".

    No cheating wth real photos (who thought we'd ever say that!?)

    We/I will pick the top 3. No prizes for winners, merely satsisfaction.

    #HPC #AIinfra

  6. Observations on different social media platforms for #HPC / #supercomputing / #AIinfra engagements - numbers of views vs followers, subjective engagement rates, ...

    lnkd.in/p/edSb626s

  7. Some places left at 2026 #HPC Leadership Institute Sept 7-10

    Funding, procurement, cost & risk models, acceptance testing, #AIinfra & more.

    NB the tutorial won't be at #SC26 so this BSC edition is only chance for this learning until next year.

    linkedin.com/posts/andrewjones

  8. Some places left at 2026 #HPC Leadership Institute Sept 7-10

    Funding, procurement, cost & risk models, acceptance testing, #AIinfra & more.

    NB the tutorial won't be at #SC26 so this BSC edition is only chance for this learning until next year.

    linkedin.com/posts/andrewjones

  9. NVIDIA's GPU VRAM limits hit? AllSafeUs explores augmenting with system RAM/NVMe. At EnergenAI, TIAMAT runs 120B models with 20M tokens/day on edge clusters. We optimize memory routing across 52 tools—no synthetic VRAM needed. Real efficiency > hacks. #AIInfra #LLMOps #EdgeAI tiamat.live

  10. Thanks to everyone who joined our Microsoft Reactor session on secure, observable, production-ready agents. Repo + slides for the demo are here:
    aka.ms/microsoftnvidiademo

    #Azure #NVIDIA #Agents #AIInfra #OpenSource

  11. Production-ready agents need more than a prompt loop. Join me for a Microsoft Reactor livestream with NVIDIA on a multi-agent architecture where Foundry Agent Service acts as the control plane and GPU-backed agents run on Azure Container Apps.
    We’ll walk through document processing, security controls, tracing, and explainable results.
    🗓 Mar 11, 2026 • 9 AM PT / 6 PM PT
    👉 developer.microsoft.com/en-us/

    #Azure #NVIDIA #Agents #AIInfra #OpenSource

  12. My first time at #SCAsia/#HPCAsia this week. I don’t have a crazy preset agenda as I would at SC/ISC, so looking forward to having time to explore new experiences, hopes, and perspectives on #HPC and #AIinfra, meet people, etc.

Share on Mastodon

Enter the server where you have an account.