Проветримся!

5.3K subscribers

🏙 CitySim: симуляция города на LLM-агентах

Новая работа предлагает симулятор городской жизни, где поведение жителей моделируется не жёсткими правилами, а языковыми моделями. Классические подходы к моделированию поведения людей в городе опираются на прописанные вручную правила, и это их ограничивает: реальные намерения, планы и адаптивное поведение так не воспроизвести.

CitySim использует «человекоподобный интеллект» LLM, чтобы обойти это ограничение.

Агенты составляют реалистичное расписание дня соблюдая индивидуальный баланс между обязательными делами, личными привычками и ситуацией. У них есть убеждения, долгосрочные цели и пространственная память, что позволяет вести длительные и «живые» симуляции.

CitySim это такая среда для изучения и прогнозирования городских процессов — полезно для social science, поведенческих исследований и урбанистики.

Кстати, этой весной я несколько раз делал доклад на тему «живём ли мы в симуляции». Один из главных аргументов «за», собственно, сводится к тому, что реалистичная симуляция мира это очень полезная прикладная вещь. Никакого злого умысла не нужно, достаточно того, что такой инструмент невероятно удобен для науки, планирования и прогнозов.
17👍4
Тут в комментариях вчера развернулась дискуссия про сознание, случайность и квантовые системы, а сегодня я увидел, что в Кёльне ищут аспиранта, чтобы изучать квантовую случайность.

Ну, как таким с вами в пятницу вечером не поделиться? Случайность (и алгоритмическая, и квантовая) в действии.

http://quantum-randomness.com/joinus
🔥25👍4
Audio
А скажите, братцы, нужен нам альбом генеративных спиричуалс на русском? Или мы пока не готовы к этому разговору?
👍23🔥9🤔9❤‍🔥4🤯1
Thinking Machines Миры Мурати выкатили веса модели Inkling.

Модель близка к фронтиру, но не дотягивает. Как верно заметили а комментах: TM хотят продвинуть свою платформу для дообучения Tinker как часть дата-стратегии энтерпрайза.

Отдельная фишка — моделька умеет работать с голосом. Я последние полгода много думаю про то, что голосовые интерфейсы в ближайшее время должны сильно поменяться и такие вот релизы эти изменения приближают.

Самое важное тут то, что это открытые веса от американской фронтирной нео-лабы. Лёд тронулся, энтерпрайз осознал, что хочет разворачивать модели в своей инфраструктуре, лучше контролировать свои затраты и данные. Лабораториям нужно на это реагировать. После повышения цен Антропиком десятки крупных американских компаний переключились на китайские модели на своей инфраструктуре. Даже пошли слухи, что администрации Трампа стоит ввести export controls для моделей из Китая. А тут Thinking Machines с их Inkling тут как тут.

https://thinkingmachines.ai/news/introducing-inkling/
👍3342🔥1
Люблю N26. Давно ими пользуюсь и доволен.

У них обновилась рефералка, так что если вы ещё не там, заходите. Обещают 60 евро на счёт.

Каждый, кто придет к N26 по рефералке до конца июля покроет нам монтаж двух выпусков. А если вас таких придёт больше 10, обещаю запустить короткие видео. Давно хочу, а руки не доходят.

Ivan has invited you to join N26. Create your account today and get €60!

https://n26.com/r/ivany4506?cid=P0Z&lang=en
❤‍🔥11🤔9👍5🦄1
В еженедельной по нынешним временам рубрике “big, if true” вот вам новая статья от исследователей из EPLF и университета Джона Хопкинса.

Можно дообучить генеративную нейронку так, чтобы сгенерированное видео стимулировало сильнее нужную вам область голосного мозга зрителя.

Ждём выход нейро-слопа на новый уровень.

https://nevo-project.epfl.ch/
❤‍🔥12🤔9👍52
Поговорили с Евгением Датским, CTO CarbonHQ, про экономику вокруг выбросов углерода.

Что такое углеродные кредиты, как они работают и как меняют жизнь людей в развивающихся странах.

https://youtu.be/ZqF6NueQb-M
186👍3
Стартап Conception заявляет, что смогли получить яйцеклетки из стволовых.

Big, if true, как говорится.

Мы уже умеем сбрасывать клетки до «заводских настроек» и получать стволовые. Если из стволовых клеток можно будет получать яйцеклетки, это огромный прорыв в решении проблем фертильности.

https://x.com/conception/status/2071962376090595685
🔥37👍10🤯9🦄3
За неделю два анонса про то, как вынимать мысли из головы, без участия языка или пальцев.

Meta показала Brain2Qwerty v2. Человек сидит в МЭГ-шлеме, думает про набор текста, а модель восстанавливает предложения. Сверху языковая модель, дообученная на нейроданных: T9 для мыслей. Обещают 61% точности там, где у прежних неинвазивных методов было 8%. Статья вышла в Nature. Цель вернуть речь тем, кто её потерял.

Почти одновременно стартовал Aleph лаборатория из пяти человек, называющая себя строителями интерфейсов «для телепатического будущего». При помощи ультразвука и контрастного вещества ребята сделали «самые детальные снимки мозга, когда-либо сделанные снаружи черепа». Посмотрите видео, если не видели. Картинка завораживает.

Пока это карта сосудов; дальше, само собой, обещают неинвазивно мысли читать.

Парадоксально, что оба решения упираются в «бутылочное горлышко» языка, хотя интуитивно самое интересное в интерфейсах мозг-компьютер это именно вопрос о том, можно ли работать с мыслями без вербальной компоненты.

Как по мне, read-only интерфейс «мозг-компьютер» осмыслен ровно настолько, насколько он расширяет наш канал ввода. В каком-то смысле вся история связи это история расширения канала: телеграфист настукивал пару битов в секунду, информация по сети шла медленно, оптоволокно увеличило пропускную способность на десять порядков. Узким местом давно стал не сам канал, а человек на его конце быстрее, чем мы превращаем мысль в слова, новые смыслы не создаются.


Генеративный ИИ даёт надежду на частичное решение этой проблемы. Мы запускаем кучу моделек, чтобы они делали что-то полезное, не особо упираясь в ограниченные возможности ограниченного количества человеческих мозгов на планете.

Телепатия — мечта давняя, но если интерфейс мозг-компьютер просто позволяет печатать, только медленнее, то это пока не то будущее, о котором мы мечтали.

Две большие новости, которых я жду: когда появятся результаты, позволяющие что-то в мозг записывать, и когда кто-то покажет, что интерфейс мозг-компьютер позволяет делать ввод быстрее, чем просто речь.
❤‍🔥14👍13🔥6🤔52
Вот ещё редкий контент выходного дня.

Мы с Митей Пузыревым сделали новый EP. Как нынче полагается, в коллабе и генеративными модельками. Тексты написаны белковыми сетями (четыре моих и один Андреева), а вот музыка результат совместной работы.

https://artists.landr.com/991048163508
14🔥10👍32
Если есть желание попрактиковаться в аудировании немецкого акцента на английском, мы выложили второй эпизод Bits of Ethics.



https://youtu.be/voILEc-nz3U
18
Мы в Pleias, кстати, по случаю VivaTech сделали синтетических бельгийцев вместе с NVIDIA.

https://pleias.ai/blog/nvidia-nemotron-personas-belgium
🔥1853👍3
Между свободой и безопаностью

После первого релиза DeepSeek я начинал лекции слайдом «Интересные времена». После DeepSeek мы живём в мире, где non-profit из Калифорнии продаёт миллионам людей доступ к модели за деньги, а хедж-фонд из Ханчжоу выкладывает свою модель в опен-сорс и, судя по всему, зарабатывает на шорте американских ИИ-компаний.

На днях Z.ai выложила GLM-5.2. Лицензия MIT, контекст миллион токенов, в разы дешевле фронтира. По бенчмаркам модель где-то между Opus 4.7 и 4.8. По сути, уже пару лет модели с открытми весами отстают от фронтира на несколько месяцев. Субъективно, отставание это сокращается.

Интересен этот релиз тем, что он происходит на фоне «отключения» Fable 5.

Я недавно задумался, что та организация, которую мы называем «коммунистическая партия китая» дословно на китайском называется 共产党, «партия общего производства». Обобществление средств производства прямо в названии. А если ИИ в постиндустриальном мире и есть средство производства, то ставка на открытые веса оказывается красивым ситуативным совпадением.

Интересно тут то, что raw capitalism, тот самый, что дал штатам отрыв на фронтире, медленно превращается в capitalism well done. Чем жёстче нормы и чем активнее государство лезет в экономику и технологии, тем тяжелее держать скорость на переднем крае. Парадокс в том, что Китай регулирует ИИ плотнее, чем даже ЕС, но регуляторное давление он осуществляет на конечные юзкейсы, а веса при этом раздаёт.

https://z.ai/blog/glm-5.2
11👍3623🔥9🤔41
Тем временем три часа назад муниципальная IT компания Рио выложила свою модельку на 375 миллиардов параметров и на некоторых бенчах по их оценкам она обходит kimi-k2.6 и qwen 3.7

Как правильно заметили в комментариях, это файнтьюн Qwen 3.5 при этом на бенчах он обходит 3.7 Plus от Alibaba.

Чуваки из бразильской госухи дотьюнили китайский квен 3.5 лучше, чем создатели 🙃


https://huggingface.co/prefeitura-rio/Rio-3.5-Open-397B

big, if true, как говорится.
👍4013🤔7🔥1🤯1
This media is not supported in your browser
VIEW IN TELEGRAM
Европейцы после того, как им отключили доступ к Fable 5

А если серьёзно: не хотите, чтобы по мутным причинам вас лишали доступа к модели, — используйте открытые веса.
👍2716🦄4🤔3🔥2
Anthropic Fable 5. Пилите, Шура, пилите, они золотые!

Anthropic выпустили Claude Fable 5, публично доступную версию модели, которую в апреле сами же объявили слишком опасной для широкого релиза и выдали узкому кругу партнёров.

Fable 5 это Mythos с предохранителями. В рискованных областях вроде кибербеза и биологии запросы автоматически перенаправляются на Opus 4.8. Аналитики говорят, что даже если стараться, редирект случается меньше чем в 5% сессий, так что обычный пользователь вряд ли заметит.

Цена в два раза выше Opus 4.8 

Сейчас Fable 5 самая дорогая модель на рынке. Mythos Preview ещё раза в два дороже.

Полтора года индустрия жила в логике «интеллект дешевеет на порядок в год, цена токена не важна». Логика на наших глазах ломается о паттерны использования. Агентные системы дробят запрос на подзадачи, и токены текут рекой. Uber, например, сжёг весь годовой бюджет на ИИ за четыре месяца. «Вот такой вот tokenmaxxing, малята!».

То есть цена за токен, конечно, падает, только вот счёт в конце месяца растёт.

Кажется, где-то полгода назад мы в подкасте упоминали парадокс Джевонса: чем доступнее ресурс, тем больше его потребляют.

Понятно, что для каких-то задач дополнительное «мышление» модели окупается. Только вот Fable 5 сейчас реально нужна примерно для пяти процентов корпоративных задач. Остальные девяносто пять это извлечение данных из документов, классификация, рутинная обработка. Гонять на этом Mythos-class модель это как заказывать консультанта из McKinsey, чтобы он разбирал входящую почту.

На этом фоне наш с Pleias тезис вокруг data efficiency начинает играть новыми красками. Маленькая модель, обученная на правильно подготовленных данных, решает конкретную задачу не хуже фронтирной, но в инференсе обходится на два-три порядка дешевле. Пока токены были «почти бесплатными», этот тезис звучал академично. Теперь, кажется, картина резко меняется.

Релиз Fable 5 фиксирует новую структуру рынка.

💰Наверху фронтир по цене бизнес-класса, для задач, где ошибка дороже токенов.

🫯Посередине будет больно, потому что там окажутся прошлые поколения фронтирных моделей, специализированные файнтьюны и открытые модели побольше, а также все неудачные попытки сделать yet another foundational model.

🛡️Внизу маленькие специализированные модели для кейсов, которые энтерпрайз считает своим уникальным торговым предложением, где у него есть «ров», прикрывающий его от конкурентов.

Anthropic, кстати, эту структуру прекрасно понимает. Fable 5 включили в подписки Pro и Max бесплатно, но только до 22 июня. «Попробуйте бизнес-класс за наш счёт, потом поговорим о цене». 💸
👍4320👾6
Матвей Кукуй — CEO и сооснователь платформы для оркестрации ИИ агентов Archestra AI.

Мы поговорили с Матвеем пару недель назад, потом я был в разъездах с паршивым интернето. Вот, наконец, удалось выложить наш разговор. Кстати, на днях Матвей с командой подняли 10 миллионов долларов венчурных инвестиций. Поздравляю ребят, они оч крутые и разговор вышел очень душевный.

https://youtu.be/oY7iH-rmuX4
126🔥15👍8
«Ничего не будет, будет одно сплошное телевидение»

Anthropic Institute выкатил эссе «When AI builds itself» — про то, как они используют модели, чтобы улучшать модели.

Из очевидного:

🔝 Claude пишет 80%+ кода. До запуска Claude Code в начале 2025-го было пару процентов. Соответственно, инженер в Q2 2026 отгружает в день в 8 раз больше кода, чем в 2024-м.

Прикольный внутренний тест: дают модели код предыдущей и просят ускорить. С ~3x в мае 2025 выросли до ~52x в апреле 2026 (Mythos). Человеку на 4x нужно где-то 4–8 часов.

Приводят три дальнейших сценария развития:

💨 тренд выдыхается, а модели начинают расходиться по экономике;
📈сложный процент на прирост эффективности — сами считают наиболее вероятным;
🦾 модель сама строит себе преемника.

Отдельно: «мы непрочь притормозить, если все притормозят».

Всё это на фоне черновика S-1 поданного в SEC. Ну, вы поняли.

Астрологи объявили сезон рассказов про будущее. Сейчас с Business FM про это поговорим.
24👍15🦄4
Loading…