ИИ для чайников
Наука
ИИ и нейросети для начинающих. Простые объяснения, чат-боты, промпты и примеры применения искусственного интеллекта в обычных задачах.
Загружаем канал…
Сайт использует cookie для работы и аналитики. Мы используем файлы cookie для работы сайта и аналитики посещаемости. Подробнее в ПодробнееПолитике обработки данных и Правилах.
Наука
ИИ и нейросети для начинающих. Простые объяснения, чат-боты, промпты и примеры применения искусственного интеллекта в обычных задачах.
OneTrans от TikTok: новая модель для рекомендательных систем Исследователи TikTok представили OneTrans — нейросетевой ранкер для рекомендательных систем. Модель объединяет sequence-моделирование и взаимодействие признаков в рамках единой архитектуры, заменяя тем самым финальный ранкер в каскадном рекомендательном стеке. В отличие от традиционного подхода, где история пользователя и ручные счётчики обрабатываются отдельно, OneTrans одновременно работает с последовательными и непоследовательными данными. Архитектура модели включает токенизацию последовательностей и непоследовательных атрибутов, а затем их обработку в OneTrans Pyramid Stack. Эксперименты показали, что OneTrans эффективно масштабируется и демонстрирует рост на 5,68% per-user GMV в онлайн-A/B-тестах. Ссылки из исходного поста…
Читать целикомКак улучшить работу сжатых языковых моделей Сжатие языковых моделей трансформеров (LLaMA, OPT, GPT) важно для повышения их эффективности. Один из популярных методов сжатия — квантизация, которая уменьшает количество бит для представления весов модели. Однако квантизация без дополнительного обучения (файнтюнинга) часто снижает качество работы модели. Авторы статьи предлагают новый метод файнтюнинга: на каждом шаге обновлять только часть весов с наибольшим градиентом, а остальные «замораживать». После этого — делать большие шаги между «выжившими» весами. Так можно обновить почти все веса и достичь оптимального баланса между сжатием и качеством. Этот подход позволяет добиться хороших результатов даже при экстремальном сжатии (до 1–1,5 бита на параметр). Например, для моделей LLaMA-2 при сж…
Читать целикомПочему ИИ не говорит «Я не знаю?»: разбираемся в синдроме уверенного лжеца Иногда ИИ выдаёт недостоверную информацию с уверенностью эксперта. Это явление называют «галлюцинацией ИИ». Рассмотрим причины и способы борьбы с ним. Одна из главных причин — влияние человеческого фактора при обучении моделей. Тренеры чаще оценивали положительно развёрнутые и уверенные ответы, даже если в них были неточности. В результате модель «научилась» предпочитать выдуманный ответ признанию незнания. Ещё одна причина — эффект снежного кома: нейросеть генерирует текст последовательно, и если первое слово или факт ошибочны, то весь последующий текст будет их оправдывать. При этом у моделей часто нет встроенного механизма проверки фактов. Чтобы снизить вероятность «галлюцинаций», можно использовать несколько…
Читать целикомMamba: особенности и преимущества модели Mamba — это языковая модель (LLM), которая базируется на State Space Models (SSM). SSM позволяют эффективно работать с длинными последовательностями данных, подобно RNN, но без нелинейности, что позволяет представлять данные в виде матричных операций. Mamba объединяет преимущества SSM и Gated MLP. Работа модели выглядит так: сначала увеличивается количество каналов с помощью in projection, затем применяется 1D-конволюция и нелинейность, после чего происходит поэлементное умножение, как в Gated MLP. Таких блоков может быть несколько. Модель способна работать с контекстом до одного миллиона токенов и показывает хорошие результаты на различных бенчмарках, например, LAMBADA и PIQA. На длинных последовательностях Mamba превосходит Transformer++, а на ко…
Читать целикомMamba против трансформеров: борьба за эффективность обработки текста Трансформеры, такие как BERT и GPT, хорошо справляются с задачами обработки естественного языка (NLP), но сталкиваются с проблемами при работе с длинными текстами. Причина — рост вычислительных затрат и сложности поддержания высокой скорости обучения и инференса. Существуют различные способы оптимизации, например, линейные аттеншн-механизмы и структурированные маски токенов, но у них есть ограничения. Альтернативой могут стать Mamba и Mamba 2, которые используют другой подход к обработке длинных текстов, не требуя одновременной обработки всех токенов. Авторы статьи сравнили Mamba, Mamba 2 и классический трансформер и выяснили, что в некоторых случаях результаты Mamba сопоставимы с трансформерами, но и у неё есть трудност…
Читать целикомКак Mixture-of-Agents улучшает ответы больших языковых моделей Существует метод, который позволяет улучшить результаты работы больших языковых моделей (LLM) без их дообучения — он называется Mixture-of-Agents (MoA). Суть метода в том, что для генерации ответа используются несколько LLM. Авторы метода создали многослойную структуру с агентами-моделями на каждом слое. На вход подаётся вопрос, каждый агент генерирует ответ, а затем данные агрегируются и передаются на следующий слой. В результате получается ответ, который превосходит по качеству ответы отдельных моделей. Авторы отметили интересный феномен: модели показывают лучшие результаты, когда имеют доступ к выходным данным других LLM, даже если эти данные не слишком качественные. Это явление они назвали «коллаборативностью LLM». Экспери…
Читать целикомГеймдев стал еще доступнее — Google запустил платформу Playground, где можно создавать игры простыми промтами без кода 💻 Достаточно просто описать правила и физику текстом, нейронка собирает тайтл, и можно сразу катать в браузере на ПК или смартфоне вместе с друзьями. На подходе еще и интеграция с Unity Spark. Инди-разрабы, как настроение? 😂 Источник
🔴 Nano Banana 2.1 уже доступна в @GPT4Telegrambot Обновленный «ИИ-фотошоп» Google гораздо лучше понимает, что вы на самом деле имеете в виду, поэтому если у вас были промпты, которые ИИ никак «не брал», то сейчас самое время попробовать еще раз: 1️⃣ Перейдите в @GPT4Telegrambot. 2️⃣ В меню выберите Создать картинку → Nano Banana 2.1. 3️⃣ Опишите идею или прикрепите фото и расскажите, что изменить. 🎁 25 генераций каждую неделю бесплатно, до 100 в день — с подпиской Premium. 🐦 НГ • Подписаться Источник
Создаем имбовые лендинги без дизайнера за пару кликов — нашли сервис Scrollytelling, который делает сайты, оживающие после прокрутки. • Можно описать готовую идею или скинуть в сервис PDF, ссылку или картинки — ИИ сам соберет из этого полноценный лендинг. • Анимации привязаны к прокрутке: фон оживает, сцены меняются, элементы появляются и двигаются вслед за скроллом. Можно даже создавать трехмерную анимацию. • После генерации результат можно править: тексты, картинки, блоки, анимации. Если не нравится одна сцена, не нужно переделывать весь сайт. • Готовую страницу можно сразу опубликовать и получить свой домен или встроить в WordPress. 😶😶😶😶😶😶😶😶😶 Мастхев для создания сайтов лежит — тут. 👍 Бэкдор Источник
🔥 Потрясающе: энтузиаст запилил сервис на базе Claude, который превращает скучные учебники в интерактивные курсы. Загружаете учебник по любой дисциплине — а на выходе получаете персональный сайт для обучения. ИИ наглядно объясняет темы, а затем предлагает закрепить знания с помощью задач и квизов. Работает бесплатно. Превращаем учебу из «надо прочитать 300 страниц» в интерактив — тут Источник
Нейронки перестанут уродовать ваши фото — в сети собрали ТОП-6️⃣ промптов с лучшими техниками фиксации лица. С ними генерация сохраняет вашу внешность идеально: 1️⃣ Премиальный деловой портрет: Преврати это фото в премиальный деловой портрет. В точности сохрани мое лицо: пропорции, текстуру кожи, форму глаз, нос, губы, линию челюсти, линию роста волос и возраст. Разрешено менять только фон, освещение, кадрирование и костюм. Не сглаживай кожу искусственно и не меняй анатомию лица. 2️⃣ Кинематографичный портрет: Сделай этот кадр кинематографичным, как на объектив 85mm. Зафиксируй лицо, мимику, возраст, прическу и естественные детали кожи: они должны остаться прежними. Разрешено менять только свет, задний план, композицию кадра и цветокоррекцию. Не накладывай бьюти-фильтры. 3️⃣ Смена одеж…
Читать целиком🔥 Потрясающе: энтузиаст запилил сервис на базе Claude, который превращает скучные учебники в интерактивные курсы. Загружаете учебник по любой дисциплине — а на выходе получаете персональный сайт для обучения. ИИ наглядно объясняет темы, а затем предлагает закрепить знания с помощью задач и квизов. Работает бесплатно. Превращаем учебу из «надо прочитать 300 страниц» в интерактив — тут @bugfeature | #полезно Источник