Главное

самый просматриваемый пост
🔥 Самое популярное
Н
Николай Тузов
@ntuzov
12.5K

🤖 LLM под капотом: трансформер. Часть 1

Серия #llm_internals

В недавнем посте мы разобрались, что такое токены и веса, а затем закрепили в голове понятие вектора в N-мерном пространстве. Теперь давайте заглянем внутрь самой модели — как она устроена и что вообще эти миллиарды весов делают. Ключевое слово тут — трансформер!

Что такое трансформер?

Это конкретный тип нейросети, придуманный в 2017 году в Google (статья Attention Is All You Need). Это самая базовая база, которую стоит знать каждому, с этого всё началось. И с тех пор ВСЕ LLM, которые вы знаете — Claude, GPT, Gemini, Llama, DeepSeek, Qwen — это трансформеры.

Суть архитектуры хорошо передаётся названием — внутри модель буквально этим и занимается: берёт ваш промт (последовательность токенов) и постепенно его преобразует (трансформирует), чтобы финальному набору можно было предсказать следующий токен.

Делается это в три шага:

Шаг 1. Промт превращается в набор векторов (эмбеддинги)

Итак, на этапе обучения модели каждому токену из её словаря сопоставляется какой-то набор параметров (8-12 тыс, зависит от модели) или, другими словами, вектор в пространстве этих параметров. Все эти вектора хранятся в одной большой таблице — её и называют таблицей эмбеддингов.

🟢Чтобы уложить в голове, представьте что у вас есть обычное 3-мерное пространство, и вам надо каким-то хитрым образом распределить по нему набор из 10 точек. Вот для модели делают то же самое, но пространство многомерное, а точек десятки и сотни тысяч. Но принцип от этого не меняется.

🦄Главная магия этой таблицы: модель училась располагать токены таким образом, чтобы близкие по смыслу оказывались рядом. То есть, «разработчик» и «программист» — рядом, а «разработчик» и «ананас» — далеко. На этой простой идее держатся все нейросети для текста.

Итак, модель готова. Теперь, когда вы отправляете свой промт, он сначала разбирается на токены, а затем каждому токену сопоставляется вектор из таблицы. К примеру, если ваш промт состоял из 10 токенов, модель будет дальше обрабатывать набор из 10 векторов.

А ещё к каждому вектору добавляется метка позиции, чтобы их порядок соответствовал порядку слов в промте.

Шаг 2. Эти вектора прогоняются через стопку «блоков».

Блок (или слой) — это просто функция, которая каким-то хитрым образом преобразовывает (трансформирует) набор наших векторов. То есть, передвигает набор точек в пространстве. У крупных моделей их 80-120 штук.

Внутри одного блока — две операции:

- attention — каждый вектор обновляется с учётом всех предыдущих векторов из последовательности (про эту операцию подробно в следующем посте, она для нас критически важна)

- feed-forward — ещё раз обрабатывает каждый вектор уже по отдельности

Важный нюанс: внутри attention каждый вектор смотрит только на предыдущие, не на последующие. Поэтому первый токен видит только себя, второй — себя и первого, а последний всех. Это техническое свойство трансформеров-декодеров (а именно ими являются все LLM, о которых мы тут говорим).

Допустим, ваш промт был такой: "Напиши программу hello world". До преобразований вектор слова «world» — это просто копия из таблицы. А после всех преобразований числа в нём поменялись таким образом, что они зависят и от «Напиши», и от «программу», и от «hello».

(да, на самом деле, как я уже писал, модель работает не со словами, а с токенами, но такая формулировка понятней интуитивно)

То есть, точка в нашем многомерном пространстве сдвинулась в новое положение, которое учитывает предыдущие токены. Можно сказать, что этот финальный токен «получил информацию» о всех предыдущих — теперь это слово в конкретном контексте.

Именно по нему модель и считает, какой токен предсказать следующим.

Шаг 3. Генерация следующего токена

Вот мы и добрались до самого интересного! У нас наконец на руках есть абсолютно всё, чтобы сгенерировать свой первый токен, а затем и весь ответ модели целиком.

// TODO: Написать об этом следующий пост

#llm_internals

Ещё из других каналов

16 постов всего
H
Hooshex
@hooshex
1.6K

بچه‌ها، ما توی تیم لینک‌آپ یه ابزار رایگان و متن‌باز برای دولوپرهایی ساختیم که با Claude Code کار می‌کنن:

https://github.com/sepehrbayat/SEPCC

پروژه SEPCC کمک می‌کنه Claude Code رو به providerهای مختلف وصل کنید و دیگه محدود به یک مسیر یا یک مدل خاص نباشید. مثلاً می‌تونید به DeepSeek وصلش کنید که هزینه خیلی پایین‌تری داره و برای استفاده روزمره دولوپرها به‌صرفه‌تره.

از طرفی، این ابزار کمک می‌کنه sessionهاتون رو راحت‌تر ادامه بدید و وقتی پروژه crash می‌کنه یا سیستم restart می‌شه، context و مسیر کارتون از دست نره.

این ریپو به‌صورت رایگان در اختیار شماست؛ به امید اینکه به کار بچه‌های دولوپر بیاد و یه ذره از فشار ابزار، هزینه و محدودیت‌ها کم کنه.

ما تقریباً هر روز داریم آپدیت‌های جدید می‌زنیم، پس حتماً ریپو رو دنبال کنید و هر روز آخرین نسخه رو بگیرید.

اگه براتون مفید بود، لطفاً بهش Star بدید تا به دست دولوپرهای بیشتری برسه ⭐️

C
Coding & AI Resources
@leadcoding
2.9K

Useful WhatsApp channels to learn AI Tools 🤖

ChatGPT: https://whatsapp.com/channel/0029VapThS265yDAfwe97c23

OpenAI: https://whatsapp.com/channel/0029VbAbfqcLtOj7Zen5tt3o

Deepseek: https://whatsapp.com/channel/0029Vb9js9sGpLHJGIvX5g1w

Perplexity AI: https://whatsapp.com/channel/0029VbAa05yISTkGgBqyC00U

Copilot: https://whatsapp.com/channel/0029VbAW0QBDOQIgYcbwBd1l

Generative AI: https://whatsapp.com/channel/0029VazaRBY2UPBNj1aCrN0U

Prompt Engineering: https://whatsapp.com/channel/0029Vb6ISO1Fsn0kEemhE03b

Artificial Intelligence: https://whatsapp.com/channel/0029VaoePz73bbV94yTh6V2E

Grok AI: https://whatsapp.com/channel/0029VbAU3pWChq6T5bZxUk1r

Deeplearning AI: https://whatsapp.com/channel/0029VbAKiI1FSAt81kV3lA0t

AI Studio: https://whatsapp.com/channel/0029VbAWNue1iUxjLo2DFx2U

React ❤️ for more

А
Авдеева Наталья 3-НДФЛ
@buh_nata
1.6K

Искусственный интеллект рулит? Люди идут в ChatGPT, DeepSeek

Есть информация… пишет мне девушка, что если мы присоединяем долю к уже имеющейся 2004 года, срок владения у нас будет считаться по последней доле, которую получили в 2026 году. Есть письмо ФНС России, я бы с удовольствием такое письмо почитала говорю девушке.

Потому что все письма которые видела я, говорят в точности наоборот.

💰Налог с продажи квартиры, если доли в ней получены в разное время ⠀ ❓Как платить налог?  Одной долей вы владеете больше пяти (трех) лет, а другой - меньше? Когда такое может быть? ⠀ ⠀⠀П Р И М Е Р 1/4 вы владеете с 2006 г. приватизация в родительской квартире 1/4 вам достается по наследству в 2021г. 1/2 вы выкупаете у брата в 2026г.

И продаете целый объект в 2026г.

Срок владения будет считаться по первой доле, с 2006 года. А он уже прошел. Налога не будет и отчетности. ⠀ Мнение Минфина России. "Согласно ст.235  ГКРФ изменение состава собственников или переход доли от одного к другому участнику общей долевой собственности право собственности не прекращают. При этом на основании ст. 131 ГКРФ изменение состава собственников имущества предусматривает гос. регистрацию такого изменения. Моментом возникновения права собственности у участника общей долевой собственности на квартиру, является момент ПЕРВОНАЧАЛЬНОЙ регистрации права собственности на данную квартиру» Например, письмо Минфина от 05.03.2021 Nº 03-04-05/15605 ⠀ ⠀⠀✅То есть, владение считается с даты регистрации первой доли. В нашем примере с 2006 года.

✔️Самое легкое - проверить ваш срок владения на это жилье в личном кабинете налогоплательщика.

➡️Заходите во вкладку имущество, нажимаете на нужную квартиру и смотрите регистрацию права. Если там ваш давний год владения, то никаких пояснений даже не нужно. Никто отчитываться не попросит.

(
(sci)Berloga Всех Наук и Технологий
@sberlogabig
1.9K

#дайджест

Дайджест AI/ML за неделю 18-24 мая 2026

Google: Gemini 3.5 Flash На этой неделе прошел Google I/O, на котором фронтир убийцу беэнчмарков не показали (пообещали через месяц), но выпустили лучшую рабочую лошадку. Flash модель, которая теперь обходит прежний флагман 3.1 Pro на агентных и кодинговых задачах (на них был упор) со скоростью ~280 т/с. Цена $1.50/$9, сильно дороже чем раньше, но сильно дешевле чем например Sonnet. Блогпост, Карточка модели

Google: Gemini Omni Очень мультимодальная модель, текст/картинка/звук/видео на входе, на выходе пока только видео, картинки и звук обещают позже. Можно разговаривать с генератором видео, наконец-то. Блогпост

Alibaba: Qwen 3.7-Max Флагманская text-only модель под длинные агентные задачи. Опять закрытая :с 1M контекст, $2.50/$7.50 за 1M. SWE-bench Pro 60.6 (между Opus 4.6 и 4.7), Terminal-Bench 69.7 (лидер). В демо 35 часов автономной работы и 1158 вызовов инструментов. Самый низкий hallucination rate ~22.9%. Plus-версия (мультимодальная) обещана позже с открытыми весами. Блогпост, Alibaba Cloud, OpenRouter

Cohere: Command A+ первый открытый фронтир от Cohere. 218B MoE (25B активных). Объединяет четыре прежние модели (Command A / Reasoning / Vision / Translate) в одну. 48 языков, нативные ссылки на источники в ответах. Блогпост , HF

Datadog: Toto 2.0 открытое семейство моделей TSFM (time series foundation models) размерами от 4M до 2.5B. Главный посыл репорта в том что для задачи предсказания временных рядов тоже работает Scaling law и общие модели на все задачи подряд. Статья, Блогпост

Менее значительные релизы: DeepSeek: V4-Pro стал в 4 раза дешевле навсегда ($0.435/$0.87) Прайсинг ByteDance: Lance — открытая 3B-активных мультимодальная модель: понимание, генерация и редактирование картинок и видео. Статья, GitHub Perplexity: Bumblebee - оупенсорс read-only сканер ИИ-окружений. проверяет конфиги агентов, расширения редакторов и пакетные зависимости. Блогпост, GitHub Microsoft: RAMPART + Clarity - еще два опенсорс-инструмента для безопасности агентов. RAMPART - pytest-фреймворк, встраивающий ред-тим-тесты (включая prompt injection). Clarity - чат-планировщик архитектуры проектов с акцентом на кибербезопасность. Блогпост OpenAI: опровергли гипотезу Эрдёша 1946 года с помошью внутренней модели, Тимоти Гауэрс назвал работу уровня Annals of Mathematics. Статья UCSD: GPT-4.5 прошёл тест Тьюринга - его приняли за человека в 73% случаев. То есть сильно чаще чем настоящего человека🙂. Первая статья со статистически значимым прохождением. Статья Anthropic: Project Glasswing Вышел отчет по раздаче Mythos Preview. Нашли гору критичных багов, оупенсорс просит котелочек не варить, не успевают латать дыры. Artificial Analysis: Coding Agent Index новый лидерборд AA для агентных систем: Claude Code (66), Codex (65), Cursor Composer 2.5 (62), Gemini CLI (43).

Бенчмарки недели: OmniGUI (GUI-агенты с omni-modal входом), CHI-Bench (длинные healthcare-воркфлоу), Spreadsheet-RL (RL для агентов в Excel), OpenComputer (1000 верифицируемых десктоп-задач)

A
AI tools | ادوات الذكاء الصناعي
@topaitool
2.2K

💰 10$ مجانًا في DoubleWord AI! ـDoubleWord AI يقدم 10$ رصيد مجاني للمطورين عند التسجيل!

✅ بدون ربط بطاقة ائتمان ✅ بدون تحقق معقد ✅ يدعم DeepSeek 4+ ونماذج أخرى

🔗 سجل الآن واستلم الرصيد

💎 Channel (@TopAItool) #الذكاء_الاصطناعي #أدوات_البرمجة #AI #Freebie #Developers #DoubleWord

I
InNeuralNetwork
@inneuralnetwork
2.6K

Скачатьгенерить презентацию быстро, классно, давай-давай 👉

Одна презентация под две задачи почти никогда не работает. Выступление перед своими и отправка важному дядьке для чтения с экрана все же разные жанры, даже если мысль одна

Да, никуда не делись нейросети для подрезки формулировок и подбора визуала. Но их расплодилась куча, при том не все для всего подходят. А чего уж говорить, если просить целиком сделать презу с первого раза

Хороший подход для создания презентации проиходит в порядке: 1️⃣ образована тема 2️⃣ определен тип под ца 3️⃣ подготовлен текст / суфлер 4️⃣ можно делать презу

Если начинать с конца, выходит чушь — переделывать дольше, чем сделать руками. Проверял на своей старой презентации: текст и задача готовы, нужно только оформить. Вот что получилось у каждого инструмента

👑 Claude Design, когда есть готовый текст и время. Аккуратно, адаптивно, по-человечески итерируется. Сохраняет в .pdf / .pptx, понимает требования к шрифтам, передаётся в Claude Code для сверх-прикольной вставок. За запрос получаю черновик без въедливых правок, за что большое спасибо дизайн-системе работающей на отлично. Правда доступно по подписке, ждать 5–15 минут на ответ, но результат того стоит

⛏ Gemini, когда надо быстро и потом доделать в Slides. Стиль сухой на манер 2010-х, ограничения (например, только 6 слайдов) не соблюдает, зато не перегружено. Открывается прямо в Slides, легко продолжить доработать вручную

🍞 Gamma, когда нужна абракадабра — то дека, до док, то вообще веб-страница. Параметров много, детально настраиваемо, но по контексту на уровне Gemini. На выходе часто слои уезжают за края или наезжают друг на друга, так что придется удалять и переставлять. Есть следованию стиля, но оно предельно условное, скорее даже абстрактное

😵 Можно было бы подвести черту, но стоит пнуть ChatGPT. Ограничения хорошо соблюдает, но от трёх элементов на слайде начинается каша. По ощущениям это SEO-ферма для запросов вроде «презентация по биографии Льва Толстого», где между делом может всплыть факт про толстого льва. При этом картинки для презентаций лучше него никто не делает, невероятная компания

😒 Deepseek, Qwen, GigaChat, Алиса AI презентацию не сделали вообще. Только текст, по убыванию качества в этом же порядке

ПДФки можно посмотреть в первом комменте

B
Botcollection
@botcollection
1.9K

🤖 Один бот вместо пяти приложений

Всё что нужно для работы и контента — здесь:

🎬 Видео — из текста, фото, Reels и AI-аватары 🎨 Картинки — DALL·E 3, апскейл, Face Swap, удаление фона 🎙 Голос — говоришь, бот отвечает. На русском. 🧠 Мой агент — настраиваешь под себя один раз 💬 Чат — GPT-5.5, GPT-5.4, DeepSeek на выбор 💳 Оплата рублями — ChatGPT, Midjourney, Claude Pro, Netflix, Spotify

Без иностранных карт. Без головной боли.

⭐️ От 290 ₽/мес — дешевле одной подписки на ChatGPT 🆓 Первый доступ бесплатно — просто зайди и попробуй 👥 Пригласи друга — оба получите бонус @uralasiahub_bot

N
neyrokiborg
@neyrokiborg
1.9K

Сбер в конце прошлого года выложил в общий доступ свою ИИ-модель GigaChat 3 для локального запуска.

Найти его, кстати, можно тут под не совсем схожим со Сбером никнеймом компании, но это именно оно: https://huggingface.co/ai-sage ✅

Для бизнеса это огромный плюс: можно спокойно работать с внутренними документами, базами знаний и корпоративными данными внутри своего контура.

Но если хотите интересные результаты, то придётся раскошелится на серверную инфраструктуру. Для запуска самой мощной модельки локально потребуется:

Диск: от 600 ГБ свободного места, лучше 1 ТБ SSD. RAM: от 512 ГБ, лучше 768 ГБ+. GPU: желательно несколько серверных GPU. Для нормальной скорости 4-8 GPU уровня A100/H100 80GB или аналогов. CPU-only: теоретически возможно, но практически будет очень медленно. ПО: свежая версия llama.cpp

И тогда точно улетите в космос 🚀😆

По качеству и архитектуре GigaChat 3 пытается играть в одной лиге с Qwen, DeepSeek и другими современными LLM.

Что думаете, получается или пока нет? Пишите в комментах👇

A
Ai & Tech
@mediumai
311

🤖 Every AI in one Telegram bot — no VPN, no cards UltraGPT gives you access to: 🧠 GPT-5, Claude Opus & Sonnet 🧠 Gemini 2.5 Pro, DeepSeek V3 🎨 Image generation (Nano Banana) 🎬 4-second video with audio (Veo 3.1) 📜 Chat history with memory — multiple parallel sessions like in ChatGPT ✍️ Real-time streaming responses Why it matters: • Works without a VPN, from any connection • Pay with Telegram Stars — no banks, no cards, no KYC • $1 = ~1000 messages in DeepSeek or ~150 in GPT-5 • Per-token billing, no subscriptions 🎁 5 free requests on first launch

👉 Try Now!

A
AI и Технологии
@aimedium
677

🤖 GPT-5, Claude, Gemini и DeepSeek — прямо в Telegram

Без VPN, без зарубежных карт, оплата через Telegram Stars.

🎁 5 бесплатных запросов сразу 🎨 Умеет рисовать картинки 🎬 И снимать короткие видео

👉 Посмотри сейчас, чтобы не потерять!

G
Gerwin AI – лаборатория искусственного интеллекта
@gerwinai_ru
5.8K

Бесплатный чат и множество новых AI моделей ❤️

Мы точно не считали, но кол-во LLM (текстовых моделей) в Гервине уже порядка ~70. Из них более 50 было добавлено буквально вчера!

Ссылки-фильтры для личного кабинета: ➡️ Новые LLM ➡️ Все доступные сейчас текстовые модели

Теперь мы покрываем буквально весь перечень мировых компаний, выпускающих конкурентные LLM:

Большая тройка: Anthropic, OpenAI, Google.

Достаточно известные: Grok, Perplexity, Llama, Yandex.

Большой список с пропиской в Китае: Qwen, GLM, MiniMax, Kimi, DeepSeek.

Менее известные: Amazon, Mistral, Gemma (от Google), Xiaomi.

Также по обновлениям:

🟣Голосовой ввод текста 🟣Эмбеддинги от Google: Gemini Embedding 2 Preview 🟣MiniMax Voice Clone (клонирование голоса) 🟣Модели Whisper 3 и Whisper 3 Turbo (распознавание голоса)

⚠️ Значительно увеличена стабильность работы LLM-моделей

🟣 Для вашего удобства: добавлено приложение «AI Чат» — все LLM модели в одном месте, их можно менять прямо в диалоге!

🟣 И вишенка: приложение «Бесплатный AI Чат» — название говорит само за себя...

Канал в Max / Канал в ВК

Работаем дальше, ваш Gerwin AI 🫶

A
AI联盟中文群组
@chatgpt_tgai
2.5K

🦏 Rhino API — 全网最强AI模型中转站

算力不够用? 想尝试最新最强的模型又怕踩坑? 各家平台来回切换,Key一堆管不过来?

一个中转站,全部搞定。

━━━━━━━━━━━━━━━━

🔥 545+模型,一站接入

OpenAI · Anthropic · Google · DeepSeek · 字节豆包 · 通义千问 · Grok · 更多...

📝 文本对话 320+ 🎨 图片生成 99+ 🎬 音视频生成 108+ 🔍 检索模型 13+

最新模型第一时间上线 GPT-5.5 · Claude Opus 4 · Gemini 3.1 · DeepSeek V4 · Grok 4 别人还在等内测,你已经用上了

━━━━━━━━━━━━━━━━

💰 价格便宜到离谱

1U = 0.75元人民币 按量付费,用多少扣多少 同样的模型,我们价格只有官方的几分之一 不充冤枉钱,不养闲置额度

━━━━━━━━━━━━━━━━

💎 为什么选 Rhino API

⚡️ 超高并发 — 不排队、不限速、不429 🛡 高稳定性 — 专业运维,7×24保障 💰 透明计费 — 账单清清楚楚,没有隐藏费用 🔌 无缝接入 — 兼容OpenAI格式,改个地址就能用 📖 完整文档 — 5分钟上手,开发者友好

━━━━━━━━━━━━━━━━

别再一家家注册、一个个充值了 一个Key,解锁全网AI模型

👉 www.xiniuziai.com

吃瓜中心
@wuklan
2.3K

“AI造黄谣”再引热议,中国官媒下场斥责9.9元“一键脱衣”黑产

从 DeepSeek 到豆包,中国 AI 应用正在快速迭代,但随之而来的滥用问题也开始集中爆发。

近期,中国舆论场热议一个现象:有人利用 AI 生成淫秽、擦边图片和视频,并通过教程、口令、插件等方式大规模传播。央视调查指出,网上已经出现公开售卖“AI 造黄口令”的灰色生意,有人声称只需一张照片,甚至几段文字,就能生成所谓“大尺度”图片或视频。

在短视频平台上,“AI制作美女视频”“全网最强大尺度”“AI擦边赛道日入五位数”等内容层出不穷,一些教程甚至详细讲解如何规避平台审核。二手交易平台上,也有人用暗语出售相关教程,价格不到10元,却包含极其详细的操作手册。

媒体调查发现,这些口令会细致描述人物发型、表情、姿势、动作幅度等内容,并通过替换英文、暗语等方式绕过 AI 平台的基础安全限制。

被点名的平台既包括豆包等大模型产品,也包括 ComfyUI 这类本地部署工具,以及依附在视频生成模型上的辅助编辑平台。需要注意的是,这些工具本身并非专门为生成淫秽内容而设计,但其强大的图像和视频生成能力,正在被部分用户恶意利用。

更值得警惕的是,这类内容已经渗透到青少年常用平台。在 Bilibili 搜索相关关键词,仍能看到“大尺度工作流教学”等内容。有创作者甚至直白表示“学 AI 就是为了搞黄”,并在评论区向网友分发口令和插件。

AI 技术本身是工具,但当生成能力越来越强、使用门槛越来越低,平台审核、法律监管和用户责任都必须同步跟上。否则,所谓“技术进步”很容易被灰色产业快速吞噬。

C
ChatGPT 精选
@awesomechatgpt
2.9K

#rust #cli #deepseek #llm #rust #terminal #tui

DeepSeek TUI is a terminal-based coding agent that runs entirely in your command line, giving you direct access to AI-powered code assistance without needing separate software installations. It uses DeepSeek's advanced V4 model with massive 1-million-token memory, allowing it to understand and work with large codebases. The tool reads and edits your files, runs commands, searches the web, and manages version control—all through a fast keyboard interface. You benefit from real-time visibility into the AI's reasoning process, automatic cost tracking, and three interaction modes ranging from read-only planning to fully automated execution, making complex coding tasks faster and more transparent.

https://github.com/Hmbown/DeepSeek-TUI

D
Data science - Azamat
@datascience_azamat
2.7K

Biror nimani bajarish yoki o’rganish uchun ChatGPTni tekin obunasida biroz yozishsangiz limitiga yetib qoladi. Pullik varianti arzon emas.

Lekin boshqa AI lar ham bor va ularni ham belgilangan darajada tekinga ishlatish mumkin. Misol, Claude, Gemini, Deepseek.

Shuni osonlashtirish yo’li bormikan deb kecha Claude bilan gaplashib telegram bot yaratdim (birinchi marta).

Uni ishlash holatiga yetib kelishi oson bo’lmadi lekin 4-5 soat ichida MVP tayyor edi.

Bu hali birinchi versiyasi. Shu mavzudan habari borlar bo’lsa your input is appreciated.

@freegpt_uz_bot

https://github.com/azamat6037/freegpt