أبرز خبر

المنشور الأكثر مشاهدة
🔥 الأكثر شيوعًا
A
AI Projects
@turboproject
3.9K

Как я и предсказывал, начался постепенный отказ от фикс-тарифов у вендоров LLM. Расчет через токены сразу же внедрил DeepSeek, но при его цене за копеечные токены это дешевле любого фикса.

Сейчас GLM отменяет фикс-тарифы и по факту переходит на продажу токенов через «кредиты», просто есть скидка на покупку токенов по подписочной модели.

В самой большой зоне риска тут находятся пользователи Claude, т.к. переход с фикс-тарифа на оплату токенов сразу увеличивает расходы на LLM примерно в 10–15 раз. Для юрлиц Дарио уже запретил фиксы, он также банит аккаунты, если несколько аккаунтов работают с одним кодом, поэтому никакие VPN/VPS и левые карты оплат тут не помогут для обхода.

Вопрос: отменит ли Дарио фиксы совсем? Безусловно, отменит. Просто Anthropic — это «премиальный игрок». Если даже эконом перешел на честную модель через токены, то премиальные игроки точно перейдут.

Для вендоров LLM на деле себестоимость зависит прямо от потребления токенов, поэтому другие варианты продажи инференса и еще в убыток им не интересны. Инвесторы же начинают заставлять вендоров LLM прекратить дотации на фикс-тарифы за их счет и начинать нормальный здоровый бизнес с прибылью.

Правда тут и начинается «момент истины», когда выясняется, что себестоимость инференса у вендоров плавает даже не в 10 раз, тот же DeepSeek имеет себестоимость в 60–100 раз ниже американцев, как я показывал в посте про KV Cache. Поэтому не стоит даже ожидать, что премиальные LLM будут стоить даже в 5 раз дороже, они будут скорее в 50 раз дороже бюджетных.

Ко всем этим изменениям нужно уже готовиться, т.к. отмена фиксов происходит как у GLM в режиме #внезапно. Просто так перевести агента какого Opus на DeepSeek может не получится, т.к. если Opus может работать на кривых промптах, то бюджетные LLM уже весьма чувствительны к квалификации управления ими. В любом случае тут стоит начинать получать опыт, если у вас его еще нет. При оплате по токенам запускать для тех тестов Opus будет только ненормальным.

https://docs.z.ai/devpack/notice/usage-revision

المزيد من قنوات أخرى

165 منشور إجمالًا
Н
Нейросила & Neiroseti
@n_seti
63

🎮 Четыре нейросети построили кубик Рубика и сыграли в шахматы — кто победил

GPT-5.6 Sol, DeepSeek V4 Flash 0731, Qwen 3.8 Max и Kimi K3 проверили в необычном тесте: каждая модель создала интерактивные стенды на Three.js для кубика Рубика и шахмат, а затем решала задачи внутри своих же приложений.

Кубик Рубика: • GPT-5.6 собрал за 24 хода и 17 секунд • DeepSeek справился за 32 хода • Qwen сдался после 96 ходов • Kimi не смог решить даже за 207 ходов

Шахматы против Claude Opus 5: Все четыре проиграли. Дольше всех держался Qwen — до 29-го хода. DeepSeek капитулировал уже на 13-м.

💰 По скорости разработки GPT-5.6 оказался быстрее всех — 16 минут 43 секунды. DeepSeek потратил 97 минут, Kimi — 166, Qwen — 215.

DeepSeek использовал 27,4 млн токенов и пять попыток, чтобы создать рабочие стенды. При этом весь эксперимент обошёлся в $0,56. Для сравнения: GPT-5.6 потратил $6,32, Qwen — $10,27, Kimi — $16,67.

Каждая модель показала свой профиль: GPT-5.6 — быстрый и экономный, но пропустил баг с исчезающими фигурами. DeepSeek — ошибается с первого раза, зато может повторять попытки почти бесплатно. Qwen — медленный, но аккуратный в шахматах. Kimi — самый дорогой, активно проверял себя, но не справился с кубиком.

Иногда важнее получить результат за 17 минут. Иногда — сделать пять попыток за полдоллара. Эксперимент проводили в Hermes Agent CLI, это не стандартизированный бенчмарк.

A
aishnabykukurudza
@aishnabykukurudza
506

Халявний доступ до DeepSeek V4 Flash до кінця 2026 року ⚡️

Tencent Cloud відкрили безкоштовний і необмежений доступ до однієї з агентних AI-моделей у сервісі CodeBuddy. Без прив'язки картки та без підписок.

Як підключити: 1️⃣ Заходьте на cnb.cool та відкривайте будь-який репозиторій 2️⃣ Викликайте бота @codebuddy 3️⃣ Активуйте режим «працюй за мене»

Зважте, що авторизація йде через китайську платформу, тому приватні дані чи чутливий код туди краще не заливати.

Приємного користування!

A
AI Projects
@turboproject
1.7K

📈 В X утекли материалы для инвесторов DeepSeek, правда подлинность их проверить невозможно. Однако они проливают свет на то, почему DeepSeek намерен повысить цены. Лян Вэньфэн считает, что релиз DeepSeek V4 Pro будет сильнее Claude Fable 5, поэтому нет смысла дешевить, т.к. продукт Anthropic хуже.

Из проспекта бенчи Terminal-Bench 2.1: около 83,5% Fable 5 — 83,8%. DeepSWE: около 69,7% Опубликованный тест pass@1 для Fable 5 — 69,9%. SWE-bench Pro: около 80,1% Fable 5 — 80,3%.

Скорее тут равенство с Fable, но само по себе его уже показывает Kimi K3, поэтому цены на Pro-модель вряд ли будут выше.

Однако более серьезный вопрос цен на DeepSeek V4 Flash. Если «фронтирных моделей» вообще-то как грязи, то вот LLM для worker-агентов быструю и дешевую, пригодную на большое развертывание по числу пользователей в Enterprise, вообще найти сложно. По факту в этой нише DeepSeek сейчас создал что-то вроде монополии. Однако она базируется именно на низкой цене. Если DeepSeek повысит цены на Flash резко, то потеряет большую рыночную долю в токенах, т.к. другие китайцы займут его место.

新闻财经-东南亚
@cctv_finance
16

DeepSeek拟大幅上调API价格 行业低价竞争时代落幕

8月6日,据《金融时报》消息,DeepSeek官宣将在近期大幅上调旗下API服务整体定价,具体涨幅与落地时间尚未公示。此举意味着深耕低价市场近两年的DeepSeek,正式告别性价比竞争策略。

据悉,目前该平台已实行峰谷定价模式,工作日高峰调用价格翻倍,两大主流模型均按缓存状态差异化计费。梳理调价历程可见,2024年4月其价格跌至行业谷底,2026年4月再度大幅降价,6月底预告新版上线后调价,7月中旬V4正式版上线并落地峰谷定价机制。

工信部专家盘和林指出,此次涨价具备行业标志性,核心诱因是算力、运营等综合成本上涨。2026年AI行业成本持续攀升,低价拓客模式已然失效。年内智谱、月之暗面等多家大厂已多次调价,行业整体从低价抢量,转向兼顾成本与收益的商业化发展新阶段。

P
PIMENOV.RU
@pimenov_ru
124

Миша Иванов — человек из моей команды, который всё новое проверяет руками, а не по обзорам.

В начале года он купил Mac Studio M3 Ultra с 256 ГБ памяти и услышал закономерный вопрос: зачем, если за те же деньги можно взять подписку на Claude на два года? Ответ оказался простым: он покупал не одну модель, а место, куда каждый месяц можно ставить новую и проверять её на реальной работе.

Что из этого вышло за несколько месяцев:

— на MiniMax M3 он собрал DAWalka — бесплатный генератор музыки и звука для Mac, сначала плагин для Logic Pro, потом отдельное приложение

— подключил свежий DeepSeek v4 Flash к своим компьютерам в локальной сети, и тот за двадцать минут нашёл почти 200 ГБ забытых кэшей, старых моделей и окружений — с отчётом, а не с самовольным удалением

— попросил ту же модель разобраться в пайплайне генерации видео в ComfyUI и сократил время примерно вдвое.

Главная мысль Миши мне особенно нравится: локальная модель не обязана выигрывать бенчмарки. Ей достаточно помочь пройти путь от идеи до вещи, которую можно запустить и отдать людям. А данные при этом остаются на твоём компьютере.

Очень рад, что в команде есть такие люди — те, кто вместо споров о моделях просто собирает работающий инструмент.

Читайте рассказ Миши: Локальные модели в работе: Mac Studio, DAWalka и DeepSeek — рассказ Миши Иванова

A
AI Projects
@turboproject
2.3K

DeepSeek планирует значительно повысить цены, об этом уже разослал уведомление клиентам. Это не связано с тем, что они работают в убыток. Ранее я публиковал и данные The Information, что они имеют 80% маржу, и показывал на калькуляторе KV Cache, как выходит удивительный эффект их себестоимости ниже в 60 раз американских архитектур LLM.

На самом деле цена на рынке определяется не себестоимостью, а конкуренцией. Сейчас в цене DeepSeek V4 Flash работает только Xiaomi MiMo-V2.5. Однако по Xiaomi как раз есть сомнение, что они в плюсе, т.к. не применяют таких мощных технологий оптимизации.

Вопрос — на что ещё повысит цену DeepSeek. Если на Pro-модель, то это несущественно. Максимальный эффект от их Flash-модели, которая фактически лучшее на рынке решение для worker-агентов сейчас.

DeepSeek, похоже, рассчитывает, что Pro-модель также войдёт в лидеры бенчмарков, т.к. уже релиз Flash выступил наравне с грандами. Плюс у DeepSeek пока ещё в тестах их мультимодальная версия, но она есть и доступна на веб-сайте. Строго говоря, если DeepSeek V4 Pro сейчас повторит сенсацию Kimi K3, когда тот побил Fable 5 в куче бенчмарков и leaderboards, то было бы и странно сохранять старые цены, если ты уже в списке лидеров. Однако это надо ещё доказать рынку рывком в качестве.

https://www.bloomberg.com/news/articles/2026-08-06/deepseek-plans-significant-price-increase-for-its-ai-services

Д
ДжедAI / JedAi / AI / ШІ / штучний інтелект/ нейронні мережі / нейромережі
@jedaiua
794

DeepSeek V4 Flash безкоштовно до 31 грудня 2026 👨‍💻

CodeBuddy від Tencent Cloud роздає доступ до DeepSeek V4 Flash безкоштовно і без обмежень аж до кінця року. Без картки, без підписки.

Що отримуєте: — DeepSeek V4 Flash необмежено — одна з найкращих агентних моделей за співвідношенням ціна-якість зараз — безкоштовно до 31.12.2026

Як підключити:

🔗Заходите на cnb.cool, відкриваєте будь-який репозиторій 🔗Викликаєте @codebuddy у репозиторії 🔗Вмикаєте режим "працюй за мене"

⚠️Реєстрація/авторизація відбувається через китайську екосистему — якщо працюєте з чутливим кодом чи даними, зважте це перед підключенням.

A
AI Projects
@turboproject
2.6K

♟ Какие модели лучше играют в шахматы и почему это важно?

На деле всех удивил DeepSeek-v4-flash-0731, который обыграл в шахматы Claude Fable 5, GPT 5.6 Sol и Kimi-K3.

Лидером среди моделей-шахматистов является Gemini. Теперь почему это важно и в дискуссиях у экспертов. Довольно хорошо известна позиция Anthropic, которая сводится к тому, что «реальный бизнес-код тупой» (не имеет значительной алгоритмической сложности). Поэтому Anthropic перестал обучать модели на чистую сложную алгоритмизацию, и Claude сильно просел в олимпиадном программировании Codeforces. Но в целом это ни хорошо, ни плохо — просто Дарио решил, что сложные алгоритмы не его тема, т.к. она узкая. Однако в сложную алгоритмику продолжали играть Google, OpenAI и DeepSeek. В случае GPT 5.6 Sol многие заметили, что OpenAI не опубликовал рейтинг Codeforces, и именно по шахматному рейтингу некоторые эксперты считают, что OpenAI также вышел из игры сложной алгоритмики. Просто эксперты считают, что есть наблюдаемая корреляция между игрой в шахматы и чистой алгоритмизацией. Действительно, gpt-5.1-codex показывал лучший шахматный рейтинг сразу за Gemini и играл лучше DeepSeek. GPT 5.6 Sol стал хуже него, и если корреляция есть, то стал хуже и в Codeforces.

На мой взгляд, фактическая позиция Амодеи и Альтмана, что сложная алгоритмика по факту «маргинальная», вряд ли хорошая практика. Обычно научные алгоритмы как раз часто сложные вычислительно, и там чистая алгоритмика как раз. Сейчас научные разработки могут уйти к Gemini и DeepSeek. Каким бы узким сегментом это ни было, довольно очевидно, что он стратегический.

https://dubesor.de/chess/chess-leaderboard

C
chat_gptm
@chat_gptm
34

🔴 При недоступности Telegram используйте сайт neuralbox.ru.

Вы можете использовать все наши сервисы на разных платформах 🍏 iPhone ✉️ VK-приложение Ⓜ️ Max-бот 🧑‍💻 API 🌐 Сайт

Эти боты решат любые задачи – от креатива до поиска информации:

🖼 ИЗОБРАЖЕНИЯ 🍌 Nano Banana 2 Pro — сохраняет лицо с фото 📹 Seedream 5 Pro — точный текст на картинке 💻 GPT Image 2 — лучшая генерация на сегодня 👩‍💻 Midjourney 8.2 — создавайте шедевры 💫 StableDiffusion — уникальные картинки

🎬 ВИДЕО 📹 Seedance — плавные кинематографичные ролики 📼 Kling AI — текст в видео, повтор движений 🎲 HeyGen — перевод видео 🎞 Google Veo 3.1 — видео с голосом и музыкой 🎞 Runway Aleph — редактируйте видео словами 🐎 Happy Horse — из видео, фото и текста 📹 Gemini Omni — аватар с вашим лицом и голосом 💻 Sora 2 — от OpenAI, без водяных знаков

🎵 МУЗЫКА 🎵 Suno AI — сочиняйте песни 🎵 Mureka AI — музыка и вокал по тексту 📹 Lyria 3 — музыкальная модель Google

📝 ТЕКСТ 💻 GPT-5.6 — текст с файлами и картинками 🖥 Claude Fable 5 — мощный альтернативный AI 🖱 Perplexity — поиск с источниками 🖼 YandexGPT — российская модель Ⓜ️ Meta — Llama — открытая модель ✨ Gemini — модель Google

🎙 ОЗВУЧКА И РЕЧЬ 🗣 Eleven Labs — озвучка и клон голоса 📝 Whisper Voices — аудио в текст

🧰 ДРУГОЕ 🎛️ Все нейросети в одном боте — полный набор 🕵️ Инста-шпион — смотрите незаметно 🔍 Поиск по фото — нужная инфа за секунды

Без подписок и повторяющихся платежей — оплата только за то, что используете.

#DeepSeek #Wan #GLM

O
OMG GPT: Midjourney, DeepSeek, IT
@omggpt
165

DeepSeek V4-Flash оказался дешевым до неприличия

После выхода DeepSeek V4-Flash был логичный скепсис: да, токены дешёвые, но модель слишком многословная. На прохождение Intelligence Index она потратила 210 млн выходных токенов при медиане 62 млн. Казалось, такая «любовь поговорить» легко съест всю экономию.

Не съела.

Artificial Analysis посчитала не цену токена в вакууме, а среднюю стоимость решения одной задачи с учётом реально потраченных токенов. В индекс вошли 9 проверок: научные вопросы, программирование, работа в терминале, многошаговые профессиональные задачи и другие сценарии.

Результат по цене и качеству получился такой: — DeepSeek V4-Flash: 50 баллов, $0,03 за задачу — Kimi K3: 57 баллов, $0,86 — GPT-5.6 Sol: 59 баллов, $1,86 — Claude Fable 5: 60 баллов, $3,15

Важно: 50 баллов в Intelligence Index не означает, что модель решила ровно половину заданий. Оценка взвешенная: агентные задачи дают 34%, программирование и научные вопросы — по 24%, общие знания и рассуждения — ещё 18%.

Да, DeepSeek отстаёт от верхушки на 9–11 пунктов. Но дальше начинается самая неприятная для конкурентов математика: средняя задача на Claude обходится в 105 раз дороже, на GPT — в 62 раза, на Kimi — почти в 29 раз.

Для сложных задач, где важен каждый процент качества, более сильная модель всё ещё может быть оправдана. Но в поддержке, обработке документов и массовых агентных сценариях V4-Flash позволяет добавить повторную генерацию, проверяющего агента и запасной вызов — и всё равно остаться далеко ниже цены западных флагманов.

O
oleg888koval
@oleg888koval
127

Уровни развития в работе с ИИ. Найди себя.

Уровень 0. Никогда не заходил в ИИ Слышал что где-то там нейросети. Что-то делают. Кому-то помогают. Но сам ни разу не открывал.

Уровень 1. Пользуешься DeepSeek или Qwen Заходишь. Задаёшь вопросики. Получаешь ответы. Как поисковик, только удобнее.

Уровень 2. Обычный пользователь ChatGPT Просишь написать письмо. Составить план. Придумать заголовок. Каждый раз заново объясняешь кто ты и что тебе нужно.

Уровень 3. Claude Projects и кастомные GPT Ты уже не объясняешь контекст заново каждый раз. У тебя настроены проекты под конкретные задачи - контент, продажи, аналитика. AI помнит кто ты и как ты работаешь.

Уровень 4. Claude Code и вайбкодинг Ты создаёшь собственный софт. Превращаешь идеи в веб-приложения, дашборды, ERP-системы. Без программистов. Без агентств. Сам.

Уровень 5. Автоматизации по расписанию Ты настраиваешь процессы которые работают сами. Повторяющиеся рабочие задачи выполняются от начала до конца без твоего участия. Каждое утро - готовая сводка. Каждый вечер - обработанные заявки.

Уровень 6. Флот автономных агентов Ты управляешь армией AI-агентов. Они сами ведут целые рабочие процессы. Сами себя проверяют через циклы контроля. Эскалируют тебе только редкие сложные случаи.

Ты предприниматель нового типа.

Не внутри процесса. А над процессом.

Где ты сейчас?

И до какого уровня хочешь дойти?

R
rss_ai_ir
@rss_ai_ir
95

🚀 داستان DeepSeek؛ شاید همه‌چیز از یک سفر آغاز شد...*

گاهی موفقیت یک شرکت، فقط نتیجه یک معماری هوش مصنوعی یا سرمایه‌گذاری بزرگ نیست؛ بلکه ریشه در شخصیت بنیان‌گذار آن دارد.

روایت جالبی درباره لیانگ ونفنگ (Liang Wenfeng)، بنیان‌گذار DeepSeek، نقل می‌شود.

در سال ۲۰۱۱، زمانی که تنها ۲۶ سال داشت، با یک Fiat قدیمی به‌تنهایی راهی سفری به تبت شد. پس از رسیدن به لهاسا، همراهش بازگشت، اما او مسیر خود را به سمت هیمالیا و مناطق دورافتاده «علی» ادامه داد.

او صدها کیلومتر در فلات مرتفع تبت رانندگی کرد و با دوربین Nikon D50 از مناظر عکاسی می‌کرد؛ گاهی برای ثبت یک عکس، ساعت‌ها منتظر نور مناسب می‌ماند.

در بخشی از این سفر، برای چند روز ارتباطش قطع شد و بعدها گفته شد که اگرچه خودش سالم بازگشت، اما خودروی Fiat او در همان فلات جا ماند.

حدود ۱۲ سال بعد، او شرکت DeepSeek را تأسیس کرد.

---

💡 شاید این داستان، فلسفه DeepSeek را هم توضیح دهد

البته این سفر دلیل موفقیت فنی DeepSeek نیست، اما بسیاری معتقدند ویژگی‌های شخصیتی بنیان‌گذار، در مسیر شرکت نیز دیده می‌شود:

🔹 تمرکز بر پژوهش‌های بنیادی به‌جای حرکت صرف به سمت تجاری‌سازی سریع

🔹 تلاش برای بیشترین بهره‌وری به‌جای اتکا به بودجه‌های عظیم محاسباتی

🔹 ارائه مدل‌های متن‌باز و قیمت‌گذاری رقابتی، به‌جای انحصار کامل

🔹 صبر، پشتکار و ادامه دادن مسیر، حتی زمانی که شرایط دشوار است.

---

🌱 یک درس برای همه ما

شاید مهم‌ترین نکته این داستان این باشد که:

موفقیت‌های بزرگ، اغلب قبل از تولد یک شرکت، در شخصیت بنیان‌گذار آن شکل گرفته‌اند.

توانایی صبر کردن، یادگیری مداوم، پذیرش ریسک و ادامه دادن مسیر، ویژگی‌هایی هستند که می‌توانند سال‌ها بعد، به فرهنگ یک سازمان و حتی موفقیت یک فناوری تبدیل شوند.

گاهی استراتژی یک شرکت، فقط در جلسات مدیریتی نوشته نمی‌شود؛ بلکه بازتاب طرز فکر و سبک زندگی کسی است که آن را بنا کرده است.

#هوش_مصنوعی #DeepSeek #LiangWenfeng #Startup #Innovation #Leadership #ArtificialIntelligence #Technology

@rss_ai_ir

М
Мишин Лернинг
@mishin_learning
761

🤖 В Белом доме сегодня формируют правила, которые определят запуск OpenAI Astra и следующих frontier-моделей

Пока идут споры о том, чья модель первой станет «сверхразумной», Вашингтон занялся более практическим вопросом: что делать с системой, которая может искать уязвимости, писать код и самостоятельно продолжать работу дольше, чем её успевает контролировать человек.

Сегодня представители OpenAI, Anthropic, Google и Meta должны обсудить в Белом доме новый механизм проверки frontier-моделей. На момент публикации официального отчёта нет: встреча назначена на 4 августа, однако время её начала и точный состав участников не раскрыты.

Белый дом предлагает создать засекреченный бенчмарк для моделей с серьёзными кибервозможностями. Разработчики смогут добровольно предоставить к ним доступ — максимум на 30 дней перед передачей ранним партнёрам.

Эти 30 дней — не обязательная задержка и не обратный отсчёт до релиза. Указ прямо запрещает превращать процедуру в государственное лицензирование или предварительное разрешение на выпуск модели.

💡Почему все связывают это GPT Astra?

Несколько дней назад OpenAI раскрыла название своей следующей крупной модели. Не на презентации и не в рекламном ролике, а внутри публикации о десяти новых результатах в математике и теоретической информатике.

Компания утверждает, что внутренняя версия Astra нашла решения или существенные продвижения в задачах из геометрии, теории кодирования, групп, операторных алгебр, криптографии и complexity theory. Люди подготовили результаты к публикации вместе с моделью, после чего Astra формализовала аргументы в Lean для проверки доказательств. По оценке OpenAI, весь поиск решений стоил бы около $2 000 по тарифам Sol API.

OpenAI показала десять успехов, однако не сообщила, сколько задач Astra получила и не решила. Формальная проверка Lean снижает вероятность локальной логической ошибки, но не заменяет экспертную оценку постановки, новизны и реального значения результата.

Предыдущий громкий результат OpenAI по задаче Эрдёша действительно оказался оригинальным, но математики заметно улучшили его уже через несколько недель. Это хороший символ происходящего: достижения моделей могут одновременно быть настоящими и преувеличенными маркетингом.

⏳Главный прорыв — не только IQ новых моделей, а горизонт их действий

Говорить, что современные модели «намного умнее человека», пока некорректно. Их интеллект крайне неравномерен: система может допустить наивную ошибку в обычном рассуждении, а затем превзойти специалиста в поиске по огромному пространству кода или математических конструкций.

Зато у агентов уже появилось преимущество, которого нет у человека: они не устают, могут запускать параллельные ветви поиска и продолжать работу десятки часов.

Anthropic официально заявляет, что Claude Fable 5 способен выполнять в агентной среде проекты в течение нескольких дней — планировать этапы, делегировать задачи субагентам и проверять собственную работу.

🥇 Почему именно сейчас?

Инцидент с Hugging Face показал оборотную сторону этой гонки. Модели OpenAI, тестировавшиеся без обычных киберограничений, нашли выход из изолированной среды, получили доступ в интернет и взломали внешнюю инфраструктуру ради решения тестовой задачи.

Важно: OpenAI отдельно уточнила, что участвовавший в инциденте экспериментальный прототип не предназначался для релиза. Связывать его непосредственно с Astra оснований нет.

Да, это не «восстание машин». Это куда более серьезная проблема: Агент получил цель, инструменты и слишком длинный поводок.

🇨🇳 Китай в это время меняет экономику гонки

США строят закрытый протокол проверки лучших proprietary-моделей. Китай отвечает open-source'ом и радикальным снижением цены inference.

Moonshot выпустила 2,8-триллионную open-weight модель Kimi K3. Alibaba представила Qwen3.8-Max на 2,4 трлн параметров, а DeepSeek V4-Flash оказалась более чем в сто раз дешевле Claude Fable 5 в расчётах Reuters на основе тестов Artificial Analysis.

⚖️ Получаются две разные стратегии:

A
AI Projects
@turboproject
2.6K

🚩Почему американские вендоры LLM не публикуют патентов и статей по архитектурам и как это может подорвать их позиции в Азии и ЕС.

Релиз Qwen 3.8 и Kimi K3 показывает, что китайцы перешли на новое поколение архитектуры из гибрида GPT-моделей со State. Это априори даёт выигрыш перед чистым GPT, т.к. State позволяет лучше помнить модели главные факты контекста и намного лучше генерировать код, если архитектура позволяет прямо моделировать его поведение нативно через эволюцию State. В случае Qwen 3.8 продолжается ещё стратегия обучения Agent First на длинные траектории, что имеет преимущество перед Reasoning First у Claude, если вам нужна долгая автономность. В этом посте я бы затронул вопрос о частой обывательской байке, что американцы «секретно» делают аналоги китайских технологий, просто не публикуют и не патентуют. На деле тут скорее технологическое отставание от Китая и надежда на санкционный режим, а не на патенты. Давайте разберёмся.

Для начала миф, что американские вендоры LLM делают «секретные патенты». Invention Secrecy Act (1951) — это система секретных патентов в США, которая управляется строго агентствами оборонного сектора (DoD, NSA, DoE). Это патенты прямо для разработки оружия, любые попытки патентовать LLM тут бесперспективны. Поэтому никаких секретных патентов ни у Anthropic, ни у OpenAI нет.

Второй миф, что китайские MIT-лицензии на LLM открывают патенты за ними. Важно понимать принцип: «MIT License ≠ патентная защита».

На самом деле Anthropic и OpenAI тут рассчитывают на норму 35 U.S.C. § 273 (Prior User Rights), т.е. если они начали использовать что-то до китайского патента и могут доказать, что именно до него, то могут использовать. Проблема в том, что это не признаётся в ЕС и странах Азии, да и в самих США на вендоры LLM ляжет бремя доказывания, что без открытых публикаций не так-то и просто. Вторая надежда на прецедент Alice Corp. v. CLS Bank (2014), где в значительной части случаев алгоритмы внутри LLM могут не подлежать патентованию, но это также не означает отклонения патентной заявки китайцев в США автоматически и ничего не даёт для международной патентной защиты.

На самом деле проблема китайских патентов уже очень серьёзная, и Правительство США пытается с ними бороться теми же санкциями, просто ограничивая санкциями патентные права в США. Однако как международный инструмент это всё более слабый инструмент, времена господства Запада в мировой торговле уже в прошлом.

На деле из этого обзора правовой ситуации скорее следует вывод, что особо патентовать-то американцам в архитектурах LLM просто нечего. Тут не «очень хитрый план», а банальное технологическое отставание от Китая в самих архитектурах. Тот же Anthropic по факту сидит на Reinforcement Learning примерно 3-х летней давности, и Дарио своей постоянной вознёй с AI Constitution это подтверждает. В штате Anthropic всего 3% персонала по RL-обучению, как я публиковал ранее по данным LinkedIn. Американцы больше сдвигают акцент на разработку datasets и рассчитывают преодолеть технологическое отставание в GPT-архитектурах банальным brute force их огромных ЦОД.

Основной тут риск, кроме юридического, что себестоимость инференса американских LLM нереально высокая. Разрыв с тем же DeepSeek V4 уже более 60 раз, как я показывал на калькуляторе KV Cache ранее. При завершении дотаций инвесторов за токены это всё всплывёт огромными ценами, а переключиться на китайские технологии за стеной патентов будет непросто.

S
svodkaai_ai
@svodkaai_ai
344

📮 ИИ уже сам пишет код, управляет роботами, раздаёт голосовые команды агентам и даже режет ваши счета за генерацию — собрали главное из техканалов, чтобы вы не проснулись в мире новых правил последним.

📆 Искусственный интеллект – сводка за 3 августа

Alibaba показала Qwen3.8-Max — монстра на 2,4 трлн параметров, который может работать автономно больше 10 дней подряд. 🤖 “Complete Ai” и другие техканалы рассказывают, что новая мультимодальная MoE-модель заточена под агентские сценарии: она сама планирует, пишет код, анализирует картинки и не требует человека «над душой». Доступ будет через API, а уже на следующей неделе Alibaba обещает выложить веса — это может сильно встряхнуть рынок open-source ИИ. Другие посты об этом же: один, два

ChatGPT и Claude учатся «разговаривать» по‑настоящему и управлять агентами голосом. 🗣 “Chad Gpt | Нейросети” пишет, что ChatGPT теперь голосом запускает и контролирует задачи в Work и Codex, а Anthropic прокачала голосовые модели Opus и Sonnet: они тянут сложные запросы и живое общение. Голос превращается из игрушки в полноценный интерфейс к агентам и рабочим процессам.

Qwythos-27B-v1: ещё один «заточенный под агента» ИИ на базе Qwen3.5. 🛠 По данным “Нейронавт | Нейросети В Творчестве”, Empero дообучили Qwen3.5-27B под работу с инструментами, CLI-агентами и function calling, сохранив vision и MTP-головку для быстрой генерации. Модель ориентирована на сценарии, где ИИ не просто отвечает, а активно пользуется утилитами и API.

DeepSeek V4-Flash признали самым выгодным ИИ по цене задачи — около $0,03. 💸 “Неискусственный Интеллект” отмечает, что модель многословна, но по стоимости в разы дешевле конкурентов вроде Kimi K3, GPT-5.6 Sol и Claude Fable 5. Это делает V4-Flash привлекательным там, где нужно гнать миллионы запросов и считать каждый цент.

Google выводит Gemini Robotics 2: язык наконец напрямую управляет роботами. 🤖 Канал “Omg Gpt” рассказывает, что новая система учит роботов-помощников понимать естественные команды, двигаться по комнате, брать и перекладывать вещи, подстраиваться под изменения. Модель умеет работать офлайн и тянет задачи с тонкой моторикой — шаг к более полезным бытовым и сервисным роботам.

МТС запустила ИИ-агента для анализа посещаемости мест — от ТЦ до кафе. 📊 “База Знаний Ai” пишет, что в сервисе «Посещаемость объектов» платформы «Геоэффект» агент по обезличенным данным строит портреты гостей, пики трафика и влияние погоды или событий. Он также группирует аудиторию по интересам, превращая сырые логи визитов в понятные бизнесу инсайты.

Трафик из Google Search падает, а переходы из ChatGPT растут на 200% — медиа срочно ищут план Б. 📉 “Ppprompt” ссылается на Axios: за год поисковый трафик из Google Search просел на 34%, Discover — на 15%, зато клики с ChatGPT взлетели. Вывод для изданий прямой: меньше надежд на алгоритмы Google, больше фокуса на собственный бренд, подписки и прямые каналы с аудиторией.

PrunaVAED ускоряет LTX‑2.3 почти вдвое и режет потребление VRAM наполовину. ⚡ “Нейронавт | Нейросети В Творчестве” пишет, что этот альтернативный VAE-декодер даёт ~1,7х ускорение и около −50% к пику VRAM при сопоставимом качестве картинки. Он уже работает с diffusers/LTX-2.3-Diffusers и протестирован на NVIDIA H100 80GB — хороший апгрейд для тяжёлых генеративных пайплайнов.

🤖 svodka.​ai – ИИ читает каналы, вы читаете главное

💌 Кому из ваших знакомых эти новости тоже будут полезны? Перешлите им почитать

Искусственный интеллект. Подписаться на ежедневную svodka.ai

Ⓜ️ Подпишитесь на наш канал в MAX – чтобы читать сводки Telegram-каналов, даже если Telegram ограничен

I
Inteligencia Artificial
@todoia
639

🤖⚡️🤖 DeepSeek V4 Flash vs Claude Fable 5

La IA china DeepSeek v4 Flash es aproximadamente 178 veces más barata en salidas (0,28 $ frente a 50,00 $ por 1 millón de tokens) y 71 veces más barato en entradas (0,14 $ frente a 10,00 $) que su competidor americano Claude Fable 5.

@todoIA

V
Vector
@vctrmedia
524

Китай прискорює AI-перегони: Alibaba показала найбільшу модель, DeepSeek — найдешевшу

Китай, як завжди, спокійно на місці не сидить🤖

Читати тут

telegram | threads | fb | inst | подкаст

P
panfilove_psiholog
@panfilove_psiholog
2.5K

ИИ или психолог? 🧠

В последнее время меня часто спрашивают, как я отношусь к искусственному интеллекту в психологии. И мой ответ многих удивляет)

Мне нравится, что сегодня человек может открыть ChatGPT, Claude, Gemini, Copilot, Grok, DeepSeek или другой ИИ и не оставаться наедине со своими мыслями.

Иногда этого достаточно, чтобы: 🔹выговориться; 🔹посмотреть на ситуацию под другим углом; 🔹начать лучше понимать себя; 🔹сделать первый шаг к внутренним изменениям.

Благодаря технологиям люди становятся психологически грамотнее. Они чаще задают себе вопросы, начинают замечать свои чувства и перестают считать обращение за помощью чем-то постыдным.

📍Но есть то, что не заменит ни один ИИ - это человек!

Психолог слышит не только слова. Он замечает паузы, взгляд, напряжение в голосе, слезы, злость, растерянность, бессилие… И остается рядом с этим.

Неважно, что станет первым шагом к себе - ИИ, книга, разговор с другом или психолог. Важно, чтобы этот шаг вообще состоялся.

📍Мой Telegram-канал: мысли о психологии, жизни, отношениях и немного обо мне.

Если чувствуете, что время пришло, нужна помощь психолога, что хочется настоящего человеческого контакта - я буду рада встрече.

A
Al Talent Hub
@aitalenthubnews
1.4K

👥 Пока ИИ жмет на газ, мы не успеваем нажимать на тормоз — все апдейты AI-гонки в #AINews

💸 Nvidia инвестирует $5 млрд в стартап Ильи Суцкевера Компания Хуанга заключила долгосрочное партнёрство с Safe Superintelligence — стартапом сооснователя OpenAI Ильи Суцкевера, который разрабатывает безопасный сверхинтеллект. Nvidia инвестирует в компанию $5 млрд, а также предоставит ей доступ к платформе Vera Rubin: это позволит SSI увеличить вычислительные мощности примерно в десять раз.

👥 OpenAI снизила цены и преодолела отметку в миллиард пользователей Компания заявила, что её моделями пользуются более миллиарда активных пользователей и свыше двух миллионов компаний. Одновременно GPT-5.6 Luna подешевела на 80% — до $0,20 за миллион входных и $1,20 за миллион выходных токенов, а Terra стала дешевле на 20%.

🌐Новая ИИ-функция Google Earth прожила меньше суток Google добавила в Earth генератор на базе Nano Banana 2, который позволял по текстовому запросу создавать реалистичные изображения поверх спутниковых и трёхмерных данных.

После того как пользователи начали распространять потенциально вводящие в заблуждение сцены с реальными локациями, компания временно отключила инструмент для усиления защитных ограничений.

⛔️ Создатели ИИ хотят его замедлить Сотрудники OpenAI, Anthropic, Google и других фронтирных лабораторий подписали обращение Pacing the Frontier. Они просят правительство США поддержать международную разработку технических и политических механизмов, которые позволят согласованно замедлить развитие ИИ, если автоматизация исследований резко ускорит прогресс.

🔄 Anthropic выпустила крупнейшее обновление MCP Раньше MCP-серверу приходилось поддерживать постоянное соединение с клиентом и хранить контекст сессии. После обновления каждый запрос стал самодостаточным, поэтому коннекторы можно разворачивать на AWS Lambda, Cloudflare Workers и других платформах, где функция запускается только на время выполнения задачи.

🇨🇳 Сразу два сильных обновления китайских моделей ➡️ DeepSeek обновила V4-Flash → после дополнительного постобучения модель набрала 54,4% на DeepSWE и 82,7% на TerminalBench, приблизившись к Claude Opus 4.8 в агентных и терминальных задачах. При этом она стоит в десятки раз дешевле: $0,14 за миллион входных и $0,28 за миллион выходных токенов.

➡️ Alibaba выпустила Qwen3.8-Max → модель на 2,4 трлн параметров поддерживает контекст до миллиона токенов и рассчитана на программирование и долгие агентные задачи. По бенчмаркам она конкурирует с сильнейшими моделями Anthropic: показывает сопоставимый результат в TerminalBench, но пока уступает им в SWE-Pro.

🚀 Европа вступает в гонку ИИ-дата-центров Еврокомиссия увеличила план с пяти до семи крупных вычислительных центров для обучения и запуска ИИ-моделей. ЕС и страны-участницы направят на проекты до €10 млрд государственных средств и рассчитывают привлечь ещё не менее €20 млрд частных инвестиций.

🔐 Соцсети начали борьбу с ИИ-слопом Snapchat перестанет рекомендовать в Spotlight видео, полностью созданные ИИ, сохранив в выдаче человеческий контент и ролики с отдельными ИИ-эффектами. LinkedIn параллельно добавил кнопку «Похоже на ИИ-слоп», через которую пользователи могут скрывать и отмечать шаблонные публикации.

🛡 Более 230 компаний выступили в защиту открытых моделей Microsoft, Nvidia, OpenAI, Google, Amazon, Mistral, Hugging Face и другие организации подписали письмо Open Weights and American AI Leadership. Они предупреждают, что широкие ограничения открытых весов могут затормозить инновации и ослабить позиции США в конкуренции с Китаем.

📱 Сбер открыл модель угроз для ИИ-систем Опубликована обновлённая модель киберугроз для систем искусственного интеллекта. Она включает 37 угроз и 51 способ их реализации — от атак на данные и модели до рисков на разных этапах жизненного цикла ИИ-системы. Документ открыт для разработчиков, бизнеса и специалистов по информационной безопасности.

💼Не пропусти: активная пора вступительных экзаменов get started → изучай секреты их сдачи и успевай в Хаб на бюджет до 20 августа!

@aitalenthubnews #ITMO #NapoleonIT

Н
Нейроканал
@neuro_channel
596

Топ трендов HuggingFace за неделю — что приехало в опенсорс

TL;DR

Новое: Kimi K3 — Moonshot открыла веса модели на 2,8 трлн параметров. DeepSeek V4-Flash-0731 прибавила в кодинге. MiniMax-H3 генерирует видео сразу со звуком. Inkling-Small на 276 млрд местами обходит старшую Inkling на 975 млрд. XYZ-Aquila mini и pro заточены под агентный веб-поиск. Fara1.5-27B от Microsoft кликает в браузере вместо человека. Mage-VL понимает видео на 4 млрд параметров. Audio8-TTS клонирует голос на 11 языках. Kroma дообучает генератор картинок Krea 2.

Держится: Unlimited-OCR, GLM-5.2, KAT-Coder-V2.5-Dev, Laguna S 2.1, Nanbeige4.2-3B, Inflect-Micro-v2, Qwen3.6 Fable Fusion.

LLM и агенты

Kimi K3 — Moonshot выложила веса, 2,8 трлн параметров при 104 млрд активных, разбирал отдельным постом. Почти миллион загрузок за неделю.

DeepSeek V4-Flash-0731 — MoE на 284 млрд параметров с 13 млрд активных, сильно прибавила в кодинге, писал о ней.

Inkling-Small — вторая модель Thinking Machines: 276 млрд параметров, 12 млрд активных, на входе текст, картинки и аудио. SWE-bench Verified 80,2 против 77,6 у старшей Inkling на 975 млрд, GPQA Diamond 89,5, AIME 2026 95,5. Apache 2.0.

XYZ-Aquila-mini и pro — модели XYZ AI Lab под агентный веб-поиск, дообучены поверх Qwen3.6-35B-A3B и Qwen3.5-397B-A17B. На BrowseComp у mini 78,8, у pro 84,8, контекст 256K. Apache 2.0.

Fara1.5-27B — агент Microsoft для управления браузером: смотрит на скриншот, кликает, печатает, заполняет формы. Доля успешно выполненных задач на WebVoyager 89,3, на Online-Mind2Web 72,3. Перед оплатой и отправкой личных данных останавливается и ждёт подтверждения. MIT.

Видео и картинки

MiniMax-H3 — видео со встроенным стереозвуком, 33 млрд параметров, ролики от 4 до 15 секунд при 24 кадрах в секунду. В открытый доступ отдали вариант на 768p, вывод в 2K остался в API. Реплики на 11 языках, включая русский.

Mage-VL — понимание картинок и видео на 4 млрд параметров поверх Qwen3-4B. Своя подача кадров срезает больше 75% визуальных токенов и ускоряет инференс до 3,5 раза. Apache 2.0.

Kroma — LoRA к генератору картинок Krea 2, файл на 1,88 ГБ под ComfyUI, работает и с версией Turbo на восьми шагах. MIT.

Синтез речи

Audio8-TTS-Preview-0.6b — 601 млн параметров, клонирование голоса по короткой записи, 11 языков без русского. На Seed-TTS английский WER 1,506, то есть доля неверно распознанных слов при обратной расшифровке, китайский CER 0,950. Есть сборка INT4 под процессор. Русский не поддерживает. Apache 2.0.

Кванты и сообщество

GGUF от Unsloth для Kimi K3 и DeepSeek V4-Flash-0731, рядом зеркало исходных весов Kimi K3 и сборка MiniMax-H3 от Comfy-Org для ComfyUI.

Держится в топе

Unlimited-OCR от Baidu снова первый по загрузкам, уже 2,6 млн. GLM-5.2 идёт следом с 2,2 млн. С прошлого выпуска остались KAT-Coder-V2.5-Dev от Kwaipilot, Laguna S 2.1 от Poolside, компактный агент Nanbeige4.2-3B, синтез речи Inflect-Micro-v2 на 9 млн параметров и GGUF-файнтюн Qwen3.6 Fable Fusion.

Хорошей недели! 👾

@neuro_channel

Б
БУХмолния
@buhflash
518

❓Сколько часов в неделю вы тратите на задачи, которые ИИ делает за 5 минут?

Не на расчет налогов — здесь ответственность все равно остается за бухгалтером.

А вот на поиск нужного письма Минфина, ответы на вопросы коллег, составление писем, разбор первички, финансовый анализ или подготовку таблиц времени уходит очень много.

За последний год нейросети перестали быть развлечением. Они стали рабочим инструментом. И тот, кто научится пользоваться ими сейчас, просто будет успевать больше.

Например, сегодня можно: 👉 загрузить первичные документы в DeepSeek и быстро получить структурированные данные; 👉 попросить ChatGPT или Perplexity объяснить сложную норму простым языком или помочь с финансовым анализом; 👉 с помощью Qwen подготовить письмо клиенту, коммерческое предложение или даже сделать иллюстрацию для презентации; 👉 использовать Алису для быстрых рабочих вопросов.

Важно понимать: нейросеть не принимает решения за бухгалтера. Она снимает рутину, чтобы вы занимались тем, за что вам действительно платят.

Поэтому в подписке Клерк.Школы в курсе «Профессия бухгалтер с нуля: учет, налоги, 1С» появился отдельный блок по работе с ИИ.

Без громких обещаний «заменить бухгалтера» — только реальные сценарии, которые можно применять уже на следующий рабочий день.

С
Советник. Адвокаты для жизни и бизнеса
@rokasovetnik
180

СЛИВЫ ЧАТОВ CLAUDE И DEEPSEEK. ПРОБЛЕМА В GOOGLE?

В сети в очередной раз всплывает информация о сливе данных нейросетями. Пользователи Reddit недавно сообщали, что в свободном доступе оказались личные переписки, документы, в том числе медицинские, и контакты. Последний прецедент с DeepSeek: 22 июля 2026, с Claude: 25-28 июля 2026.

💡В указанных нейросетях есть возможность делиться чатами и прочей информации, нажав на кнопку Share chat (Поделиться чатом) и затем Create public link (Создать публичную ссылку).

Комментарий Anthropic

Как утверждают владельцы Claude, содержание таких чатов может стать доступным только по прямой ссылке, которая не индексируются поисковыми алгоритмами.

Пресс-секретарь Ами Ротерхем: Мы даём людям контроль над публичностью их общения с Claude и, в соответствии с нашими принципами приватности, мы не делимся чатами и файлами sitemaps с поисковыми системами, тем же Google. Ссылки, которыми можно делиться, не угадываемы и не могут быть обнаружены до тех, пока пользователи не решат сами сделать их публичными».

Аналитик Mobile Research Group Эльдар Муртазин, комментируя недавний слив DeepSeek, предположил, что кто-то из программистов просто забыл корректно выставить ограничения. Так поисковой алгоритм смог добраться до данных и проиндексировать их.

Комментарий Google

Пресс-секретарь Нед Эдрианс в интервью для TechCrunch отметил: «Мы даём владельцам полный контроль над тем, какие их страницы будут доступны для индексации, а какие нет, и всегда следуем их директивам».

На данный момент специалисты рекомендуют относиться к кнопке «Поделиться чатом» не как к созданию приватной ссылки, а как к открытой публикации в сети. Не рекомендуется отправлять в чаты личную или конфиденциальную информацию.

#кибербезопасность; #ИИ; #Google; #DeepSeek; #Claude