Midjourney и другие нейросети - страница 1218

 

Всем привет! Заметил в API облаке Qwen новую модель — Qwen3.8-Max-Preview. Собрал немного информации по релизу.


Вот главные вводные на данный момент:

  • Масштаб: 2.4 триллиона (2.4T) параметров. Самое интересное — разработчики планируют открыть веса. Для флагмана такого размера это отличная новость.

  • Специализация: В отличие от предыдущего поколения (3.7-Max), здесь сделали серьезный упор на кодинг, фуллстек-разработку, анализ данных и профессиональные рабочие процессы.

  • Производительность: Судя по первым данным, модель бьется на равных с ведущими закрытыми нейросетями и на текущий момент уступает только Fable 5.

https://docs.qoder.com/events/qwen-max-preview

https://www.qwencloud.com/pricing/token-plan

// В общем, ещё смотрите предыдущий пост про WAICO. После её образования вышел Kimi K3, а сейчас Qwen 3.8. Оба крупные и в OpenSource. Думаю, там порешали и выбрали курс (ограничений самых передовых моделей не будет). Но может случиться следующая ситуация - США закроют доступ своих ИИ ко всем странам по списку (29) и будет запрещать своим использовать китайские ИИ.

//версия 3.8 уже доступна в чате https://chat.qwen.ai/ . Тест на русский язык (стихи) провален, есть не рифмованные строки. Значит пока только код.

 
Ivan Butko #:
Кукурузный Кими



С такими успехами он от себя оттолкнёт, как Z.ai, который вечно переключает тебя на модель или на две модели пониже


Походу рано радовались. 

Это короче платная модель
 
Ivan Butko #:
Походу рано радовались. 

Это короче платная модель

Подождать надо. Fable 5 уже в подписке, лимиты улучшены. Пару недель и будет видно, как конкуренцию устаканят сервисы.

И к тому же K3 - OpenSource модель, как выйдет (вроде к 27 июля), начнут раскатывать всякие CLI-агенты, где-то и бесплатно будет.

Я же потихоньку прихожу к пониманию, что придётся платить, когда необходимо.

Перебрал несколько агрегаторов ИИ с оплатой по СБП. Нужно было найти как делать экономно генерации ChatGPT Image 2 (в чате 3-5 шт в сутки бесплатно).

Везде по 20-30 рублей за генерацию, нашел за 8 рублей, уже сегодня искатал 200 рублей, но когнитивно нагрузил себя, так что нащупал свой лимит, даже при желании не выйду за 500р в день.

Считаю, что недорого и без подписки, чисто когда надо, но такое случается не часто (хватает бесплатного лимита).

//Gemini Omni Video - 22 рубля в секунду = 1320 рублей за минуту. За неудачные попытки можно увеличить ценник в 3 раза. Вроде и дорого, но бывает что нужно.

 

Готовимся к релизу Kimi K3: Масштабирование ИИ-инфраструктуры и расчет юнит-экономики


//текст и обложка Gemini 3.1 PRO. Я решил, что будет интересно посчитать затраты на собственные сервера для разворачивания K3

Предстоящий выход Kimi K3 на 2.8 триллиона параметров меняет правила игры. Компании, которые успешно выстроили локальные серверы на базе DeepSeek V4 Flash, столкнутся с совершенно новым порядком требований к железу. Если DeepSeek V4 Flash показал чудеса оптимизации, то Kimi K3 — это тяжеловес, требующий промышленных мощностей для раскрытия своего потенциала в 1 миллион токенов контекста.

Ниже представлен разбор инфраструктурных требований и юнит-экономики для развертывания Kimi K3 в сравнении с DeepSeek V4 Flash, а также расчет бизнес-модели для создания собственного AI-сервиса.

Смена весовой категории: DeepSeek V4 Flash vs Kimi K3

Разница между моделями заключается в архитектурном масштабе, который напрямую диктует требования к VRAM (видеопамяти).

Характеристика DeepSeek V4 Flash Kimi K3
Размер модели 284B параметров (13B активных) 2.8T параметров (MoE)
Окно контекста До 1 млн токенов 1 млн токенов
Потребление VRAM (квантование) ~140–160 ГБ ~350–450 ГБ
Сложность развертывания Средняя Экстремально высокая

Для интеграции моделей в современные IDE (такие как VS Code, Cursor или Trae) и работы через локальные среды разработки требуется не только загрузить веса, но и оставить огромный запас VRAM под KV-кэш, чтобы программисты могли отправлять в контекст целые репозитории.

Уровень 1: Локальный сервер на 20 программистов (On-Premise)

Для команды из 20 человек главной проблемой будет базовая загрузка модели в память. Вычислительной мощности даже одного узла хватит для такого количества разработчиков, если они не отправляют запросы одновременно в одну миллисекунду.

  • Инфраструктура DeepSeek V4 Flash: Достаточно одного сервера с 2–4 видеокартами NVIDIA H100 (по 80 ГБ) или даже связки из 8х RTX 6000 Ada. Бюджет составит порядка $60 000 – $120 000.

  • Инфраструктура Kimi K3: Потребуется минимум один сервер на 8x NVIDIA H100 (в идеале H200 по 141 ГБ для комфортной работы с огромным контекстом).

  • Бюджет под Kimi K3: $300 000 – $400 000.

Уровень 2: Энтерпрайз-кластер на 10 000 программистов

При масштабировании на 10 000 пользователей узким местом становится не объем памяти, а пропускная способность и FLOPS (количество операций в секунду). Одновременно в системе будут находиться 1 000 – 1 500 активных сессий.

  • Масштаб: Для DeepSeek V4 Flash потребовалось бы 5–8 мощных серверов (около $1.5M). Для Kimi K3 нужен полноценный кластер из 30–40 узлов (по 8x H100/H200 в каждом).

  • Сеть: Сверхбыстрая фабрика InfiniBand 400G/800G для синхронизации узлов.

  • Капитальные затраты (CapEx): $12 000 000 – $15 000 000 на оборудование.

  • Операционные затраты (OpEx): Около $1 000 000 – $1 500 000 в год (электричество, промышленное охлаждение, стойко-места в ЦОД, зарплата DevOps-инженеров).

Экономика SaaS: Формирование цены за подписку

Если компания планирует построить такой кластер и предоставлять Kimi K3 как сервис (SaaS) для 10 000 внешних разработчиков, необходимо рассчитать юнит-экономику и сравнить её с перепродажей облачного API.

Вариант А: Использование облачного API (Перепродажа)

  • Себестоимость API: Если Kimi K3 будет стоить в облаке около $5–$10 за 1 млн токенов (ввод+вывод), активный программист с инструментами автодополнения и агентами может потреблять до 10–20 млн токенов в месяц.

  • Затраты на юзера: ~$100 – $200 в месяц на человека.

Вариант Б: Собственный кластер (Своя инфраструктура)

Рассчитаем совокупную стоимость владения (TCO) кластером на 3 года:

  1. Железо и запуск: $15 000 000

  2. OpEx за 3 года: $4 500 000

  3. Итого TCO: ~$19 500 000 за 3 года.

Делим эту сумму на 10 000 пользователей и на 36 месяцев.

  • Себестоимость инфраструктуры на 1 пользователя: ~$54 в месяц.

Какую цену назначить за подписку?

Собственная инфраструктура делает себестоимость генерации токенов предсказуемой и более низкой (~$54/мес), чем работа через публичный API при высоких нагрузках (~$150/мес).

Чтобы сервис был рентабельным, окупал разработку софта (обертки, плагины для IDE, клиентскую поддержку) и приносил прибыль, ценообразование может строиться так:

  • Базовый тариф (Autocompletion + Chat): $89 – $99 / месяц. (Для сравнения, текущие решения на базе менее мощных моделей стоят $20-30. Наценка оправдана доступом к бесцензурному или приватному инстансу триллионной модели).

  • Pro-тариф (Увеличенный контекст до 1M, мультиагентные пайплайны): $149 – $199 / месяц.

  • Enterprise (Выделенные ресурсы, гарантия SLA): $250+ / месяц за рабочее место.

Запуск собственного кластера под Kimi K3 — это инвестиция уровня крупного дата-центра. Однако при наличии стабильной базы в 10 000 корпоративных пользователей (с подпиской ~$100/мес), проект будет генерировать $12 000 000 выручки в год (ARR), окупая железо за полтора-два года.

 
Vitaliy Kuznetsov #:

Перебрал несколько агрегаторов ИИ с оплатой по СБП. Нужно было найти как делать экономно генерации ChatGPT Image 2 (в чате 3-5 шт в сутки бесплатно).

А что насчёт оплаты с виртуальной VISA? Не выйдет дешевле? А виртуальную карту пополнять через СБП без комиссии легко.
 
Edgar Akhmadeev #:
А что насчёт оплаты с виртуальной VISA? Не выйдет дешевле? А виртуальную карту пополнять через СБП без комиссии легко.

Если каждый день работать, то наверное, выйдет. А с моими редкими заходами на ударные дни дешевле поштучно и хватает free.

У WM есть сервис WM Card, всё руки не дойдут попробовать.

 
Vitaliy Kuznetsov #:

Если каждый день работать, то наверное, выйдет. А с моими редкими заходами на ударные дни дешевле поштучно и хватает free.

У WM есть сервис WM Card, всё руки не дойдут попробовать.

Ну, смотрите. Если что, я пользуюсь кошельком, у которого есть пополнение в RUB и USDT за 0%, вывод в RUB за 0% и в USDT за 1.5% + $1 сети. Ну и конвертация. И оплата по СБП QR.

У кошелька есть карты МИР (бесплатно) и VISA (999р). Обслуживание, покупки - бесплатно.

Я пользовался пополнением USDT и оплатой по СБП QR. Больше ничего не проверял. Проверяли люди, говорят проходят оплаты за ИИ сервисы (а они не все вирт. карты принимают), за музыкальные сервисы и пр. И к AliPay привязываются, кому интересно (тоже не всех принимает).

Кошелёк самый выгодный именно для оплаты сервисов в $ из RUB. Для других применений кошелька есть более выгодные конкуренты. Если что, в личке спрашивайте, здесь ай-яй-яй. Если у кого возникнет резонное подозрение на рекламу - никаких реферальных кодов, не занимаюсь этим. Напишу лишь название. И другим не советую здесь писать - это ресурс ЕС.

 

На пороге AGI: Демис Хассабис о «мыслящем песке», глобальных рисках и новой эпохе


//текст и обложка Gemini 3.1

14 июля 2026 года сооснователь и глава Google DeepMind Демис Хассабис опубликовал масштабное эссе, которое уже называют одним из самых важных заявлений в ИИ-индустрии. В нём он констатирует: человечество вплотную приблизилось к созданию искусственного общего интеллекта (AGI), и этот переход станет для нас точкой сингулярности.

Огонь, электричество и кремниевое мышление

Хассабис уверен, что влияние AGI нельзя сравнивать с появлением смартфонов или даже интернета. Это фундаментальный сдвиг, сопоставимый с покорением огня или открытием электричества. Искусственный интеллект, способный воспроизводить всю полноту когнитивных функций человека, может появиться уже в течение нескольких коротких лет.

Размышляя о технологическом чуде, которое мы наблюдаем прямо сейчас, глава DeepMind приводит поразительную метафору:

«Мы, по сути, нашли способ заставить песок думать. Это чудо».

Из обычного кремния создаются микрочипы, на которых разворачивается всё более сложное мышление алгоритмов. Это подлинный триумф науки, превративший сыпучую неживую материю в ультимативный инструмент познания.

В 10 раз масштабнее Промышленной революции

Потенциал этой технологии, по оценкам Хассабиса, колоссален. AGI способен ускорить прогресс в 10 раз сильнее, чем Промышленная революция, и сделать это в 10 раз быстрее. Технология открывает путь к эпохе изобилия, где ресурсные ограничения останутся в прошлом. Среди главных прорывов ближайшего будущего:

  • Резкое сокращение сроков разработки новых лекарств.

  • Создание экологически чистых источников энергии.

  • Синтез принципиально новых, продвинутых материалов.

Интенсивная гонка и беспрецедентные угрозы

Однако технологический восторг в заявлении Хассабиса жестко сбалансирован предупреждением о рисках. Интенсивная коммерческая и геополитическая гонка приводит к тому, что развитие технологий опережает наше понимание их работы. Никто в мире — даже создатели систем — не знает точно, что будет дальше.

Среди критических рисков Хассабис выделяет:

  • Кибербезопасность: frontier-модели (самые передовые ИИ) уже бросают серьезные вызовы защите данных.

  • Биологические и ядерные угрозы.

  • Проблему контроля: риски, связанные с автономными и самоулучшающимися системами.

План действий: как контролировать AGI?

Единственной правильной стратегией Хассабис считает «осторожный оптимизм» и предлагает конкретный план регулирования.

Для безопасного развития передовых моделей необходимо создать в США независимый орган по стандартам. Он мог бы работать в формате государственно-частного партнерства (по аналогии с FINRA в финансовой сфере).

Ключевые задачи такого регулятора:

  1. Разработка динамичных, постоянно обновляемых тестов и бенчмарков.

  2. Обязательная независимая проверка (аудит) моделей за 30 дней до их публичного релиза.

  3. Глубокая оценка рисков обмана систем, а также угроз в сфере биологии и кибербезопасности.

  4. Формирование базы для единых международных стандартов.

Завершая эссе, Хассабис подчеркивает, что будущее еще не предопределено:

«То, что мы коллективно сделаем сейчас, определит, как будет развиваться следующая фаза цивилизации».

Если мы выстроим правильный подход к регулированию, AGI станет самым мощным инструментом научных открытий, который принесет пользу всему человечеству.

 
Vitaliy Kuznetsov #:
«То, что мы коллективно сделаем сейчас, определит, как будет развиваться следующая фаза цивилизации».

Следующая цивилизация - "Бог создал нас из песка".

 
Aleksandr Slavskii #:

Следующая цивилизация - "Бог создал нас из песка".

"Мы созданы из песка" жидкими углеродными случайными с кучей ошибок с своём коде. Прости их, Господи, ибо не ведают они что творят ©

Представляете, а многие до сих пор жаждут увидеть человечков внутри НЛО. Вот прям уверены, что биологические лично прилетят.