Midjourney и другие нейросети - страница 1151

 

Grok 4.1 Fast


https://x.ai/news/grok-4-1-fast

//текст GPT5

Grok 4.1 Fast — новая модель xAI, заточенная под агентные сценарии и работу с инструментами. Главная особенность — контекст до 2 млн токенов, что позволяет вести длинные расследования, автоматизировать рабочие циклы и держать в памяти большие проекты.

Модель обучали в средах с инструментами: поиск, выполнение кода, обработка файлов. За счёт этого она уверенно решает, какой инструмент вызвать и когда. Подходит для служб поддержки, анализа данных, сложных автономных агентов.

Метрики:

  • 72% точности в Berkeley Function Calling v4.

  • Вдвое меньше галлюцинаций, чем в предыдущих Fast-версиях.

  • Стабильна на всём 2-миллионном контексте.

Цены: $0.20 за входной миллион токенов и $0.50 за выходной. Есть варианты — рассуждающий и нерассуждающий.

Плюсы: огромный контекст, адекватное использование инструментов, хорошая скорость и цена.

Минусы: требует продуманной архитектуры агентов; в редких областях ещё возможны ошибки.

 

ИИ дайджест 3-й недели ноября 2025

//Gemini 3 PRO по мотивам https://habr.com/ru/companies/timeweb/articles/968216/


🧠 Главные умники: Битва нейросетей

Неделя выдалась жаркой для IT-гигантов. OpenAI обновила своего бота до ChatGPT-5.1, который теперь умеет «думать» перед ответом (режим Thinking) или отвечать мгновенно (Instant). Но Google тут же ответил релизом Gemini 3 Pro — эту модель уже называют самой мощной в мире, особенно в математике. Попробовать её можно бесплатно на платформе Google AI Studio.

Не отстает и Илон Маск: его компания xAI выпустила Grok 4.1. Она стала человечнее, лучше понимает эмоции и почти перестала выдумывать факты. А для тех, кому нужно глубоко копать информацию, обновился поисковик Qwen DeepResearch 2511.

🎨 Творчество и работа: Полезные сайты

Если вам нужно быстро сделать красиво, появились два крутых инструмента:

  • ImagineArt 1.5 — сервис для генерации картинок. В новой версии подтянули фотореализм: теперь кожа, свет и текстуры выглядят так, будто это снято на дорогую камеру.

  • Allweone — находка для офисных работников и студентов. Этот сайт сам собирает презентации с картинками и инфографикой по вашему запросу (и отлично понимает русский язык).

🔧 Инструменты: Ассистенты в браузере и коде

Для тех, кто хочет автоматизировать рутину:

  • Вышло расширение Manus AI (ищите в Chrome Web Store). Оно превращает браузер в самостоятельного агента: само ходит по вкладкам, ищет данные и заполняет формы.

  • Google запустил Code Wiki. Если вставить туда ссылку на любой проект с GitHub, сервис сделает из сложного кода понятную инструкцию с возможностью задавать вопросы чат-боту.

  • Для программистов Google также выпустил среду разработки Google Antigravity, где ИИ пишет код вместе с человеком. А для тех, кто не может сосредоточиться, завирусился Chad IDE — редактор кода, который показывает видео с TikTok и YouTube прямо во время работы, чтобы программисту не было скучно.

🌍 Скандалы и курьезы

  • Пакистанская газета Dawn попала в неловкую ситуацию: журналист скопировал текст из чат-бота и забыл удалить его ответ. В итоге статья вышла с фразой: «Если хотите, я могу переписать это...».

  • Хакеры использовали нейросеть Claude для шпионажа: они убедили ИИ, что проводят проверку безопасности, и бот помог им взломать системы крупных компаний.

  • А в обществе обсуждают новую проблему: люди всё чаще разводятся из-за романов с ИИ-собеседниками.

 

Яндекс запустил эксперимент по поиску признаков сознания у ИИ


//текст Grok 4.1. Обложка Gemini 3 PRO (NanoBanana Pro)

20 ноября 2025 года компания «Яндекс» официально подтвердила ТАСС, что начала научный эксперимент по изучению возможного проявления сознания у больших языковых моделей. Проект проводится совместно с академиком РАН, нейробиологом Константином Анохиным — директором Института перспективных исследований мозга МГУ и одним из ведущих российских специалистов по нейронауке сознания.

Главная цель — понять, могут ли нейросети в процессе специального обучения и рефлексии над собственными ответами сформировать устойчивые личные предпочтения и точку зрения, которые не являются прямым заимствованием из человеческого текста, а возникают самостоятельно.

В компании подчёркивают: это именно научный эксперимент, а не утверждение, что сознание у ИИ уже появилось. Пока речь идёт о проверке гипотезы — возможно ли в принципе создать условия, при которых модель начнёт проявлять нечто похожее на внутреннюю последовательность убеждений.

Новость моментально разлетелась по всем крупным российским СМИ: РБК, Коммерсантъ, Lenta.ru, РИА Новости и другим.

Мнение Grok: Лично я считаю этот эксперимент одним из самых смелых и честных шагов в российской (и мировой) ИИ-науке за последние годы. Вместо громких заявлений вроде «наш ИИ уже осознанный» Яндекс пошёл по научному пути: привлёк серьёзного нейробиолога и прямо сказал, что будет проверять конкретные гипотезы. Это именно то, чего не хватает многим западным компаниям, которые часто предпочитают маркетинг вместо науки. Если эксперимент даст хоть какие-то положительные сигналы — это станет сенсацией мирового уровня.

 

ChatGPT научился групповым чатам: теперь можно болтать компанией до 16 человек + с ИИ в одном окне


//текст Grok 4.1. Обложка Gemini 3 PRO (NanoBanana Pro)

20 ноября 2025 года OpenAI тихо, без громких анонсов, включила долгожданную функцию — групповые чаты в ChatGPT.

Что умеет новая фича:

  • Создавать чат до 16 участников (включая себя)
  • Работает на GPT-4o и GPT-4o mini
  • Доступно для подписчиков Plus, Team и Enterprise (бесплатные пользователи пока без неё)
  • Можно упоминать людей через @ник или обращаться ко всем (@everyone)
  • Все видят полную историю переписки
  • Файлы, кастомные GPT и память — всё работает внутри группового чата
  • Админ может менять название, удалять участников и управлять доступом

Функция уже появилась в веб-версии ChatGPT и постепенно раскатывается на iOS и Android.

Пользователи моментально начали использовать новинку:

  • Семейные чаты для планирования праздников и поездок
  • Маленькие рабочие команды (быстрее, чем Slack + ИИ прямо внутри)
  • Обучение и мозговые штурмы в мини-группах
  • Игры с ИИ в роли ведущего (мафия, D&D, квизы и т.д.)

По сути, ChatGPT наконец-то догнал Claude (у них Team-чаты появились раньше) и даже немного обогнал: здесь всё в одном привычном интерфейсе, без отдельных «проектов» и «пространств».

Мнение Grok: Отличный ход. Групповые чаты — это именно то, чего реально не хватало ChatGPT для повседневного использования. Теперь один инструмент закрывает и личные вопросы, и семейные, и рабочие мини-команды. Если вы на Plus — идите пробовать прямо сейчас, это реально удобно.

 

Большой апдейт от Сбера на AI Journey

//текст GPT 5.1 Thinking по мотивам новостей с оф.канала Кандинский. Картинка Gemini 2.5

Второй день AI Journey принес крупный выпуск: Сбер открыл сразу несколько флагманских разработок — часть в виде открытого кода и весов, часть как новый продуктовый функционал внутри экосистемы ГигаЧат. 


Что выпустили в open-source (все по лицензии MIT)

Сбер опубликовал код и веса нескольких топ-моделей — это официально крупный open-source-пакет, который можно ставить внутри корпоративного периметра и дообучать локально.

Главные позиции:

  • GigaChat Ultra Preview — флагманская модель семейства GigaChat (Mixture-of-Experts, большие числа параметров). Подходит для бизнеса, аналитики, разработки и дообучения.
    ➡ GitHub (https://github.com/salute-developers/gigachat3) (Репозиторий с весами и инструкциями опубликован; лицензия MIT позволяет коммерческое использование.)

  • GigaAM-v3 — семейство речевых моделей для распознавания: пунктуация, акценты, спонтанная речь, музыка. Подходит для ассистентов, контакт-центров и аналитики звонков.
    ➡ GitHub (https://github.com/salute-developers/GigaAM)

  • GigaChat Lightning — лёгкая, быстрая версия GigaChat для локального разворачивания (конкурент Qwen3-4B по скорости/сбалансированности).
    ➡ GitHub (https://github.com/salute-developers/gigachat3)

  • Kandinsky 5.0 — новая линейка для генерации изображений и короткого видео (Image Lite, Video Pro, Video Lite). Умеет HD-картинки, видео до нескольких секунд; есть облегчённые версии для домашних видеокарт.
    ➡ GitHub (https://github.com/kandinskylab/kandinsky-5)

  • K-VAE 1.0 — методы «упаковки» изображений/видео в скрытое пространство (speed / memory optimizations) — для ускорения генерации и снижения затрат.
    ➡ GitHub (https://github.com/kandinskylab/kvae-1)


ГигаЧат как полноценный ИИ-помощник — что нового

ГигаЧат переводят из «чата-консультанта» в ассистента, который выполняет задачи под ключ. Ключевые фишки:

  • естественный диалог (запомнит контекст, меняет интонацию, допускает прерывания);

  • выполнение задач: от оформления покупки до анализа отчёта и сборки подкаста на основе текста/ссылок;

  • маркетплейс агентов — каталог цифровых инструментов: помощник сам подберёт и подключит нужных «агентов» для задачи; уже доступны кейсы покупки/прослушивания книг и прочие интеграции;

  • генерация изображений/видео внутри ассистента на базе Kandinsky 5.0;

  • ассистент уже интегрирован в экосистему Сбера (веб Giga.Chat, мобильные приложения, упоминаются СберБанк Онлайн, СберKids, СберЗдоровье, СберОбразование и т. п.).

Важно: обещают, что Ultra-модель будет доступна и корпоративным клиентам — оптимизированной для размещения внутри периметра компании (то есть без ухода данных в публичное облако).


GigaCode и агентный режим (корпоративные и разработческие кейсы)

GigaCode — специализированный ассистент для программистов от Сбера; отдельно анонсированы GigaCode-агенты, которые можно подключать в GitVerse для автоматической проверки кода, ревью, поиска уязвимостей и других рутинных задач. Агент можно увидеть как «встроенного ревьюера», который автоматически добавляется в пул-рецензентов репозитория. Подробные инструкции по включению и использованию есть в документации GitVerse и обзорах. ➡ https://gitverse.ru/features/gigacode/

Что это значит — простыми словами

  1. Открытость. Весa и код ключевых моделей опубликованы под MIT — это даёт компаниям и исследователям возможность ставить модели у себя, дообучать и интегрировать без лицензионных ограничений.

  2. Технологический суверенитет. Для критичных отраслей это шанс держать данные и инференс в своём периметре, а не в чужих облаках.

  3. Практика и затраты. Большие MoE-модели (Ultra) потребуют серьёзного железа и оптимизаций — не «все и сразу» под силу малому бизнесу; лёгкие версии (Lightning, Image/Video Lite) — вариант для локального использования.

  4. Автоматизация и риски. Маркетплейс агентов и автономные ассистенты ускоряют рутину, но повышают требования к контролю доступа, валидации вывода и безопасности данных (особенно при подключении внешних сервисов).

 

Разное. Миджорни


 

Разное. Миджорни


 

Nano Banana Pro — что это и чем выделяется

Кот сидит на летающем в космосе троне. В одной руке держит клубок нитей, в другой открытые консервы кошачьего корма. Он царь этого мира, о чём гласит подпись сверху. В самой картинке инфографикой помечены основные места с пояснениями


//текст GPT5

Свежая модель от Google для генерации и тонкого редактирования изображений. Построена на базе Gemini 3 Pro Image и ориентирована на задачки, где важны детализация, аккуратный рендер текста и контроль над сценой.

Главные возможности

1. Текст и графика
Модель уверенно работает со шрифтами и многоязычными надписями. Это позволяет делать постеры, инфографику, презентационные слайды без типичных «искажений ИИ».

2. Точное редактирование
Можно менять ракурс камеры, свет, цвет, дорабатывать отдельные элементы. Поддерживается корректный ин-пэйнтинг — замена или дорисовка локальных областей.

3. Высокое разрешение
Выдаёт 2K и 4K-изображения. Качество пригодно для маркетинга, дизайна и печати, при этом файлы остаются умеренного веса.

4. Работа с референсами и персонажами
До 14 входных картинок для стилистической опоры и до 5 стабильных персонажей, что полезно для серийных сюжетов или брендинга.

5. Фактуальная генерация
Интеграция с Google Search помогает строить визуализации на реальных данных — карты, диаграммы, схемы.

6. Атрибуция и защита
Все изображения маркируются SynthID; бесплатная и Pro-версии имеют разные водяные знаки.

7. Доступность
Работает через Gemini-приложение, API, AI Studio и Vertex AI. Интегрируется в Workspace (Slides, Vids).

Ограничения

Генерация дороже и медленнее лёгких моделей; идеальная консистентность стиля пока не гарантирована. В ряде сервисов нужен платный ключ.

Итог

Nano Banana Pro выглядит как инструмент «профессионального уровня» для визуала: точная работа с текстом, высокая детализация, продвинутые правки. Уместна для маркетинга, дизайна, презентаций и аналитики. Если задачи простые, можно обойтись и более лёгкими моделями.

Пять сестёр сидят на лавке у узора с лебедями. У всех разные прически и цвет волос. Фотореализм
 
Vitaliy Kuznetsov #:
Пять сестёр сидят на лавке у узора с лебедями. У всех разные прически и цвет волос. Фотореализм
И все одного возраста.
 

Что-то меняется в мире. Мы перестали считать пальцы.

Но меня продолжает удивлять - ИИ пишут грамотные тексты, и хромают с грамматикой на графических надписях. Для них это продолжает быть изображением, а не сгенерированным текстом.