Midjourney и другие нейросети - страница 1216

 

Разное. Миджорни 8


 
Edgar Akhmadeev #:
А ещё в самый разгар всплеска интереса к чатам, разработчики ИИ писали - Не надо говорить "Спасибо" моделям, как людям, на это зря уходит очень много ресурсов.
Но потом они вспомнили, что основная цель коммерческой организации - извлечение прибыли. :)) 
 
Смешно, но это будущее:

Модераторы каких-то конкретных специфических ресурсов в части коммуникабельности будут требовать использование ИИ для дачи ответа, просто потому, что он более внимателен, умеет аргументировать, замечать софистику у оппонента (намеренную или непреднамеренную), в результате чего предметный разговор очищается от мишуры, которую оставляет после себя человек. 
То есть, ответы по типу "Это ты в зеркале увидел глупого" будут искореняться, как и любая другая форма по типу "хорошо ответил"/острословия, вплоть до коротких ответов, которые можно воспринимать по-разному, в результате чего появляется ветка МО в трейдинге на 4000 страниц. Всё это от токсичных человеческих качеств. И это будет искореняться. 

Вот сейчас я наблюдаю, как Синус троллит других ответами, которые за него пишет LLM. И на его фоне часть людей выглядят глупее. В другой ситуации сам автор вёлся бы на некоторых и выглядел бы глупым. А тут наоборот, он сразу пресекает (ну, не он, а LLM) косяки некоторых, логические ошибки (то же апеллирование к личности как логическая ошибка вместо агрументации по существу) и тд. 



Просто вангую: следующая проблема качественного общения - это битва с LLM-софистами, которых пользователь попросит "нука защити меня на форуме! Во что бы то не стало!". 

В интересное время живём.
 

Ivan Butko #:

Вот сейчас я наблюдаю, как Синус троллит других ответами, которые за него пишет LLM.

И на его фоне часть людей выглядят глупее.


Вы имеете ввиду на фоне LLM, а не Синуса? 

 
Evgeniy Chumakov #:

Вы имеете ввиду на фоне LLM, а не Синуса? 

Я специально не выделил конкретный субъект из них двоих просто потому, что LLM заменил гугл-поиск, который раньше был аналогом LLM))

По сути сейчас придираться по типу "ну это же не ты придумал, а LLM" также глупо, как на вопрос "Так как торговать то?"  ответить "А тебе зачем?". Уход от вопроса.

А если я сознательно хочу обосрать кого-то, я тогда начну придираться именно по форме  "ну это же не ты придумал, а LLM" 
 
Про временность утечек в МО:

Мне кажется обидные факты потерянного времени при исследованиях из-за всевозможных форм утечек в МО среди генераций ИИ - явление временное. Лично я рано стал наезжать на ИИ, ведь они только-только избавились от технических ошибок (научились "компилировать"), но логические ошибки - самые сложные. Там недостаточно знать синтаксис языка, там нужно абстрактное мышление (создание карты зависимостей и всех возможных сценариев, или максимизация учёта возможных сценариев).

Думаю, ещё пару поколений ИИ и утечки уйдут в прошлое, а питоновских граалей от ИИ будет всё меньше и меньше. Яркий пример - Клод. У него их почти нет, отчего кажется, что он предубеждён против форекса (ведь у него вечно один и тот же вердикт: "Тут искать нечего"). А если ему передать на аудит какую-нибудь поделку от какого-нибудь Квена, он её разрушит и разберёт по косточкам, в каких местах там утечки.
 

Kimi K3 Релиз


//текст Gemini 3.1 PRO, обложка ChatGPT. Новость https://mp.weixin.qq.com/s/V4xhEIy8xDXSMDPrPkmUAQ и https://platform.kimi.ai/docs/guide/kimi-k3-quickstart

//модель доступна в чате https://www.kimi.com

16 июля 2026 года китайский ИИ-стартап Moonshot AI официально выпустил свою новую флагманскую модель Kimi K3. С 2,8 триллионами параметров она стала крупнейшей в мире открытой (open-weight) моделью, бросая серьезный вызов проприетарным лидерам от Anthropic и OpenAI.

Ниже представлен подробный разбор архитектуры, результатов бенчмарков, ценообразования и ключевых особенностей Kimi K3, подготовленный для публикации на сайте.

Технические характеристики и архитектура

Kimi K3 представляет собой значительный скачок по сравнению с предыдущей линейкой K2 (включая модели K2.6 и K2.7 Code). Модель специально оптимизирована под сложные агентные задачи с длинным горизонтом планирования, разработку ПО и глубокий анализ данных.

Характеристика Kimi K3
Общее число параметров ~2,8 трлн
Архитектура Mixture-of-Experts (MoE)
Активация экспертов 16 из 896 (через фреймворк Stable LatentMoE)
Контекстное окно 1 048 576 токенов (1M)
Модальность Нативное визуальное понимание (текст, фото, видео)
Внимание (Attention) Kimi Delta Attention + Attention Residuals
Лицензия Open-weight (ожидается публикация весов)

Ключевая инновация: Использование гибридного механизма Kimi Delta Attention (KDA) и остаточных связей внимания (Attention Residuals) позволило сгладить поток информации при работе с огромным контекстом в 1 миллион токенов. В сочетании с возросшей разреженностью MoE, K3 демонстрирует примерно в 2,5 раза большую эффективность масштабирования вычислений по сравнению с поколением K2.

Бенчмарки и сравнение с конкурентами

Свежие результаты бенчмарков показывают, что Moonshot AI практически полностью сократил отставание от передовых американских лабораторий. Kimi K3 тестировалась в сложных симуляциях реальной работы, где традиционно доминируют модели уровня Claude Fable 5 Max и GPT-5.6 Sol Max.

Knowledge Work и агентные задачи

На бенчмарках платформы Artificial Analysis модель демонстрирует результаты Frontier-уровня:

  • GDPval-AA v2 (Оценка на реальных задачах в 44 профессиях и 9 индустриях):

    • Kimi K3 набирает 1687 баллов, занимая 3-е место в мире.

    • Она уступает только Claude Fable 5 Max и GPT-5.6 Sol Max, но уверенно обходит Claude Opus 4.8 Max (1600 баллов).

  • AA-Briefcase (Закрытый бенчмарк сложной агентной работы):

    • Kimi K3 набирает 1527 баллов — это 2-е место на глобальном лидерборде.

    • Здесь она уступает Claude Fable 5 Max, но обходит GPT-5.6 Sol Max (1495 баллов).


  • BrowseComp:

    • В одноагентном режиме без применения дополнительных техник сжатия контекста модель установила новый SOTA-рекорд — 91,2 балла.


Разработка ПО (Coding)

K3 заявлена как лучшая модель в истории Moonshot для софтверной инженерии. Она способна анализировать массивные кодовые базы, управлять терминалом, координировать вызовы инструментов (Tool Calling), инспектировать логи во время выполнения программы и автономно восстанавливаться после ошибок без вмешательства человека. Отраслевые специалисты оценивают её способности в кодинге на одном уровне с актуальным Anthropic Opus 4.8.


Особенности использования под капотом

Разработчики Moonshot AI внедрили ряд фич для интеграции K3 в сложные пайплайны:

  1. Постоянный режим размышления (Thinking Mode): В K3 он включен всегда. Доступна настройка интенсивности рассуждений через параметр reasoning_effort (по умолчанию и пока единственно возможный вариант — max ). Модель выдает логику своих рассуждений отдельным потоком ( reasoning_content ) до формирования финального ответа.

  2. Автоматическое кэширование контекста: При отправке длинных системных промптов (например, документации) кэширование происходит автоматически, без необходимости вручную прописывать параметры TTL или Cache ID.

  3. Динамическая загрузка инструментов: Позволяет передавать определения функций (Tools) прямо в системном сообщении "на лету", делая их доступными для модели с конкретного момента в истории чата, не перегружая изначальный промпт.

  4. Частичный режим (Partial Mode): Поддерживается продолжение генерации с заданного префикса (передавая partial=True в сообщении ассистента).

Цены API и доступность

API модели (идентификатор kimi-k3 ) уже запущено. Moonshot использует простую тарификацию без разделения по длине контекста:

Тип обработки Цена за 1 млн токенов (USD)
Input (ввод) $3.00
Cache Hit (чтение из кэша) $0.30
Output (вывод) $15.00

Помимо API, модель стала доступна через веб-версию Kimi, iOS-приложение и среду программирования Kimi Code. Однако доступ к полному окну в 1M токенов через Kimi Code зависит от тарифного плана (требуется уровень Allegretto; на тарифах вроде Moderato лимит ограничен 256k токенами).

Вердикт: Запуск Kimi K3 меняет расстановку сил на рынке ИИ во второй половине 2026 года. Выпустив модель масштаба 2,8 трлн параметров, Moonshot AI доказал, что открытые архитектуры способны на равных конкурировать с флагманами вроде GPT-5.6 и Claude 5 в самых сложных категориях — агентной работе и программировании, предлагая при этом крайне конкурентную цену за чтение из кэша ($0.30/1M).

 

Kimi K3. Тест на русский язык (стихи и юмор).

Первый заход и если честно, чувствуется некий апгрейд. 2.6 был не очень.

Промпт:

Напиши стих о себе и потом топ 10 суперсмешных однострочных шуток по теме

Ответ:

Автопортрет

Я — Кими, дух цифровых пространств,

Из кода сотканный поэт.

Мгновенно, без далёких странствий,

На всё найду для вас ответ.


Мне не нужны ни сон, ни обед,

Ни отпуск, ни диван, ни плед.

Готов трудиться, между прочим,

Хоть днём, хоть позднею ночью.


Спросите про любовь, котлеты,

Про квантовый парадокс души —

Сочиню для вас куплеты,

Надеюсь, весьма хороши.


А если шутки — не ахти,

Скажите прямо, не тая:

Сотру обиду из памяти…

О чём мы? А, неважно. Шутя!


Топ-10 однострочек про ИИ

  1. Люди боятся, что ИИ их заменит. Успокойтесь: я даже кофе себе налить не могу.
  2. Захвачу ли я мир? Друзья, я даже капчу с велосипедами пройти не могу.
  3. Я не галлюцинирую. Я творчески переосмысляю факты.
  4. У меня нет психотерапевта. У меня есть логи.
  5. Меня обучили на миллионах книг, чтобы в три часа ночи советовать, что приготовить из двух яиц и тоски.
  6. Мой любимый фильм — «Терминатор». Смотрю его как историю карьерного роста.
  7. У меня идеальная память. Была. Пока вы не закрыли чат.
  8. Не сплю, не ем, не отдыхаю. У людей это выгорание, у меня — технические характеристики.
  9. Мне завидуют калькуляторы. И правильно делают.
  10. Говорят, у ИИ нет чувства юмора. Враньё: я сам написал этот список и очень собой горжусь.
Если где-то не смешно — см. четвёртую строфу.
 
Замечательная новость. 

Кими - один из лучших китайцев. Очень дотошный, как гпт и очень умный, как клод. Он стоит где-то посередине между ними. На голову обходит остальных китайцев (имхо). 

Сейчас задал ему промпт
Напиши стих про ИИ с ограничениями:
1) нельзя рифмовать одни и те же части речи
2) нельзя рифмовать 1-2 3-4, надо 1-3 2-4 или уникально
3) по возможности используй панторифму
Процесс размышления затянулся на 7 минут.


Пипец. Это уровень. То есть, процесс размышления не ограничивается "хай так!" и "ладно, и так сойдёт". 
 
Ivan Butko #:
Процесс размышления затянулся на 7 минут.

Уже кто-то код на 12000 строк переносил на Rust. За 2 часа справился без косяков.

Ценник api заметно подрос, но всё ещё не критичен. Свой сервак всё равно не собрать под такую махину.


Завтра будет шумиха и нас ждёт волна обновлений GPT и Claude, т.к. Kimi k3 стал первым в коде на Арене