<?xml version="1.0" encoding="utf-8" ?><rss version="2.0" xmlns:tt="http://teletype.in/" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:media="http://search.yahoo.com/mrss/"><channel><title>@dolovar</title><generator>teletype.in</generator><description><![CDATA[@dolovar]]></description><link>https://teletype.in/@dolovar?utm_source=teletype&amp;utm_medium=feed_rss&amp;utm_campaign=dolovar</link><atom:link rel="self" type="application/rss+xml" href="https://teletype.in/rss/dolovar?offset=0"></atom:link><atom:link rel="next" type="application/rss+xml" href="https://teletype.in/rss/dolovar?offset=10"></atom:link><atom:link rel="search" type="application/opensearchdescription+xml" title="Teletype" href="https://teletype.in/opensearch.xml"></atom:link><pubDate>Wed, 23 Sep 2026 07:27:32 GMT</pubDate><lastBuildDate>Wed, 23 Sep 2026 07:27:32 GMT</lastBuildDate><item><guid isPermaLink="true">https://teletype.in/@dolovar/9XwmAvXiaDP</guid><link>https://teletype.in/@dolovar/9XwmAvXiaDP?utm_source=teletype&amp;utm_medium=feed_rss&amp;utm_campaign=dolovar</link><comments>https://teletype.in/@dolovar/9XwmAvXiaDP?utm_source=teletype&amp;utm_medium=feed_rss&amp;utm_campaign=dolovar#comments</comments><dc:creator>dolovar</dc:creator><title>IDE годится не только для программирования</title><pubDate>Thu, 26 Feb 2026 08:27:29 GMT</pubDate><description><![CDATA[(написано для тг-канала Нейрокухня Доловара)]]></description><content:encoded><![CDATA[
  <p id="5NgU">(написано для тг-канала <a href="https://t.me/neurokuh" target="_blank">Нейрокухня Доловара</a>)</p>
  <p id="5Pvz">Если вы ведете заметки в блокноте, составляете документы или ведете блог, и при этом у вас возникают мысли вроде &quot;надо бы проверить на опечатки&quot;, &quot;не забыл ли я вписать что-то важное&quot; или &quot;чепуха получается, надо что-то переделать, понять бы что именно&quot;, то эта статья может быть вам полезна.</p>
  <p id="Wlp8">TL;DR: Специалистам вряд ли будет интересно, текст для начинающих. Речь пойдет о том, как использовать IDE для управления базой своих текстов. О различиях между конфигами, скиллами и воркфлоу. О названиях файлов и простейших способах экономии токенов. Подобного добра в интернете уже много, но я не со всем согласен, поэтому напишу своё.</p>
  <hr />
  <p id="VmYS">У меня есть папка со скромным названием &#x60;texts&#x60;, в которой лежат, вы не поверите, текстовые файлы. По подпапкам разложены архивы постов в ЖЖ и Телегу, статьи на каких-то площадках, черновики книг, мелкие заметки, документация по разным проектам, заготовки промптов и что-то там еще.</p>
  <p id="xiIt">Формат текстовых файлов - Markdown. Это то же самое, что текст, только расширение не &#x60;.txt&#x60;, а &#x60;.md&#x60;. Данный формат понимается практически всеми редакторами и позволяет сохранять форматирование, вроде заголовков или выделения курсивом. Немного удобнее, чем просто текст.</p>
  <p id="9nE0">Папка регулярно синхронизируется с облачным хранилищем, изменения отправляются в приватный (не в публичный, это важно) репозиторий на GitHub. Это создает бакап (люблю бакапы), а также позволяет подтягивать папку на другие компьютеры или на мобилку. Подредактировал в одном месте - изменения разбегутся по всем моим рабочим местам. Удобно. Плюс могу откатывать изменения, если случайно удалю важный файл или захочу отменить вчерашние изменения. А если я потеряю доступ к блокноту, компьютеру или сервису, то не потеряю свои наработки (не люблю Notion и другие программы с проприетарными хранилищами, которые нарушают мой суверенитет над моими данными).</p>
  <p id="kmAm">Но что еще удобнее, так это возможность работать с этой папкой как с проектом в IDE. Integrated Development Environment - это как бы среда разработки, такая специальная большая программа, которая изначально обрастала специальными фичами для работы с кодом какого-нибудь программного продукта. Там есть подсветка кода, предупреждения об ошибках, удобство навигации по множеству взаимосвязанных файлов, автоматизация тестов и деплоймента, а также другие специализированные фишки для программистов. Но, по сути, это просто очень продвинутый текстовый редактор. Который хорошо подходит для работы с базой текстов.</p>
  <p id="volW">Современные IDE очень сильно продвинулись в работе с ИИ-агентами. Программисты и просто продвинутые пользователи могут в чате с ИИ попросить что-нибудь найти, создать или исправить, и хитро настроенные команды ИИ-агентов (оркестры) бросаются выполнять поставленные задачи, пока пользователь попивает чай, раздумывая о следующем этапе работы. Или проверяет результат работы агентов (на это сейчас уходит основная часть работы - не доверяй, проверяй).</p>
  <p id="MeHF">Уже есть много AI IDE, и постоянно появляются новые: VS Code, VS Codium, Cursor, Windsurf, Antigravity, Zed, Trae, PearAI и так далее. Для разных платформ, платные и бесплатные, оконные и консольные. Глаза разбегаются, благо можно обсудить выбор с ИИ, описав ему свои задачи и возможности.</p>
  <p id="Jkur">***</p>
  <p id="WkVX">Вернемся к базе текстов. Открываем папку в IDE и начинаем работу - правим черновики, добавляем новые, удаляем старые. Как в обычном блокноте. Например, я пишу новый пост в телегу и... И постоянно вижу работу механизма автодополнения, который предлагает мне продолжение фразы или исправление опечатки в набранном тексте. Могу просто нажать кнопку &quot;Tab&quot;, чтобы принять предложение, вместо того, чтобы бежать курсором к месту, в котором нужно исправить опечатку. Или нажать &quot;Esc&quot;, чтобы ИИ отстал, убрал свое неуместное предложение. Или просто продолжить писать своё, не обращая внимания на старательного помощника. Автодополнение сейчас вполне умное, но это лишь начало удобств.</p>
  <p id="GNxx">При переходе от работы с отдельными документами в Word или Docs к работе с базой текстов быстро появляется ощущение масштаба - дорогого стоит возможность видеть дерево файлов в архиве и делать смысловой поиск по всей базе. Особенно когда текстов становится много.</p>
  <p id="sbhZ">Набираю новый текст и включаю справа панель для беседы с ИИ-агентом. Привычное окошко чата, в котором я могу попросить ИИ, например, проверить свеженабранный текст на ошибки фактические, смысловые, грамматические, стилистические и любые другие. Теоретически, можно даже попросить ИИ переписать или дописать текст, но не делайте этого (плохая дорога на свалку нейрослопа). Зато можно пообщаться с ИИ, если мысль зашла в тупик - вот тут я что-то хочу выразить, но не могу понять что именно, давай прикинем возможные продолжения.</p>
  <p id="vSUK">Разумеется, всё это можно делать просто в веб-браузере на сайте какого-нибудь ИИ, но в IDE этот ИИ будет иметь доступ ко всем вашим файлам, будет лучше понимать ваши интересы и стиль. Зачем постоянно копипастить куски текстов в домик ИИ, если можно пригласить ИИ в гости к текстам?</p>
  <p id="VEnf">Впрочем, есть одна причина не звать ИИ в гости - когда вас смущает то, что ваши сокровенные тексты улетят в чужое облако, где разработчики ИИ могут подглядывать. В моем случае все тексты так или иначе превращаются в публикации, поэтому я не против использования GitHub и облачных ИИ. Но, разумеется, не стоит хранить пароли, API-ключи от нейросетей и прочую чувствительную информацию в папке проекта, с которым будут работать ИИ-агенты, и которая будет сохраняться в облаке (пусть даже приватном).</p>
  <p id="a1SF">Если у вас есть папка с текстами, и вы ежедневно с ними работаете, то есть смысл попробовать IDE. Например, Antigravity от Google сейчас предоставляет неплохие бесплатные лимиты, вполне можно поставить и пощупать (это не оплаченная реклама, но благодарность за то, что меня всё ещё не забанили за мои эксперименты). Если не понравится, то можно поставить на пробу другую IDE, благо папка с текстами не страдает от смены программы редактирования.</p>
  <p id="coJH">Если понравится, то вы быстро заметите, что ИИ не всегда понимает ваши замыслы, его приходится часто поправлять и направлять. Возникает желание настроить среду под себя. И здесь мы переходим к главной теме: а как вообще можно настраивать ИИ-среду? Об этом и пойдет речь.</p>
  <p id="m8QC">***</p>
  <p id="Rhjs">При настройке умной IDE под себя важно помнить главное - вы никому ничего не должны. Если в каком-нибудь обучающем видео или статье говорят &quot;обязательно сделайте&quot;, то они не правы, слишком увлеклись. Все настройки должны делаться только по одному принципу - я встретил неудобство и хочу его исправить.</p>
  <p id="274r">Например, мне надоело постоянно объяснять IDE, что вот в такой-то папке у меня лежат заготовки текстов для такой-то площадки, где свои целевая аудитория, формат и прочие особенности. Я хочу это прописать раз и навсегда, чтобы IDE всегда понимала автоматически при любых работах с данной папкой. Такую настройку называем словом &quot;**конфиг**&quot; (системный промпт, пользовательские настройки, политики проекта, правила поведения агентов).</p>
  <p id="wXD5">Или я заметил, что часто прошу выступать ИИ в определенных ролях. Если я прошу его побыть скептиком, то ему следует выискивать одно, а если прошу его побыть мотиватором, то ему следует сосредоточиться на другом. В каждой роли есть свои особенности, которые явно не стоит класть в системный промпт, настолько они разные. Это называем словом &quot;**роли**&quot; (специальности, скиллы, навыки).</p>
  <p id="ZQIc">Еще пример, у меня в работе есть последовательность действий, которую я выполняю регулярно - свеженаписанный текст нужно проверить сначала на соответствие фактам, логичность выводов, затем на читабельность, а в конце на чистописание. Это называем словом &quot;**сценарий**&quot; (алгоритм, скрипт, воркфлоу).</p>
  <p id="OJxW">Всё это добро можно положить в один большой промпт, который сохранить как текстовый файл в корневой папке проекта. IDE будет автоматически подгружать его содержимое и учитывать в своей работе. Но если инструкций стало слишком много, если они стали противоречивыми, то появляется смысл разделить их, хранить в разных местах.</p>
  <p id="Ix1h">На разделении &quot;хранить в разных местах&quot; спотыкаются многие - становится сложно, в правилах можно утонуть, не хочется тратить силы еще и на прописывание конфигов. Напоминаю главный принцип - настройки делаются не из-за &quot;сказали что так надо&quot;, а для &quot;вижу возможность добавить удобство&quot;. Каждая строчка настроек должна добавляться осознанно. Если настройка уменьшает утомление, то настройки не будут утомительны, даже когда они разрастаются.</p>
  <p id="aRrT">Подсматривать в чужие примеры можно, их много есть в интернете, но не для бездумного копирования всего подряд, а для поиска возможностей - ух ты, оказывается еще и это можно автоматизировать, это мне поможет, беру.</p>
  <p id="PAOO">***</p>
  <p id="VJNv">Начнем с самого простого - конфиг в корневой папке. Это просто текстовый файл, в котором мы пишем промпт: в данной папке лежит то-то, обращайся с этим так-то, делай хорошее и не делай плохого.</p>
  <p id="cdn0">Есть много разнородных рекомендаций о названии такого файла:</p>
  <p id="pKKl">- &#x60;.cursorrules&#x60;, &#x60;clinerules&#x60;, &#x60;.windsurfrules&#x60;, &#x60;.github/proposals&#x60;, &#x60;.vscode/*&#x60; - лично мне подобные варианты не нравятся из-за привязки к конкретным IDE или инструментам.</p>
  <p id="7XLk">- &#x60;GEMINI.md&#x60; - с таким названием файла Antigravity не будет тратить лишний запрос на чтение, IDE автоматически подтянет файл. А вы будете постоянно видеть рекламу гуглового ИИ в списке своих файлов (хитро придумали).</p>
  <p id="jQhs">- &#x60;AGENTS.md&#x60; - более распространенный вариант, который понимают разные IDE, но лично мне не нравится из-за того, что капслок &quot;мозолит&quot; глаза. Предпочитаю, чтобы взгляд цеплялся за мои файлы, а не за вспомогательные.</p>
  <p id="368v">- &#x60;.ai-rules.md&#x60; - мне нравится такой универсальный вариант, но не настаиваю.</p>
  <p id="5H78">- Или любой другой вариант названия, который будет очевидно понятен как человеку, так и ИИ-агентам в любой IDE.</p>
  <p id="wPZx">Начать писать такой файл можно одной строчкой текста: &quot;в этой папке лежат мои тексты, не вздумай их переписывать, здесь автором является человек&quot;. Ну или что там для вас является главным. Следует добавлять новые правила тогда, когда вы замечаете, что надо бы что-то автоматизировать, зафиксировать или исправить, чтобы не писать это всякий раз в промпте вручную.</p>
  <p id="louT">Неспешно продумываем и прорабатываем этот файл. Специалисты делают это месяцами. Например, добавляем в конфиг карту проекта - структуру подпапок с описанием желательного поведения в них. Теперь ИИ будет тратить меньше ресурсов на попытки понять, где что искать, и что с этим делать.</p>
  <p id="tT1p">Если не понятно, что вообще следует прописывать в конфиге, то можно обсудить это в чате с ИИ - у меня есть вот такая-то задумка, посоветуй возможности. Но я бы советовал добавлять правила только по мере необходимости, а не по принципу &quot;ну люди же делают, авось и мне пригодится&quot;.</p>
  <p id="dOXg">Если хочется, чтобы ИИ-агенты лучше ориентировались в вашем проекте, но спецификации и прочая документация занимают слишком много места, можно не тянуть их в одну кучу, а ссылаться из файла конфига - если нужна структура, то найдешь в таком-то файле, а если нужны особенности бренда, то смотри вон в той папке. Так, как вы бы объясняли человеку. В таком случае ИИ-агенты не будут загружать в контекст всё подряд на каждый запрос, а будут подтягивать только ту информацию, которая покажется им релевантной для текущей задачи.</p>
  <p id="U7W9">Если корневой конфиг разросся слишком сильно, его можно разделить - правила для подпапок перенести в точно такие же файлы конфигов, которые будут лежать в этих подпапках. При этом в корневом конфиге упоминаем &quot;если в папке есть локальные правила, то они имеют больший приоритет&quot;, чтобы уменьшить вероятность конфликта инструкций.</p>
  <p id="CGdR">***</p>
  <p id="HLfm">Конфиг - это промпт. Часть всего того, что улетит в ИИ для создания контекста, опираясь на который ИИ будет выстраивать свои ответы и действия. А значит, в файле с конфигом можно и следует использовать все правила промптинга, которые вам покажутся уместными - заголовки, списки, выделение болдом ключевых слов и т.д.</p>
  <p id="AZEI">Обычно промпты начинают с указания роли: дорогой ИИ, сейчас представь себя таким-то специалистом и следующие инструкции воспринимай с этой точки зрения, поступай профессионально. Проблема в том, что при работе над проектом разные ИИ-агенты должны исполнять разные роли. Прописывать всевозможные роли в файле конфига - это способ создать противоречия и раздуть системные инструкции избытком того, что нужно только при решении некоторых задач.</p>
  <p id="17bz">Можно создать файлы с конфигами для разных ролей, и в основном конфиге прописать что-то вроде &quot;если тебя просят сделать то-то, то смотри дополнительные инструкции там-то&quot;. Но в ИИ-индустрии это уже стандартизировали, назвав словом &quot;Skills&quot; (навыки), поэтому имеет смысл ознакомиться со стандартным подходом.</p>
  <p id="7fbD">Если вы только знакомитесь с AI IDE, то рекомендую прямо в этой IDE в окне чата с ИИ-агентом поставить ему задачу: я планирую тут использовать таких-то агентов, продумай и создай для них скиллы. Если вы используете достаточно современную и умную AI IDE, то вам выпадет шанс на практике увидеть, как агент создаст папку &#x60;.agent/skills&#x60;, в которой разложит настройки под каждую роль из списка заказанных. Это и есть стандартный подход к организации ролей - текстовые файлы, разложенные по папкам в специальной директории, где хранятся дополнительные инструкции для ИИ-агентов.</p>
  <p id="qkzE">Скиллы от прочих промптов и конфигов отличаются разве что заголовком с &quot;name&quot; и &quot;description&quot;. Особенно важно &quot;описание&quot; - оно должно быть кратким, и оно должно позволять ИИ-агентам понимать, в каких задачах следует подтянуть инструкции именно из данной роли.</p>
  <p id="i0SW">Кроме &quot;name&quot; и &quot;description&quot; в скиллах можно прописывать и другие ключевые слова, но это уже информация не для начинающих. Желающие могут самостоятельно найти и проверить возможные опции (лично мне нравится disable-model-invocation).</p>
  <p id="5wbc">Для работ над базой личных текстов могут пригодиться такие роли: корректор (знаток орфографии и пунктуации), бета-ридер (оценка читабельности и интересности), скептик (спарринг-партнер для проверки идей на прочность), фактолог (борьба с галлюцинациями). Добавляйте роли по мере надобности: индексирующий архивариус, генератор расширений, валидатор списков, сюжетный выравниватель, культурный локализатор, SEO-оптимизатор, хранитель секретов, мастер иллюстраций, искатель трендов, создатель брендбуков... Но не пытайтесь прописать заранее всё, что придумается, добавляйте новое только по мере необходимости.</p>
  <p id="j7JC">После создания скиллов можно пробежаться по конфигам в разных папках, добавить советы по привлечению специалистов. Старые тексты - не нужно сюда звать корректора, это уже не будет обновляться. Документация - тут нечего делать бета-ридеру, зато здесь есть работа для библиотекаря. Новая статья - подключай всех подряд.</p>
  <p id="y5RO">В интернете есть целые сайты с коллекциями Skills - проработанных, богатых деталями. Можно подсмотреть и забрать себе что-нибудь, если лениво продумывать самостоятельно. Но я бы рекомендовал всё скачанное дорабатывать напильником под себя, чтобы не раздувать промпты тем, что лично вам не нужно. Принцип &quot;выкидывать лишнее&quot; особенно пригодится, если вы решите перейти на платные подписки, где всякий токен имеет свою цену.</p>
  <p id="eaY2">И да, существуют скиллы типа &quot;Мастер скиллов&quot; - проработанные промпты, которые учат ИИ-агентов создавать новые или улучшать старые скиллы.</p>
  <p id="5Oo9">***</p>
  <p id="8fdZ">В современных AI IDE есть два режима работы агентов - по-быстрому и с планированием. Во втором случае запускается могучий сценарий совместной работы нескольких ИИ-агентов: сначала вникаем в задачу, задаем дополнительные вопросы человеку, после чего составляем план действий с чек-листом, затем выполняем последовательность намеченных этапов, после чего составляем отчет о проделанной работе. Для сложных задач вроде &quot;создай новый проект&quot; рекомендуется запуск именно планирования. Для более простых задач лучше выбирать режим попроще, чтобы не расходовать лимиты запросов и токенов впустую.</p>
  <p id="53Uh">Но и режим &quot;попроще&quot; можно сделать более умным, создавая сценарии для типовых работ. В своей личной работе следует отмечать регулярные последовательности действий - я обычно делаю сначала одно, потом второе, а заканчиваю третьим. Если нужно, чтобы ИИ-агент следовал такому же алгоритму, то следует прописать его где-то, создать соответствующий промпт. Например, в папке &#x60;.agent/workflows/&#x60; можно вручную создать файл с промптом, в котором расписаны шаги по какому-то сценарию. Или можно ИИ-агента попросить создать, додумать и расписать сценарий, чтобы затем полюбоваться на то, как сценарии вообще должны оформляться (там тоже важен &quot;description&quot; в начале).</p>
  <p id="Ietj">В разных IDE могут быть приняты разные названия и формат файлов со сценариями для ИИ-агентов. Если вы планируете попробовать работу с разными IDE, то рекомендуется использовать такие названия папок и файлов, которые будут более-менее универсальны, понятны и человеку, и ИИ. Для верности можно добавить упоминание названия папки со сценариями в корневом конфиге, и тогда умный ИИ-оркестр не пройдет мимо, подхватит и применит при получении соответствующей задачи.</p>
  <p id="qLfa">И можно не надеяться на автоматическое распознавание, а при постановке задачи вручную указывать требуемый Скилл или Воркфлоу - используй их сейчас. Зачастую в IDE в поле ввода задачи даже есть кнопки для выбора из имеющихся. Например, в Antigravity можно перетащить файл роли или сценария прямо в беседу с агентом. Или при наборе промпта ввести &quot;/&quot;, чтобы получить выпадающий список с доступными ролями и сценариями. Или в конфиге конкретной подпапки прописать &quot;при задаче &#x27;проверить&#x27; иди по такому-то сценарию&quot;.</p>
  <p id="VVFJ">***</p>
  <p id="qbUy">Повторим список возможностей по настройке агентов в IDE:</p>
  <p id="3S1c">- **Конфиги** - это правила, рекомендации и запреты.</p>
  <p id="snAb">- **Скиллы** - это специализации, уточнение ролей, добавление профессионализма.</p>
  <p id="nxjY">- **Воркфлоу** - это сценарии, то есть оптимальные последовательности команд.</p>
  <p id="3gQ4">Границы между ними размыты. Например, часто конфиги задают ролевое поведение, скиллы содержат воркфлоу, а в сценариях прописаны конфигурационные правила. Не удивляйтесь, когда встретите примеры, где все файлы содержат всё подряд. Главное - чтобы человек, который этим пользуется, понимал и помнил, где у него что лежит.</p>
  <p id="2vv1">Можно встретить очень разные архитектуры проектов. Например, в папке &#x60;Agents&#x60; будут лежать скиллы со сценариями, в папке &#x60;Scripts&#x60; будут лежать вспомогательные инструменты, а в папку &#x60;Executions&#x60; будут складываться отчеты о проделанной работе. И в корне проекта будет лежать одинокий &#x60;README.md&#x60;, в котором для человека и ИИ-агентов будет рассказано, где что лежит, и как этим пользоваться.</p>
  <p id="Nb4k">И всё это - промпты. А значит не помешает вспомнить, что вообще могут содержать промпты.</p>
  <p id="HJNK">Если у вас возникла мысль &quot;что-то конфиг получился маловат, надо бы что-нибудь добавить&quot;, то воспользуйтесь следующим чек-листом:</p>
  <p id="fVCA">* **Факты**: знания о том, где мы находимся, с чем работать, где искать дополнительную информацию.</p>
  <p id="UHuT">* **Установки**: роль и цели ИИ, цели человека.</p>
  <p id="vq7s">* **Команды**: что делать (предписания), что не делать (запреты и ограничения, &quot;негативный промпт&quot;).</p>
  <p id="ivQb">* **Примеры**: образцы критериев, ответов и других опорных точек, которые помогут ИИ лучше понять задачу.</p>
  <p id="sl4o">* **Сценарии**: рекомендуемый порядок выполнения последовательности команд (возможны ветвления и переходы, досрочные и аварийные остановки).</p>
  <p id="4d06">* **Маркеры**: заголовки, списки, выделение ключевых слов и прочее форматирование, которое помогает ИИ ориентироваться в тексте и правильно расставлять акценты.</p>
  <p id="BcDi">* **Мета-данные**: то, что помогает увязывать несколько последовательных промптов в единую задачу.</p>
  <p id="twxz">Если возникла мысль &quot;вроде бы в конфиге всё есть, но работает плохо&quot;, то пригодятся критерии для оценки качества промптов. Еще один полезный чек-лист для выявления возможных проблем:</p>
  <p id="vlEP">* **Конкретность**: давать не только общее направление, но и точные инструкции, чтобы ИИ не гадал про замысел.</p>
  <p id="Si0K">* **Однозначность**: если инструкция допускает несколько разных толкований, то её следует переформулировать.</p>
  <p id="j53e">* **Ограничения**: помогают в создании конкретности и однозначности.</p>
  <p id="gBMO">* **Непротиворечивость**: нельзя требовать разного. В случае каскадного промптинга, когда воедино сливаются промпты из разных файлов, нужно хотя бы прописать приоритеты, например: локальное важнее глобального, сценарий важнее роли.</p>
  <p id="nBhk">* **Полнота**: даны все знания и установки, которые нужны для получения качественного результата.</p>
  <p id="2xDP">* **Релевантность**: отправляемая информация относится к текущей задаче, а не ко вчерашней или к параллельной.</p>
  <p id="I435">* **Неизбыточность**: не отправлять за раз слишком много информации и команд, чтобы ИИ не захлебнулся, рассеяв внимание. Обычно помогают конкретность и релевантность, но иногда приходится прибегать к декомпозиции задач.</p>
  <p id="bCCD">* **Краткость**: если для инструкции есть несколько вариантов написания, которые похожи по конкретности и полноте, то следует выбрать как можно более короткий вариант.</p>
  <p id="IsU7">* **Язык**: из синонимичных выбирайте те выражения, которые лучше понятны ИИ, а не человеку. Ему с этим работать.</p>
  <p id="83Mn">* **Консистентность**: единообразие терминов и формулировок. Например, &quot;проверка&quot;, &quot;анализ&quot; и &quot;ревизия&quot; - это не одно и то же для ИИ, художественное разнообразие в промптах не нужно и даже вредно.</p>
  <p id="vYRC">* **Защищенность**: если в промпт подставляется содержимое произвольных файлов, то оно должно быть оформлено и подкреплено инструкциями так, чтобы случайно (или зловредно) попавшееся подобие команды не сбивало рабочий процесс. В IDE этим занимаются встроенные механизмы оркестрации, но если вы планируете в своей базе текстов держать заготовки промптов, то не помешает добавить в конфиг несколько защитных заклинаний.</p>
  <p id="a0wp">* **Структурированность**: формулировки и форматирование помогают ИИ понять, к чему относится каждая фраза. Как минимум, разделяйте факты и команды.</p>
  <p id="393F">* **Связность**: группируйте схожие инструкции и предваряйте списки заголовками (пояснениями), чтобы ИИ не спотыкался на слишком резких переходах между разнородными мыслями.</p>
  <p id="opMv">* **Акценты**: если есть хоть малейший риск возникновения неоднозначности или переполнения внимания, то указывайте, что является главным, а что второстепенным (форматирование в помощь).</p>
  <p id="CHEw">Если данный чек-лист выглядит слишком сложным, то он вам не нужен. На начальном уровне главное - это баланс между крайностями полноты и избыточности. Давать для картины контекста все необходимые детали и не давать лишнего. Если конфиг &quot;захромал&quot;, то или не хватает нужного, или есть лишнее.</p>
  <p id="0E6F">***</p>
  <p id="OmJc">Когда я пишу в чате с ИИ-агентом &quot;сделай такую-то задачу&quot;, в нейронку улетает большой текст, состоящий из разных частей:</p>
  <p id="xlkV">- Наверняка добавятся инструкции по конкретной задаче (пользовательский промпт).</p>
  <p id="N3X5">- Автоматически добавятся инструкции из системного промпта плюс история беседы (если она была).</p>
  <p id="uh82">- По мере надобности будут догружаться агентские инструкции из конфигов, скиллов и инструментов. Например, агенты могут прочитать содержимое папки, заинтересоваться какими-то файлами и самостоятельно добавить их содержимое себе в контекст.</p>
  <p id="Son0">Поскольку агентские конфиги лежат в корневой директории и в подпапках, скиллы могут подтягивать друг друга, и по мере чтения файлов могут подключаться разные сценарии, можно говорить о том, что мы перешли к каскадному промптингу. И это значит, что приходится больше внимания уделять устранению возможных противоречий и борьбе с избыточностью.</p>
  <p id="joiL">По сути, это уже переход от промптинг-инженерии к контекст-инженерии - мы заботимся уже не только об отдельных формулировках, но и о сочетании формулировок из разных файлов. Мы разделяем промпты по ролям и задачам, а не сваливаем всё в одну кучу, чтобы не переполнить контекст отправкой всего подряд. Если где-то раздувается файл с промптом, значит пора его декомпозировать, разделить на несколько более узко специализированных и прописать, какая часть нужна в каких-то конкретных случаях.</p>
  <p id="HAQP">Например, если какой-то скилл стал слишком тяжелым, то выносим тяжелые части в соседние файлы. В &#x60;.agents/skills/skillName/&#x60; могут появиться подпапки:</p>
  <p id="lpjh">- &#x60;references&#x60; - справочная документация и примеры, которые иногда могут понадобиться при работе данного скилла.</p>
  <p id="n2he">- &#x60;assets&#x60; - файлы, которые содержат не знания, а дополнительные настройки, шаблоны или иные ресурсы.</p>
  <p id="Ifan">- &#x60;scripts&#x60; - скрипты и утилиты, инструменты, которыми скилл может пользоваться.</p>
  <p id="YfQL">- &#x60;storage&#x60; - логи, индексы и другая информация, которую скилл будет собирать и использовать при работе.</p>
  <p id="me7C">- &#x60;tests&#x60; - юнит-тесты для проверки логики скриптов и корректности ответов скилла.</p>
  <p id="S5fB">- Или что-нибудь иное.</p>
  <p id="blKs">На начальном уровне это обычно не требуется, но если вы захотите скачать из интернета какой-нибудь скилл или воркфлоу и увидите, что там не просто файл с кусочком промпта, а какая-то сложная структура, то вам следует знать, что так бывает. И в таком случае вам следует не полениться и заглянуть в скачанное, чтобы проверить, нет ли там чего-нибудь вредоносного. В интернете выкладывают не только полезное, увы.</p>
  <p id="bnfF">И вся эта сложность нужна для того, чтобы не переполнить контекст и внимание модели тем, что иногда вроде бы полезно, но не относится к текущей задаче.</p>
  <p id="L021">На продвинутом уровне в AI IDE подключаются инструменты (начиная с RAG и MCP-сервисов), которые позволяют расширять возможности ИИ-агентов. Например, можно дать своим ИИ-агентам возможность запрашивать информацию из какой-нибудь вашей базы данных. Но я сейчас вернусь к более простым настройкам.</p>
  <p id="LPjl">***</p>
  <p id="2IMs">Вы уже настроили бакап ваших ценных файлов в облако? Если вы выбрали GitHub, то не забудьте прописать в файле &#x60;.gitignore&#x60; списки того, что именно следует отправлять, а что отправлять не нужно (логи и тяжелые архивы лучше не держать рядом с текстами). Плюс настройте автоматическую отправку по времени (вечером) и по нажатию кнопки (после больших и важных изменений). Если вы планируете редактировать вашу базу с разных компьютеров, синхронизируя изменения через облако, то вам также нужно получить информацию о том, как в Git решать возможные конфликты (один файл менялся из двух мест). Как всё это сделать - вам может подсказать ИИ.</p>
  <p id="lO70">Если вам надоела назойливость автодополнения (Suggestions), то следует заглянуть в настройки IDE и выключить лишние опции. Если вам не нравится расположение окон, цветовое оформление, хочется увеличить шрифт или овладеть горячими клавишами для ускорения работы, то следует заглянуть в настройки и справку IDE. Где всё это искать и менять - вам может подсказать ИИ.</p>
  <p id="0XyK">Если вам не хватает автоматической проверки орфографии или хочется, чтобы редактируемый абзац подсвечивался немного ярче, чем соседние (это реально удобно), то вы можете добавить в IDE множество плагинов. Их тысячи. В выборе и настройке вам может оказать помощь ИИ.</p>
  <p id="QrY2">Если вы решили полностью пересесть на IDE, отказаться от других сервисов автоматизации (N8N, например), то вы можете расширять функционал IDE так, как вам позволит фантазия. Если фантазии не хватает, то можно посоветоваться с ИИ.</p>
  <p id="UvNf">Серьезно, современные большие облачные ИИ уже неплохо знакомы с современными AI IDE, их ответы зачастую более информативны и быстры, чем поиск в интернете.</p>
  <p id="QNk5">NB: В этом месте я запнулся, потому что Google Gemini 3 попытался убедить меня, что не существует никакой Google Antigravity IDE. Но при этом он охотно подсказал мне список рекомендуемых плагинов для писательской работы в этой IDE. Бывает и такое, пройдет через пару месяцев при обновлении версии.</p>
  <p id="dTYI">Здесь самое время вспомнить про существование веб-сайтов, где с этими ИИ можно чатиться. Работа ИИ-агентов в IDE имеет свои ограничения - лимиты на частоту и объем запросов. Особенно на бесплатном пробном тарифе. Чтобы не исчерпать эти лимиты слишком рано, любые вопросы &quot;как мне лучше сделать&quot; или &quot;давай обсудим&quot; следует делать не в IDE, не в чате с агентом, а в браузере, зайдя на привычный сайт любимого ИИ. Лимиты в IDE и лимиты на сайте - это разные лимиты, даже если вы залогинены везде одним аккаунтом. Приберегите ресурсы в IDE для работы, беседовать лучше в других местах.</p>
  <p id="4Bvv">Предполагаю, что контекст читателя уже переполнился, внимание размылось.</p>
  <p id="qM0m">-- Какой заяц? Какой орел? Какая блоха?! (с) мультфильм &quot;Ух ты, говорящая рыба!&quot;</p>
  <p id="3K2I">Если вам что-то кажется сложным (какой-то гит, плагины, юнит-тесты, MCP и прочие штучки для программистов), то напоминаю главный принцип - вам нужно только то, что нужно вам. Вам не нужно всё то, что показалось полезным для других.</p>
  <p id="Tqj1">Начинайте с краю. IDE - это крутой редактор текстов. AI IDE - это крутой редактор текстов с командой ИИ-помощников. Добавляйте в него только то, что облегчает вам жизнь или работу. А бакапить тексты можно и на флешку (любите бакапы).</p>
  <hr />

]]></content:encoded></item><item><guid isPermaLink="true">https://teletype.in/@dolovar/-BNum5geu14</guid><link>https://teletype.in/@dolovar/-BNum5geu14?utm_source=teletype&amp;utm_medium=feed_rss&amp;utm_campaign=dolovar</link><comments>https://teletype.in/@dolovar/-BNum5geu14?utm_source=teletype&amp;utm_medium=feed_rss&amp;utm_campaign=dolovar#comments</comments><dc:creator>dolovar</dc:creator><title>Где можно початиться с ИИ</title><pubDate>Wed, 23 Apr 2025 18:06:02 GMT</pubDate><description><![CDATA[Ссылок пост для тг-канала Нейрокухня Доловара]]></description><content:encoded><![CDATA[
  <p id="BUnI">Ссылок пост для тг-канала <a href="https://t.me/neurokuh" target="_blank">Нейрокухня Доловара</a></p>
  <p id="74ms">В бурно развивающемся мире нейросетей всё быстро меняется, но для ориентирования в этом мире иногда полезно переписать известное. Сейчас речь пойдет про текстовые нейронки, которые LLM. Причем с упором на общедоступное и бесплатное. Порядок в списке даю не по удобству или частоте использования, а скорее по истории развития. И начну с широко известной пятерки.</p>
  <p id="7OAa"><br /><a href="https://chatgpt.com/" target="_blank">https://chatgpt.com/</a><br /><a href="https://openai.com/" target="_blank">https://openai.com/</a><br /><a href="https://platform.openai.com/playground/prompts" target="_blank">https://platform.openai.com/playground/prompts</a> (платное)</p>
  <p id="GrQ8">Бренд *<strong>ChatGPT</strong>* от OpenAI (US). За последние пять лет выходили модели: GPT-3, GPT-3.5, GPT-4, мультимодальная GPT-4o, шустрая 4o-mini, рассуждающие o1, o3-mini, o3-mini-high, затем GPT-4.5 для исследований, несколько 4.1, o3, o4-mini, o4-mini-high - порядок нумерации не отражает последовательность разработки. Если упростить:<br />- 4o и 4o-mini для повседневных нужд окончательно заменили нашумевшую несколько лет назад 3.5 и поумневшую 4 (буква &quot;o&quot; после имени всегда указывает на мультимодальность),<br />- тестируемые сейчас 4.1, 4.1-mini и 4.1-nano могут подвинуть 4o и хвастаются контекстным окном в миллион токенов (бесплатно не будет),<br />- o3 сменила o1 и тугодумную o1-pro на посту рассуждающих (буква &quot;о&quot; перед цифрами всегда указывает на режим рассуждений перед ответом),<br />- новенькие рассуждающие o4-mini немного уступают o3, но превосходят и заменяют o3-mini на посту оптимизированных,<br />- стареющая задумчивая и дорогущая 4.5 недолго, но еще будет актуальна для тщательных исследований (Deep Research).<br />Сказанное выше о версиях потеряет актуальность в течение нескольких месяцев, можно не запоминать.</p>
  <p id="3i3e">Кто-то считает OpenAI лидером рынка, технологий, непререкаемым авторитетом и лучшим из визионеров. Но я предпочитаю откидывать шумиху и смотреть на факты. Не лидер рынка, а глубоко убыточное предприятие, которое остается на плаву лишь благодаря постоянному притоку инвестиций извне. Не самый популярный сервис, китайцев не обойти по числу пользователей. Не лидер технологий, не самые продвинутые модели, хоть и держится в топе лучших. И не лучшие по соотношению цены к качеству. Их главная заслуга - доказательство возможности, породившее волну. Пионеры они, вот за это им спасибо. Сейчас активно работают над библиотеками для оркестрации агентов, чтобы заменять людей в длинном ряде профессий (и людям пора пугаться).</p>
  <p id="qQeO">Мне они запомнились тем, что их генератор картинок (Dalle-e) был способен учитывать множество параметров из промпта. Конкуренты, к сожалению, откидывали половину инструкций (сейчас уже не актуально, многие рисовалки улучшились). Сейчас рисовалку доработали так, что она почти без ошибок переносит на картинку русские тексты, можно комиксы рисовать, но наметились проблемы со сложными промптами.</p>
  <p id="E6pJ">ЧатЖпт также запомнился тем, что у них самые жадные лимиты на бесплатные запросы, слишком быстро отказываются продолжать беседу &quot;на максималках&quot;. Особенно жалко, что не получается полноценно использовать инструмент холста, лимита хватает лишь на несколько правок. И даже на тарифе Pro не доступны некоторые инструменты, например транскрибация аудио. И еще одна характерная черта - под видом новостей дается слишком много заявлений и обещаний (поддержание хайпа необходимо для привлечения инвестиций), избыток пустозвонства.</p>
  <p id="ihGa">*Доступно бесплатно*: веб-интерфейс и мобильное приложение, редактирование текста на отдельном холсте (Canvas), поиск в интернете, рассуждающая модель, загрузка картинок и файлов для анализа, создание картинок (мультимодальная 4o), возможность управлять запоминаемой информацией о пользователе (Custom instructions и Memories).<br />*Не доступно бесплатно*: выбор конкретной модели, преднастраиваемые агенты (GPTs), папки для организации чатов (projects), запланированные запросы (tasks), генерация видео (Sora), доступ нейронки к вашим документам на гугл-диске, доступ по API, голосовой чат, расширенные функции рассуждающих моделей.<br />*Рекомендация к использованию*: окончательная полировка текстов, редкое проведение серьезных исследований, редкое создание простых иллюстраций.</p>
  <p id="Wzzv"><br /><a href="https://claude.ai/" target="_blank">https://claude.ai/</a><br /><a href="https://www.anthropic.com/" target="_blank">https://www.anthropic.com/</a><br /><a href="https://console.anthropic.com/" target="_blank">https://console.anthropic.com/</a></p>
  <p id="e22V">Семейство моделей *<strong>Claude</strong>* от Anthropic (US). В версиях 3.5 и 3.7 нужно смотреть на имена: быстрый и простоватый Haiku, умница Sonnet, крутой Opus.<br />Часть разработчиков из OpenAI из-за разногласий ушли и создали конкурирующую фирму, которая быстро добилась впечатляющих результатов. Sonnet и сейчас считается лучшим из облачных вариантов для программирования и написания текстов. Они же являются авторами Model Context Protocol (MCP), который позволяет расширять контекст запроса данными со своих серверов.<br />Из-за проблем с вычислительными ресурсами иногда в бесплатном доступе вместо умницы Сонета появляется глуповатый Хайку. Нет поиска в интернете, поэтому модных функций DeepSearch или DeepResearch (вдумчивый поиск в интернете) пока не предвидится (но на платном тарифе уже виднеется какой-то beta-Research). Также пока не видно возможности управлять преднастраиваемыми агентами, потому что акцент компании поставлен на развитии API, а не на веб-интерфейсных плюшках - предоставляют инструменты, а не решения.</p>
  <p id="EcUd">*Доступно бесплатно*: веб-интерфейс и мобильное приложение, выдача кода в отдельных окнах (artifacts), загрузка картинок и файлов для анализа.<br />*Не доступно бесплатно*: выбор конкретной модели, папки для организации чатов (projects), доступ к данным из гугл-сервисов, доступ по API, расширенные функции рассуждающих моделей.<br />*Рекомендация к использованию*: умный собеседник для сложных вопросов, написание простых программ.</p>
  <p id="Q9eq"><a href="https://grok.com/" target="_blank"><br />https://grok.com/</a><br /><a href="https://x.ai/" target="_blank">https://x.ai/</a></p>
  <p id="mCoD">Семейство моделей *<strong>Grok</strong>* от xAI (US), последняя версия 3.<br />Еще один отколовшийся от OpenAI конкурент. Илону Маску не понравилось то, что OpenAI совсем не open, поэтому он создал новенький дата-центр (Colossus) и старается бесплатно давать то, на чем соседи пытаются зарабатывать, причем с минимумом цензуры и лимитов. Долгое время Grok был доступен только в пределах соц.сети X (бывший Twitter), но внезапно вышел в качестве отдельного сервиса и сразу попал в списки топов.</p>
  <p id="W3Sy">*Доступно бесплатно*: веб-интерфейс и мобильное приложение, загрузка картинок, файлов и урлов для анализа (также интеграция с Google Drive), генератор изображений (Aurora), голосовой чат (пока только на английском), режим рассуждений и DeepSearch (с небольшими ограничениями на частоту запросов), Grok Studio с холстом и исполнением кода.<br />*Не доступно бесплатно*: доступ по API, режим рассуждений и DeepSearch с последней более умной моделью, расширение фич и лимитов в Grok Studio.<br />*Рекомендация к использованию*: повседневное использование.</p>
  <p id="Dmdx"><br /><a href="https://gemini.google.com/" target="_blank">https://gemini.google.com/</a><br /><a href="https://aistudio.google.com/prompts/new_chat" target="_blank">https://aistudio.google.com/prompts/new_chat</a><br /><a href="https://notebooklm.google.com/?hl=ru" target="_blank">https://notebooklm.google.com/?hl=ru</a><br /><a href="https://labs.google/" target="_blank">https://labs.google/</a></p>
  <p id="goeh">Семейство моделей *<strong>Gemini</strong>*, LearnLM, Gemma и так далее от Google (US).<br />Разумеется, монстр Гугла не мог остаться в стороне и немедленно попытался оседлать волну, создав свои LLM, причем не только облачные, но и локально запускаемые (о них расскажу как-нибудь в другой раз). И даже на телефонах с Андроидом предложил заменить программу Ассистента на чат с Gemini (и поэтому мой ассистент разучился ставить будильники, пофиксили через несколько месяцев). Из-за того, что пустячные запросы к ассистенту попадают в общую историю чатов, пришлось эту историю отключить. Как и в случае OpenAI и Anthropic на политические темы лучше не общаться, поскольку предвзятость зашкаливает до полной потери смыслов (в обучающей базе было слишком много западных газет).</p>
  <p id="p0gV">Основное преимущество гугловских сервисов - хорошее быстродействие, и практически отсутствуют лимиты, можно гонять в хвост и в гриву. Ну и API вроде как самое дешевое из западных, есть даже возможность бесплатного подключения (для некоммерческого использования и не во всех странах, но достаточно для тестов в ходе разработки).<br />Главный недостаток - модели слишком своевольные, плохо следуют сценариям сложных промптов (разве что Gemini 1.5 Pro показывает прогресс). И в ответах избыток постороннего - приветствия, предложения продолжить общение на сторонние темы, не взирая на попытки запретить это инструкциями в промптах.</p>
  <p id="j3So">Возможность ознакомиться с новейшими моделями предоставляется на отдельной платформе Google AI Studio - там есть и более умные версии, и варианты с поддержкой огромного контекста. И с дополнительными возможностями, например - сбегай на ютуб по ссылке и перескажи содержание видео.<br />Также можно заглянуть в сервис NotebookLM - обсуждение черновиков, создание выжимок, аудиопересказы и другие функции. И можно заглянуть в другие AI проекты Google Labs (если ваша страна в списке допущенных).</p>
  <p id="lV34">*Доступно бесплатно*: веб-интерфейс и мобильное приложение, создание преднастроенных агентов (Gems или Gem-боты), загрузка картинок и файлов для анализа (есть доступ к гугл-диску), генерация картинок с возможностью внесения изменений (Imagen 3), голосовой чат (в AIStudio и в приложении), доступ по API (!!!), режим рассуждений и DeepResearch, холст (canvas, пока сыровато).<br />*Не доступно бесплатно*: доступ по API (расширенные лимиты), интеграция с гугл-сервисами, генерация видео (Veo), режим рассуждений и DeepResearch с последними более умными моделями.<br />*Рекомендация к использованию*: повседневное использование, дефолтный выбор для подавляющего большинства мелких вопросов.</p>
  <p id="gSne"><br /><a href="https://chat.mistral.ai/chat/" target="_blank">https://chat.mistral.ai/chat/</a><br /><a href="https://mistral.ai/" target="_blank">https://mistral.ai/</a><br /><a href="https://console.mistral.ai/" target="_blank">https://console.mistral.ai/</a></p>
  <p id="2sYd">Сервисы Le Chat и Le Platform представляют семейство моделей *<strong>Mistral</strong>*, Mixtral, Ministral, Pixtral, Codestral, Mathstral и их производных от Mistral (FR).<br />Европейцы озаботились поднятием своего стартапа, чтобы разбавить доминирование Штатов, и французы первыми реализовали хорошее семейство моделей для разных задач - от больших облачных до миниатюрных локальных. Поначалу их модели не отличались сообразительностью, но сейчас они вполне конкурентоспособны для несложных задач.</p>
  <p id="FG1k">Еще в прошлом 2024 году Мистраль давала два существенных преимущества - отсутствие лимитов и огромные окна для ввода и вывода. Сделать подробный пересказ текстовой расшифровки двухчасового видео - на это был способен только ЛеЧат, прочие отказывались. По мере роста популярности платформы из-за возросшей нагрузки французы добавили лимиты на ежедневное использование, но и сейчас их сервисы остаются привлекательными. И наиболее важным преимуществом сейчас являются возможность бесплатно использовать преднастроенные агенты и даже облачный API - не для всех моделей и с ограничениями, но этого достаточно для отладки при разработке своих сервисов.</p>
  <p id="SXUD">*Доступно бесплатно*: веб-интерфейс и мобильное приложение, загрузка картинок и файлов для анализа, веб-поиск (плюс отдельная функция &quot;flash answers&quot; с кешированием наиболее частых запросов), генерация изображений (Flux Pro), холст (Canvas, слабее чем у OpenAI), интерпретатор кода (артефакты с кодом и результатами), доступ по API (!!!).<br />*Не доступно бесплатно*: доступ к продвинутым моделям, отсутствие лимитов на количество запросов.<br />*Рекомендация к использованию*: повседневное использование, особенно для пересказов больших текстов (summarize).</p>
  <p id="hGTi"><br />NB: Главный недостаток упомянутой выше &quot;большой пятерки&quot; - шаткое экономическое положение, они опасно балансируют на грани банкротства, каждый из этих гигантов может внезапно уйти в прошлое, оставив следы лишь в истории (разве что Гугл &quot;Too Big to Fail&quot;). Еще один серьезный недостаток - по политическим и экономическим причинам отказываются работать с рядом стран (я не рекламирую VPN), кажется из вышеперечисленных только Мистраль в этом отношении более интернациональный, за что ему еще один плюс.</p>
  <p id="gswb"></p>
  <p id="lpo6">*<strong>GigaChat</strong>* от Сбера: <a href="https://giga.chat/" target="_blank">https://giga.chat/</a> (нужен ID банка)<br />*<strong>YaGPT</strong>* и Алиса от Яндекса: <a href="https://alice.yandex.ru/" target="_blank">https://alice.yandex.ru/</a> (сломана регистрация через гугл) https://shedevrum.ai/</p>
  <p id="X8Pk">По техническим причинам не могу самостоятельно протестировать большие модели из РФ. По обзорам я вижу, что они активно развивают свои модели и интерфейсные плюшки для них, и для простых запросов их уже можно использовать. Да, пока эти модели уступают &quot;большой пятерке&quot; в сложных задачах, но если честно - так ли уж сложны ваши повседневные задачи и запросы? При выборе ориентируйтесь не на синтетические тесты, а на простоту доступа и свои настоящие потребности, в которых обычно не решение мудрёных головоломок, а бытовые вопросы: получение справок и советов; перевод, пересказ и улучшение текстов; вытаскивание текста из аудио, видео, картинок - для подобного не нужны именно чемпионы соревнований.</p>
  <p id="utPv">ГигаЧат улучшают в основном для работы с цифрами, но встречаются и забавные фичи вроде &quot;переписать под зумеров, бумеров, миллениалов&quot;. Плюс рисовалка вполне достойная среди бесплатных (Kandinsky). Доступно также в Телеграме и по API, подходит и для автоматизации (N8N, make.com). Алиса же удобна не столько колонкой, сколько встроенными функциями в я-браузере и мобильном приложении.<br />*Рекомендация к использованию*: повседневное использование в тех странах, где западные LLM недоступны без ухищрений.</p>
  <p id="IgrL"></p>
  <p id="0cnA"><a href="https://chat.deepseek.com/" target="_blank">https://chat.deepseek.com/</a></p>
  <p id="SOwD">Бренд *<strong>DeepSeek</strong>* от одноименной компании (CN) с моделями DeepSeek-V3 и рассуждающей DeepThink-R1.<br />Хедж-фонд High-Flyer для игр на бирже создал большой вычислительный кластер, который решил дополнительно использовать для разработки ИИ. Создали подразделение DeepSeek, в которое взяли на работу молодых специалистов, которые успешно решили задачу &quot;догнать и перегнать на ограниченных ресурсах&quot;. Это не стартап, а вполне устойчивая компания, которая больше года успешно конкурировала с технологическими гигантами Китая, а к началу 20025 года вышла на международный рынок, заставив и западных конкурентов пересматривать подходы и цены.</p>
  <p id="dJj2">Вполне умные модели умеют проводить исследования с подтягиванием данных из Интернета, реализовав один из первых бесплатных веб-сайтов с функцией DeepResearch. Следует помнить, что доступ к некоторым сайтами из Китая может быть ограничен. Также внимания заслуживает тот факт, что в базу знаний модели попали политические установки из обучающих текстов и контролеров, склонных к западным же нарративам, то есть модели получились отнюдь не &quot;коммунистические&quot;.</p>
  <p id="tM5I">Главным недостатком является то, что сервис старательно атаковали во время стартовой шумихи, поэтому сайт регулярно отказывался выполнять запросы (сейчас с этим полегче).<br />Также при использовании локальных дистиллятов следует понимать, что они больше взяли от базы, чем от моделей DeepSeek, и прежде всего это касается устаревших базовых знаний.</p>
  <p id="STs8">*Доступно бесплатно*: веб-интерфейс и мобильное приложение, загрузка картинок и файлов для анализа, веб-поиск, переключение на рассуждающую модель.<br />*Не доступно бесплатно*: доступ по API (цены в числе наиболее низких на рынке), в веб-интерфейсе расширение лимитов, приоритетная обработка, мультимодальные функции, интеграция с бизнес-системами.<br />*Рекомендация к использованию*: повседневное использование.</p>
  <p id="ZsVo"><br /><a href="https://chat.qwenlm.ai/" target="_blank">https://chat.qwenlm.ai/</a></p>
  <p id="zuLL">Бренд *<strong>Qwen</strong>* от компании Alibaba Cloud, которая является частью гиганта Alibaba Group (CN). Свежие модели: большое семейство локальных Qwen2.5, Qwen2.5-1M с большим окном контекста, мультимодальная Qwen-VL, умеющая чатиться Qwen2.5-Omni, большие Qwen-Max и Qwen-Plus.<br />Специализируются на разработке ИИ более пяти лет, вложили немало средств и достигли впечатляющих результатов. Раньше их знали по локальным моделям qwen, которые были вполне умны и быстры, а недавно таки сделали веб-сайт с публичным и бесплатным доступом, что сразу же подняло известность и популярность.</p>
  <p id="LHY7">*Доступно бесплатно*: веб-интерфейс, веб-поиск, переключение на рассуждающую модель, загрузка файлов, картинок, аудио и видео для анализа, создание изображений и видео, артефакты.<br />*Не доступно бесплатно*: доступ по API, в веб-интерфейсе расширение лимитов.<br />*Рекомендация к использованию*: повседневное использование.</p>
  <p id="ttdT"><br /><a href="https://minimax.io/" target="_blank">https://minimax.io/</a><br /><a href="https://chat.minimax.io/" target="_blank">https://chat.minimax.io/</a></p>
  <p id="mWZB">Бренд *<strong>MiniMax</strong>* от стартапа Hailuo AI (CN) представляет модели MiniMax-Text-01 для обычного использования и MiniMax-01 для обработки длинных контекстов (CN), мультимедийные Hailuo Vision, Hailuo Video, Hailuo Audio.<br />Изначально стартап работал над генерацией изображений и видео, но недавно открыл публичный сайт и для доступа к своим LLM. Модели выглядят не самыми умными (это активно правится), веб-интерфейс простоват, но бесплатное и без ограничений по странам заслуживает внимания.</p>
  <p id="f6bn">*Доступно бесплатно*: веб-интерфейс и мобильное приложение, веб-поиск, загрузка файлов и картинок для анализа, создание изображений, аудио и видео.<br />*Не доступно бесплатно*: доступ по API, в веб-интерфейсе расширение лимитов.<br />*Рекомендация к использованию*: повседневное использование для простых запросов и мультимедийных задач.</p>
  <p id="Y0eU"><br /><a href="https://kimi.ai/" target="_blank">https://kimi.ai/</a></p>
  <p id="SfXk">Бренд *<strong>Kimi</strong>* AI от стартапа Moonshot AI (CN) дает доступ к единственной, но мультимедийной и рассуждающей модели Kimi 1.5<br />Еще один пример публично доступной возможности чатиться с нейронкой.</p>
  <p id="12MV">*Доступно бесплатно*: веб-интерфейс и мобильное приложение, веб-поиск, переключение в режим рассуждений, загрузка файлов и картинок для анализа.<br />*Не доступно бесплатно*: доступ по API, в веб-интерфейсе расширение лимитов.<br />*Рекомендация к использованию*: повседневное использование, особенно для больших контекстов.</p>
  <p id="Xd9b"></p>
  <p id="VaT3">А теперь упомяну тех, кто известен, но не попал в список лучших из облачных LLM с бесплатным доступом:</p>
  <p id="l3ry"><br /><a href="https://www.perplexity.ai/" target="_blank">https://www.perplexity.ai/</a></p>
  <p id="ZF8H">Сервис *<strong>Perplexity</strong>* AI от одноименной компании (US).<br />Бесплатный доступ к модели, основанной на Sonar LLM (собственная разработка с элементами GPT). Специализируется на веб-поиске с генерацией ответов, то есть не традиционный чат, а скорее попытка создать умный поисковый сервер на замену Гуглу. Есть возможность фильтровать источники: веб, научные работы, социальные сети.</p>
  <p id="wqem">Сервис успел обрести популярность, но из-за очевидности идеи быстро уступает позицию гигантам, которые тоже поспешили реализовать веб-поиск, и сделали это лучше. Модель от Перплексити была откровенно глуповата, и сервис без возможности чата с обсуждением не был достаточно удобным, чтобы составить длительную конкуренцию на рынке. В последнее время Перплексити предоставляет возможность переключиться на модели &quot;большой пятерки&quot;, но перспективы так себе.</p>
  <p id="JtGI"><br /><a href="https://copilot.microsoft.com/" target="_blank">https://copilot.microsoft.com/</a></p>
  <p id="6q9D">Проект *<strong>Copilot</strong>* от Microsoft (US).<br />Поначалу сотрудничал с OpenAI, но затем поработали над своими LLM (Prometheus, Phi-4), однако для сложных функций по-прежнему используют большие LLM от &quot;большой пятерки&quot;.<br />Тесно интегрированы в MS Office и другие MS продукты.<br />Причина малой популярности - бесплатная версия слишком сильно урезана по уму и лимитам на запросы. Однако порисовать простые картинки можно и сейчас.<br />Основные усилия MS направляет на реализацию того, что доступно по платным подпискам в продуктах MS.</p>
  <p id="0j4X"><br /><a href="https://ai.meta.com/" target="_blank">https://ai.meta.com/</a><br /><a href="https://www.meta.ai/" target="_blank">https://www.meta.ai/</a><br /><a href="https://www.llama.com/" target="_blank">https://www.llama.com/</a></p>
  <p id="BylH">Семейство моделей *<strong>Llama</strong>* от Meta AI, подразделения Meta Platforms (US).<br />Вы вряд ли будете использовать чат на родном веб-сайте - он не доступен без VPN и meta-аккаунта &quot;правильной&quot; страны.<br />Кстати, компания находится под судебным разбирательством, поскольку кое-кто спиратил миллионы книг и личных переписок для обучения своих моделей.<br />Также стоит упомянуть, что в некоторых странах данная компания считается причастной к причастных к терроризму и экстремизму.<br />Но мы любим их не за это.</p>
  <p id="Bjm0">Мета создают модели с открытым кодом и широкой лицензией, которые можно скачать себе и использовать почти без ограничений. Упомяну некоторые:<br />llama 3.1 была одной из первых, которые работали быстро, послушно, а еще хорошо говорили по-русски (и на множестве других языков).<br />llama 3.2 стала мультимодальной.<br />llama 3.3 весом в 70b по уму почти догнала облачных собратьев.<br />llama 4 обрела огромное окно контекста и прочие улучшения.</p>
  <p id="W8XJ">NB: Полезнейший и популярный сервис ollama для запуска локальных моделей не связан с Meta, разрабатывается совсем другими людьми.</p>
  <p id="0eFO"><br />Добавлю в список несколько агрегаторов:</p>
  <p id="JV09"><a href="https://huggingface.co/" target="_blank">https://huggingface.co/</a><br />HuggingChat от Hugging Face - позволяет протестировать множество моделей, хранящихся в этом огромном архиве.</p>
  <p id="1KlS"><a href="https://dewiar.com/" target="_blank">https://dewiar.com/</a><br />DEWIAR - эксперименты в автоматизации и не только.</p>
  <p id="L898"><a href="https://you.com/" target="_blank">https://you.com/</a><br />You.com от YouChat - размышляющий ассистент, примечателен возможностью проведения исследований (три в день), есть приложения для мобилок.</p>
  <p id="F9GB"><a href="https://poe.com/" target="_blank">https://poe.com/</a><br />Poe от компании Quora - автоматизация ботами, есть приложения для мобилок.</p>
  <p id="gtro"><a href="https://openrouter.ai/chat" target="_blank">https://openrouter.ai/chat</a><br />OpenRouter (США) - популярный сервис, доступ к десятку популярных моделей, есть какие-то интерфейсные плюшки.</p>
  <p id="R4bf"></p>
  <p id="Xm8f">Также посмотрел и не нашел пользы:</p>
  <p id="kjd7"><a href="https://www.genspark.ai/" target="_blank">https://www.genspark.ai/</a><br />Genspark - агенты, создание картинок и видео, плюс другие инструменты, может даже звонить по телефону, но бесплатного тарифа хватило всего на два запроса.</p>
  <p id="QUdS"><a href="https://llm.hunyuan.tencent.com/#/chat/hy-t1" target="_blank">https://llm.hunyuan.tencent.com/#/chat/hy-t1</a><br />Довольно умная рассуждающая модель T1 от Hunyuan, входящего в Tencent (CN), но интерфейс оставляет желать лучшего.<br />Tencent является технологическим гигантом, но сегодня больше ориентирован на корпоративных клиентов и внутренний рынок, чем на массового пользователя.</p>
  <p id="8QEw">NB: Еще один китайский гигант ByteDance (владелец TikTok) вовсе не имеет публичного веб-интерфейса для своих LLM, таких как Doubao. Их модели доступны через API или интегрированы в продукты ByteDance (например, Douyin), но прямого браузерного чата нет.</p>
  <p id="o9Ro"><a href="https://bigscience.huggingface.co/" target="_blank">https://bigscience.huggingface.co/</a><br />Мультимодальная BLOOM от международного сообщества BigScience - значительный проект, но не имеет своего собственного веб-сайта.</p>
  <p id="GEU1"><a href="https://playground.sea-lion.ai/" target="_blank">https://playground.sea-lion.ai/</a><br />SEA-LION от AI Singapore - небольшие модели, максимальный вес 70B.</p>
  <p id="LK8s"><a href="https://sea-sailor.github.io/" target="_blank">https://sea-sailor.github.io/</a><br />Sailor от SEA AI Lab и Singapore University of Technology and Design - скромные нейронки весом около 20B, тестировать предлагают на хаггинг-фейсе.</p>
  <p id="36LJ"><a href="https://chat.falconllm.tii.ae/" target="_blank">https://chat.falconllm.tii.ae/</a><br />Falcon LLM от Technology Innovation Institute (ОАЭ), предоставляют только слабые модели весом до 10B.</p>
  <p id="JgiI"><a href="https://nova.amazon.com/" target="_blank">https://nova.amazon.com/</a><br />Американский гигант Амазон тоже разрабатывает разные нейронки в семействе Nova, но доступ через веб-интерфейс только из США.</p>
  <p id="BtJb"><a href="https://www.grokker.com/grokkyai" target="_blank">https://www.grokker.com/grokkyai</a><br />Израильский Grokker, вроде как предоставлял бесплатный доступ к локальной модели, оптимизированной для аналитики и чата, но теперь нужно вставать в очередь при запросе демо.</p>
  <p id="7M3v"><a href="https://cohere.com/" target="_blank">https://cohere.com/</a><br />Канадский Cohere с доступом к одноименной модели - какие-то проблемы с логином, возможно криво организованная блокировка для ряда стран.</p>
  <p id="oJld"><a href="https://www.01.ai/" target="_blank">https://www.01.ai/</a><br />Китайский 01.AI (от бывшего сотрудником Google) с доступом к семейству моделей Yi - не нашел веб-интерфейса для тестирования, есть только предложение попробовать корпоративное решение с ДипСиком.</p>
  <p id="3qT9"><a href="https://inceptionai.ai/jais/index.html" target="_blank">https://inceptionai.ai/jais/index.html</a><br />Jais AI от Inception (ОАЭ) - не проверял из-за нежелания заполнять регистрационную анкету.</p>
  <p id="Wzrm"><a href="https://ying.baichuan-ai.com/chat" target="_blank">https://ying.baichuan-ai.com/chat</a><br />Китайский Baichuan - на сайте среди иероглифов не видно возможности регистрации, похоже необходим китайский мобильник.</p>
  <p id="adMf"><a href="https://damo.alibaba.com/" target="_blank">https://damo.alibaba.com/</a><br />SeaLLM от Alibaba DAMO Academy - для регистрации и входа нужен китайский мобильник.</p>
  <p id="8Nhj"></p>
  <p id="lPHJ">Пожалуй, на этом уже можно затормозить.</p>
  <p id="dX0U">Итого, выше упомянуты большая пятерка, русская двойка, четыре годных китайца (и десяток посредственных), не считая агрегаторов и локально запускаемых моделей - мир широк, и становится всё шире.<br /></p>

]]></content:encoded></item><item><guid isPermaLink="true">https://teletype.in/@dolovar/xRpI70fJFB-</guid><link>https://teletype.in/@dolovar/xRpI70fJFB-?utm_source=teletype&amp;utm_medium=feed_rss&amp;utm_campaign=dolovar</link><comments>https://teletype.in/@dolovar/xRpI70fJFB-?utm_source=teletype&amp;utm_medium=feed_rss&amp;utm_campaign=dolovar#comments</comments><dc:creator>dolovar</dc:creator><title>Новейшая история разработки крупных языковых моделей</title><pubDate>Mon, 24 Feb 2025 19:28:35 GMT</pubDate><description><![CDATA[(данный текст по тестовому запросу составил Claude 3.7 Sonnet, чьи знания ограничены октябрем 2024 года)]]></description><content:encoded><![CDATA[
  <p id="g9W9"># Новейшая история разработки крупных языковых моделей</p>
  <p id="oTzD">(данный текст по тестовому запросу составил Claude 3.7 Sonnet, чьи знания ограничены октябрем 2024 года)</p>
  <p id="EOF4"></p>
  <p id="LFzm">## Основные исследовательские вехи (2017-2020)</p>
  <p id="rEJl">**Июнь 2017** — Google представляет архитектуру Transformer в работе &quot;Attention is All You Need&quot;. Революционный подход, заменивший рекуррентные сети механизмом внимания, что позволило эффективнее обрабатывать длинные последовательности.</p>
  <p id="aUJI">**Июнь 2018** — OpenAI выпускает GPT-1 (117 миллионов параметров). Отличительная особенность — предобучение на огромном корпусе текстов с последующей тонкой настройкой, что повысило качество работы с языком.</p>
  <p id="6tu5">**Февраль 2019** — OpenAI выпускает GPT-2 (1,5 миллиарда параметров). Модель произвела фурор своей способностью генерировать настолько правдоподобный текст, что OpenAI изначально отказалась выпускать полную версию из соображений безопасности.</p>
  <p id="aLWl">**Май 2020** — OpenAI выпускает GPT-3 (175 миллиардов параметров). Модель продемонстрировала &quot;эмерджентные свойства&quot; — способность решать новые задачи без дополнительного обучения, только на основе текстовых примеров.</p>
  <p id="V7ow">**Апрель 2020** — Facebook выпускает Blender (9,4 миллиарда параметров). Первая модель, специально оптимизированная для ведения естественных диалогов и проявления эмпатии.</p>
  <p id="Dguj">**Октябрь 2020** — Google представляет T5 (11 миллиардов параметров). Универсальная модель, переформулировавшая различные языковые задачи в единый формат &quot;текст-в-текст&quot;, что повысило её универсальность.</p>
  <p id="1nKR"></p>
  <p id="RZBz">## Переход к коммерческим приложениям и рост конкуренции (2021-2022)</p>
  <p id="ucYR">**Январь 2021** — Группа исследователей, включая Дарио и Даниэлу Амодеи, покидает OpenAI и основывает Anthropic. Причина — разногласия относительно коммерциализации OpenAI и подходов к безопасности ИИ.</p>
  <p id="vOud">**Май 2021** — Google представляет LaMDA, отличительной особенностью которой стала способность поддерживать открытые диалоги на любые темы, избегая повторений и нерелевантных ответов.</p>
  <p id="0Cuw">**Декабрь 2021** — DeepMind представляет Gopher (280 миллиардов параметров), затем в марте 2022 — Chinchilla (70 миллиардов параметров). Chinchilla продемонстрировала, что модель меньшего размера, обученная на большем количестве данных, превосходит гораздо более крупные модели.</p>
  <p id="df6o">**Апрель 2021** — китайская компания Inspur выпускает Yuan 1.0 (245 миллиардов параметров). Первая крупная китайская LLM, работающая на двух языках — китайском и английском.</p>
  <p id="hm03">**Июль 2021** — Яндекс анонсирует YaLM с 13 миллиардами параметров. Особенность — глубокая оптимизация для русского языка и культурного контекста.</p>
  <p id="tdtK">**Апрель 2022** — Google выпускает PaLM (540 миллиардов параметров). Модель продемонстрировала прорыв в способности проводить сложные рассуждения, решать математические задачи и понимать причинно-следственные связи.</p>
  <p id="ZOTQ">**Май 2022** — Meta выпускает OPT-175B как открытую альтернативу GPT-3. Основное отличие — полная доступность для исследовательского сообщества, что способствовало демократизации исследований в области LLM.</p>
  <p id="8Bjh">**Июль 2022** — BLOOM (176 миллиардов параметров) выпускается международным консорциумом BigScience. Уникальная особенность — поддержка 46 естественных языков и 13 языков программирования, разработка международным сообществом из более чем 1000 исследователей.</p>
  <p id="XewR">**Ноябрь 2022** — OpenAI запускает ChatGPT. Революционный пользовательский интерфейс и обучение с человеческой обратной связью (RLHF) сделали технологию массово доступной и понятной.</p>
  <p id="uMz8">**Декабрь 2022** — В России НИЦ &quot;Курчатовский институт&quot; и Сбер представляют улучшенную модель ruGPT-3 Large. Особенность — глубокое понимание русского языка, включая морфологию, синтаксис и культурные особенности.</p>
  <p id="jIWd"></p>
  <p id="r9Sz">## Эра гигантских моделей и специализации (2023)</p>
  <p id="G3sd">**Март 2023** — OpenAI выпускает GPT-4. Прорывные возможности в решении сложных задач уровня человека-эксперта, понимании изображений и более глубоком следовании намерениям пользователя.</p>
  <p id="kGKV">**Июль 2023** — Anthropic выпускает Claude 2. Отличие — усиленный акцент на безопасности, более низкая склонность к галлюцинациям и особый подход &quot;конституционного ИИ&quot;, обучающий модель следовать набору принципов.</p>
  <p id="Tu0J">**Июль 2023** — Meta релизит LLaMA 2 как полностью открытую модель. Модель предоставила доступ к передовым возможностям ИИ для исследователей и разработчиков, что привело к взрыву инноваций.</p>
  <p id="D6ej">**Май 2023** — DeepSeek основан бывшими исследователями из Baidu и других компаний. В декабре 2023 они выпускают DeepSeek-LLM с 67 миллиардами параметров. Особенность — превосходные результаты в программировании, математике и рассуждениях при относительно компактном размере.</p>
  <p id="TIUT">**Август 2023** — Google представляет PaLM 2, значительно превосходящую предшественницу в многоязычности и решении научных задач.</p>
  <p id="ku6w">**Май 2023** — Основание Mistral AI бывшими исследователями из Meta и DeepMind. В сентябре и декабре 2023 выпуск моделей Mistral 7B и Mixtral 8x7B, демонстрирующих, что относительно небольшие модели могут конкурировать с гигантскими по ряду задач.</p>
  <p id="3xlT">**Март 2023** — Baidu запускает ERNIE Bot. Особенность — глубокая интеграция с китайскими сервисами и культурным контекстом, поддержка китайских диалектов.</p>
  <p id="jnzm">**Июль 2023** — iFlytek выпускает Spark, отличающуюся специализацией на медицинской и юридической тематике для китайского рынка.</p>
  <p id="pauY">**Апрель 2023** — Alibaba представляет Tongyi Qianwen. Модель выделяется способностью понимать и генерировать контент, связанный с китайской культурой, и интеграцией с экосистемой Alibaba.</p>
  <p id="HZmJ">**Апрель 2023** — Сбер выпускает GigaChat. Первая публично доступная российская LLM с многомодальными возможностями, интегрированная с экосистемой Сбера.</p>
  <p id="TvXJ">**Ноябрь 2023** — Илон Маск основывает xAI и выпускает Grok. Позиционируется как модель с &quot;чувством юмора&quot; и меньшими ограничениями на генерацию контента, чем конкуренты.</p>
  <p id="unKK">**Ноябрь 2023** — В России появляется Яндекс YaLM 100B. Отличие — огромный размер и глубокая адаптация к российскому контексту, русской литературе и культуре.</p>
  <p id="K8g4"></p>
  <p id="lftc">## Новые игроки и развитие экосистемы (2023-2024)</p>
  <p id="fNTY">**Август 2023** — Perplexity AI запускает инновационный поисковый движок на основе LLM. Уникальный подход, объединяющий поиск информации с генерацией ответов и указанием источников.</p>
  <p id="LE4Y">**Январь 2024** — Alibaba представляет семейство Qwen (Tongyi Qianwen) в открытом доступе. Особенность — различные размеры моделей от 1.8B до 72B параметров, каждая со своими оптимизациями.</p>
  <p id="wEF1">**Январь 2024** — DeepSeek выпускает DeepSeek-Coder, специализированную модель для программирования, превосходящую многие конкурирующие модели в задачах кодирования.</p>
  <p id="xWMK">**Февраль 2024** — Cohere выпускает Command R+. Отличие — фокус на корпоративном использовании с улучшенной способностью работать с документами компаний и специализированной бизнес-лексикой.</p>
  <p id="ed78">**Март 2024** — Anthropic выпускает Claude 3 в трех версиях (Haiku, Sonnet, Opus). Opus демонстрирует исключительные способности в сложных задачах рассуждения и следования инструкциям.</p>
  <p id="lFMu">**Апрель 2024** — Meta выпускает Llama 3 с 70 и 8 миллиардами параметров. Модель сочетает компактность с высокой производительностью, превосходя многие закрытые модели.</p>
  <p id="3JR9">**Апрель 2024** — Google выпускает Gemini Ultra, демонстрирующую превосходные результаты в научных и инженерных задачах.</p>
  <p id="vXEb">**Июнь 2024** — BAAI (Пекинская академия искусственного интеллекта) представляет Hailuo (HaiHe) с заявленными 13 триллионами параметров. Потенциально крупнейшая в мире модель, специально оптимизированная для китайского языка.</p>
  <p id="18w9">**Июль 2024** — Tencent представляет модель Hunyuan 2.0. Особенность — мощные возможности по обработке видео и интеграция с экосистемой WeChat.</p>
  <p id="GUFi">**2024** — В России активно развиваются:<br />   - MTS AI с моделью &quot;Гагарин&quot; (май) — особенность: многомодальность и интеграция с телеком-инфраструктурой<br />   - Яндекс YaGPT (март) — преимущество: глубокая интеграция с сервисами Яндекса<br />   - Сбер — GigaChat 2 (июнь) — улучшение: значительно расширенный контекст и улучшенное следование инструкциям<br />   - NashGPT от VK (февраль) — фокус на интеграции с социальными сетями и мессенджерами<br />   - &quot;Сириус&quot; (август) — результат коллаборации российских разработчиков<br />   - LARD от НИЦ &quot;Курчатовский институт&quot; (апрель) — специализация на научных текстах<br />   - FRED от компании Selsup (март) — фокус на бизнес-применениях</p>
  <p id="Cc8h"></p>
  <p id="tMJS">## Разработки за пределами США, Китая, России и Европы</p>
  <p id="Qqsb">### Южная Корея<br />**Март 2023** — компания Naver выпускает HyperCLOVA X. Особенность — глубокая оптимизация для корейского языка и интеграция с самой популярной поисковой системой страны.</p>
  <p id="NEqf">### Япония<br />**Июль 2023** — группа исследователей из нескольких университетов выпускает Weblab-10B, оптимизированную для японского языка.</p>
  <p id="DJlJ">**Март 2024** — Line Corporation выпускает CALM (Comprehensive Assistant Language Model), интегрированную с популярным мессенджером Line.</p>
  <p id="gvgZ">### Индия<br />**Октябрь 2023** — компания Sarvam AI представляет OpenHathi, первую крупную индийскую LLM с поддержкой хинди и английского языков.</p>
  <p id="bvz2">**Февраль 2024** — правительство Индии запускает проект Bhashini для разработки LLM, поддерживающих 22 официальных языка Индии.</p>
  <p id="gfe2">### Израиль<br />**Сентябрь 2023** — AI21 Labs выпускает Jurassic-2, модель, оптимизированную для работы с иврритом и английским языком, с особым фокусом на академические и бизнес-применения.</p>
  <p id="zK3g">### ОАЭ<br />**Август 2023** — Technology Innovation Institute выпускает Falcon LLM (40B параметров). Особенность — хорошая поддержка арабского языка и адаптация к ближневосточному контексту.</p>
  <p id="opYq"></p>
  <p id="Gd8s">## Значимые технологические прорывы</p>
  <p id="rDUe">**Ноябрь 2022** — Внедрение RLHF (Reinforcement Learning from Human Feedback) в ChatGPT значительно улучшило способность моделей следовать намерениям пользователей.</p>
  <p id="kZ7e">**Декабрь 2023** — Mistral представляет Mixture of Experts (MoE) архитектуру в Mixtral 8x7B, позволяющую эффективно масштабировать модели без пропорционального увеличения вычислительных затрат.</p>
  <p id="qMUT">**Март 2024** — Google представляет Gemma, семейство открытых моделей, демонстрирующих, что крупные технологические компании начинают поддерживать движение открытых моделей.</p>
  <p id="SkmI">**Май 2024** — Microsoft представляет Phi-3, компактную модель, показывающую исключительную эффективность и производительность при размере всего 3.8B параметров.</p>
  <p id="Z9m5"></p>
  <p id="y1TB">## Текущие тенденции развития</p>
  <p id="8uRG">1. **Эффективность моделей** — разработка компактных моделей, сравнимых по возможностям с гораздо более крупными (SLiM, Phi-3, Mistral)<br />2. **Мультимодальность** — интеграция текста, изображений, аудио и видео в единые модели (GPT-4V, Claude 3, Gemini)<br />3. **Специализация** — создание моделей для конкретных задач: программирование (DeepSeek-Coder), математика, медицина<br />4. **Открытость** — рост экосистемы вокруг открытых моделей (Llama, Mistral, Qwen)<br />5. **Локализация** — адаптация моделей к специфическим языкам и культурам<br />6. **Расширение контекста** — увеличение размера контекстного окна с сотен токенов до миллионов<br />7. **RAG-системы** — интеграция поиска по внешним источникам с генеративными возможностями LLM</p>
  <p id="Ivcb">Развитие LLM продолжает ускоряться, с появлением новых подходов и моделей практически каждый месяц, и всё больше стран и организаций включаются в эту технологическую гонку.</p>
  <p id="QyA3"></p>
  <p id="QXne">## Результат перепроверки:</p>
  <p id="vwvS">   - Hailuo/HaiHe от BAAI с 13 триллионами параметров — Это может быть преувеличением. BAAI (Пекинская академия ИИ) разрабатывает модели, но информация о модели с 13 триллионами параметров выглядит недостоверной. Крупнейшие публично известные модели имеют параметры в диапазоне сотен миллиардов, не триллионов.<br />   - Некоторые даты и месяцы для российских моделей — Точные даты релизов таких моделей как &quot;Гагарин&quot;, YaGPT, GigaChat 2, &quot;Сириус&quot;, LARD могут быть неточными.<br />   - FRED от Selsup — Информация об этой модели может быть неточной.<br />   - Подробные даты релизов в 2024 году — Некоторые указанные мной конкретные даты релизов в 2024 году могут быть неточными, особенно для месяцев после моей даты обновления знаний (октябрь 2024).<br />   - Проект Bhashini в Индии — Хотя инициатива по разработке ИИ для индийских языков существует, конкретные детали могут отличаться.</p>

]]></content:encoded></item></channel></rss>