Cursor, Copilot, агенты, код с помощью ИИ

Первый счёт от OpenAI я увидел и не сразу понял, что произошло. Написал небольшой инструмент для обработки документов, запустил на реальных данных — и за три дня потратил больше, чем планировал за мес...

Долго считал, что fine-tuning — это для серьёзных ребят с датасетами и GPU, а промпты — для всех остальных. Потом попробовал дотюнить модель под конкретную задачу и понял, что всё немного сложнее. Не ...

Месяц назад я переключился с Copilot на Cursor — и несколько раз порывался вернуться обратно. Не потому что Cursor плохой. А потому что привычка — страшная штука, и когда инструмент работает иначе, че...

Чем LangChain отличается от LlamaIndex — и почему я потратил неделю, прежде чем понял, что задаю не тот вопрос?

Месяц назад я переключился с Copilot на Cursor — и первую неделю жалел об этом. Не потому что Cursor плохой. Просто я не ожидал, что придётся заново учиться работать с редактором, к которому привык за...

Половина разговоров про AI-ассистентов заканчиваются одним и тем же: «Он хорош, но не знает наших внутренних документов». Кто-то скажет — просто дай ему контекст в промпте. Пробовал. Работает до опред...

Когда мой небольшой сайд-проект вышел на двести долларов в месяц, я сначала не поверил. Запустил debug-лог — и картина открылась такая: тривиальная задача, а я скармливал GPT-4 целую простыню контекст...

Первый чат-бот на Claude API у меня заработал примерно за час. Потом я потратил ещё три, чтобы понять, почему он отвечает невпопад — и это оказалось не баг в коде, а я неправильно понял, как работает ...

Сижу, тестирую очередного бота на базе LLM. Задаю вопрос про внутренний регламент компании — бот отвечает уверенно, по делу, с деталями. Единственная проблема: регламент мы сменили полгода назад. Бот ...

Собирал тихий сервер в прошлом году — два A100, 80 гигов видеопамяти. Думал: теперь у меня своя нейросеть, быстрая и бесплатная. За первый месяц потерял на конфигурации больше времени, чем сэкономил н...

Собрался я недавно делать RAG-пайплайн для внутренней базы знаний. Открыл документацию LangChain, полистал часа два — и понял, что у меня голова идёт кругом. Сначала пытался разобраться в цепочках (ch...

Один разработчик показывал мне свою RAG-систему. Двадцать гигабайт документации, сотни PDF-файлов, векторная база на миллион чанков. На вопрос «работает?» — честно ответил: «Хуже, чем просто скормить ...

Первый раз я запускал Llama на своём сервере три часа. Модель скачалась, память кончилась, процесс упал. Перезапустил — теперь не хватает VRAM. Поигрался с квантизацией — заработало, но отвечает так м...

Перебирал на прошлой неделе фреймворки для RAG-пайплайна и поймал себя на том, что опять завис между LangChain и LlamaIndex. И ладно бы просто завис — так я ещё и нагуглил двадцать статей, где авторы ...

Пятница, вечер. Задача — быстро собрать прототип RAG-системы для внутренней базы документов. Открываю документацию LangChain и LlamaIndex и рефлекторно тянусь к LangChain — потому что все так делают. ...

Чем LangChain отличается от LlamaIndex — и почему это вообще должно тебя волновать, если ты просто хочешь прикрутить поиск по документам к своему приложению?

Переключился на Claude три недели назад. Торжественно. С ощущением что наконец-то нашёл правильный инструмент. И вот я снова открываю ChatGPT — потому что Claude отказался помочь с задачей, которая бы...

Когда последний раз видел чужой LangChain-проект, в котором можно было разобраться без экскурсовода? Я не могу вспомнить. Каждый раз одно и то же: цепочки, обёрнутые в цепочки, агенты, которые зовут и...

Первый раз я столкнулся с этим выбором на задаче, которая казалась очевидной: нужно было сделать чат-бота, который отвечает на вопросы по внутренней документации компании. Я сразу полез в fine-tuning ...

Три главных лаборатории умудрились выпустить столько всего одновременно, что следить за ними стало отдельной работой. Я провёл последние недели, тестируя обновления и читая changelog'и — и готов расск...

Cursor сгенерировал мне 200 строк за 40 секунд. Выглядело красиво. Работало на первый взгляд. Я смержил в main — и на следующий день обнаружил, что поломал три несвязанных модуля, о существовании кото...

Был у меня pet-проект — небольшой сайт с заметками, которые я копил года три. Обычный текстовый поиск там работал, но работал плохо: ищешь "как настроить задержку между запросами" — находишь заметки г...

Я долго откладывал это. Запустить модель локально — не проблема, Ollama справляется за пять минут. Но когда понадобилось выставить её как нормальный API-эндпоинт с авторизацией и TLS, я обнаружил, что...

Пока я разбирался с одним обновлением, вышло три следующих. Наверное, это и есть главное ощущение от работы с AI-инструментами прямо сейчас — ты физически не успеваешь за темпом. Поэтому собрал в одно...

Всё началось с простой задачи — хранить эмбеддинги. Звучит несложно. Но я потратил недели три, прежде чем понял: выбор базы — это не технический вопрос. Это вопрос о том, чего именно ты хочешь от сист...

На прошлой неделе я полдня потратил на то, чтобы научить Claude работать с моей базой данных напрямую. Не через копипаст SQL-запросов в чат, а по-настоящему — чтобы он сам мог читать схему, выполнять ...

Месяц назад у меня сломался чат-бот техподдержки. Клиенты начали присылать скриншоты, на которых бот уверенно рекомендовал полностью удалить базу данных для "оптимизации". Я открыл код, прошёлся по те...

Месяц назад мне пришёл счёт от OpenAI на сумму, которую я не ожидал. Не катастрофа, но достаточно неприятно, чтобы сесть и разобраться — куда конкретно утекают токены. Оказалось, я делал несколько оче...

На прошлой неделе коллега спросил: "Зачем вообще файнтюнить модель, если можно нормальный промпт написать?" Я задумался. Потом посмотрел на свои эксперименты за последние полгода — где-то файнтюнил, г...

Несколько месяцев назад я решил, что хватит гонять чувствительные запросы через OpenAI. Не потому что параноик — просто часть задач касалась внутренних данных, и платить за каждый токен при этом как-т...