#агенты

страница 2 из 2
пост №1974ИИ и машинное обучение

Тем временем, Claude Code это оказывается уже для нормисов, а модные ребята пересели на более крутую open source упряжь openCode, которая поддерживает любые модели (а не только от anthropic). Ну и конечно есть безумно прокачанный форк от китайцев oh-my-opencode, который прямо сейчас запускают как отдельный сервис, Сизиф. Нейминг как у самолета Антея.

Узнал об этих инструментах из драмы, которая разворачивается прямо сейчас: формально, Anthropic разрешает пользоваться своими моделями с подпиской Pro и Max только внутри своего Claude Code. Пару часов назад, они начали блокировать запросы из openCode, после чего пользователи стали жаловаться, что Claude Code — это каменный век и отменять подписки. При этом модели Anthropic, по словам пользователей, лучше конкурентов. Моделями Anthropic можно пользоваться «по API» без скидок и ограничений, но если платить за каждый запрос — получаются совсем безумные цифры даже для модных вайбкодеров.

Вряд ли Anthropic стал бы бороться с чужими инструментами, будь они хуже родного. Получается, лучшая (и честная) рекомендация от ведущей лаборатории!

пост №1972ИИ и машинное обучение

Я наконец-то добрался сам попробовать Claude Code и это очень крутая штука, не только для программистов.

Если вы любите копаться в компьютерах, но «не настоящий программист» — рекомендую попробовать. Программистам — тем более.

Это программа, которая наконец-то может управлять нашим компьютером. Пусть пока только через терминал, но благодаря unix-утилитам, через командную строку она может делать почти всё что угодно.

Она сама открывает сайты, скачивает, читает и создает файлы, запускает другие программы (это нынче называют «агент» или «harness», упряжь для нейросети), уточняет, что ты хочешь, сама ставит себе задачи и сама запускает свои копии для их решения (это «оркестратор»)! Магическое ощущение — наблюдать, как машина работает на тебя.

Многие задумывались о том, что в чатовых нейросетях не хватает нормального интерактивного динамического интерфейса: кнопок, чеклистов и вкладок, которые бы подстраивались под текущий разговор. Странно всё-таки, что с самой мощной технологией современности можно общаться только текстом, как в 90-е.

Так вот, Claude Code дает этот интерактивный интерфейс, но при этом буквально использует приемы из 90-х!

Интерфейс у него на псевдографике, как в эпоху Norton Commander, с элегантным использованием Unicode-символов. Хороший микс эстетики 90-х с самыми современными технологиями (хотя, конечно, отсутствие возможности нормального редактирования текста — страдание).

У меня эта «переписка с компьютером в псевдографическом интерфейсе» ассоциируется с игрой ADOM.

Для того, чтобы попробовать самому, потребуется подписка Claude Pro за 20 долларов в месяц, но токены эта штука ест как не в себя, многие переключаются на тариф за 100. Дорогая игрушка! Зато теперь она создает результаты в реальном мире.

Ancient Domains of Mystery

пост №1963ИИ и машинное обучение

Самый популярный диалог среди программистов в последние 2 дня:

Андрей Карпатый (член первоначальной команды OpenAI, известный публичный эксперт ИИ): жалуется, что чувствует, что не успевает за современными инструментами разработки. Речь про ИИ-инструменты, конечно: agents, subagents, their prompts, contexts, memory, modes, permissions, tools, plugins, skills, hooks, MCP, LSP, slash commands, workflows, IDE integrations.

Ему отвечает Борис Черный (руководитель Claude Code), что прошел первый месяц, когда он не открывал IDE и весь код в Claude Code за него писала Opus 4.5. И ещё приводит пример, когда он попытался искать утечку памяти по старинке, подключив профайлер, а коллега просто попросил нейросеть сделать дамп и поискать, что там есть лишнего.

Борис разрабатывает этот инструмент, ему положено хайповать. И очевидно, что программисты все равно нужны. Но инструменты на самом деле развиваются с умопомрачительной скоростью и лучше всего ими пользуются те, кто работают над улучшением инструментов. Нас ждет очень интересный год.

Я как раз на днях думал, что только недавно смог уверенно сказать, что мы с Федей и коллегами успешно построили компанию по созданию софта. Большие проекты, маленькие, в стартапах и корпорациях — мы стабильно запускаем проекты каждые несколько месяцев. Такая пиратская шхуна, в которой каждый на своем месте. И вот только мы научились уверенно жить в этом мире, как опять шторм.

пост №1897ИИ и машинное обучение

Мы тут начали делать свой продукт — медицинского ИИ-консультанта. (да, на основе и с помощью ИИ)

Многие советуются с ИИ про здоровье. Пишут свои симптомы, загружают анализы, просят разъяснить диагнозы и получают второе мнение.

Искусственный интеллект может быть очень мощным помощником, но важно уметь составить правильный запрос и дать ему весь необходимый контекст.

Плюс, у людей, которые активно этим пользуются, возникает проблема менеджмента переписки: какой это был чат, в какой программе, а где я уже загрузил эти выписки и анализы? А хранение и каталогизация медицинской истории и документов, чтобы можно было использовать их в будущем — это вообще отдельная песня.

Мы решили сделать небольшое приложение, которое задаст все необходимые уточняющие вопросы и даст четкий ответ, и при этом будет вести «личный медицинский профиль» — сохранять все заболевания, анализы, выписки и т. д., используя их в дальнейших консультациях.

За пару дней накидали дизайн в фигме и в lovable: окно чата + раздел «моё здоровье», где заболевания и документы. Принципиальная схема приложения банальная — бэкенд на питоне с базой в postgres и фронт на js.

Бэкенд пишет руками сам Федя. Во первых, вайб-кодить бэкенд — себе дороже — ИИ пока что оставляет слишком большие дырки с точки зрения безопасности, а медицинская история — это не шутки; во вторых, мы хотим разобраться, как интегрироваться с AI.

Мне казалось, что учитывая всю эту AI-движуху, должны быть практически готовые технологические решения для проектов, подобных нашему. На слуху Langgraph, PySpur, dify — на словах они обещают ровно то, что нам нужно. Бери любой, крути поверх бизнес-логику и наслаждайся!

В реальности, всё тлен. Вот короткий внутренний статус от Феди после недели исследования:

Потратил несколько часов на работу с Langgraph и полностью в нём разочаровался:
— Документация не соответствует действительности. Копируешь куски — не работают.
— Переусложнённые абстракции. У него очень высокий порог входа — я за 3 часа не смог написать инструмент, который написал бы за 10 строк чистого httpx.post(‘https://api.openai.com')
— Все действительно полезные примитивы попрятаны внутрь langgraph platform, которая выглядит как closed source bloatware с нулевым devex. Без него придётся самим разруливать стейт между пользователями и делать API телеги/lovable

Что ещё я посмотрел:
— pyspur: Купился на автотесты запросов прямо в UI. К сожалению, проект выглядит мёртвым. Как будто бы 5к звёзд у него накручены — в issues почти пусто, а в дефлотной установке не работает даже справка по CLI: я натурально так и не смог её прочитать за час, угадывал.
— dify: купил за то, что у них прямо на лендосе визуально построен граф для бота поддержки медклиники. Выглядит кайфово, но я не смог понять, как ему подсовывать свой собственный стейт юзера. У них есть свои memories, но это очень тяжёлый вендорлок, и нет уверенности что туда влезет то, что нам надо.

Кажется, dify мог бы нам подойти, но с ним MVP не пойдёт дальше founders-friends-family, т.к. у себя его не развернуть (несмотря на заявления на лендосе там полный пиздец в инфраструктуре), то есть никаких локальных моделей для тестирования.

В общем, классическая на сегодняшний день ситуация, когда много блестящего вокруг, но настоящего, хорошего — нет. В результате, Федя написал свой код на питоне и основная бизнес-логика уже работает.

Про фронтенд напишу в следующий раз.

Надеюсь, уже в ближайшие недели будет рабочий прототип, который мы покажем друзьям и знакомым. На бета-тест записаться вот тут.

пост №1848ИИ и машинное обучение

Мне тут наконец-то объяснили, такое AI-агент.

Это когда мы в первом запросе предоставляем ИИ список тулов, которыми ей можно пользоваться. Пользоваться — это просить нас (клиента) запустить тул с нужными параметрами и вернуть нейросети ответ. И всё это в вечном цикле, не забывая каждый раз прикреплять к запросу всю предыдущую историю переписки. Всё.

Вот отличная статья с примером полной программы, которая делает именно это. Подзаголовок замечательный «Король-то голый!»

Отсутствие сложности не делает этот прием менее полезным. Если включить этот режим в редакторе Cursor — то он сам запросит нужные файлы, прогонит линтер и запустит любые другие нужны утилиты. «Вы и есть за меня будете?!»

пост №1783ИИ и машинное обучение

Нейросеть научили управлять компьютером — видеть экран, кликать мышкой, печатать.

Это обновление популярной модели Claude от Anthropic, основного конкурента OpenAI.

Функция в бете, доступна только через API для разработчиков; попробовать самому можно через готовый Docker-образ или open-interpreter. Рассказ, как они её сделали — здесь.