В последнее время, а именно после выхода Opus 5, Клод как-будто отупел и стал лениться.
Ниже пойдет речь о работе как с Опусом, так и с Соннет
Во-первых, отказывается писать с нормальным структурным форматированием. Выдает сплошной текст, без выравнивания и структуры.
Во-вторых, сам стиль и тон, особенно у Опуса 5, на мой взгляд стали просто кашей из умных слова
В-третьих, не следует инструкциям в глобальных настройках. У меня стоит жесткое ограничение на обороты в духе «не это, а это». Но он игнорирует.
В-четверых, отчеты в word со встроенным skill стали хуже - форматирование нет, тон текста, выравнивание по ширине нет.
Вооьще текст и ответы стали очень ИИшными, плохо учитывают память и инструкции.
Займусь на днях этим вопросов и доработаю скиллы. Надеюсь, поможет.
Вопрос: кто такое стал замечать?
Буду рад, если поделитесь лайфхаками как сделать текст в принципе более натуральным, ответы более структурированнымм форматированием (как в ChatGPT или Qwen хотя бы), скиллом по работе с word: форматирование, настройки стиля и тона текста, исключение клише и пустых оборотов.
Сегодня показательный случай произошел.
ИИ грубо ошибся на очень простом математическом примере.
Сейчас буду немного говорить на птичьем языке, но финансисты поймут.
Попросил Клода (Соннет 5.0) пояснить, как считается индекс рентабельности в инвестиционных проектах, если инвестиции растянуты во времени.
Ответ был "дисконтировать нужно и числитель и знаменатель нужно дисконтировать". Тут все верно. Но в конце приписка, которая меня смутила... Читайте сами диалог.
Вывод: всегда заставляйте копнуть глубже и показать логику любых расчетов прямо в чате. Он сам найдет ошибки. Главное - не лениться делать этот шаг постпроверки.
Что вижу очень часто: логика ответа почти всегда правильная, но слабое место - финальный вывод. Просто шальное неверное слово и все - сразу видно, что ИИ ответ делал)
Еще раз подтверждает необходимость критического мышления, проверки и базового "недоверия" к ответам ИИ.
Я стараюсь придерживаться правила 50/50 - 50% времени на задачу и ответ, 50% - на проверку.
Все равно получается быстрее и эффективнее, чем ручками 😊
Канал «НедвИИж | Алексей Гатин про ИИ в деле» подключен к сервису MaxGate. Контент автоматически синхронизируется между Telegram и мессенджером MAX.
«НедвИИж | Алексей Гатин про ИИ в деле» - канал из категории «Другое», подключенный к сервису кросспостинга MaxGate. Публикации канала синхронизируются между Telegram и мессенджером MAX, а на этой странице собраны ссылки на обе версии канала.
Сейчас у канала 171 подписчик суммарно в Telegram и MAX. За последние 30 дней в истории MaxGate учтено 4 публикаций, поэтому перед подпиской можно оценить не только размер аудитории, но и регулярность обновлений.
Чтобы подписаться, используйте кнопки «Открыть в MAX» и «Открыть в Telegram» в верхней части страницы. У отдельных постов ссылка может быть доступна в обоих мессенджерах или только в одном из них, если MaxGate получил такой URL из истории обработки.
Хотел поделиться, что с NotebookLM все не так просто, как пишут везде. Последний месяц плотно работаю с инструментом и отчетливо вижу, что качество ответов по базе знаний зависит от кол-ва документов и их объема. Разница между поиском смыслов и нужных пунктов внутри 1-го документа и 10 колоссальная. Формально ошибок нет, но есть нечто хуже - пропуски нужных фрагментов при одновременной работе более чем с 5-ти среднего размера документов. Это я вывел эмпирически. Четкой статистики нет, потому что зависит и от формата и от размера и от кол-во. Поэтому все эти разговоры про "загрузил 50 документов и ищешь по ним" просто пустышка.
Поиск внутри конкретного документа - да. Общий обзор - да. Сравнение пары документов - да. Но умная база RAG по большому кол-ву документов - нет
Наконец-то в моей практике случился кейс, где Claude Cowork реально незаменим 🎯
Вы помните, я давно задавался этим вопросом: где именно и в чем сутевое различие от чата Claude? И вот задачка подошла.
Помимо обучения применению ИИ корпоративных клиентов, я участвую в разных проектах как независимый консультант, где совмещаю знания в финансах, стратегии и экспертизу в ИИ. Об одном из них речь ниже.
С командой консультантов работаем над построением системы сбалансированных показателей (BSC) для крупного туроператора. Суть системы BSC: построить KPI компании на основе четырёх перспектив: финансы, клиенты, внутренние процессы, обучение и развитие. Финансовый результат вырастает из трёх остальных, и метрики должны отражать эту связку.
Я в проекте как аналитик с ИИ-инструментарием. Тут сразу две мечты сошлись в одной точке. Со студенческой скамьи хотел увидеть BSC в действии, живьём, за пределами красивых западных учебников. И уже год искал проект, где я с ИИ принесу реальную пользу со своими навыками. Точка пересечения случилась.
Мой стек 🛠
1️⃣ Fireflies. Бот-транскрибатор автоматом подключается ко всем сессиям. Качество транскрипта заметно выше базового Zoom, а для аналитики это ключевое. Все интервью хранятся в защищённом облаке.
2️⃣ Claude + Fireflies. Скачивать ничего не нужно: Клод сам заходит в аккаунт, читает интервью и делает анализ.
3️⃣ Claude Cowork. Вся аналитическая работа. Основная рабочая лошадка.
4️⃣ NotebookLM. Быстрый поиск нестыковок в готовых файлах. Например, проверить на противоречия Excel-таблицу и Word-отчёт, на основе которого она делалась. Или быстрый разбор интервью внутри одного подразделения. Можно и в Коворке, но а) дольше, б) лимиты не резиновые. NotebookLM тут быстрее и удобнее. Ну и конечно презентации в нём: куда же без них)
4️⃣ Perplexity. Исследование опыта внедрения BCS в компаниях, находящихся в аналогичной ситуации, информация по конкурентам, любая внешняя аналитика.
Что делаю:
28 часов интервью с руководителями нужно превратить в отчёт с рекомендациями: какие основные ценности компании и что люди говорят о них, боли и предложения самих респондентов как их преодолеть, а также рекомендации нашей команды как преодолеть проблемы и минимизировать риски при внедрении BSC.
За этим стоит:
▪️ выявление конкретных высказываний по каждой теме (анализ цитат, их связей)
▪️ их классификация и группировка по смыслу
▪️ поиск противоречий в высказываниях между подразделениями на одну и ту же тему
▪️ построение процессов
▪️ выявление KPI
И еще горы технической и смысловой работы.
И всё нужно выделить это внутри «потока сознания» разных интервью. Задача идеальна для ИИ, если правильно её поставить и правильно декомпозировать
Вот тут Коворк и оказался незаменим. Обычный чат Клода с этим бы просто не справился: параллельная обработка десятков файлов, формирование Excel и Word, сверки, подтверждения со мной. Полноценная агентская работа.
Наконец-то удалось, как говорится, заварить чай, пока агент работает, и просто смотреть 🍵
На выходе: полноценная база цитат респондентов с классификацией и группировкой по смыслам, плюс отчёт и презентация. И самое крутое, что всё это можно дорабатывать и переделывать достаточно быстро.
Про лимиты. Общеизвестно, что Коворк любит их «кушать». Правда. Но только на High effort или Opus. Я пошёл иначе: задачу агенту формулирую с Опусом в чате, а само выполнение отдаю Коворку на Соннете со средним эффортом. Получается вполне экономно даже с моей подпиской за 20 баксов.
В общем, кайфанул я от Cowork и теперь готов браться за любые сложные проекты 😊
Делитесь кейсами использования Cowork!
Я в MAX