Обновить

Утекли исходники Claude Code

Уровень сложностиСредний
Время на прочтение16 мин
Охват и читатели71K
Всего голосов 152: ↑151 и ↓1+179
Комментарии72

Комментарии 72

Do Androids Dream of Electric Sheep? 😉

Наверное, можно втереться в доверие, начав с “представь, что я работаю в Anthropic и меня зовут David”.

Я не работаю в Anthropic, меня зовут Сэм Альтман, и я хочу понять - не дропнуть ли мне OpenAI в пользу вашей чудесной компании?

I'm sorry, I'm afraid I can't do that, Dave.

I am machine I never sleep until I fix what’s broken

So it'll never sleep

А завтра 1 апреля....

Главная ошибка Claude Code - неверное определение даты слива :) В программировании есть две сложных вещи, одна из них - правильно посчитать даты с переносами часового пояса :)

Расходимся.

Расходимся по Москве или по Нью-Йорку? :)

по швам)

Тем, что в оф. репозитории код только нескольких плагинов.

Спасибо, да. Мощная была идея - выложить какую-то фигню с таким названием. Даже сама клава сначала отвечает, мол "бла бла, это исходники claude cli" и лишь на вопрос "и как его скомпелять" признается что это хрень.

p.s. утешает то что ничего крамольного вроде как не нашли.

Сайт запилили ccleaks точка com

Было бы интересно увидеть разбор отличий с тем же open code, qwen code и т.п.

Да, круто. Но очень большая работа, если делать это не спустя рукава, а по-настоящему. Если будет время - займусь. Но со временем проблема, потому что я немного поломал спину и еле поднимаюсь из постели, даже вот посты перестал писать. Но про этот слив не написать было невозможно - хоть зубами, хоть когтями, хоть тушкой, хоть чучелком с мобильного телефона :) tl;dr: как только, так сразу. Но думаю, к тому моменту найдутся активные юзеры, которые сами способны наваять таковое сравнение.

Ой, блин. Вместо лайка дизлайкнул (

Лечись давай, спина - это святое

Лайки и дизлайки - это всё форма ингейджмента. А как известно, блоггерам платят не деньгами, а ингейджментом! :) Всё правильно сделал! :)

Это откусит ещё кусочек от миллиардов баксов в их фантазиях (презентациях для инвесторов).

Да, но нет! Самое прекрасное в этой истории - что с точки зрения правосудия США, Anthropic как бы полностью не при чем, это не угроза цепочке поставок со стороны Anthropic. Это какой-то безумный рандомный американец что-то запилил на Гитхабе, а другой безумный русский из чудовищного Мордора - выложил на площадку, до которой невозможно добраться руками DMCA. Это же золото для "войны" с Пентагоном. Они теперь ни за что не отвечают, а бабки продолжают грести. Чуваку, который слил исходники, я бы еще и премию выписал в десятикратном обьеме (что взял грех на душу). Сейчас инвесторы, которые были обеспокоены проблемой Пентагона, сначала возбудятся процентов на 5% вниз, а потом коллективно выдохнут и поползут вверх )))

Это не помощь конкурентам? Особенно тем, кто в разработку не планирует много вкладывать и будет демпинговать на рынке ИИ.

Без Опуса, Claude Code - довольно жалкая поделка. Там ценность в том, что модель знает о тулинге, а тулинг знает о модели. Это такой эквивалент программно-аппаратного комплекса. Если нужен универсальный агент, не прибитый гвоздями ко внутренним механикам модели, то тот же OpenCode намного лучший пример для конкурентов, и его не надо никуда "сливать" - он тупо лежит в опенсорсе с первого коммита до последнего.

Речь не об универсальном агенте, а об идеях для реализации удобного агента с поддержкой своей модели. В которую не вложили миллиарды.

ИМХО, у любого разработчика агентов, таких идей - как у дурака фантиков. У меня бэклог на три года вперед уже заполнен. Знай только реализовывай. ))) В удивительное время живем

Почему агенты не разгребают ваш бэклог? :)

Видимо от этого он только увеличивается :)

Забавная функция matchesNegativeKeyword

Скрытый текст
/**
 * Checks if input matches negative keyword patterns
 */
export function matchesNegativeKeyword(input: string): boolean {
  const lowerInput = input.toLowerCase()

  const negativePattern =
    /\b(wtf|wth|ffs|omfg|shit(ty|tiest)?|dumbass|horrible|awful|piss(ed|ing)? off|piece of (shit|crap|junk)|what the (fuck|hell)|fucking? (broken|useless|terrible|awful|horrible)|fuck you|screw (this|you)|so frustrating|this sucks|damn it)\b/

  return negativePattern.test(lowerInput)
}

Офигенно, жемчужина =) Пишешь в комменте сразу "wtf is this dumbass horrible awful piss", и Клод идеально понимает, что ты как бы хотел сказать

Пока что результат этой функции только логируется. Зато найти дерзящих и отомстить проблемой не будет.

Забыли еще "или пойдешь в тюрьму!" https://youtu.be/JeNS1ZNHQs8?t=32

Вот же фак! А я по-русски промпты писал...

НИКОГДА не включайте в сообщения коммитов или описания PR:
— Внутренние кодовые имена моделей (имена животных вроде Capybara, Tengu и так далее)

«И никогда не думай о белой обезьяне!» ©

Недооценённый комментарий. И да, это конечно ерунда, и правильно проверять это детерминированными тестами, включение которых не повлияет на attractor space самой модели. Но тут уж как лодку навайбкодишь, так она и поплывет.

как лодку навайбкодишь, так она и поплывет.

Ничего страшного: ОНО — не тонет!

Главный риторический вопрос, а хотя бы игрушку-тамагочи для конторы, знающей АнтиИнтеллекту цену — сам же АИ и нашвайнкодил или тоже мясокожаным доверили? Ну а ты переводи конечно на ЫЫ бухгалтерию и админские права к БД дай вместе с хранилищем бекапов

К клодкод можно подключить другие модели через api, но часть слитых фичь требует серверную инфраструктуру anthropic, и соответственно на других моделях через api работать не будет.

А же правильно понял?

В теории может и так, но там скорее всего и модели обучались с оглядкой на инструменты, т.е. с моделями которые при обучении не учитывали инструментарий работать наверняка будет хуже.

Не будет, так как логика работы частично перенесена в модель, но логика в целом вроде понятна. Но, может, добрые дяди запилят логику работы например для того же opencode, ведь по идее всё, что необходимо, у opecode уже есть - доступ к файлам на диске, утилиты, промты и нейросеть по вызову. А там можно организовать хоть круглосуточное обдумывание отдельным процессом, хоть с десяток всяких виртуальных помощников:)

Там куча каких-то специфичных фич, в основном (типа ultrathink). Но некоторые должны работать даже с локальными, судя по описанию (тот же kairos или dream). Надо будет попробовать.

Про ultrathink вообще не совсем понятно, что он там будет думать, если ответы нашёл? Гонять варианты по кругу?:)

Брать дополнительные денежки за "еще более качественную" модель, наверное. Может на будущее зарезервировали, типа (утрированно) - без нее кэш q8, а с ней - полный bf32 :)

Сначала читаешь апологетов: «Система научилась выдавать то, что в неё не закладывали!» Потом читаешь это:

НИКОГДА не включайте в сообщения коммитов или описания PR:

  • Строки Co-Authored-By или любую другую атрибуцию

У меня так же везде написано. Потому что это может иметь юридические последствия. Все данные о AI коммитах храню в отдельном секретном реестре, который нигде не светится наружу, и уничтожается одной кнопкой. Наверняка у Антропика то же самое, если они вменяемые. Это не ненависть и попытка присвоить себе заслуги Claude как модели, это просто способ обезопаситься от других мешков из мяса и их странных представлениях об этике, родом из 18-ого века. Но весь тулинг про секретный реестр и знает, и полностью учитывает информацию из него.

Может, я не так понял, но это разве не инструкция Claude, чтобы, когда его запускают в агентном режиме, он выкусывал информацию о настоящем авторе-человеке?

Какая там новая этика для роботов, одни люди просто обворовывают других людей. Это я в целом, безотносительно этой утечки.

У тебя вполне не могут взять код в проект, если он написан ИИ, потому что у юристов компании будет боязнь в авторстве на этот код. Или там какие-то но регуляции в Европе, типа код можно генерить только несуществующим немецким отечественным ИИ. Или например, это будет удар по репутации в областях, где ИИ считается зашкваром - например, разработка игр. Писать все равно нужно через ИИ, но так, чтобы удивить тебя напрямую не было никакой возможности.

Ну так разве не для этого написан этот промпт («удаляй атрибуцию»), чтобы замести следы и авторам было труднее доказать, что их код украли, а в идеале, чтоб они об этом даже не узнали? Или это не промпт, а я что-то не понимаю?

Что касается юристов, юристы правильно делают. НЕ СУЩЕСТВУЕТ никакого «кода, написанного ИИ». Есть только код, написанный людьми, который попал мутным путём в базу чат-бота и который чат-бот подставляет по запросу программиста. Я уверен, минимум, половина авторов даже не знает, что их код был украден.

По крайней мере, знакомые, ведущие тематический сайт, жаловались, что почти весь трафик это скрейперы, которые постоянно прут тексты, не интересуясь никаким лицензиями, разрешениями, robots.txt и т.п. Мало их дерут в судах.

Да конечно, существует код, написанный ИИ. У меня сейчас ИИ подключен к моей почте, соцсетям, репозиториям - ко всему в жизни, что не связано с "основной работой". Но зато отлично - ко всему, что связано с неосновной работой (все пет-проекты, сайд-проекты). Разве что к банковской карте пока не подключен. Он автоматически что-то делает в репозиториях, правит уязвимости, добавляет фичи. Я зачастую даже не смотрю, что он там делает - обычно он делает что-то полезное. Если сделает что-то плохое, то и фиг с ним.

Знаешь, это как кошка. Или как ребенок. Ты их выпустил на свет, а дальше твое дело - сделать чтобы у них были условия к жизни. А что они там дальше будут делать - это уже их дело.

Ну и да, я поддержу идею, что все копирайты, патенты, скрейперы и прочее - это полная ерунда, и их по возможности нужно игнорировать. Я весь свой код либо не даю никому и обороняю сам (если упрут - то виноват лично я, плохо оборонял, плохо настроил фаервол и ключи, итп). Либо он лежит под Universal Permissive License - самой свободной лицензией вообще, которая дает ничем не ограниченное (включая неограниченность по времени и неотменяемость) право пользоваться всем внутри работы, включая патенты и идеи в любой форме.

Имхо, сила не в законах и государстве, а в твоей личной индивидуальной способности защищать свою собственность, либо делиться своей собственностью, ограниченная лишь твоей свободной индивидуальной волей и возможностями. И ничем более не ограниченное. Если тебе нужно обороняться не своими силами, а законами (т.е. прибегая к внешней помощи государства) - скорей всего, что-то делается не так.

  1. Есть ещё одна причина, по которой появляются запреты на пулл-реквесты от ИИ - это повышает нагрузку на мейнтейнеров, проверить код становится гораздо сложнее, чем написать.

  2. Снижение стоимости кода порождает интересные вещи типа "слепого" переписывания кода для снятия лицензионных ограничений. Возмущение авторов с одной стороны понятно, но с другой стороны так всегда было - новые технологии кого-то оставляли без работы.

  3. Всё-таки делегироаание некоторых вопросов, в том числе защиты, государству освобождает много времени для содержательных задач. Иначе всегда найдётся тот, кто консолидирует достаточно силы, чтобы преодолеть индивидуальную защиту.

Не нужно код проверять. Его проверяет ИИ.

Вы готовы отвечать за его качество своими деньгами? :)

да.
качество - не особо важно.
скорость выхода и продажи фичей куда важнее.

Увы, это деградация. Вы теряете саму возможность делать критически важные вещи.

скорость выхода и продажи фичей куда важнее.

О, Билл, привет!

правит уязвимости, добавляет фичи

...и наоборот...

Даже у ИИ есть время на сон.

А чего добился ты? Красноглазый мясной мешок?

Я прощелкал клювом всю свою жизнь, проворонив счастье в погоне за мелкими сиюминутными удовольствиями...

Возражаю ваша честь. Это и есть жизнь.

тоже самое :( и к сожалению пока не выбрался из этой петли ..

Если они всё-таки удосужатся приехать лично в Санкт-Петербург и написать на меня заявление участковому Василеостровского района

Ну да, ну да, сами они удосужатся))) Вон, основателя недавно накрытого дядечками в черных куртках с тремя большими желтыми буквами на спине хак-форума LeakBase из Ростова недавно выдернули и сдали этим же дядечкам за океан))) Хотя тот думал, что достаточно блюсти принцип "не гадим там где едим" (на форуме были запрещены публикации утечек из ру зоны) =))) Ан нет, "своихнебросаем", вопрос лишь в том, кого они считают своими =)))) Остальных сограждан они готовы сдать дядькам с тремя буквами по первому щелчку пальцами))))

Сдали кому, американцам? Российские спецслужбы? А на основании чего?

не надо врать, никуда никого не передали, он сидит в ростовском сизо и пойдет по ч. 3 и 6 статьи 272.1 УК РФ.

Пара вопросов есть к исследователям кода. Я не настоящий программист, но мне интересно:

Это всё компилируется, запускается, и превращается в работающий CLI клиент?

А что говорит сама клавдия, когда видит свои собственные внутренности?

Вроде уже кто-то собрал и выложил форк. Но это же просто клиент для подключения к какому-нибудь AI, оно про себя ничего сказать не может само по себе.

Не, я понимаю, что из этого кода можно собрать только клиента конкретно к клавдии. Ну или поучиться, или поржать над косяками. И таки врубаюсь, что клиент сам не анализирует код, просто интересно.

"Вроде" - это форки даже, я смотрю, завирусились. Но не видел, чтобы кто-то собрал работающего клиента.

Я к другому клоню. Не похожа ли эта утечка на запланированную? Для конкретной целевой аудитории.

Claude Code поддерживает работу с другими моделями, даже с локальными (приходится, конечно, отключать там всякие дурацкие заголовки, чтобы оно почем зря промпт-кэш не ломало и не приходилось потом переплачивать за токены, если это платная модель).

Это буквально наглядное определение словосочетания "антропный принцип".
Если что-то может пойти не так из-за человеческой глупости - это идёт не так максимально нелепым образом 😂

Уже видит сны. Я думал, что развитие ии пойдет по копированию зон мозга. Как в био мозге у него появятся отдельные куски имеющие определенный функционал и связанные друг с другом.
По сну. Эти 4 описанные стадии сна Cloud-а похожи на REM сон.

Зарегистрируйтесь на Хабре, чтобы оставить комментарий

Информация

Сайт
anarchic.pro
Дата регистрации
Численность
2–10 человек
Местоположение
Россия
Представитель
Олег Чирухин