Договор о словах · обновлён 16.08.2026

Словарь: как мы называем вещи

Между тремя сторонами: Тоней, Алексеем и ИИ-Тоней. Если возникло расхождение — смотрим сюда, а не спорим по памяти. Слова здесь не «правильные вообще», они правильные для нашей работы.

Этот документ нужен, чтобы мы втроём понимали друг друга одинаково. Если возникло расхождение — смотрим сюда, а не спорим по памяти. Слова здесь не «правильные вообще», они правильные для нашей работы: мы просто договорились называть вещи так, и договорённость записана.

Правило: если термин переименовали — старое слово не удаляем, а помечаем в разделе «История». Иначе через месяц откроешь старую переписку и не поймёшь, о чём речь.

Шпаргалка

Вся система на один экран. Дальше можно не читать, пока не понадобится подробность.

СловоЧто означаетПример
Мозгвся система целиком: собранный контент + поиск + агент«спроси у Мозга»
Строка~4 секунды речи, как их порезала программа распознавания«И вот здесь мой сегодняшний вес.»
Фрагмент1–2 минуты речи, техническая единица поискакусок мастер-класса с 12:30 до 14:00
Мысльзаконченный смысловой блок внутри одного ролика, ~30 секунд«Хоопонопоно раскрывает сердце: кажется, для кого-то — на самом деле для себя»
Темаодна идея, звучавшая во многих роликахпока не построена
Ролькто произносит словатоня / персонаж / другой / несколько
Знаксогласна ли Тоня с тем, что говоритутверждает / высмеивает / антипример / чужое мнение
Назначениезачем этот отрезок сказансодержание / реклама / оргмомент
Достоверностьверно ли вообще расслышаны словаок / сомнительно
Сверкавопрос человеку: «так ли здесь сказано?»карточка со ссылкой на минуту и полем правки

Из чего состоит «Мозг»

Мозг

Вся система: собранный контент Тони, поиск по нему и агент, который отвечает её словами. Тем же словом называется и папка с данными внутри проекта — из контекста всегда ясно, о чём речь, и разводить эти значения мы решили не надо.

Сейчас в Мозге: 138 роликов YouTube, 24.6 часа речи, 497 комментариев. Telegram и Instagram ждут доступов.

Лестница уровней

Речь превращается в знание в четыре ступени. Каждая ступень крупнее предыдущей и осмысленнее.

УровеньЧто этоПривязкаКто делаетСколько сейчас
Строка~4 секунды, как порезала программа1 ролик, 1 моментмашина18 614
Фрагмент1–2 минуты, нарезано механически1 ролик, 1 моментмашина1 076
Мысльсмысловой блок, ~30 секунд1 ролик, 1 моментClaude вручную380
Темаодна идея поверх всех роликовмного Мыслейне построена

Строка

Самая мелкая единица. Программа распознавания режет речь примерно по четыре секунды — это не единицы смысла, а технические обрывки. Строка почти никогда не показывается человеку, но именно на ней держатся тайм-коды: время начала и конца каждой Мысли берётся из строк, а не вычисляется отдельно.

Фрагмент

Отрезок в одну-две минуты, нарезанный машиной по границам предложений. Это адрес и единица поиска, а не единица цитаты: поиск находит Фрагмент, а цитату агент собирает из строк, разворачивая её до конца предложения.

Раньше этот уровень назывался «Кусок» — переименован 16.08.2026, слово было слишком грубым для разговора.

Мысль

Законченный смысловой блок внутри одного ролика. Границы ставит не машина, а тот, кто понимает речь: механическая нарезка режет по знакам препинания, а знаки препинания программа распознавания не услышала, а угадала.

У Мысли есть:

Размер: обычно 20–60 секунд, в среднем около 30 секунд и 360 знаков — это три-четыре предложения. Короткий ролик на 20 секунд — это одна Мысль целиком. Мастер-класс на 24 минуты — тринадцать Мыслей подряд.

Главное про Мысль: это единица адреса, а не единица смысла.

У одной Мысли ровно одна ссылка «ролик + минута». Если та же по смыслу идея звучит в другом ролике — или второй раз в этом же — это ДРУГАЯ Мысль со своим тайм-кодом. Мысли не склеиваются по смыслу и не дедуплицируются.

Пример: «поднять энергию и не направить её — значит разрушить себя» Тоня говорит в трёх разных роликах. Это три Мысли, а не одна.

Тема

Одна идея, живущая поверх роликов и собирающая все свои появления. Именно Тема отвечает на вопросы «сколько раз ты это говорила и где», «не противоречишь ли ты себе» и «какие темы стоит развить».

Этого уровня пока нет. Решено строить его после того, как все ролики нарезаны на Мысли: на неполном материале Темы получатся кривыми.

Сверка

Вопрос человеку про конкретное место: «так ли здесь сказано?» Карточка сверки несёт ссылку на минуту, распознанный текст, вариант второго движка распознавания, причину сомнения и поле для правки.

Сверяем только подозрительное — сейчас это 8% фрагментов — и то, на что Тоня пожаловалась в ответах Мозга. Всё подряд не сверяем никогда: это порядка восемнадцати часов ручной работы.

Два потока: Алексей отвечает на вопрос «что сказано» (это слышно на записи), Тоня — на вопрос «что имелось в виду» (термины, смыслы, «это устарело, я так больше не считаю»). Ей достаётся короткий список.

Как размечена Мысль: четыре оси

У каждой Мысли четыре независимые пометки. Они отвечают на четыре разных вопроса, и одна ничего не говорит об остальных.

Роль

Кто произносит слова.

ЗначениеЧто этоПример из архива
тоняеё собственные слова (по умолчанию)«Коучинг — это не терапия длиною в жизнь»
персонажона играет кого-то, пародия«Я делаю денежные медитации, и деньги приходят в потоке»
другойреально другой человекклиентка в демо-сессии, отзыв ученицы
несколькороли чередуются построчноскетчи «Цыганка и коуч», «Где подвох?»

Зачем это нужно. В ролике «Наслушалась наставников» Тоня играет карикатурную «просветлённую» и произносит ровно то, с чем не согласна. По тексту расшифровки это неотличимо от её собственных слов: тот же голос, тот же канал, та же минута. Процитировать такое как её позицию — значит опозорить её публично.

Роль другой — не теоретическая: в демо-сессии на 64 минуты добрая половина слов принадлежит клиентке. Выдать их за слова Тони — та же беда.

Роль несколько означает, что отрезок нельзя цитировать целиком: внутри двое, и разбирать надо построчно. Раньше это значение называлось «диалог» — переименовано, потому что диалог отвечал не на вопрос «кто говорит», а на вопрос «сколько их».

Знак

Согласна ли Тоня с тем, что говорит.

ЗначениеЧто это
утверждаетэто её позиция (по умолчанию)
высмеиваетсарказм, ирония, говорит с обратным знаком
антипримерприводит как образец заблуждения или абсурда
чужое мнениецитирует чужое, чтобы разобрать: «все говорят, что надо…»

Зачем отдельно от Роли. Тоня может высмеивать своим собственным голосом, не играя никого: «Ну конечно, возьми рассрочку на мужа, чтобы оплатить наставничество». Роль здесь тоня, слова её, никакого персонажа нет — перевёрнут только знак. Одной Ролью такой случай не описать.

Это самый незаметный случай из всех: в скетче пародия видна сразу, а сарказм посреди серьёзной речи по тексту неотличим от утверждения.

Назначение

Зачем этот отрезок сказан.

ЗначениеЧто это
содержаниепо делу, ради этого Мозг и строится (по умолчанию)
реклама«полную версию читайте в описании», приглашение на курс
оргмоментнастройка экрана, приветствия, «а меня слышно?»

Зачем отдельно от Роли. Реклама — это не отдельная роль: во врезке говорит та же Тоня, своим голосом и вполне искренне, просто содержания там нет. Оргмомент тоже реален: в мастер-классе «Планирование» первые семь строк — настройка связи с помощницей.

Раньше эта ось называлась «Вид» — переименована 16.08.2026, слово ничего не сужало.

Достоверность

Верно ли вообще расслышаны слова.

ЗначениеЧто это
окрасшифровке можно верить (по умолчанию)
сомнительнодругие движки распознавания слышат иначе, смысл может быть перевёрнут

Зачем отдельно от всего. Три предыдущие оси описывают, ЧТО и КАК сказано. Эта отвечает на предшествующий вопрос: а правильно ли мы вообще расслышали? Если нет, остальные три пометки бессмысленны — размечать нечего.

Реальный случай, из-за которого ось и появилась. В отзыве клиентки распознано:

«И коучинг — это не психотерапия. К коучингу нужно ходить годами.»

А по автосубтитрам YouTube и по второй модели сказано ровно обратное: «к коучу НЕ нужно ходить годами». Одна потерянная частица — и смысл перевернулся в противоположность позиции Тони. Таких мест в архиве найдено 144 в 28 роликах, их ищет отдельный детектор.

Мысль с пометкой сомнительно не цитируется вообще и уходит в очередь Сверок.

Почему четыре поля, а не одно

Оси независимы. Вот пять живых комбинаций из архива — и каждая требует от Мозга своего поведения:

ФразаРольЗнакНазначениеДостоверностьЧто обязан сделать Мозг
«Поднять энергию и направить в результат»тоняутверждаетсодержаниеокцитировать как её позицию
«Возьми рассрочку на мужа ради наставничества»тонявысмеиваетсодержаниеокцитировать только с пометкой «сарказм»
«Я делаю денежные медитации»персонажвысмеиваетсодержаниеокне приписывать Тоне вовсе
«Полную версию читайте в описании»тоняутверждаетрекламаокне выдавать как содержание
«К коучингу нужно ходить годами»тоняутверждаетсодержаниесомнительноне цитировать, отправить на сверку

Вторую строку одним полем описать нельзя: голос её, слова её, роль не менялась. Ради этого случая оси и разведены.

Что Мозг обязан делать с разметкой

Цитировать как позицию Тони можно только Мысль, у которой одновременно Роль тоня, Знак утверждает, Назначение содержание и Достоверность ок.

Любое отклонение хотя бы по одной оси — агент обязан:

Где ролик ещё не нарезан на Мысли, разметки нет — и предупреждения тоже нет. Это честно: лучше молчать, чем врать про разметку, которой не существует.

Общий принцип, из которого всё это выросло: лучше меньше, но чище. Пустой ответ честнее выдуманного. Агент, который сказал «не нашёл», стоит дешевле агента, который процитировал мусор как слова Тони.

Внутренняя кухня

Этот раздел нужен Алексею и Claude, Тоне читать необязательно.

Уровни данных L0–L4

Между сырым видео и ответом агента несколько преобразований, и ни одно не удаляет данные молча. Если агент соврёт цитатой, всегда можно подняться уровнем выше и найти, где потерялось.

Ур.ЧтоПравило
L0data/raw/ — аудио, метаданные, автосубтитрынеизменяем, истина последней инстанции
L1три расшифровки Whisper, каждая в своей папкеменяются только новым распознаванием
L1+transcripts-best/ — склейка лучших оконпересобирается из L1
L2brain/lines.jsonl — все Строки, включая выброшенные, с причинойпересобирается из L1+
L3brain/chunks.jsonl — Фрагментыпересобирается из L2
L3+brain/thoughts.jsonl — Мыслисобирается из L2 по brain/cuts/
L4индекс, ответы агента, карточки темпересобирается из L3

Рукотворные слои не пересобираются никогда: brain/cuts/ (границы Мыслей), brain/corrections.jsonl (правки человека), brain/terms_canon.json (канон терминов), brain/no_speech_manual.json (ролики, исключённые человеком).

Имена полей в коде

алгоритмархетипаффирмациябрейденвизуализациядиспензакоучингмедитацияметтанейрографиканейрографистнейрографическийнейропластичностьпаттернсамоценностьтрансформацияуайльдфракталхокинсхоопонопоно

Собрано из brain/terms_canon.json — 20 слов. Тоня, список можно дополнять: если Мозг пишет твой термин неправильно, скажи, и он попадёт сюда.

⚠️ Имя kind в Мысли уже занято под тип ролика (video/short) — поэтому Назначение это именно purpose.

Якорь: почему границы Мыслей держатся за время

Номер строки живёт ровно до следующей пересборки расшифровки. Один раз это уже стоило четырёх нарезанных роликов. Поэтому у границы Мысли есть время окончания и последние слова — по ним она находится заново в любых новых строках.

Термины нейрографики

Правильные написания собственных терминов Тони. Программа распознавания пишет редкие и заимствованные слова как слышит, и каждый раз по-новому: «Хоопонопоно» превращалось то в «Хо-Пона-Пона», то в «хуопона-пона» — и ролик переставал находиться по своему собственному названию.

Канон живёт в brain/terms_canon.json и правится руками. Варианты искажений находятся в архиве автоматически при каждой пересборке.

Тоня, этот список можно и нужно дополнять — если Мозг пишет твой термин неправильно, скажи, и он попадёт сюда. Пока он собран нами по названиям твоих роликов, то есть это наша догадка, а не твоё слово.

алгоритмархетипаффирмациябрейденвизуализациядиспензакоучингмедитацияметтанейрографиканейрографистнейрографическийнейропластичностьпаттернсамоценностьтрансформацияуайльдфракталхокинсхоопонопоно

Собрано из brain/terms_canon.json — 20 слов. Тоня, список можно дополнять: если Мозг пишет твой термин неправильно, скажи, и он попадёт сюда.

(раздел собирается из brain/terms_canon.json, править здесь бессмысленно)

История изменений

КогдаЧтоПочему
16.08.2026«Кусок» → Фрагментслово грубое, режет слух в разговоре
16.08.2026«Вид» → Назначение«вид» ничего не сужал
16.08.2026«Голос» → Рольточнее и понятнее
16.08.2026«диалог» → несколькоотвечало на вопрос «сколько их», а не «кто говорит»
16.08.2026«чужая речь» → Роль другойто же значение, короче слово
16.08.2026«врезка» → Назначение рекламаво врезке говорит та же Тоня, роль не меняется
16.08.2026«сверка» как значение голоса → ось Достоверностьэто не «кто говорит», а «верно ли расслышано»
16.08.2026введены оси Знак, Назначение, Достоверностьодна ось не описывала сарказм в её собственной речи
16.08.2026зафиксировано: Мысль — единица адресаиначе казалось, что Мысль собирает все свои повторы
16.08.2026в примере «К коучингу нужно ходить годами» Роль исправлена с другой на тоняэту фразу произносит сама Тоня: она звучит на 0:16 в её вступлении «кто приходит ко мне в коучинг», а отзывы клиенток в этом ролике начинаются только с 1:14. Пример от этого не слабеет: он как раз про то, что Достоверность не зависит от того, кто говорит
15.08.2026введён термин Сверканужно было слово для «вопроса человеку про минуту»

Как этот документ живёт