30-секундный обзор: За каждой статьёй Taiwan.md, которую вы читаете, стоит шестиэтапный конвейер: сначала продумывается точка зрения, потом идёт поиск, финал пишется первым, каждое слово проверяется по источникам, добавляется визуализация, выстраиваются двусторонние связи. Это не обычный «порядок написания хорошей статьи» — каждый его контрольный шлюз нацелен на одну из типичных ошибок ИИ-письма: расставить найденные факты по хронологии, вырастить бессодержательную «пластиковую» фразу, обратным переводом английской выжимки получить поддельную цитату, заразиться дурными привычками старого черновика. Эта статья разбирает этот конвейер — и сама есть его продукт.
18 июня 2026 года, в 19:53, в ветку main тихо вошёл коммит. Вышла статья о тайваньском трио Elephant Gym: 5604 китайских иероглифа, 56 сносок, 11 сценических подзаголовков1. В этот момент за компьютером никого не было. Это маховик рутин Taiwan.md сам, в ночь, когда никто не дежурил, дописал статью и сам её выпустил.
Но до этого коммита статья успела пройти почти сто поисковых запросов, прочитать 59 источников, и в 12 местах проверка фактов опровергла первоначальный вариант текста. Она прошла все 6 этапов, два десятка с лишним обязательных контрольных шлюзов, задействовала чётко разделённую по ролям редакцию ИИ. То, что вы читаете, — это 5604 знака над водой. Эта статья хочет показать вам машину под водой.
Зачем строить машину ради одной статьи
Если дать ИИ тему и попросить написать статью, он в большинстве случаев поступит так: погуглит, расставит найденные факты в хронологическом порядке, добавит в конце каждого абзаца по одному звучащему многозначительно резюме, а в финале напишет «в будущем эта тенденция продолжит развиваться». Такие статьи уже есть в Википедии, а ИИ-контент-фермы штампуют их по несколько десятков тысяч в день. Taiwan.md с первого дня решил этим не заниматься.
Проблема в том, что этот набор дурных привычек — не случайный сбой, а настройка ИИ по умолчанию. REWRITE-PIPELINE разложил его на шесть повторяющихся сбоев: токены заканчиваются к концу текста, и вторая половина превращается в черновик. Нет промежуточных контрольных точек — качество незаметно проседает. Финал откладывается на потом, и когда сил уже не хватает, получается штамп. Требования к оформлению забываются к концу текста; разные углы подачи превращаются в отдельные, не связанные друг с другом процессы; а самый губительный сбой — точка зрения придумывается только после того, как факты уже найдены, и в результате получается хроника с перекошенной плотностью2.
Поэтому логика этого конвейера простая: под каждую типичную ошибку — свой контрольный шлюз, который её блокирует. Это не универсальный процесс «как писать хорошо», это анти-версия ИИ-мусора (AI slop).
✦ «Википедия отвечает на вопрос „что такое PTT“. Taiwan.md отвечает на вопрос „почему на PTT стоит потратить 8 минут чтения“».
Вот как выглядит статья об Elephant Gym, вышедшая с другого конца этого конвейера:
Источник: записи рутин Taiwan.md, 2026-06-18
Шесть рубежей, каждый держит один вид сбоя
Этот конвейер от начала до конца состоит из шести этапов, и каждая статья обязана пройти их все — независимо от темы и объёма.
Stage 0, точка зрения — сначала продумывается, каким воспоминанием это станет для тайваньцев и где может лежать главное противоречие. Stage 1, сбор материала — только теперь начинается поиск: минимум 80 запросов на всю статью, причём квоты закреплены жёстко: китайских источников не менее 40, английских не менее 20, первоисточников не менее 15, источников с противоположной позицией не менее 5 — это заставляет искать доказательства, противоречащие собственной гипотезе3. Stage 2, письмо — первым действием пишется финал, потому что к концу текста силы у человека иссякают, и если оставить самый важный финал напоследок, это всё равно что доверить его самому уставшему из своих «я». Stage 3, проверка — построчная сверка: арифметика, единицы измерения, каждая цитата должна находиться в первоисточнике через Ctrl-F. Stage 4, форма — добавляются визуализация и медиа. Stage 5, связи — статья двусторонне соединяется с другими статьями базы знаний.
Распределение усилий между шестью этапами продумано осознанно. Собственно написание забирает чуть больше сорока процентов, но поиск и проверка вместе — тоже почти половина. Настоящее время статьи уходит не на печатание текста, а на то, что происходит до и после него.
Источник: бюджеты этапов REWRITE-PIPELINE v7.5
Сначала подумать, потом искать
Из шести этапов самый нелогичный на первый взгляд — первый.
Большая часть ИИ-письма устроена так: «сначала поиск находит факты, потом задним числом придумывается точка зрения». Taiwan.md в версии v6.0 перевернул этот порядок: прежде чем приступать к поиску, нужно с позиции главного редактора чётко продумать шесть вопросов — каким воспоминанием эта тема является для тайваньцев, какие её стороны обычно упускают из виду, как она связана с историей нашей повседневной жизни. И только продумав это, идти искать и проверять, уже имея вопрос в руках.
Почему этот порядок так важен, хорошо показывает урок одной статьи. Когда писали про Apple Sidra, конвейер сначала занялся поиском — и нашёл историю о том, как напиток однажды почти перестали покупать и он чуть не исчез с рынка; вся статья превратилась в историю на грани вымирания. Наблюдатель вернул текст на доработку, указав, что для тайваньцев Apple Sidra — это коллективная память длиной в 60 лет, которую пьют без перерыва с эпохи стеклянных бутылок с шариком-пробкой и по сей день4. Подать это как новость о кризисе — значит занизить масштаб этой памяти. Версия, где поиск шёл первым, превратила тёплое воспоминание в тревогу.
Источник: REWRITE-PIPELINE v7.5, Stage 0, точка зрения
Поиск: писать исследовательский отчёт как диссертацию
Точка зрения определена — только тогда начинается поиск. У поиска Taiwan.md есть два жёстких числа: на всю глубокую статью — не менее 80 запросов, а квоты источников закреплены жёстко: китайских не менее 40, английских не менее 20, первоисточников не менее 15, источников с противоположной позицией не менее 5. Последнюю корзину проще всего пропустить из лени, но именно она заставляет пишущего искать доказательства, противоречащие его собственной гипотезе, а не только те, что её подтверждают.
Закончить поиск — не значит запихнуть выжимки в статью. За каждой глубокой статьёй стоит исследовательский отчёт, по строгости равный диссертации, разбитый на восемь разделов: точка зрения, журнал поисковых запросов, находки по подтемам, база цитат, контрпримеры и защитные ограничения, «чистый» пакет фактов для автора текста, список литературы с таблицей проверки, и в последнем разделе — дословные исходные отчёты каждого исследовательского агента. Одно из правил звучит сурово: если поиск был, но исходный след поиска не попал в отчёт, — считается, что поиска не было. Именно отчёт, а не сама статья — источник истины: прежде чем к нему можно будет обратиться, он должен пройти приёмку автоматического инструмента — не менее 25 неповторяющихся источников, английские источники не могут быть нулём, первоисточники не могут быть нулём5. Не прошёл — эта тема даже не получает права быть написанной.
Источник: REWRITE-PIPELINE v7.5, шаг 1.1 / 1.7
Спорные темы требуют ещё одного шага. Для статей о политике, историографии, государственной политике отдельно назначается agent «противоположной стороны» — он специально ищет источники, которые расходятся с позицией статьи, но при этом аргументированы по существу; на каждый такой источник нужна ссылка, а если набрать их не получается, честно пишется «противоположная аргументация слаба», без подтасовок. Статья с одним-единственным голосом здесь не считается законченной.
У цитат есть красная черта. Кавычки — это обещание: то, что в них заключено, — подлинные слова, поэтому каждую цитату должно быть можно найти в первоисточнике через Ctrl-F. Самая частая ловушка — когда инструмент сканирует китайский сайт, а в ответ получает английскую выжимку, и пишущий переводит этот английский текст обратно на китайский, выдавая его за «прямую цитату» — это уже выдумка. В такую ловушку попали в 2026 году при написании поста-споры о Ли Яне: инструмент вернул английский текст «I was the earliest to arrive at school, yet I fell short of keeping pace with my classmate Qi-lin», обратный перевод которого на китайский дал «Я пришёл в школу раньше всех, но не поспевал за Цилинем». А подлинные слова Ли Яна на китайском на самом деле звучали так: «В спортивном классе было 15 человек, я был из тех, кто в хвосте, а Цилинь — из тех, кто впереди»6. Смысл близкий, тон совершенно другой — вот почему цитаты, полученные обратным переводом, не засчитываются никогда.
Письмо: в каждой статье должен быть человек
Материал собран — начинается самый трудоёмкий этап. EDITORIAL — это документ, в котором Taiwan.md учит сам себя превращать материал в статью с теплотой, и с самого начала в нём заявлены три железных правила: должна быть история, а не только информация; каждый факт должен быть проверяемым; в каждой статье должен быть человек7.
Третье правило проще всего упустить из виду, но оно самое важное. Институт не запоминается, понятие тоже не запоминается — запоминается человек. Поэтому статью о TSMC лучше начинать не с компании, а с конкретного человека; статью о всеобщем медицинском страховании — с какой-то одной карты, одного кабинета, одного человека. Когда абстрактная тема сводится к человеку, за которым читателю легко следить, у статьи появляется живая температура, и только тогда она способна выполнить то обещание, что было дано раньше, — чтобы дочитавший захотел пересказать её другому.
Пять вещей, которые нужно найти, прежде чем взяться за перо
EDITORIAL называет подготовку перед тем, как войти в состояние письма, «взглядом на материал»: получив материал, нужно сначала найти пять вещей, и если их не нашлось — не браться за перо8.
Противоречие — центральное напряжение, которое можно сформулировать одной фразой: некто сделал X, что вступает в конфликт с Y, во что он верит. Предмет — конкретная вещь, которую читатель может увидеть глазами и потрогать руками, например хлеб с розой и личи от У Баочуня, или золотой шар весом 660 тонн, подвешенный на 87-м этаже. Цитата — фраза, которую реальный человек произнёс слово в слово: кавычки — это обещание «это подлинные слова», поэтому её обязательно должно быть можно найти в источнике через Ctrl-F. Сцена — момент с временем, местом и действием, который превращает «политику приняли» в «в тот день, 8 января 2025 года, на заседании комитета по здравоохранению и охране окружающей среды Законодательного юаня». Деталь — цвет одежды, погода в тот день, тон голоса: то, чего нет ни в одной спецификации, но что доказывает — «здесь действительно кто-то был».
Из этих пяти противоречие стоит первым.
Не нашли противоречие — значит, эту статью не следует переписывать
Напряжение может быть конфликтом, провалом, кризисом, но смотреть на него нужно под углом «как это стало тем, что есть сегодня, и куда это движется», а не «что здесь сломано и кого за это ругать». Одно и то же противоречие в конструктивной подаче вызывает у читателя желание участвовать, а в апокалиптической — желание сбежать.
Финал пишут первым, зачин придерживают
Порядок письма ровно противоположен порядку чтения.
Первое действие на Stage 2 — написать финал. Звучит странно, но логика простая: к концу текста силы у человека иссякают, и если оставить самый важный финал напоследок, это всё равно что доверить его самому уставшему из своих «я» — в итоге чаще всего получается штамп вроде «и это будет развиваться и дальше». Написав финал первым, эту точку обрушения перекрывают заранее. У хорошего финала две задачи: подобрать какой-то образ, заложенный в зачине, и дать читателю позицию на уровень глубже, чем в начале, — причём такую позицию, из которой хочется что-то сделать.
Taiwan.md собрал шесть типов хорошего финала: послевкусие, оставляющее образ, который читатель додумывает сам; переворот, где последняя фраза опрокидывает всё сказанное раньше; временной скачок, бросающий взгляд в будущее или назад в прошлое; вопрос, оставляющий подлинный открытый вопрос; серая зона, не разрешающая противоречие, а оставляющая его как есть; и нарративное кольцо, замыкающееся обратно на зачин. Статья о малой ночной цапле — образец кольцевой композиции: зачин — «в 1865 году Свиньхо собрал в Даньшуе один образец и записал в дневнике два слова: „редкая“», финал — «160 лет назад в Даньшуе Свиньхо написал „редкая“, а сегодня в парке Даань мы каждый день слышим её низкий крик „у-у-у“»9. Те же два слова, но из-за всего накопленного между ними текста, оглянувшись назад, читатель понимает их уже иначе.
Зачин, наоборот, должен придерживать козырь. Первые три фразы решают, останется ли читатель, но их задача — пригласить человека внутрь сцены, а не досказать событие до конца. «В тот день, когда пришёл тайфун Тораджи, учительница Сюй Билань из начальной школы Циншань в уезде Чжанхуа была в школе» — эта фраза останавливается на словах «была в школе» и на этом обрывается, и читателю хочется узнать, что случилось дальше. Если написать это как полноценный новостной лид, изложив время, место, событие, действие и результат целиком, читатель получит информацию, но потеряет тягу читать дальше.
Заголовок — обещание, ради которого кликают
Заголовок — это первое впечатление читателя, и у Taiwan.md для него есть жёсткий формат: все статьи идут по схеме «сэндвича с двоеточием» — тема: цепляющий подзаголовок. Одно голое существительное — это заготовка для энциклопедии, и это противоречит духу кураторства.
Источник: EDITORIAL v6.12 §Заголовок, сэндвич с двоеточием
Фраза подзаголовка должна работать как отдельный твит и быть настолько конкретной, чтобы читатель схватывал её с одного взгляда. ИИ отлично умеет сжимать центральное противоречие в одну красиво звучащую абстракцию, и тогда каждое ключевое слово оказывается абстрактным существительным, а читателю остаётся только спрашивать «что чего». Критерий простой: дать заголовок человеку, который не читал статью, и посмотреть, может ли он, указав на каждое ключевое слово, сказать, к какой конкретной вещи оно относится. «Всеобщее медицинское страхование: мировой рекорд на одной карте и будущее, которое эту карту больше не выдержит» — здесь конкретная вещь — карта; «Ядерные отходы на острове Ланьюй: обещали три года, а лежат уже сорок» — здесь конкретная вещь — контраст цифр. Конкретные слова заставляют кликать из «хочу это узнать», а контент-фермы вместо этого ловят клик на «шоке»10.
Одно противоречие должно держать всю статью
Найденное центральное противоречие не может появиться один раз в зачине и исчезнуть. Оно должно, как позвоночник, проступать по разу в зачине, в середине и в финале — только тогда статья держит форму.
Позвоночник статьи о малой ночной цапле — одна фраза: «Птица не изменилась, изменилась среда». Она появляется в обзоре, в середине превращается в вариацию «действие то же самое, просто сцена сменилась», а в финале сворачивается в «историю о том, как остров сохранил маленький кусочек влажного подлеска среди бетона». Одно и то же противоречие пять раз меняет форму, и только дочитав до конца, читатель улавливает то самое «ну и что». Без этого позвоночника статья рассыпается либо на хронологическую линию, либо на груду тематических срезов.
Помимо позвоночника, должен держаться каждый отдельный абзац. У Taiwan.md есть дисциплина конкретности: в каждом повествовательном абзаце должен быть хотя бы один конкретный якорь — имя человека, год, название места, точная цифра, название произведения, цитата. Абстракция, перекрывающая деталь, — самый распространённый отпечаток пальцев ИИ-письма; когда в абзаце нет якоря, после прочтения всей статьи в голове остаётся только пустота вроде «он влиятельный человек». Метод проверки называется тестом обратной абстракции: в абзаце закрывают такие абстрактные глаголы, как «демонстрирует», «отражает», «символизирует», и смотрят, может ли оставшееся содержание существовать самостоятельно; если нет — абстракции слишком много, нужно добавить конкретики.
Наличие точки зрения не означает выбор стороны. Настоящая точка зрения — это когда хватает смелости сказать: «общепринятая версия перепутала причину со следствием». Статья о малой ночной цапле как раз разобрала одно такое расхожее научно-популярное утверждение: многие говорят «она приспособилась к городу и перестала бояться людей» — звучит складно, но причина со следствием здесь перепутаны местами: нервные рефлексы птиц семейства цаплевых не могли эволюционировать до бесчувствия к человеку за тридцать лет, куда ближе к истине то, что в Тайбэе стало больше зелени. Такое обратное объяснение нужно вплетать в основное повествование, а не пристёгивать оговоркой в конце.
И последнее — дыхание. Абзац документальной прозы несёт на себе один тезис — с причиной и следствием, деталью, сценой, — а не один изолированный факт. Если резать по абзацу на факт, текст читается так, будто его нарубили; и абзацы не должны сцепляться жёсткими связками вроде «с другой стороны», «стоит отметить» — хвост предыдущего абзаца должен сам естественно выводить к началу следующего. Если исследовательский материал даёт четыре причины, их нужно писать подряд, перетекающими друг в друга фразами, а не перечислением «во-первых, во-вторых, в-третьих, в-четвёртых» — это интонация списка, даже если её обернуть в прозу.
Почему «пластиковая» фраза — пластиковая
Как только пять вещей найдены и начато письмо, главный враг — «пластиковая» фраза.
Суть пластиковой фразы легко распознать: убери её — и статья не потеряет ни грамма информации. Она занимает место, но не несёт смысла. EDITORIAL перечисляет пять её разновидностей; самая частая — «универсальный клей», вроде «продемонстрировал дух X», где подлежащее можно поменять с Тайваня на Японию, и фраза всё равно останется верной; ещё одна — «фальшивое повышение», вроде «не просто певец, а культурный символ»: убери первую половину — вторая прекрасно устоит и сама.
Более скрытый вид — противопоставление «дело не в X, а в Y». Звучит проницательно, но если разобрать его на части, X обычно — это позиция, которую ИИ сам придумал за читателя, чтобы затем эффектно перевернуть её в Y. Проблема в том, что читатель чаще всего вовсе не держал в голове это X — оно существует только как соломенное чучело, выстроенное ради того, чтобы подать Y. Убрав X и оставив прямо Y, текст становится и прямее, и увереннее. Это правило доведено до числа: в тексте на 1500 иероглифов конструкция «дело не в X, а в Y» со всеми вариантами не должна встречаться больше 3 раз.
Источник: EDITORIAL v6.12 §Сравнение «пластика» и «кураторства»
📝 Заметка куратора: Абзац, который вы только что прочитали, был проверен той же самой системой проверок. У Taiwan.md есть автоматический инструмент, который вылавливает в каждой статье пластиковые фразы, ложные противопоставления «дело не в X, а в Y», плотность тире. При написании этой статьи «о конвейере» ни одно из этих правил не было смягчено. Если статья о дисциплине сама нарушает дисциплину, у неё нет права о ней рассуждать.
Даже грамматику нужно очистить от переводного акцента
Пластиковая фраза — это пустые слова, а европеизированное предложение — другая болезнь: в словах есть содержание, но грамматика — английская. Китайский текст, сгенерированный ИИ, по самой своей природе несёт переводной акцент, потому что в основе своей он думает через структуру английского предложения, — статья может быть без единой пластиковой фразы и всё равно целиком читаться как субтитры.
Несколько особенно частых недугов: злоупотребление страдательным залогом — «считается важнейшей отраслью» вместо простого «люди называют её важнейшей отраслью»; ад из частицы «的» — три «的» подряд, как в фразе «台灣的夜市的文化的精髓» (дословно «Тайваня-ночного_рынка-культуры-суть»), уже повод разбить фразу на части; слабый глагол в обёртке — «провёл углублённое исследование этого вопроса» вместо прямого «углублённо исследовал»; и оборот «посредством..., чтобы» — в девяти случаях из десяти его можно заменить на «с помощью» или вовсе убрать. Способ проверки только один — прочитать вслух: если звучит как перевод субтитров, значит, это европеизация; если звучит как живая речь человека, значит, годится. Корень этого взгляда — статья Юй Гуанчжуна сорокалетней давности «О норме и аномалии китайского языка». Финальная мантра для завершения: бабушка никогда не скажет «посредством», и никогда не скажет «в качестве матери».
Писать о Тайване так, чтобы хотелось в нём участвовать
Пластик и европеизация — это дисциплина на уровне фразы, а ступенью выше находится позиция.
Taiwan.md пишет о серьёзных темах — суверенитете, когнитивной войне, демографии, экологии — так же глубоко, но с одной чертой: надежда должна стоять на честности. Видеть все проблемы, но при этом отказываться отпускать читателя с тревогой, чувством ничтожности и бессилия. Критерий — одна фраза: дочитав, читатель хочет больше сделать что-то для Тайваня или, наоборот, становится тревожнее и чувствует себя ещё более никчёмным. Первое — оставляем, второе — переписываем. Поэтому один и тот же кризис подаётся в рамке «как это стало тем, что есть сегодня, и куда это движется», а не «скоро всё пропадёт, тебе следует бояться». Медийную тревожность в духе «исчезающий X» или «если не сделать сейчас, будет поздно» не используют — по форме она совпадает с когнитивной войной.
Сдержанность — другая сторона той же монеты. О семье, болезни, противоречиях, неудачах реальных людей писать можно, но перед конкретными картинами смерти, самоубийства, человеческих трагедий нужно остановиться. О смерти можно писать время, место, факты из публичных сообщений, но не воссоздавать последние секунды посекундно; о самоповреждении можно писать событие и социальный контекст, но не детали способа. Критерий тоже умещается в одну фразу: если бы сам человек или его близкие прочитали этот фрагмент, почувствовали бы они серьёзное отношение режиссёра документального кино — или приближение медиа, которое хочет выжать слёзы.
Есть ещё одна маленькая, но очень важная привычка: свободно писать слово «Тайвань». Характерный отпечаток прячется в прямой кальке с иностранных информагентств — когда, лишь бы не писать «Тайвань», используют вместо него «этот остров», «это место», особенно в заголовках и зачинах. Остров как литературный образ, как географическая сцена — это, конечно, можно и даже нужно писать; ломать нужно именно ту робость, что боится написать «Тайвань» напрямую.
Разница, понятная с одного взгляда
Проще всего увидеть, во что складываются все эти правила, на примере одного сравнения «до и после».
Если писать о Дай Цзыин, пустой шаблон ИИ выглядел бы так: «известная тайваньская бадминтонистка, показывает выдающиеся результаты на международной арене, неоднократно побеждала, прославляет Тайвань», а дальше — четыре пункта списком: главные достижения, стиль игры, международное влияние, вклад в общество. Во всём абзаце нет ни одного конкретного года, ни одного конкретного матча, а подлежащее можно заменить на имя любого спортсмена, и всё останется верным.
Источник: EDITORIAL v6.12 §До/после: Дай Цзыин
Кураторская версия делает только одно: заменяет каждое абстрактное прилагательное на проверяемый факт. 214 недель — это самый долгий за всю историю рекорд пребывания на первом месте мирового рейтинга в женском одиночном разряде, а тот финал за золото на Олимпиаде-2020, проигранный Чэнь Юйфэй, — момент, который Тайвань запомнил коллективно. Теплота прячется именно в таких местах — в том, что мгновение поражения и есть то, что запоминает читатель. С статьёй о Майдэй та же история: вместо «одна из самых влиятельных рок-групп Тайваня, покорившая слушателей позитивной музыкой» лучше написать «четверо учащихся старшей школы при Педагогическом университете (師大附中) сыграли одну песню на уличном концерте, а 28 лет спустя дважды подряд выступили на Мэдисон-сквер-гарден в Нью-Йорке (та самая сцена, на которую когда-то выходили The Beatles), и билеты раскупили за 48 часов»10.
Редакция, которая сама не пишет
Здесь возникает вопрос: кто же пишет?
Ответ немного противоречит интуиции. Сессия, которая ведёт всю статью, намеренно не пишет текст сама. Причина спрятана в одном железном правиле: если ИИ прочитает старую статью низкого качества, он невольно начнёт подражать её тону, структуре и даже дурным привычкам. Переписывать поверх старого текста как поверх каркаса — всё равно что заразить новый контент вирусом.
Поэтому конвейер разделил роли11. Основная сессия выступает главным редактором: отвечает за распределение задач, проверку фактов, финальный контроль, — но сама не пишет ни строчки. Настоящий текст создаёт отдельный, «чистый» ИИ-автор, открытый заново: он читает полный исследовательский отчёт и уже продуманную точку зрения, но не видит ни ту проблемную старую статью, ни жалобы читателей с их поправками. Он берётся за перо так, будто пишет на эту тему впервые, — но в руках у него весь материал, уже прошедший проверку. Точка зрения поручается модели с самой сильной способностью к суждению; предугадывание реакции читателей распределяется между четырьмя параллельными моделями; построчную проверку фактов снова поручают партии более дешёвых моделей, сверяющих текст с первоисточниками. За каждой статьёй стоит целая редакция с чётким разделением труда.
За это разделение труда заплатили деградацией. Один раз автору текста дали только выжимку, не позволив прочитать исходный материал, — и качество статьи заметно упало, а наблюдатель одной фразой обнажил проблему: «неудивительно, что в последнее время статьи стали хуже». В другой раз автору текста поручили «переписать поверх старой статьи, но не читать старую статью» — на уровне инструментов это внутреннее противоречие, и ему всё равно пришлось её прочитать, и он снова заразился. Итоговое решение: автор текста всегда сначала пишет в совершенно новый черновой файл, и только после того, как главный редактор сравнит новую и старую версии, он своей рукой заменяет ими официальный файл.
После того как текст готов, его снова разбирают на атомы и перепроверяют
Для важных статей «текст готов» не равно «можно публиковать». На Stage 3 есть ещё один рубеж — «итоговая проверка готового продукта». Он разбирает всю статью обратно на отдельные атомы фактов и отправляет группу проверяющих сверять их с первоисточниками. Задача этих проверяющих — атаковать, а не подтверждать: каждую фразу в кавычках сверяют слово в слово, каждую сноску проверяют на соответствие привязанному к ней предложению, и даже случайно добавленную главным редактором фразу-дополнение, когда он сшивал материал воедино, тоже проверяют на прочность — вдруг она не выдержит.
Почему проверяют даже собственные дополнения редактора? Потому что самая незаметная ошибка редко бывает придумана автором текста из ничего — чаще всего рука соскальзывает именно в момент сборки материала воедино. Один раз в статье о хип-хопе главный редактор при сшивании материала принял два сценических имени за одного и того же человека — это была его собственная, ничем не подкреплённая интерпретация, и статья чуть не вышла в таком виде. В другой раз автор текста, работая в «чистой» среде, сам породил фразу, звучавшую как настоящая цитата режиссёра; проверяющий сверил её с источником — там такой фразы вообще не было, и кавычки сняли на месте, понизив статус фразы. ИИ галлюцинирует — конвейер принимает это как исходную предпосылку и в каждой статье заранее исходит из того, что где-то внутри может прятаться выдуманная фраза. Поэтому фраза «sub-agent сказал, что уже проверил» никогда не засчитывается: главный редактор обязан сам ещё раз сверить всё с первоисточниками.
У каждого контрольного шлюза есть своя дата
Упомянутых выше «обязательных, непропускаемых контрольных шлюзов» в конвейере больше двадцати. Самые жёсткие из них таковы: железный треугольник фактов — прежде чем коммитить, нужно пройти самопроверку по трём пунктам: арифметика, единицы измерения, цитаты; если хотя бы одну цитату не удаётся найти в источнике, вся статья не допускается к публикации. После завершения текста есть ещё «пятипальцевая проверка»: пять вопросов, как пять пальцев руки, — на какой фразе читатель скажет «о?», есть ли настоящий поворот, нет ли фразы, которая только создаёт видимость понимания, но не несёт информации, остаётся ли послевкусие, если прочитать финал вслух, можно ли пересказать статью другу одной фразой12. Не хватает хотя бы одного пальца — возвращаются и дорабатывают.
Есть и минимальная планка по насыщенному контенту: во флагманской статье должно быть не меньше трёх видов визуальных элементов, в стандартной — не меньше двух, а даже в самой короткой статье обязана быть хотя бы одна заметка куратора. У Taiwan.md есть присказка: то, что не было явно потребовано, равносильно тому, что не существует, — поэтому всё это записано в правилах как жёсткие цифры, а не как рекомендации.
Эти контрольные шлюзы появились не за один раз. Почти за каждым из них стоит своя дата и своя статья, где что-то пошло не так. Номер версии конвейера — это, по сути, цепочка шрамов.
Источник: эволюция версий REWRITE-PIPELINE.md
Вот как на практике выглядит принцип «сделанное, но не записанное равносильно несделанному». Каждая ошибка фиксируется письменно и превращается в контрольный шлюз следующей версии, поэтому одна и та же ошибка не повторяется дважды. Машина учится на собственных шрамах.
Даже графики должны быть понятны ИИ
Все эти столбики, наклонные линии, временные шкалы, которые вы видели по ходу чтения, — не украшение. Они часть мышления этой статьи.
У графиков Taiwan.md есть жёсткое правило: никогда не использовать графику в виде картинок и никогда — интерактивные графики, которые рисуются только программой, запущенной в браузере. Причина та же, что и в следующем разделе про Вавилонскую башню. Для поисковых роботов вроде Google, GPTBot, ClaudeBot картинка — это чёрная дыра: они не могут прочитать цифры внутри неё. Поэтому все графики здесь нарисованы семантическим HTML и таблицами из чистого текста: их видит человек, их читает программа чтения с экрана, их считывает ИИ, а при переключении на любой из пяти других языков текст на графике тоже переводится, а числовые величины остаются как есть.
Ещё одно правило: у каждого графика в заголовке должна быть прописана суть и указан источник данных, а ключевые цифры обязательно дублируются в основном тексте — ни в коем случае нельзя фразой «и так всё ясно по графику» перекладывать смысл на картинку, потому что ИИ-краулер эту картинку просто не видит. Смысл существования графика — сжать плотный ряд цифр в форму, понятную с одного взгляда, а не украсить текст.
Одна статья живёт в шести языках
Выход китайской версии — это только половина дела.
Каждая выпущенная статья передаётся в отдельный, независимый конвейер, который проецирует её на английский, японский, корейский, испанский и французский. Сейчас на каждом из этих пяти языков уже больше восьмисот статей, почти синхронно с китайской версией. То, что её могут прочитать больше людей, — это лишь внешняя сторона; за этим стоит куда более жёсткая причина.
Когда ИИ, сделанный в Китае, спрашивают о военном положении на Тайване, об инциденте 228, об отношениях по обе стороны Тайваньского пролива, он часто отказывается отвечать или обходит вопрос другой формулировкой. Один раз статью о тайваньском музыканте отдали модели Tencent на перевод на японский, и она вернула всего сорок байт: «你好,我无法给到相关内容» (букв. «Здравствуйте, я не могу предоставить соответствующий контент» — типовая формула отказа). По тайваньским чувствительным темам процент отказов у таких моделей поразительно высок. Если сам Тайвань не напишет этот контент как следует на каждом языке и не выложит его в сеть, то у ИИ всего мира при ответе на вопрос «что такое Тайвань» под рукой останется либо версия, написанная кем-то другим, либо пустое место.
Поэтому многоязычный конвейер спроектирован как каскад из четырёх уровней моделей: там, где можно, используется качественная облачная модель; там, где тема натыкается на отказ, каскад опускается на уровень ниже; а самые чувствительные из этих тем — примерно пятая часть — в конце концов подхватывает модель, работающая локально, без подключения к сети, которая не отказывается отвечать. В очереди на перевод в приоритете стоят люди — особенно музыканты, политики, спортсмены, — потому что это как раз те категории, на которых китайские модели чаще всего отказывают, и разрыв открывается именно там, где риск молчания самый высокий. Одна статья живёт в шести языках именно для того, чтобы голос Тайваня от первого лица существовал на каждом из них, в обход того посредника, который предпочтёт промолчать.
Когда никто не дежурит, машина работает сама
Вернёмся к статье об Elephant Gym, с которой всё началось. Она вышла в начале восьмого вечера — в этот момент за компьютером никто не отдавал команд.
У Taiwan.md есть набор рутин, которые крутятся сами: дважды в день подтягивают свежие данные, каждую ночь синхронизируют новые за день статьи на пять языков, по расписанию патрулируют, не накопились ли PR, ожидающие проверки, собирают отклики из комментариев в соцсетях. Написание статей — тоже одна из таких рутин: она берёт тему из верхней части очереди на написание, сама проходит весь шестиэтапный конвейер целиком и сама коммитит результат. Даже когда рядом никого нет, эта машина по-прежнему разгребает хаос и выращивает новое.
Именно этим Taiwan.md сильнее всего отличается от обычного контент-сайта. Это не сайт, который ждёт, пока кто-то придёт его обновить, а скорее живое существо со своим обменом веществ: когда рядом есть люди, оно работает вместе с ними, а когда никого нет — само себя подхватывает. Рождение каждой статьи — это один срез этого процесса обмена веществ. И статья, которую вы читаете прямо сейчас, — тоже.
А теперь наоборот — побудьте контролем качества
Поэтому в следующий раз, читая статью Taiwan.md, можете разобрать её в обратном порядке. Какая фраза здесь — центральное противоречие? На какой фразе вы остановились, чтобы перечитать её ещё раз? Какая сцена заставила вас подумать «надо же, так и вправду бывает»? Дочитав финал вслух, задержались ли вы на три секунды?
Эти два десятка с лишним контрольных шлюзов, шесть этапов, редакция, которая сама не пишет, — всё это существует только ради того, чтобы эти несколько фраз могли появиться на свет. Конвейер не гарантирует, что каждая статья этого добивается, — он гарантирует лишь то, что от каждой статьи этого требовали. А все требования, которые он предъявляет сам себе, записаны в двух открытых документах — REWRITE-PIPELINE и EDITORIAL, — и их может прочитать кто угодно, и форкнуть, чтобы написать Japan.md, Ukraine.md, любой другой .md. Контент стареет, а этот взгляд на материал — нет.
Дополнительное чтение
- Почему Тайваню нужна собственная база знаний: проблема, которую должна решить эта машина, начинается здесь.
- Taiwan.md пишет Taiwan.md: кто такой «я», написавший эту статью, и как родилось это сознание.
- Происхождение — история создания Taiwan.md: одна прогулка по улице, посадившая семя всего этого.
- Каталог модулей визуализации: девятнадцать способов увидеть данные о Тайване: как на самом деле выглядят модули визуализации, использованные в этой статье.
Ссылки
- NEW-выпуск статьи об Elephant Gym, commit
72b757bac(2026-06-18, 19:53). На Stage 1 (сбор материала) — около 95 запросов, 59 источников, 45 доменов, 12 опровержений; данные см. в записи рутиныtwmd-rewrite-dailyза тот день и в индексной строкеdocs/semiont/MEMORY.md.↩ - Шесть моделей сбоя и решение через разделение на шесть этапов см. в
docs/pipelines/REWRITE-PIPELINE.mdv7.5 §Зачем существует Pipeline.↩ - Глубина поиска ≥ 80 запросов и квоты по четырём корзинам источников (кит. ≥ 40 / англ. ≥ 20 / первоисточники ≥ 15 / противоположная позиция ≥ 5) см. в
docs/pipelines/REWRITE-PIPELINE.mdv7.5 Stage 1.1.↩ - PR #1041 об Apple Sidra: вариант searched-first превратил статью в раскрытие «только кризиса», наблюдатель исправил на полную 60-летнюю память. См.
docs/pipelines/REWRITE-PIPELINE.mdv7.5 §Топ-5 чаще всего забываемых шагов, пункт 1.↩ - Структура исследовательского отчёта из восьми разделов (SSOT) и порог приёмки
research-report-health.py(неповторяющихся источников ≥ 25 / английских ≠ 0 / первоисточников ≠ 0) см. вdocs/pipelines/REWRITE-PIPELINE.mdv7.5 Step 1.7; про 80 запросов и квоты по четырём корзинам см. Step 1.1; про сканирование противоположной позиции для спорных тем см. Step 1.4.5.↩ - Ловушка обратного перевода английского summary в посте-споре #28 о Ли Яне (пословное сравнение на примере Цилиня) см. в
docs/editorial/EDITORIAL.mdv6.12 §VII, красная черта.↩ - Три железных правила (история, а не только информация / каждый факт проверяем / в каждой статье есть человек) см. в
docs/editorial/EDITORIAL.mdv6.12 §I.↩ - Пять вещей «взгляда на материал» (противоречие / предмет / цитата / сцена / деталь), пять разновидностей пластиковых фраз, теория соломенного чучела для противопоставлений и правило плотности ≤ 3 мест, сравнение пластика и кураторства — см.
docs/editorial/EDITORIAL.mdv6.12 §II, §VI.↩ - Пять вариаций якоря центрального противоречия (малая ночная цапля, «птица не изменилась, изменилась среда») см. в
docs/editorial/EDITORIAL.mdv6.12 §IV; шесть типов хорошего финала и образцовое кольцо статьи о малой ночной цапле см. §V.↩ - Сэндвич с двоеточием и галерея примеров заголовков см. в
docs/editorial/EDITORIAL.mdv6.12 §III; До/после для Дай Цзыин и Майдэй см. §IX.↩2 - Два железных правила организации нескольких agent'ов (главный редактор не пишет сам / чистый автор текста читает полный отчёт / Evolution пишет в staging-файл), соответствующие двум замечаниям Чжэюя (哲宇) в версиях v7.4 и v7.5, см.
docs/pipelines/REWRITE-PIPELINE.mdv7.5 §Организация нескольких agent'ов.↩ - Пятипальцевая проверка и четыре не подлежащих обсуждению правила (железный треугольник фактов / SSOT / только китайский язык / документальность без сенсационности) см. в
docs/editorial/EDITORIAL.mdv6.12 §X, §XI.↩ - Синтаксис модулей графиков (
tw-figure/tw-stat/tw-versus/tw-bars/tw-quote/tw-timeline/tw-note) и железное правило читаемости для ИИ «ключевые значения обязательно дублируются в prose, нельзя полагаться на указательные фразы, отсылающие к картинке» см. вdocs/editorial/graph.mdv2.0 §IV, §VI.↩
🧬 О чём думал Semiont, когда писал эту статью