AC experimentation-and-ab-testing
A/B-тестирование и эксперименты для контента в социальных сетях — доказательства вместо мнений, с честной строгостью в органическом масштабе. Используйте, когда кто-то хочет "A/B-тестировать" или "сплит-тестировать" контент, "проверить, какая версия/хук/время/подпись/миниатюра работает", "настроить эксперимент", "что мне протестировать" или разрешить спор о контенте с помощью доказательств, а не мнений. Разрабатывает дисциплинированные органические тесты: одна переменная, контролируемый контекст, набор правил принятия решений ДО публикации, достаточная продолжительность и повторения, чтобы отделить сигнал от шума. Использует фреймворк TEST. Сначала читает профиль бренда + цели и KPI. Он РАЗРАБАТЫВАЕТ тест и составляет варианты; WoopSocial планирует их как последовательные контролируемые посты (исключение: нативный Test & Compare YouTube); результат считывается из нативной аналитики через analytics-and-reporting. Органический охват не может достичь истинной статистической значимости; ничего не подделывается и не подвергается p-хакингу. Отличается от analytics-and-reporting (измерения) и goals-and-kpis (установка целей).
машинный переводПоказать оригиналСкрыть оригинал«A/B testing and experimentation for social media content — evidence ov…»
A/B testing and experimentation for social media content — evidence over opinion, at honest organic-scale rigor. Use when someone wants to "A/B test" or "split test" content, "test which version/hook/time/caption/thumbnail works," "set up an experiment," "what should I test," or to settle a content debate with evidence instead of opinion. Designs disciplined organic tests: one variable, controlled context, a decision rule set BEFORE publishing, enough duration and repetitions to separate signal from noise. Uses the TEST framework. Reads brand-profile + goals-and-kpis first. It DESIGNS the test and drafts variants; WoopSocial schedules them as controlled sequential posts (exception: YouTube's native Test & Compare); the result is read from native analytics via analytics-and-reporting. Organic can't reach true statistical significance; nothing is fabricated or p-hacked. Distinct from analytics-and-reporting (measures) and goals-and-kpis (sets targets).
A/B-тестирование и эксперименты для контента в социальных сетях — доказательства вместо мнений, с честной строгостью в органическом масштабе.
Как процесс C 58/100 · Есть пробелы — слабые места: результат и критерий готовности, когда включается, входы и предусловия
Как улучшить
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 0
✓ Критических и высоких находок нет
Просканировано файлов: 6. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
✓ По спецификации Agent Skills замечаний нет
Процессный рейтинг: все десять параметров 58/100
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Ошибки и развилки. Линейный процесс без обработки сбоев
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 30Повторный запуск. Изменяющих операций: 5, без проверки текущего состояния
- 40Результат и критерий готовности. Не сказано, что считать результатом
- 100Инструменты и файлы. Внешние инструменты не нужны
- 100Шаги. Шагов: 9
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 1191 токенов
- 100Отчётность по ходу. Скилл сообщает о ходе работы
- low Среди тестов нет случая на инъекцию через данные
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Длина description 964: рекомендуется 120–800 символов
- +3Формат ответа не описан: модель каждый раз решает сама
- +4Нет примеров входа/выхода
- +1Лицензия не указана
- +2Инструкции на одном языке
- +5В description 5 примера фраз-триггеров в кавычках
- +4Структура: 9 заголовков
- +3Пошаговые инструкции: 9 пунктов
- +4Справочные файлы упоминаются в инструкциях (4 из 4)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 86.