Если на сайте один автор, а архивы /author/... всё равно открыты для поиска, это почти всегда лишний индексируемый мусор. Но закрывать такие страницы через robots.txt — плохая идея: робот может перестать их обходить, а значит не увидит директивы noindex и может дольше держать URL в индексе. Для WordPress рабочий путь обычно другой: оставить страницу доступной для обхода, но отдать ей noindex, follow и при необходимости скорректировать canonical.
Когда архив автора действительно мешает
Проблема не в самом архиве, а в том, что он часто дублирует уже опубликованный контент. На небольшом блоге это может быть одна и та же подборка записей, на корпоративном сайте — пустая страница с именем автора и несколькими постами. В индексе такие URL создают шум: поисковик тратит обход на страницы без самостоятельной ценности, а в отчётах по индексации появляются лишние URL.
Типичные признаки
- в поиске видны страницы вида
/author/admin/или/author/ivanov/; - в выдаче показывается не запись, а архив автора;
- в Search Console растёт число проиндексированных служебных страниц;
- на сайте один автор, и архив не несёт отдельной пользы пользователю.
Диагностика: что именно сейчас отдаёт WordPress
Сначала проверьте, не закрыт ли архив автора уже где-то ещё. Частая ошибка — одновременно использовать SEO-плагин, ручной код в теме и правила в robots.txt. В итоге страница то закрыта, то нет, а понять причину сложно.
Что смотреть в исходном коде
Откройте архив автора в браузере и проверьте:
- есть ли в
<head>мета-тегnoindex; - какой canonical указан на странице;
- не отдаёт ли страница редирект на главную или на другой архив;
- не блокируется ли URL в
robots.txt.
Если архив уже закрыт в robots.txt, это не лучший вариант для такой задачи. Робот может перестать заходить на страницу и не увидеть обновлённую директиву. Для удаления из индекса важнее именно noindex.
Рабочие варианты: плагин, код, комбинированный подход
Для этой задачи есть три нормальных сценария. Выбор зависит от того, используете ли вы SEO-плагин и есть ли у вас доступ к теме или mu-plugin.
| Способ | Когда подходит | Минусы |
|---|---|---|
| Через SEO-плагин | Если уже стоит Yoast, Rank Math или аналог и не хочется лезть в код | Зависимость от интерфейса плагина и его логики |
| Через код | Если нужен точный контроль и минимальная зависимость от плагинов | Нужно аккуратно тестировать после обновлений темы |
| Плагин + код | Если SEO-плагин закрывает базу, а код нужен для исключений | Легко получить конфликт директив |
Пошаговое решение через код
Ниже вариант, который можно положить в functions.php дочерней темы или в собственный mu-plugin. Он добавляет noindex, follow на архивы авторов и оставляет их доступными для обхода.
<?php
add_filter( 'wp_robots', function( array $robots ) {
if ( is_author() ) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
} );
Этот вариант хорош тем, что использует штатный фильтр WordPress для robots-мета. Он не ломает другие страницы и не требует вмешательства в шаблон header.php.
Если нужен отдельный canonical
Иногда архив автора не должен канонизироваться сам на себя, особенно если это пустая или почти пустая страница. Тогда можно аккуратно задать canonical на главную или на страницу с архивом записей, но только если это действительно соответствует структуре сайта. Не стоит бездумно отправлять все авторские архивы на главную: это уже другая логика и может запутать поисковик.
<?php
add_filter( 'get_canonical_url', function( $canonical, $post ) {
if ( is_author() ) {
return home_url( '/' );
}
return $canonical;
}, 10, 2 );
На практике canonical для архивов авторов меняют реже, чем robots-директиву. Если архив нужен пользователям и содержит уникальное описание автора, лучше ограничиться noindex, follow.
Как сделать это через SEO-плагин
Если на сайте уже используется SEO-плагин, сначала проверьте его настройки. Во многих случаях архивы авторов можно закрыть без кода. Это удобнее, если редактору нужно управлять индексацией из админки, а не через разработчика.
Но даже в этом случае важно не смешивать несколько источников правды. Если плагин уже ставит noindex, не дублируйте это вручную в теме. Иначе при обновлении или смене плагина вы получите непредсказуемое поведение.
Проверка результата после внедрения
После изменения откройте архив автора и проверьте исходный код страницы. Вам нужно увидеть:
<meta name="robots" content="noindex, follow">или эквивалентную директиву;- отсутствие конфликтующего
indexиз другого плагина; - корректный canonical, если вы его меняли;
- отсутствие блокировки в
robots.txtдля этого URL.
Дальше проверьте страницу через инструменты поисковой системы. Если URL уже был в индексе, удаление может занять время: поисковик должен сначала переобойти страницу и увидеть новую директиву. Это нормальный процесс, а не ошибка кода.
Чек-лист перед публикацией
- архив автора открывается без 404 и без редиректов на неожиданный URL;
- в head есть
noindex; - страница не закрыта в
robots.txt; - нет второго SEO-плагина, который переопределяет robots;
- в Search Console нет массовых ошибок по шаблону авторских архивов.
Частые ошибки и как их исправить
Закрыли архив в robots.txt
Это самая частая ошибка. Страница становится недоступной для обхода, но не обязательно быстро исчезает из индекса. Исправление простое: уберите запрет из robots.txt и отдайте noindex на самой странице.
Поставили noindex и одновременно canonical на главную
Такой микс иногда работает, но часто создаёт лишний шум в диагностике. Если архив реально не нужен, достаточно noindex, follow. Canonical меняйте только если понимаете, зачем это нужно именно вашему сайту.
Дублируют директивы плагин и тема
Например, SEO-плагин уже добавляет noindex, а в теме вручную прописан другой meta robots. В результате в коде может оказаться две директивы, и поисковик выберет не то, что вы ожидали. Оставьте один источник настройки.
Закрывают все архивы авторов без проверки структуры сайта
Если у вас редакционный сайт, архив автора может быть полезен: там есть биография, список материалов и внутренняя перелинковка. В таком случае закрывать его полностью не всегда разумно. Иногда лучше оставить страницу доступной, но убрать её из индекса только для отдельных ролей или для технических аккаунтов.
Что делать, если архивы авторов нужны пользователям, но не поиску
Это самый практичный сценарий. Страница остаётся для навигации, а поисковик её не индексирует. Такой подход обычно безопаснее, чем удалять архивы или прятать их через блокировку обхода. Если на сайте много служебных страниц, имеет смысл отдельно посмотреть на чистку дублей и технических URL. В некоторых случаях для этого удобен Clearfy Pro: он закрывает часть типовых SEO-задач без ручного кода, но проверять итоговую разметку всё равно нужно вручную.
Главная мысль простая: для авторских архивов в WordPress чаще нужен не запрет обхода, а корректная директива индексации. Это решается точечно, без поломки сайта и без лишних ограничений для поисковых роботов.