Linux удалить комментарии из файла

Обновлено: 01.07.2024

Это помогло много, за исключением строки.

Если вы хотите изменить его на месте, добавьте переключатель -i :

Если комментарии могут начинаться только в начале строки, сделайте следующее:

Если им может предшествовать пробел, но ничего больше, выполните:

Edit:

На самом деле не очень хороший способ определить, находится ли что-то в строке. Я бы использовал последние два, если бы это соответствовало ограничениям вашего языка.

Проблема с обнаружением того, являетесь ли вы в строке, заключается в том, что регулярные выражения не могут делать все. Есть несколько проблем:

  • Строки могут, вероятно, охватывать линии
  • Регулярное выражение не может отличить апострофии и одинарные кавычки

Регулярное выражение не может соответствовать вложенным кавычкам (эти случаи будут путать регулярное выражение):

Если двойные кавычки являются единственным способом определения строк, двойные кавычки никогда не будут отображаться в комментарии, а строки не могут охватывать несколько строк, попробуйте что-то вроде этого:

Это много предварительных условий, но если они все держат, вы в бизнесе. В противном случае, я боюсь, что вы SOL, и вам лучше писать его в чем-то вроде Python, где вы можете сделать более сложную логику.

Это может сработать для вас (GNU sed):

Так как нет ввода образца, предоставленного пользователем, я возьму пару случаев, а Bash - это входной файл, потому что Bash используется как тег вопроса.

Случай 1: целая строка - это комментарий

В большинстве случаев должно быть достаточно:

Любые строки, такие как:

Они будут удалены.

не будет удалено, что является желаемым результатом.

Случай 2: комментарий после фактического кода

Часть комментария может быть удалена

[^\"'] используется для предотвращения путаницы с кавычками, однако это также означает, что комментарии с цитатами ' или " не будут удалены.

Final sed

Первый аргумент sed - это строка, содержащая sed-команду, состоящую из двух команд строки-удаления формы / regex /d . Команды разделяются на ; . Первая команда удаляет строки комментариев, но не строки shebang. Вторая команда удаляет все оставшиеся пустые строки комментариев. Он не обрабатывает завершающие комментарии.

Последний аргумент sed - это файл для использования в качестве входных данных. В Bash вы также можете использовать строковую переменную следующим образом:

Тогда мы можем разрешить ноль или более повторений строки с кавычками. Чтобы принять либо одинарные, либо двойные кавычки, разрешите ноль или более каждого. Строка с кавычками должна определяться как начальная кавычка, за которой следует ноль или более либо произвольного символа обратной косой черты, либо любого символа, кроме заключительной цитаты: "\(\\.\|[^\"]\)*" или аналогично для строк с одной кавычкой '\(\\.\|[^\']\)*' .

Объединив все это вместе, ваш sed script может выглядеть примерно так:

Но поскольку его нужно указывать, и как одиночные, так и двойные кавычки включены в строку, нам нужно еще одно дополнительное усложнение. Напомним, что оболочка позволяет склеить строки, такие как "foo"'bar' заменяется на foobar - foo в двойных кавычках и bar в одинарных кавычках. Таким образом, вы можете включить одинарные кавычки, поставив их в двойные кавычки рядом с вашей строкой с одним кавычком - '"foo"'"'" is "foo" в одинарных кавычках рядом с ' в двойных кавычках, таким образом "foo"' ; и "' может быть выражена как '"' рядом с "'" . И поэтому строка с одной кавычкой, содержащая обе двойные кавычки foo"'bar , может быть приведена в соответствие с 'foo"' рядом с "'bar" или, что более реалистично для этого случая 'foo"' рядом с "'" рядом с другой строкой с одной кавычкой 'bar' , что дает 'foo'"'"'bar' .

Это было протестировано в Linux; на других платформах диалект sed может несколько отличаться. Например, вам может потребоваться опустить обратную косую черту перед операциями группировки и изменения.

Увы, если у вас могут быть строки с несколькими строками, это не сработает; sed , по дизайну, проверяет только одну строку ввода за раз. Вы можете построить сложный script, который собирает несколько строк в память, но к тому времени переключается на, например, Perl начинает иметь большой смысл.

linux-logo

Удаляем комментарии и пустые строки из файла на Linux. При редактировании каких-либо конфигурационных файлов, в них присутствуют закомментированные и пустые строки — это не очень удобно (по крайней мере для чтения). Файлы можно отредактировать вручную, если в нем несколько закомментированных и пустых строк, но если файл имеет тысячи таких строк, это трудно сделать вручную. Сегодня в статье научимся избавляться от лишних пустых и закомментированных строк в файле.

Что такое комментарии в программировании?

Эти строки известны как Комментарии.

В программировании комментарий — это удобочитаемое описание или аннотация, используемая для пояснения целей фрагментов кода.

Они помогают пользователям и другим программистам легко понять, что делает код.

Как правило, комментарии и пустые строки будут игнорироваться компиляторами и интерпретаторами. Они предназначены только для программистов.

Синтаксис комментариев варьируется в зависимости от языка программирования.

Теперь давайте посмотрим, как исключить или пропустить эти комментарии и пустые строки и отображать только те строки, которые не закомментированы.

Вывод содержимого файлов без комментариев и пустых строк на Linux

Позвольте мне показать вам содержимое файла sources.list в одной из моих систем Ubuntu:

Пример вывода вышеуказанной команды:

Все комментарии и пустые строки исчезли.

Теперь вывод вполне читабелен.Я предпочитаю способом через grep фильтровать ненужные строки, отображаемые в выводе. Вы также можете сделать это с помощью команд awk и sed.

Удаление комментариев и пустых строк в файле на Linux

Давайте теперь отредактируем файл чтобы в нем не оставалось закомментированных строк.

Можно и такой командой:

Как удалить комментарии из нескольких файлов

find -name ‘*.c’ | xargs sed -i ‘0,/^*\/$/d’

Если есть вопросы, то пишем в комментариях.

Также можете вступить в Телеграм канал, ВК или подписаться на Twitter. Ссылки в шапки страницы.
Заранее всем спасибо.

Я просто хочу напечатать весь некомментированный код:

Возможность извлечения комментариев из файла очень важна . Какой хороший способ сделать это?

Вы не можете удалить части строки с помощью grep. Вы можете использовать Sed для этого Ваш текст и ваш пример противоречат. Вы пишете о закомментированных строках, но ясно, что из последней строки вы имеете в виду части строк. Затем удаляется первая строка с комментарием, включая EOL, а вторая может быть, но неясно, так как это последняя строка. Пожалуйста, перефразируйте «закомментированные строки», чтобы быть точным, и устраните неоднозначность ваших примеров. @Questionmark Я мог бы быть умным, но я не умный пишущий-грамматик-парсер.

Один из способов , чтобы удалить все комментарии заключается в использовании grep с -o опцией:

Обратите внимание, что пустые строки тоже будут удалены, но останутся только строки с пробелами.

Комментарии исчезли, но я вижу кучу пробелов на их месте в выводе? sed Решение имеет только одну пустую строку, кажется твердым аргументом для использования другого ответа, если я что-то упустил? @JBallin Ты определил псевдоним для, grep может быть? Попробуйте изменить grep на command grep , если вы все еще видите пробелы после примера ввода.

Я верю, что sed справится с этим гораздо лучше, чем grep . Что-то вроде этого:

объяснение

@javadba, да, но в этот момент вы могли бы также использовать полный анализатор. Что будут использовать эти данные, которые могут понимать кавычки и назначения переменных, но не могут обрабатывать комментарии? (Вот почему многие файлы конфигурации, такие как crontab разрешают только полнострочные комментарии с пробелом или без него, но не допускают конечные комментарии в строке. Логика НАМНОГО проще. Используйте только первую из двух инструкций Sed в этом ответе для зачистки комментариев crontab.)

Вы можете получить требуемый результат, используя команду sed. Команда ниже сделала трюк для меня.

Здесь нам нужно удалить эти строки, чтобы мы заменили их пустыми, пропустив часть «замена».

  • g упоминание повторного поиска шаблона, пока не будет достигнут конец файла.

Общий синтаксис sed: s/regexp/replacement/flags FileName

примечание: в этом случае 4-я строка заменяется новой. Попробуйте это с помощью сценария, содержащего эту sed команду .

Я написал средство форматирования оболочки под названием shfmt , в котором есть функция минимизации кода. Это включает в себя удаление комментариев, среди прочего:

Синтаксический анализатор и принтер являются пакетами Go, поэтому, если вам нужно нестандартное решение, довольно легко написать программу Go из 20 строк, которая удалит комментарии именно тем способом, который вам нужен.

Вы можете использовать обратное совпадение следующим образом:

-v, --invert-match Инвертировать смысл соответствия, чтобы выбрать несовпадающие строки. (-v определяется POSIX.)

В прошлый раз мы говорили о функциях в bash-скриптах, в частности, о том, как вызывать их из командной строки. Наша сегодняшняя тема — весьма полезный инструмент для обработки строковых данных — утилита Linux, которая называется sed. Её часто используют для работы с текстами, имеющими вид лог-файлов, конфигурационных и других файлов.




Если вы, в bash-скриптах, каким-то образом обрабатываете данные, вам не помешает знакомство с инструментами sed и gawk. Тут мы сосредоточимся на sed и на работе с текстами, так как это — очень важный шаг в нашем путешествии по бескрайним просторам разработки bash-скриптов.


Сейчас мы разберём основы работы с sed, а так же рассмотрим более трёх десятков примеров использования этого инструмента.

Основы работы с sed

Утилиту sed называют потоковым текстовым редактором. В интерактивных текстовых редакторах, наподобие nano, с текстами работают, используя клавиатуру, редактируя файлы, добавляя, удаляя или изменяя тексты. Sed позволяет редактировать потоки данных, основываясь на заданных разработчиком наборах правил. Вот как выглядит схема вызова этой команды:


По умолчанию sed применяет указанные при вызове правила, выраженные в виде набора команд, к STDIN . Это позволяет передавать данные непосредственно sed.


Вот что получится при выполнении этой команды.


Простой пример вызова sed

В данном случае sed заменяет слово «test» в строке, переданной для обработки, словами «another test». Для оформления правила обработки текста, заключённого в кавычки, используются прямые слэши. В нашем случае применена команда вида s/pattern1/pattern2/ . Буква «s» — это сокращение слова «substitute», то есть — перед нами команда замены. Sed, выполняя эту команду, просмотрит переданный текст и заменит найденные в нём фрагменты (о том — какие именно, поговорим ниже), соответствующие pattern1 , на pattern2 .

Выше приведён примитивный пример использования sed, нужный для того, чтобы ввести вас в курс дела. На самом деле, sed можно применять в гораздо более сложных сценариях обработки текстов, например — для работы с файлами.

Ниже показан файл, в котором содержится фрагмент текста, и результаты его обработки такой командой:


Текстовый файл и результаты его обработки

Здесь применён тот же подход, который мы использовали выше, но теперь sed обрабатывает текст, хранящийся в файле. При этом, если файл достаточно велик, можно заметить, что sed обрабатывает данные порциями и выводит то, что обработано, на экран, не дожидаясь обработки всего файла.

Выполнение наборов команд при вызове sed

Для выполнения нескольких действий с данными, используйте ключ -e при вызове sed. Например, вот как организовать замену двух фрагментов текста:


Использование ключа -e при вызове sed

К каждой строке текста из файла применяются обе команды. Их нужно разделить точкой с запятой, при этом между окончанием команды и точкой с запятой не должно быть пробела.
Для ввода нескольких шаблонов обработки текста при вызове sed, можно, после ввода первой одиночной кавычки, нажать Enter, после чего вводить каждое правило с новой строки, не забыв о закрывающей кавычке:


Вот что получится после того, как команда, представленная в таком виде, будет выполнена.


Другой способ работы с sed

Чтение команд из файла

Если имеется множество команд sed, с помощью которых надо обработать текст, обычно удобнее всего предварительно записать их в файл. Для того, чтобы указать sed файл, содержащий команды, используют ключ -f :

Вот содержимое файла mycommands :


Вызовем sed, передав редактору файл с командами и файл для обработки:


Результат при вызове такой команды аналогичен тому, который получался в предыдущих примерах.


Использование файла с командами при вызове sed

Флаги команды замены

Внимательно посмотрите на следующий пример.


Вот что содержится в файле, и что будет получено после его обработки sed.


Исходный файл и результаты его обработки

Команда замены нормально обрабатывает файл, состоящий из нескольких строк, но заменяются только первые вхождения искомого фрагмента текста в каждой строке. Для того, чтобы заменить все вхождения шаблона, нужно использовать соответствующий флаг.

Схема записи команды замены при использовании флагов выглядит так:


Выполнение этой команды можно модифицировать несколькими способами.

  • При передаче номера учитывается порядковый номер вхождения шаблона в строку, заменено будет именно это вхождение.
  • Флаг g указывает на то, что нужно обработать все вхождения шаблона, имеющиеся в строке.
  • Флаг p указывает на то, что нужно вывести содержимое исходной строки.
  • Флаг вида w file указывает команде на то, что нужно записать результаты обработки текста в файл.


Вызов команды замены с указанием позиции заменяемого фрагмента

Тут мы указали, в качестве флага замены, число 2. Это привело к тому, что было заменено лишь второе вхождение искомого шаблона в каждой строке. Теперь опробуем флаг глобальной замены — g :


Как видно из результатов вывода, такая команда заменила все вхождения шаблона в тексте.


Глобальная замена

Флаг команды замены p позволяет выводить строки, в которых найдены совпадения, при этом ключ -n , указанный при вызове sed, подавляет обычный вывод:


Как результат, при запуске sed в такой конфигурации на экран выводятся лишь строки (в нашем случае — одна строка), в которых найден заданный фрагмент текста.


Использование флага команды замены p

Воспользуемся флагом w , который позволяет сохранить результаты обработки текста в файл:


Сохранение результатов обработки текста в файл

Хорошо видно, что в ходе работы команды данные выводятся в STDOUT, при этом обработанные строки записываются в файл, имя которого указано после w .

Символы-разделители

Представьте, что нужно заменить /bin/bash на /bin/csh в файле /etc/passwd . Задача не такая уж и сложная:


Однако, выглядит всё это не очень-то хорошо. Всё дело в том, что так как прямые слэши используются в роли символов-разделителей, такие же символы в передаваемых sed строках приходится экранировать. В результате страдает читаемость команды.

К счастью, sed позволяет нам самостоятельно задавать символы-разделители для использования их в команде замены. Разделителем считается первый символ, который будет встречен после s :


В данном случае в качестве разделителя использован восклицательный знак, в результате код легче читать и он выглядит куда опрятнее, чем прежде.

Выбор фрагментов текста для обработки

До сих пор мы вызывали sed для обработки всего переданного редактору потока данных. В некоторых случаях с помощью sed надо обработать лишь какую-то часть текста — некую конкретную строку или группу строк. Для достижения такой цели можно воспользоваться двумя подходами:

  • Задать ограничение на номера обрабатываемых строк.
  • Указать фильтр, соответствующие которому строки нужно обработать.


Обработка только одной строки, номер который задан при вызове sed

Второй вариант — диапазон строк:


Обработка диапазона строк

Кроме того, можно вызвать команду замены так, чтобы файл был обработан начиная с некоей строки и до конца:


Обработка файла начиная со второй строки и до конца

Для того, чтобы обрабатывать с помощью команды замены только строки, соответствующие заданному фильтру, команду надо вызвать так:


По аналогии с тем, что было рассмотрено выше, шаблон передаётся перед именем команды s .


Обработка строк, соответствующих фильтру

Тут мы использовали очень простой фильтр. Для того, чтобы в полной мере раскрыть возможности данного подхода, можно воспользоваться регулярными выражениями. О них мы поговорим в одном из следующих материалов этой серии.

Удаление строк

Утилита sed годится не только для замены одних последовательностей символов в строках на другие. С её помощью, а именно, используя команду d , можно удалять строки из текстового потока.

Вызов команды выглядит так:


Мы хотим, чтобы из текста была удалена третья строка. Обратите внимание на то, что речь не идёт о файле. Файл останется неизменным, удаление отразится лишь на выводе, который сформирует sed.


Удаление третьей строки

Если при вызове команды d не указать номер удаляемой строки, удалены будут все строки потока.

Вот как применить команду d к диапазону строк:


Удаление диапазона строк

А вот как удалить строки, начиная с заданной — и до конца файла:


Удаление строк до конца файла

Строки можно удалять и по шаблону:


Удаление строк по шаблону

При вызове d можно указывать пару шаблонов — будут удалены строки, в которых встретится шаблон, и те строки, которые находятся между ними:


Удаление диапазона строк с использованием шаблонов

Вставка текста в поток

С помощью sed можно вставлять данные в текстовый поток, используя команды i и a :

  • Команда i добавляет новую строку перед заданной.
  • Команда a добавляет новую строку после заданной.


Теперь взглянем на команду a :


Как видно, эти команды добавляют текст до или после данных из потока. Что если надо добавить строку где-нибудь посередине?

Тут нам поможет указание номера опорной строки в потоке, или шаблона. Учтите, что адресация строк в виде диапазона тут не подойдёт. Вызовем команду i , указав номер строки, перед которой надо вставить новую строку:


Команда i с указанием номера опорной строки

Проделаем то же самое с командой a :


Команда a с указанием номера опорной строки

Обратите внимание на разницу в работе команд i и a . Первая вставляет новую строку до указанной, вторая — после.

Замена строк

Команда c позволяет изменить содержимое целой строки текста в потоке данных. При её вызове нужно указать номер строки, вместо которой в поток надо добавить новые данные:


Замена строки целиком

Если воспользоваться при вызове команды шаблоном в виде обычного текста или регулярного выражения, заменены будут все соответствующие шаблону строки:


Замена строк по шаблону

Замена символов

Команда y работает с отдельными символами, заменяя их в соответствии с переданными ей при вызове данными:


Замена символов

Используя эту команду, нужно учесть, что она применяется ко всему текстовому потоку, ограничить её конкретными вхождениями символов нельзя.

Вывод номеров строк

Если вызвать sed, использовав команду = , утилита выведет номера строк в потоке данных:


Вывод номеров строк

Потоковый редактор вывел номера строк перед их содержимым.

Если передать этой команде шаблон и воспользоваться ключом sed -n , выведены будут только номера строк, соответствующих шаблону:


Вывод номеров строк, соответствующих шаблону

Чтение данных для вставки из файла

Выше мы рассматривали приёмы вставки данных в поток, указывая то, что надо вставить, прямо при вызове sed. В качестве источника данных можно воспользоваться и файлом. Для этого служит команда r , которая позволяет вставлять в поток данные из указанного файла. При её вызове можно указать номер строки, после которой надо вставить содержимое файла, или шаблон.


Вставка в поток содержимого файла

Тут содержимое файла newfile было вставлено после третьей строки файла myfile .

Вот что произойдёт, если применить при вызове команды r шаблон:


Использование шаблона при вызове команды r

Содержимое файла будет вставлено после каждой строки, соответствующей шаблону.

Пример

Представим себе такую задачу. Есть файл, в котором имеется некая последовательность символов, сама по себе бессмысленная, которую надо заменить на данные, взятые из другого файла. А именно, пусть это будет файл newfile , в котором роль указателя места заполнения играет последовательность символов DATA . Данные, которые нужно подставить вместо DATA , хранятся в файле data .

Решить эту задачу можно, воспользовавшись командами r и d потокового редактора sed:


Замена указателя места заполнения на реальные данные

Как видите, вместо заполнителя DATA sed добавил в выходной поток две строки из файла data .

Итоги

Сегодня мы рассмотрели основы работы с потоковым редактором sed. На самом деле, sed — это огромнейшая тема. Его изучение вполне можно сравнить с изучением нового языка программирования, однако, поняв основы, вы сможете освоить sed на любом необходимом вам уровне. В результате ваши возможности по обработке с его помощью текстов будет ограничивать лишь воображение.

На сегодня это всё. В следующий раз поговорим о языке обработки данных awk.


Читайте также: