Не работает htmlspecialchars php
Здесь могла бы быть ваша реклама
Покинул форум
Сообщений всего: 4574
Дата рег-ции: Июль 2006
Откуда: Israel
Секрет
Теперь, когда вы уже наверняка второпях отправили свой запрос,
я расскажу вам простой секрет, который сэкономит вам уйму ожиданий,
даже если первый ответ по теме последуем сразу же.
Само собой я знаю что ответят мне тут же, и если я посмотрю
на сообщения на форуме, то пойму что в общем то я и не ошибаюсь.
Но еще я точно замечу, что очень мало тем, в которых всего два ответа :
вопрос автора и еще два сообщение вида Ответ + Спасибо
После этого приходится начинать уточнять этим неграмотным что мне надо.
Они что, сами читать не умеют? А уточнять приходится.
И иногда пока они переварят то что я им скажу проходит и не одна ночь..
Уверен что если бы я им сказал что у меня есть
фиолетовый квадрат, и нужно превратить его в синий треугольник
и я пытался взять кисточку, макнуть в банку и поводить ей по квадрату
но почему то кисточка не принимала цвет краски в банке,
то на мой вопрос — где взять правильные банки мне бы ответили гораздо быстрее
предложив её открыть, а не тратить еще стольник на жестянку.
Поэтому с тех пор я строю свои вопросы по проверенной давным давно схеме:
Что есть
Что нужно получить
Как я пытался
Почему или что у меня не получилось.
На последок как оно происходит на форумах
Новичок: Подскажите пожалуста самый крепкий сорт дерева! Весь инет перерыл, поиском пользовался!
Старожил: Объясни, зачем тебе понадобилось дерево? Сейчас оно в строительстве практически не используется.
Новичок: Я небоскрёб собираюсь строить. Хочу узнать, из какого дерева делать перекрытия между этажами!
Старожил: Какое дерево? Ты вообще соображаешь, что говоришь?
Новичок: Чем мне нравиться этот форум — из двух ответов ниодного конкретного. Одни вопросы неподелу!
Старожил: Не нравится — тебя здесь никто не держит. Но если ты не соображаешь, что из дерева небоскрёбы не строят, то лучше бы тебе сначала школу закончить.
Новичок: Не знаите — лучше молчите! У меня дедушка в деревянном доме живёт! У НЕГО НИЧЕГО НЕ ЛОМАЕТСЯ.
Но у него дом из сосны, а я понимаю, что для небоскрёба нужно дерево прочнее! Поэтому и спрашиваю. А от вас нормального ответа недождёшся.
Прохожий: Самое крепкое дерево — дуб. Вот тебе технология вымачивания дуба в солёной воде, она придаёт дубу особую прочность:
Новичок: Спасибо, братан! То что нужно.
Отредактировано модератором: Uchkuma, 26 Апреля, 2011 — 10:21:12
Источник
Не работает htmlspecialchars php
Регистрация на форуме тут, о проблемах пишите сюда — alarforum@yandex.ru, проверяйте папку спам! Обязательно пройдите активизацию e-mail, а тут можно восстановить пароль
| Регистрация
Здравствуйте, уважаемые программисты! | |||||||||
Добавить комментарий
// считываем файл comments.txt и превращаем его в массив
$comments = unserialize ( file_get_contents ( ‘comments.txt’ ));
// если файл битый или не существует, обнуляем массив
if( gettype ( $comments )!= ‘array’ ) $comments =array();
// если нажали «добавить коммент»
if( $_POST [ ‘submit’ ]== ‘1’ ) <
// проверка формы на заполненность
if( $_POST [ ‘name’ ]== » || $_POST [ ‘mail’ ]== » || $_POST [ ‘text’ ]== » )
echo ‘
‘ ;
else <
// добавляем к массиву новую запись
$comments []=array(
‘name’ => base64_encode ( $_POST [ ‘name’ ]),
‘mail’ => base64_encode ( $_POST [ ‘mail’ ]),
‘comment’ => base64_encode ( $_POST [ ‘text’ ])
);
// открываем файл для записи и записываем
$desc =@ fopen ( ‘comments.txt’ , ‘wt’ );
@ fwrite ( $desc , serialize ( $comments ));
@ fclose ( $desc );
$_POST =array();
>
>
Комменты юзеров
// вывод комментариев
foreach( $comments as $v ) <
// base64_decode — функция, которая превращает строку в однородную симвользую строку,
// удобную для хранения и передачи
$v [ ‘name’ ]= base64_decode ( $v [ ‘name’ ]);
$v [ ‘mail’ ]= base64_decode ( $v [ ‘mail’ ]);
$v [ ‘comment’ ]= base64_decode ( $v [ ‘comment’ ]);
echo ‘
Источник
PHP, html_entity_decode и htmlspecialchars_decode не будут работать
Угу, PHP мне никогда не нравился, он такой «нечистый» .
Теперь мне нужно его использовать, и у меня с ним проблема: в основном, ни html_entity_decode , ни htmlspecialchars_decode у меня не работают. Я просмотрел этот форум и ничего. Вроде везде работает, только тут не сработает .
Я отправляю название фильма в базу данных, все закодировано, а затем, когда я получаю его из БД, я декодирую его следующим образом:
Это часть объекта JSON, который я создаю с помощью PHP. Хотя когда я смотрю на свойства этого конкретного объекта, его заголовок не декодируется, на самом деле вообще ничего не меняется. Я пробовал обе функции, как указано в заголовке вопроса, и пробовал кодировать, например UTF-8, а также некоторые параметры, такие как ENT_QUOTES или ENT_COMPAT, но это все равно не сработает.
Может кто-нибудь сказать мне, почему, черт возьми, PHP не подчиняется мне?
Изменить: вот все, что я там делаю:
Извините, это немного запутано, в блокноте ++ выглядит лучше; / Я на самом деле вывожу его в теге сценария, чтобы создать объект, и я посмотрел на json_encode и не совсем понял, как он может мне помочь, потому что я не знаю, как бы мне использовать с таким количеством переменных, извините.
Кроме того, вот код из источника после создания тега с javascript с использованием переменных из этого объекта JSON:
3 ответа
(Я не мог поместить это в комментарий, так что это должен быть ответ.)
Настоящая проблема здесь в том, как данные помещаются в вашу базу данных. Давайте посмотрим на приведенный вами образец строки:
Итак, пользовательский ввод был O.S.T.R «Track # 12»
Ключевой концепцией здесь является то, что именно так он должен был храниться в базе данных. Потому что это реальные данные. Не храните измененные версии в своей базе данных. Вместо этого экранируйте данные соответствующим образом, поскольку вам нужно их вывести.
Вот образцы данных, которые я буду использовать для следующих нескольких примеров:
Итак, когда вы записываете данные в операторе SQL, вы используете addslashes (или подготовленные операторы, но здесь я покажу подход с добавлением косых черт):
Для кодировки json используйте json_encode:
Для кодирования в формате csv в файле журнала используйте fputcsv:
Для вывода в формате HTML используйте htmlspecialchars () (или html_entity_encode ()):
Теперь, возможно, я все еще не убедил вас, и вы все еще действительно хотите хранить данные, готовые к HTML, в своей базе данных и терпеть дополнительный шаг, чтобы удалить их из HTML каждый раз, когда вы хотите использовать их для чего-то еще? В этом случае ваша примерная строка должна выглядеть так:
В то время как ваша строка выглядела так:
Вы видите разницу? В первом html-объекты были закодированы ровно один раз. Вызов html_entity_decode() декодирует его правильно. Во втором они закодированы дважды. Он больше не кодируется как html-объекты. Это то, что мы будем называть форматом с двойным кодированием или для краткости DEEF. Нет функции deef_decode() ни в PHP, ни в каком-либо другом компьютерном языке, о котором я когда-либо слышал, даже более чистом, чем PHP. Причина в том, что эта функция никому не нужна.
РЕЗЮМЕ: у вас есть ошибка в вашем коде, который записывает в их базу данных. Вы получаете строки с уже закодированными объектами, но вы снова кодируете их перед записью в базу данных.
ЗАКЛЮЧЕНИЕ: возвращаясь к ключевой концепции , которую я дал выше, вы должны декодировать эти html-объекты перед записью их в базу данных, а не кодировать их во второй раз. НО, когда вы вносите это изменение, убедитесь, что весь код, который берет данные из базы данных и помещает их в HTML или XML, знает, что теперь он должен кодировать сущности.
Я не совсем уверен, в чем проблема, но мне интересно, почему вы не используете json_encode() построить объект?
Это позаботится обо всех проблемах с кодированием.
Хорошо, если у кого-то такая же проблема и он сам не поймет эту чушь, решение простое, функции PHP html_entity_decode и htmlspecialchars_decode не удаляют строку полностью из специальных символов, он удаляет ее только из одного специального символа, если вы есть два специальных символа, вам нужно запустить эту функцию дважды . например, эта строка:
O.S.T.R "Track #12"
Нужно дважды зачистить, сначала убрать &, а затем в другой раз убрать эти «-es».
Источник
htmlspecialchars() и пустота. php 5.4.
Если вы заметили, что функция htmlspecialchars() начала возвращать пустую строку (внешний признак — пустые поля в формочках), не пугайтесь. Это не баг, это фича.
Именно так по замыслу разработчиков PHP и должна работать функция со строками в кодировке cp1251 и прочими «нацменьшинствами». Вы, кончено, будете возражать: «Раньше работала нормально. Значит — баг!» Ничего подобного! Задокументированный баг считается фичей. Вот вам выдержка из инструкции по миграции с php 5.3 на php 5.4:
Кодировкой по умолчанию для функций htmlspecialchars() и htmlentities() сейчас является UTF-8, вместо прежней ISO-8859-1. Обратите внимание, что изменения кодировки вывода с помощью конфигурационной опции default_charset не действует на вышеупомянутые функции до тех пор, пока вы не передадите «» (пустую строку) в качестве параметра кодировки в вызовы функций htmlspecialchars()/ htmlentities(). В целом, мы не рекомендуем так делать, потому что вы должны иметь возможность изменить кодировку вывода без воздействия на кодировку во время исполнения, используемую этими функциями. Самый безопасный подход — явно установить кодировку при каждом вызове функций htmlspecialchars() и htmlentities().
То есть, разработчикам и эксплуататорам движков и скриптов, использующих кодировку отличную от utf-8 предлагается либо переходить на utf-8, либо исправлять все(!) вхождения функций htmlspecialchars() и htmlentities() на такой, полный, формат:
htmlspecialchars($str, ФЛАГ, ‘кодировка сайта’);
Однако, можно попробовать использовать более универсальный код (в 5.6 уже не работает):
Такой код избавит вас от необходимости каждый раз править все вызовы при смене кодировки, что очень важно, если заранее не известно, в какой кодировке придется работать скрипту. Этот «универсальный» код работает и с utf-8, и с cp1251 в php 5.4.6 даже без маневров с default_charset. То есть — как раньше. Видимо из-за этого, разработчики его и не рекомендуют 😉
А что делать тем, у кого скрипты свёрнуты ионкубом или зендом? Выпить йаду. Договаривать с хостером об откате php на предыдущую версию, менять хостера, брать VPS/VDS, короче, крутиться кто как может, не забывая посылать лучи ненависти в строну разрабов php.
В заключение хочу искренне поблагодарить разработчиков php, что они не вспомнили о функциях preg_*, которые тоже можно было перевести на utf по умолчанию, изменив смысл флага «u» на противоположный.
UPD В PHP 5.6 код: htmlspecialchars($str, NULL, »); тоже возвращает пустую строку.
Спасибо, Андрей, за уточнение.
Источник
htmlspecialchars
(PHP 4, PHP 5, PHP 7, PHP 8)
htmlspecialchars — Преобразует специальные символы в HTML-сущности
Описание
В HTML некоторые символы имеют особый смысл и должны быть представлены в виде HTML-сущностей, чтобы сохранить их значение. Эта функция возвращает строку, над которой проведены эти преобразования. Если вам нужно преобразовать все возможные сущности, используйте htmlentities() .
Если входная строка, переданная в эту функцию и результирующий документ используют одинаковую кодировку символов, то этой функции достаточно, чтобы подготовить данные для вставки в большинство частей HTML-документа. Однако, если данные содержат символы, не определённые в кодировке символов результирующего документа и вы ожидаете сохранения этих символов (как числовые или именованные сущности), то вам недостаточно будет этой и htmlentities() функций (которые только преобразуют подстроки с соответствующими сущностями). Необходимо использовать функцию mb_encode_numericentity() .
| Символ | Замена |
|---|---|
| & (амперсанд) | & |
| » (двойные кавычки) | » , если не установлена ENT_NOQUOTES |
| ‘ (одинарные кавычки) | ‘ (для ENT_HTML401 ) или ‘ (для ENT_XML1 , ENT_XHTML или ENT_HTML5 ), но только если установлена ENT_QUOTES |
| (меньше) | |
| > (больше) | > |
Список параметров
Конвертируемая строка ( string ).
Битовая маска из нижеуказанных флагов, определяющих режим обработки кавычек, некорректных кодовых последовательностей и используемый тип документа. По умолчанию используется ENT_QUOTES | ENT_SUBSTITUTE | ENT_HTML401 .
| Название константы | Описание |
|---|---|
| ENT_COMPAT | Преобразует двойные кавычки, одинарные кавычки не изменяются. |
| ENT_QUOTES | Преобразует как двойные, так и одинарные кавычки. |
| ENT_NOQUOTES | Оставляет без изменения как двойные, так и одинарные кавычки. |
| ENT_IGNORE | Без всяких уведомительных сообщений отбрасывает некорректные кодовые последовательности вместо возврата пустой строки. Использование этого флага не рекомендуется, так как это может привести к » негативным последствиям, связанным с безопасностью. |
| ENT_SUBSTITUTE | Заменяет некорректные кодовые последовательности символом замены Юникода U+FFFD в случае использования UTF-8 или � при использовании другой кодировки, вместо возврата пустой строки. |
| ENT_DISALLOWED | Заменяет неверные коды символов для заданного типа документа символом замены юникода U+FFFD (UTF-8) или � (при использовании другой кодировки) вместо того, чтобы оставлять все как есть. Это может быть полезно, например, для того, чтобы убедиться в формальной правильности XML-документов со встроенным внешним контентом. |
| ENT_HTML401 | Обработка кода в соответствии с HTML 4.01. |
| ENT_XML1 | Обработка кода в соответствии с XML 1. |
| ENT_XHTML | Обработка кода в соответствии с XHTML. |
| ENT_HTML5 | Обработка кода в соответствии с HTML 5. |
Необязательный аргумент, определяющий кодировку, используемую при конвертации символов.
Если не указан, то значение по умолчанию для encoding зависит от конфигурационной опции default_charset.
Хотя этот аргумент является технически необязательным, настоятельно рекомендуется указать правильное значение для вашего кода, опция конфигурации default_charset может быть задана неверно для входных данных.
Для целей этой функции кодировки ISO-8859-1 , ISO-8859-15 , UTF-8 , cp866 , cp1251 , cp1252 и KOI8-R являются практически эквивалентными, предполагая то, что сама строка string содержит корректные символы в указанной кодировке, то символы, изменяемые htmlspecialchars() , останутся на тех же местах во всех этих кодировках.
Поддерживаются следующие кодировки:
| Кодировка | Псевдонимы | Описание |
|---|---|---|
| ISO-8859-1 | ISO8859-1 | Западно-европейская Latin-1. |
| ISO-8859-5 | ISO8859-5 | Редко используемая кириллическая кодировка (Latin/Cyrillic). |
| ISO-8859-15 | ISO8859-15 | Западно-европейская Latin-9. Добавляет знак евро, французские и финские буквы к кодировке Latin-1 (ISO-8859-1). |
| UTF-8 | 8-битная Unicode, совместимая с ASCII. | |
| cp866 | ibm866, 866 | Кириллическая кодировка, применяемая в DOS. |
| cp1251 | Windows-1251, win-1251, 1251 | Кириллическая кодировка, применяемая в Windows. |
| cp1252 | Windows-1252, 1252 | Западно-европейская кодировка, применяемая в Windows. |
| KOI8-R | koi8-ru, koi8r | Русская кодировка. |
| BIG5 | 950 | Традиционный китайский, применяется в основном на Тайване. |
| GB2312 | 936 | Упрощённый китайский, стандартная национальная кодировка. |
| BIG5-HKSCS | Расширенная Big5, применяемая в Гонконге. | |
| Shift_JIS | SJIS, SJIS-win, cp932, 932 | Японская кодировка. |
| EUC-JP | EUCJP, eucJP-win | Японская кодировка. |
| MacRoman | Кодировка, используемая в Mac OS. | |
| » | Пустая строка активирует режим определения кодировки из файла скрипта (Zend multibyte), default_charset и текущей локали (смотрите nl_langinfo() и setlocale() ) в указанном порядке. Не рекомендуется к использованию. |
Замечание: Остальные кодировки не поддерживаются, вместо них будет применена кодировка по умолчанию и сгенерировано предупреждение.
Если параметр double_encode выключен, то PHP не будет преобразовывать существующие html-сущности. По умолчанию преобразуется все без ограничений.
Возвращаемые значения
Преобразованная строка ( string ).
Если входная строка string содержит неверную последовательность символов в указанной кодировке encoding , то будет возвращаться пустая строка в случае, если флаги ENT_IGNORE или ENT_SUBSTITUTE не установлены.
Источник