Skip to content
This repository was archived by the owner on Jul 7, 2021. It is now read-only.

Latest commit

 

History

History
74 lines (47 loc) · 2.41 KB

File metadata and controls

74 lines (47 loc) · 2.41 KB

Процесс:

Часть I

Я решил, что собрать все -- это значит собрать ссылки на ресурсы (хотя бы).

Для этого имеющимся в интернете инструментами извлекаю URL-ы из письма и со страницы http://www.usdp.ru/savva.html

Обрабатываю в редакторе vim:

:s/".*$//
:g/embed/d

Получается файл urls1.txt вида:

...
https://www.youtube.com/watch?v=6fCoqeqme10
https://www.youtube.com/watch?v=Byw49v8uAPo
https://www.youtube.com/watch?v=I_JnVNIjKRY
...

Сортируем и удаляем дубликаты

sort urls1.txt | uniq > urls.txt
rm urls1.txt

Теперь у нас есть файл urls.txt со всеми ссылками

Часть II

База данных

База данных нужна, чтобы можно было делать выборки и удобно сортировать ресурсы. Кроме того, возможно добавление метаинформации.

Я решил использовать базу данных SQLite3, так как она уже установлена на Маке и хранит данные в одном файле.

Создадим базу данных:

$ sqlite3 database.sqlite3
sqlite> CREATE TABLE urls (url TEXT UNIQUE NOT NULL);
sqlite> /* и импортируем в нее наш файл */
sqlite> .import urls.txt ulrs

Теперь наши ссылки в базе данных

Часть III

Вывод ссылок.

Я буду использовать php, так как он уже устновлен на Маке и можно легко запуситить встроенный сервер.

Файл <index.php> просто выводит строки из базы данных.

Делаем гит-репозиторий для удобства обмена.

git init

Загружаем тестовую версию по адресу http://egor.cf/savva/

Часть IV

Начинаем упорядочивать имеющийся массив данных. Добавляем в базу данных поля title, comment.

Пишем парсер заголовков, определяем категории, модифицируем вывод.