Ben Kurtovic 1f893911eb | před 2 měsíci | |
---|---|---|
logs | před 10 roky | |
scripts | před 2 měsíci | |
src/copyvios | před 2 měsíci | |
static | před 2 měsíci | |
templates | před 3 roky | |
.gitignore | před 2 měsíci | |
.pre-commit-config.yaml | před 2 měsíci | |
LICENSE | před 2 měsíci | |
README.md | před 2 měsíci | |
app.py | před 2 měsíci | |
build.py | před 2 měsíci | |
pyproject.toml | před 2 měsíci | |
schema.sql | před 5 roky |
This is a copyright violation detector web tool for Wikipedia articles running on Wikimedia Cloud Services at copyvios.toolforge.org.
It can search the web for content similar to a given article, and graphically compare an article to specific URLs. Some technical details are expanded upon in a blog post, though much of it is outdated.
If using Toolforge, clone the repository to ~/www/python/src
, or otherwise
symlink it to that directory.
Create a virtual environment and install the dependencies. On Toolforge,
this should be in ~/www/python/venv
, otherwise it can be in a subdirectory
of the git project named venv
:
python3 -m venv venv . venv/bin/activate pip install -e .
If you intend to modify CSS or JS, install the frontend dependencies:
npm install -g uglify-js cssnano postcss postcss-cli
Create an SQL database with the tables defined by schema.sql
.
Create an earwigbot instance in .earwigbot
(run earwigbot .earwigbot
).
In .earwigbot/config.yml
, fill out the connection info for the database by
adding the following to the wiki
section:
copyvios:
engine: mysql
host: <hostname of database server>
db: <name of database>
Run ./build.py
to minify JS and CSS files after making any frontend
changes.
Start your WSGI server pointing to app:app.