mirror of
https://github.com/guezoloic/millesima_projetS6.git
synced 2026-03-28 19:13:42 +00:00
Compare commits
3 Commits
54e4b7860b
...
888defb6b6
| Author | SHA1 | Date | |
|---|---|---|---|
| 888defb6b6 | |||
| 734e3898e9 | |||
| 4bb3112dd0 |
38
README.md
38
README.md
@@ -1 +1,37 @@
|
||||
# millesima_projetS6
|
||||
# Millesima AI Engine 🍷
|
||||
|
||||
> A **University of Paris-Est Créteil (UPEC)** Semester 6 project.
|
||||
|
||||
## Documentation
|
||||
- 🇫🇷 [Version Française](https://guezoloic.github.io/millesima-ai-engine)
|
||||
> note: only french version enabled for now.
|
||||
---
|
||||
|
||||
## Installation
|
||||
> Make sure you have **Python 3.10+** installed.
|
||||
|
||||
1. **Clone the repository:**
|
||||
```bash
|
||||
git clone https://github.com/votre-pseudo/millesima-ai-engine.git
|
||||
cd millesima-ai-engine
|
||||
```
|
||||
|
||||
2. **Set up a virtual environment:**
|
||||
```bash
|
||||
python3 -m venv .venv
|
||||
source .venv/bin/activate # Windows: .venv\Scripts\activate
|
||||
```
|
||||
|
||||
3. **Install dependencies:**
|
||||
```bash
|
||||
pip install -e .
|
||||
```
|
||||
|
||||
## Usage
|
||||
|
||||
### 1. Data Extraction (Scraping)
|
||||
To fetch the latest wine data from Millesima:
|
||||
```bash
|
||||
python3 src/scraper.py
|
||||
```
|
||||
> Note: that will take some time to fetch all data depending on the catalog size.
|
||||
@@ -1,3 +1,16 @@
|
||||
# Millesima
|
||||
|
||||
L’objectif de ce projet est d’étudier, en utilisant des méthodes d’apprentissage automatique, l’impact de différents critères (notes des critiques, appelation) sur le prix d’un vin. Pour ce faire, on s’appuiera sur le site Millesima (https://www.millesima.fr/), qui a l’avantage de ne pas posséder de protection contre les bots. Par respect pour l’hébergeur du site, on veillera à limiter au maximum le nombre de requêtes. En particulier, on s’assurera d’avoir un code fonctionnel avant de scraper l’intégralité du site, pour éviter les répétitions.
|
||||
L’objectif de ce projet est d’étudier, en utilisant des méthodes d’apprentissage automatique, l’impact de différents critères (notes des critiques, appelation) sur le prix d’un vin. Pour ce faire, on s’appuiera sur le site Millesima (https://www.millesima.fr/), qui a l’avantage de ne pas posséder de protection contre les bots. Par respect pour l’hébergeur du site, on veillera à limiter au maximum le nombre de requêtes. En particulier, on s’assurera d’avoir un code fonctionnel avant de scraper l’intégralité du site, pour éviter les répétitions.
|
||||
|
||||
## projet
|
||||
<div style="text-align: center;">
|
||||
<object
|
||||
data="/millesima-ai-engine/projet.pdf"
|
||||
type="application/pdf"
|
||||
width="100%"
|
||||
height="1000px"
|
||||
>
|
||||
<p>Votre navigateur ne peut pas afficher ce PDF.
|
||||
<a href="/millesima-ai-engine/projet.pdf">Cliquez ici pour le télécharger.</a></p>
|
||||
</object>
|
||||
</div>
|
||||
@@ -1,4 +1,5 @@
|
||||
site_name: "Projet Millesima S6"
|
||||
site_url: "https://github.guezoloic.com/millesima-ai-engine/"
|
||||
|
||||
theme:
|
||||
name: "material"
|
||||
@@ -7,6 +8,11 @@ plugins:
|
||||
- search
|
||||
- mkdocstrings
|
||||
|
||||
extra:
|
||||
generator: false
|
||||
|
||||
copyright: "Loïc GUEZO & Chahrazad DAHMANI – UPEC S6 – 2026"
|
||||
|
||||
markdown_extensions:
|
||||
- admonition
|
||||
- pymdownx.details
|
||||
|
||||
@@ -99,7 +99,11 @@ def main() -> None:
|
||||
|
||||
filename = argv[1]
|
||||
cleaning: Cleaning = Cleaning(filename)
|
||||
_ = cleaning.drop_empty_appellation().fill_missing_scores().encode_appellation()
|
||||
cleaning.drop_empty_appellation() \
|
||||
.fill_missing_scores() \
|
||||
.encode_appellation() \
|
||||
.getVins() \
|
||||
.to_csv("clean.csv", index=False)
|
||||
|
||||
|
||||
if __name__ == "__main__":
|
||||
|
||||
Reference in New Issue
Block a user