{"repo":"muhammetakkurtt/mevzuat-gov-scraper","free":true,"listed":false,"github":"https://github.com/muhammetakkurtt/mevzuat-gov-scraper","clone":"git clone https://github.com/muhammetakkurtt/mevzuat-gov-scraper.git","description":"Web scraping uygulaması ile mevzuat.gov.tr üzerinden belirlenen yıllar arasında yayımlanan mevzuatları toplar ve JSON formatında sunar.","language":"Python","stars":27,"topics":["python","scrapy","selenium","webscraping"],"license":"MIT","category":"scrapers-browser-automation","readme_excerpt":"Mevzuat-Gov Scraper Bu proje, belirlediğiniz yıllar arasında yayımlanan mevzuatlar/kanunlar için mevzuat.gov tarayıp içeriklerini almanızı sağlayan bir web scraping uygulamasıdır. Scrapy ve Selenium teknolojilerini kullanarak mevzuat verilerini toplar ve JSON formatında çıktı üretir. İçindekiler - Özellikler - Kurulum - Kullanım - GUI Arayüzü Verileri Kazıma - Mevzuat Verilerini Ayrıştırma - Dosyalar - Mevzuat Verileri - Kullanılan Teknolojiler ve Atıf - Hatalar ve Geliştirme Alanları - Meta Özellikler - Belirli yıllar arasında yayımlanan mevzuatları tarar. - İki farklı veri çekme yöntemi sunar: - Tam Metin: Mevzuatın tam içeriğini çeker (Selenium kullanır) - Meta Veri: Sadece özet bilgileri çeker - Mevzuat türü seçimi (Kanun, Tüzük, Yönetmelik vb.) - Mevzuatın tam metnini web sitesinden çeker ve JSON formatında kaydeder. - Selenium ile tarayıcıyı kontrol eder, Scrapy ile sayfaları kazır. - Başlangıç ve bitiş yıllarını Tkinter tabanlı GUI ile girebilirsiniz. - Tek bir yıl ya da tüm yıllar arasındaki mevzuatı seçebilirsiniz. - Toplanan mevzuatların metinlerini regex ve doğal dil işleme (NLP) ile ayrıştırır. - Kanun adı, kanun numarası, kabul tarihi, resmi gazete bilgileri ve kanun maddelerini çıkarır. - Çıktıyı JSON formatında sunar. Kurulum Adım 1: Gerekli Paketlerin Yüklenmesi Proje Python 3.11.9 sürümü ile test edilmiştir. Projeyi çalıştırmadan önce, gerekli Python paketlerini yüklemeniz gerekmektedir. Aşağıdaki komut ile gerekli paketleri yükleyebilirsiniz: Gerekli paketle","default_branch":null,"files":null,"tree":[],"storefront":"/r/muhammetakkurtt","claimed":false,"request_supported":{"post":"https://gitbuyer.com/r/muhammetakkurtt/mevzuat-gov-scraper/request-supported","requests":0},"note":"indexed from public GitHub; nothing is for sale on this page. Clone it from GitHub. Paid listings live at /search."}