Not a member of Pastebin yet?
Sign Up,
it unlocks many cool features!
- # GITHUB LINK: https://github.com/YBI-Foundation/Dataset/blob/main/Salary%20Data.csv
- import numpy as np
- import pandas as pd
- import seaborn as sns
- import matplotlib.pyplot as plt
- from sklearn.ensemble import IsolationForest
- df=pd.read_csv('Salary Data.csv')
- df.head(10)
- sns.violinplot(df.Salary)
- model = IsolationForest(n_estimators=50,max_samples='auto',contamination=float(0.1),max_features=1.0)
- model.fit(df[['Salary']])
- df['scores']=model.decision_function(df[['Salary']])
- df['anomaly']=model.predict(df[['Salary']])
- df.head(20)
- anomaly=df.loc[df['anomaly']==-1]
- anomaly_index=list(anomaly.index)
- print(anomaly)
Advertisement
Add Comment
Please, Sign In to add comment