sigma***
2024-06-20

책임감 있고 지속 가능한 ML 시스템을 배포하는 방법, AI 모범 사례와 위험 관리 프로세스 제대로 알고 활용하기
최근 회사 신입 사원 면접을 AI 로 진행하는 경우를 흔하게 볼 수 있고, 의료 분야에서는 진단 예측은 물론 맞춤형 치료에 AI 기술이 적용되고 있다. 이러한 AI 기술은 금융 분야(사기 탐지 신용평가), 자율 주행, 물류, 고객 서비스 챗봇, 품질 관리등 다양한 분야에 적용되는등 최근 몇 년 동안 놀라운 속도로 발전과 혁신을 가져오고 있다. 이러한 인공지능(AI) 기술의 급속한 발전은 사회 전반에 걸쳐 많은 혜택을 가져왔지만, 동시에 여러 가지 리스크와 윤리적 문제를 야기하고 있다. 특히 금융, 의료, 자율주행 자동차와 같은 고위험 애플리케이션에서의 AI 사용은 잠재적인 위험을 증가시키며, 이에 대한 적절한 관리와 규제에 대한 목소리가 높아지고 있으며, 규제가 필수적이라고 인식되고 있다.[24년 3월 최근 유럽연합이 인공지능법(AI Act)을 제정한 것은 이러한 맥락]
이 책은 머신러닝 모델의 위험 관리에 대한 실무 가이드를 제공한다. 머신러닝 모델이 의사 결정에 중요한 역할을 하는 경우가 늘어나면서 모델의 오용이나 악용으로 인한 위험이 증가하고 있는데, 이 책은 이러한 위험을 완화하기 위한 다양한 방법을 제시한다.
책은 크게 3부로 구성되어 있다.
1부 : 인공지능 위험관리의 이론과 실제 적용 사례
1장: 현대의 머신러닝 위험관리 이 장에서는 현대 머신러닝의 법률, 규제, 사고 사례, 문화적 역량, 조직 프로세스를 다룬다. 질로우 아이바잉 사례 연구를 통해 실제 발생한 문제점과 해결 방안을 살펴본다. 머신러닝 시스템에서 발생할 수 있는 다양한 리스크와 이를 관리하기 위한 체계적인 접근 방식을 이해할 수 있다.
2장: 해석 및 설명 가능한 머신러닝 모델 해석의 중요성을 강조하고, 설명 가능한 모델과 사후 설명 기법을 소개한다. 알고리즘 채점 사례 연구를 통해 설명 가능한 모델의 실무적 활용 방안을 제시한다. 특히, 모델의 투명성과 이해 가능성은 신뢰 구축에 필수적이다.
3장: 안전성과 성능을 높이는 머신러닝 시스템 디버깅 훈련, 모델 디버깅, 배포 단계별 디버깅 과정을 설명하고, 자율주행차 사망 사고 사례 연구를 통해 디버깅의 중요성을 강조한다. 모델의 성능을 최적화하고 안전성을 보장하기 위해 디버깅이 필수적임을 알 수 있다.
4장: 머신러닝 편향관리 편향의 개념, 관련 법률, 피해, 테스트, 완화 방안을 다룬다. 편향 버그 바운티 사례 연구를 통해 실제 편향 문제 해결 사례를 살펴본다. 편향 문제는 머신러닝의 공정성과 관련된 중요한 이슈로, 이를 적절히 관리하는 방법을 배운다.
5장: 머신러닝 보안 보안 기초, 공격 유형, 일반적인 보안 문제, 대응책을 다룬다. 실제 우회 공격 사례 연구를 통해 보안 취약점을 파악하고 해결하는 방법을 제시한다. 머신러닝 시스템의 보안은 데이터와 모델의 신뢰성을 유지하기 위해 필수적이다.
2부: 인공지능 위험관리 실행하기
6장: 설명 가능한 부스팅 머신과 XGBoost 설명 부스팅 머신과 XGBoost를 활용한 설명 가능한 모델 구축 방법을 단계별로 안내한다. 설명 가능한 모델을 구축함으로써 모델의 투명성을 높일 수 있다.
7장: 파이토치 이미지 분류기 흉부 엑스레이 이미지 분류 사례를 통해 파이토치 이미지 분류 모델 구축 및 설명 방법을 설명한다. 실제 의료 데이터를 사용하여 모델을 구축하고 해석하는 방법을 배운다.
8장: XGBoost 모델 선택 및 디버깅 XGBoost 모델 선택 및 디버깅 방법을 단계별로 안내하고, 민감도 분석, 잔차 분석 등을 활용한 모델 개선 방안을 제시한다. 모델의 성능을 최적화하기 위한 다양한 디버깅 기법을 소개한다.
9장: 파이토치 이미지 분류기 디버깅 파이토치 이미지 분류 모델 디버깅 방법을 단계별로 안내한다. 모델의 성능을 높이기 위해 디버깅 과정이 얼마나 중요한지 알 수 있다.
10장: XGBoost를 사용한 편향 테스트 및 개선 XGBoost 모델의 편향 평가 및 개선 방법을 단계별로 안내한다. 모델의 공정성을 확보하기 위한 다양한 방법을 제시한다.
11장: 레드 팀 XGBoost 레드 팀 공격 시나리오를 활용한 XGBoost 모델 공격 및 방어 방법을 설명한다. 실제 공격 시나리오를 통해 보안 취약점을 파악하고 이를 방어하는 방법을 학습한다.
3부: 결론
12장: 고위험 머신러닝에서 성공하는 방법 고위험 ML 프로젝트 참여 시 고려해야 할 사항, 과학적 접근 방식, 결과 평가, 외부 표준 적용, 상식적 위험 완화 전략 등을 다룬다. 고위험 프로젝트를 성공적으로 수행하기 위한 다양한 전략을 제공한다.
장점 :
실용적인 가이드: 모델 배포, 위험 관리, 설명 가능성, 안정성, 안전성, 편향 관리, 보안, 프라이버시 등 다양한 주제에 대한 실용적인 지침을 제공한다.
다양한 도구 및 기법: 모델 위험을 평가하고 완화하는 데 도움이 되는 다양한 도구와 기법을 소개한다.
코드 예시: Python 코드 예시를 통해 모델 거버넌스 및 위험 관리 개념을 실제로 적용하는 방법을 보여준다.
폭넓은 대상: 머신러닝 엔지니어, 데이터 과학자, 규제 기관, 정책 전문가 등 다양한 독자에게 유용하다.
아쉬운 점 :
강화 학습, 생성 AI, GPT 모델과 같은 최신 머신러닝 기술에 대한 소개 부재
실무 경험이 적은 독자들이 이론적인 개념을 더 쉽게 이해할 수 있는 예시와 설명
'머신러닝 리스크 관리 with 파이썬'은 ML 모델 개발 및 활용 과정에서 발생하는 다양한 위험 요소를 이해하고, 이를 해결하기 위한 실용적인 방법을 제공하는 유용한 도서이다. 특히, 실무 경험을 바탕으로 구체적인 사례와 코드 예시를 제시하는 부분은 이 책의 큰 장점이다.
ML 모델 개발 및 활용에 관심 있는 전문가와 ML 위험 관리 분야에 대한 실무 지식을 쌓고 싶은 사람들에게 유용하게 활용될 수 있을 것으로 생각된다.
한빛미디어 <나는 리뷰어다> 활동을 위해서 책을 제공받아 작성된 서평입니다.