Этот репозиторий содержит выполненные мной лабораторные работы в рамках элективного курса "Интерпретируемый исскусственный интеллект".
В течении семестра работы выполнялись в Google Collab, для локального запуска могут понадобится незначительные изменения.
| № | Тема | Основные инструменты |
|---|---|---|
| 1 | Основы интерпретируемости моделей | interpret |
| 2 | Вскрытие «Черного ящика» (Model-Agnostic методы) | shap, PyALE, umap-learn |
| 3 | Анатомия компьютерного зрения (Uncertainty & Saliency) | torchvision, captum, PIL, scipy |
| 4 | Иллюзия восприятия (Adversarial Attacks & XAI) | torchvision, captum, PIL |
| 5 | Анатомия Иллюзий (Logit Lens и Probing) | transformer_lens |
| 6 | Анатомия Уязвимостей и Конституция ИИ | Любые доступные языковые модели (deepseek), сервисы онлайн-перевода (Google Translate) |
| EXPERT 3 | Джейлбрейк Агентов | Платформы с ИИ-агентами (Perplexity) |
Подробные описания заданий находятся в ноутбуках решений.
.
├── LAB_1/ # Первое задание
│ ├── whitebox.ipynb # Ноутбук с решением
│ ├── cat.png # Изображения для решения задачи (если есть)
│ ├── thrustworthu-llms.pdf # Текстовый отчет решения (если есть)
│ └── data.csv. # Специальные данные для задания (если есть)
├── LAB_2/ # Второе задание
├── ...
└── README.mdКурс: ИИИ, 6 семестр, 2026
@Гришина Ксения, 23.Б16-мм