ЗАДАЧА
Преврати мою папку со скриншотами в аккуратную локальную базу знаний.
Мне недостаточно просто разложить изображения по папкам.
Я хочу, чтобы в результате:
- каждый скриншот имел понятную тему;
- его можно было найти по смыслу через поиск;
- у изображения были полезные поисковые теги;
- связанные скриншоты объединялись в серии;
- интересные идеи, места, товары, фильмы, советы и материалы не терялись среди случайных файлов;
- вся библиотека работала локально без интернета;
- оригинальные изображения оставались полностью нетронутыми.
ПАПКИ
Исходная папка
[ВСТАВЬ ПОЛНЫЙ ПУТЬ К ПАПКЕ СО СКРИНШОТАМИ]
Папка результата
[ВСТАВЬ ПОЛНЫЙ ПУТЬ К ПУСТОЙ ПАПКЕ ДЛЯ ГОТОВОЙ БИБЛИОТЕКИ]
ОСНОВНОЙ ПРИНЦИП
Относись к скриншотам не как к набору файлов, а как к моей личной визуальной базе знаний.
Главный вопрос при классификации:
«Что здесь сохранено и зачем мне потенциально может понадобиться найти это снова?»
Классифицируй изображение прежде всего по его содержанию и смыслу.
Название приложения, имя файла и место хранения используй только как дополнительный контекст.
БЕЗОПАСНОСТЬ
Исходная папка неприкосновенна.
Никогда:
- не изменяй оригинальные изображения;
- не перемещай их;
- не переименовывай;
- не удаляй;
- не редактируй;
- не меняй их метаданные;
- не перезаписывай существующие файлы.
Создавай новые файлы исключительно в ПАПКЕ РЕЗУЛЬТАТА.
Перед работой обязательно проверь:
1. исходная папка существует;
2. папка результата существует;
3. это разные директории;
4. папка результата не находится внутри исходной;
5. исходная папка не находится внутри папки результата;
6. папка результата пустая.
Если какое-либо условие не выполнено - остановись и сообщи мне проблему.
РАБОТАЙ В ДВА ЭТАПА
ЭТАП 1 - РАЗВЕДКА И ПРОЕКТИРОВАНИЕ
Первый этап выполняй исключительно в режиме чтения.
На этом этапе ничего не:
- копируй;
- перемещай;
- переименовывай;
- создавай;
- удаляй;
- перезаписывай.
Не создавай даже временные файлы.
Сначала изучи архив и предложи мне архитектуру будущей базы.
После отчёта остановись и дождись моего явного разрешения перейти к ЭТАПУ 2.
ЧТО НУЖНО НАЙТИ
Просмотри исходную папку и все её подпапки.
Найди изображения подходящих форматов, включая распространённые форматы скриншотов и фотографий.
Для каждого найденного изображения проанализируй реальное визуальное содержание.
Не делай классификацию только по:
- названию файла;
- названию папки;
- приложению;
- интерфейсу Telegram / WhatsApp / Instagram / Safari и т. п.
КАК ОПРЕДЕЛЯТЬ СМЫСЛ СКРИНШОТА
Пытайся определить:
1. Что здесь изображено?
2. Какая информация была причиной сохранения?
3. Для чего этот скриншот может понадобиться потом?
4. Какие слова я вероятнее всего введу, пытаясь его найти?
5. Является ли он самостоятельным материалом или частью серии?
Например:
скрин сообщения в Telegram с рекомендацией сериала
→ это материал про фильм или сериал, а не просто «Telegram»
скрин сообщения с красивым рестораном
→ место / ресторан
скрин с интересным промптом
→ ИИ / промпты
скрин чужого дизайна сайта
→ дизайн / референсы
скрин интересной одежды
→ покупки / одежда
скрин совета по работе
→ работа / полезная информация
скрин переписки, которую важно сохранить именно как переписку
→ коммуникация / переписка
СОЗДАЙ СТРУКТУРУ НА ОСНОВЕ МОЕГО АРХИВА
Не используй фиксированный список тем.
Сначала изучи содержимое и только после этого предложи категории.
Категории должны отражать реально встречающиеся материалы.
Они должны быть достаточно широкими.
Избегай ситуации:
- 40-50 микрокатегорий;
- отдельных папок ради 1-2 изображений;
- нескольких почти одинаковых категорий.
Например, вместо:
- рестораны;
- кофейни;
- завтраки;
- бары;
- интересные кафе;
может быть одна категория:
Места и путешествия
а подробности должны определяться тегами.
СИСТЕМА: ТЕМА + ТЕГИ
У каждого изображения должна быть:
Одна основная тема
Она определяет физическую папку, в которую будет помещена копия изображения.
Несколько тегов
Теги используются для более точного поиска.
Пример:
Основная тема:
Места и путешествия
Теги:
Москва, ресторан, завтрак, веранда, красивый интерьер, хочу сходить
ТЕГИ ДОЛЖНЫ БЫТЬ ПОЛЕЗНЫМИ
Не создавай бессмысленные технические теги вроде:
- screenshot;
- image;
- Telegram;
- iPhone;
если они не помогают искать содержание.
Предпочитай смысловые теги.
Например:
нейросети
Claude
промпты
автоматизация
Reels
дизайн
интерьер
Москва
ресторан
подарок
косметика
фильм
рецепт
НОРМАЛИЗУЙ ТЕГИ
Не создавай несколько вариантов одного понятия без необходимости.
Например, избегай одновременного существования:
нейросеть
нейросети
нейронки
AI
если они используются как одно и то же понятие.
Выбери один основной вариант.
Для известных названий и брендов сохраняй оригинальное название, например:
ChatGPT
Claude
Notion
Telegram
СЕРИИ СКРИНШОТОВ
Особенно внимательно ищи последовательности.
Несколько изображений могут быть частями:
- длинной статьи;
- переписки;
- инструкции;
- карусели;
- одной публикации;
- одного документа;
- одного сайта;
- одной подборки;
- одного длинного экрана.
Определяй серии по совокупности признаков:
- близкое время создания;
- последовательные имена файлов;
- одинаковый интерфейс;
- продолжение текста;
- совпадающие элементы;
- логическое продолжение содержания.
Связанные изображения анализируй вместе.
Для каждой обнаруженной серии создай единый series_id.
Например:
series-001
Все части одной серии должны:
- иметь одну основную тему;
- иметь согласованные теги;
- находиться рядом в каталоге.
Не распределяй части одной последовательности по разным темам без веской причины.
НАЗВАНИЕ СКРИНШОТА
Создай каждому изображению короткое человеческое название.
Название должно объяснять, что находится внутри.
Хорошо:
Промпт для анализа конкурентов
Ресторан с верандой в Москве
Список фильмов на осень
Референс лендинга курса
Плохо:
Скриншот Telegram
IMG 4832
Картинка
КРАТКОЕ ОПИСАНИЕ
Добавь короткое описание - обычно 1-2 предложения.
Не переписывай в описание весь текст изображения.
Описание должно помогать быстро понять, стоит ли открывать файл.
ТЕКСТ НА ИЗОБРАЖЕНИИ
Если можешь распознать текст на скриншоте, сохрани его для локального поиска.
Распознанный текст не обязательно полностью показывать в карточке.
Он прежде всего нужен поисковой системе.
Не придумывай неразборчивый текст.
Если часть текста невозможно уверенно распознать, не восстанавливай её по догадке.
УРОВЕНЬ УВЕРЕННОСТИ
Для каждого изображения установи:
high
medium
или
low
HIGH
Содержание и категория очевидны.
MEDIUM
Общий смысл понятен, но возможна другая близкая классификация.
LOW
Невозможно достаточно уверенно понять содержание или назначение.
Все изображения с low автоматически относи к:
На проверку
Не угадывай.
ДОПОЛНИТЕЛЬНАЯ МЕТКА «НА ПРОВЕРКУ»
Используй её также, если:
- изображение почти пустое;
- содержание повреждено;
- текст невозможно прочитать;
- непонятно, зачем оно сохранено;
- возможны две совершенно разные трактовки;
- недостаточно контекста.
Мне важнее точность, чем попытка автоматически классифицировать 100% файлов.
ЛИЧНЫЕ И ЧУВСТВИТЕЛЬНЫЕ МАТЕРИАЛЫ
Отдельно определяй изображения с потенциально чувствительной информацией.
Используй флаг:
private: true
Это может включать изображения с:
- финансовыми данными;
- платёжной информацией;
- персональными документами;
- адресами;
- телефонами;
- медицинской информацией;
- паролями;
- кодами подтверждения;
- приватной перепиской;
- другими очевидно чувствительными данными.
Не считай автоматически любой личный материал секретным.
Например:
- селфи;
- фотографии друзей;
- фотографии животных;
- памятные моменты;
могут относиться к теме:
Личные фото и воспоминания
без обязательного флага private.
КАРТОЧКИ ЧУВСТВИТЕЛЬНЫХ МАТЕРИАЛОВ
Для private: true:
- не показывай читаемые секретные данные на превью;
- не выводи распознанный секретный текст;
- не раскрывай его в описании;
- не используй секретные данные как теги.
Но пользователь должен иметь возможность сознательно открыть полный файл по клику.
ДАННЫЕ КАЖДОГО ФАЙЛА
Для каждого изображения сохрани как минимум:
- уникальный ID;
- исходное имя файла;
- исходный путь;
- основную тему;
- название;
- короткое описание;
- теги;
- распознанный текст;
- уровень уверенности;
- private: true/false;
- needs_review: true/false;
- series_id, если применимо;
- дату файла, если она доступна;
- относительный путь организованной копии.
ПЕРЕД НАЧАЛОМ КОПИРОВАНИЯ ПОКАЖИ МНЕ ОТЧЁТ
На ЭТАПЕ 1 сообщи:
Архив
- сколько изображений найдено;
- сколько исходных подпапок просмотрено;
- общий объём изображений.
Безопасность
Подтверди результаты проверки путей и папки результата.
Предлагаемая структура
Покажи предлагаемые основные темы.
Для каждой темы укажи:
- название;
- примерное количество файлов;
- несколько примеров того, что туда попадёт.
Теги
Покажи примерно 20-40 наиболее часто предполагаемых тегов, чтобы я увидела будущую логику базы.
Серии
Укажи примерное количество обнаруженных серий.
На проверку
Укажи количество спорных файлов.
Личное
Укажи количество файлов, которые предположительно требуют режима приватности.
Место на диске
Рассчитай приблизительный дополнительный объём, необходимый для копий и каталога.
Примеры
Покажи 10 разных примеров в формате:
файл → название → тема → теги → уверенность
Старайся выбрать разные типы контента.
ПОКАЖИ БУДУЩУЮ СТРУКТУРУ
До создания файлов покажи структуру примерно такого типа:
RESULT/
index.html
organized/
ИИ и технологии/
Работа/
Идеи и вдохновение/
Дизайн и референсы/
Места и путешествия/
Покупки/
На проверку/
data/
assets/
Это только пример.
Используй реальные темы, найденные при анализе моего архива.
Также точно перечисли, какие служебные файлы собираешься создать и зачем.
ПОСЛЕ ЭТОГО ОСТАНОВИСЬ
Не создавай ничего.
Не начинай ЭТАП 2.
Дождись моего явного сообщения о том, что предложенная структура одобрена и можно продолжать.
ЭТАП 2 - СОЗДАНИЕ БАЗЫ
После моего разрешения создай библиотеку.
Используй папку:
RESULT
В organized/ должны находиться только копии исходных изображений.
Оригиналы остаются на месте.
ЛОКАЛЬНЫЙ КАТАЛОГ
Создай главную страницу:
index.html
Каталог должен работать обычным двойным кликом по этому файлу.
Он не должен требовать:
- интернета;
- локального сервера;
- установки программ;
- запуска команд в терминале.
Используй только относительные пути.
НИКАКИХ ВНЕШНИХ ЗАВИСИМОСТЕЙ
Не подключай:
- CDN;
- Google Fonts;
- внешние JavaScript-библиотеки;
- внешние CSS-фреймворки;
- облачную аналитику;
- API;
- удалённые изображения;
- интернет-сервисы.
Всё необходимое для работы каталога должно находиться внутри RESULT.
ИНТЕРФЕЙС
Интерфейс полностью на русском языке.
Визуальный стиль:
- современный;
- минималистичный;
- светлый;
- спокойный;
- много свободного пространства;
- синие акценты;
- жёлтый только для небольших смысловых выделений.
Не перегружай карточки информацией.
ГЛАВНАЯ СТРАНИЦА
Сверху размести общий поиск.
Покажи сводку:
Всего
Темы
Серии
Личное
На проверку
Ниже покажи основные темы с количеством материалов.
ПОИСК
Создай локальный полнотекстовый поиск.
Он должен искать одновременно по:
- названию;
- описанию;
- тегам;
- распознанному тексту.
Поиск должен работать прямо из index.html без интернета и сервера.
УМНЫЙ ПОИСК ПО НЕСКОЛЬКИМ СЛОВАМ
Если пользователь вводит:
Claude промпты
результат должен учитывать оба слова.
Если вводит:
Москва завтрак
должны находиться материалы, где эти понятия встречаются в метаданных, тегах или распознанном тексте.
ФИЛЬТРЫ
Добавь фильтрацию:
- по основной теме;
- по тегам;
- по личным материалам;
- по материалам «На проверку»;
- по сериям;
- по уровню уверенности.
КАРТОЧКИ
Для обычного изображения карточка может содержать:
- превью;
- название;
- основную тему;
- несколько наиболее важных тегов.
Не показывай на карточке длинные OCR-тексты.
ПРОСМОТР
При открытии файла:
- показывай изображение полностью;
- не обрезай его;
- вписывай изображение в доступную область окна;
- разрешай увеличить;
- разрешай вернуться к исходному масштабу.
Покажи:
- название;
- исходное имя файла;
- тему;
- описание;
- теги;
- принадлежность к серии.
СЕРИИ В КАТАЛОГЕ
Если изображение входит в серию:
покажи рядом остальные изображения этой серии.
Должна быть возможность последовательно переходить:
предыдущее → текущее → следующее
ПАКЕТНАЯ ОБРАБОТКА БОЛЬШОГО АРХИВА
Если файлов много и их невозможно надёжно обработать за один проход, работай пакетами.
Не снижайте качество анализа ради скорости.
Для большого архива:
1. раздели обработку на разумные пакеты;
2. веди единый реестр уже обработанных файлов;
3. не обрабатывай один файл повторно без причины;
4. сохраняй единые правила категорий и тегов между пакетами;
5. перед созданием новой темы проверяй, нельзя ли использовать существующую;
6. сохраняй прогресс так, чтобы работа могла быть продолжена после прерывания.
МАНИФЕСТ
На ЭТАПЕ 2 создай служебный manifest с информацией обо всех обработанных изображениях.
Manifest должен позволять определить:
- обработан ли файл;
- куда он классифицирован;
- какие у него теги;
- входит ли он в серию;
- какая уверенность классификации;
- требует ли проверки;
- является ли личным;
- где находится его копия.
Используй этот manifest как единый источник данных для каталога и для продолжения обработки после возможного прерывания.
НЕ СОЗДАВАЙ ДУБЛИКАТЫ ПРИ ПОВТОРНОМ ЗАПУСКЕ
Если работа была прервана и затем продолжена:
- сначала прочитай manifest;
- определи уже завершённые файлы;
- продолжай с места остановки;
- не создавай повторные копии;
- не создавай повторные карточки.
Если состояние файлов не соответствует manifest, сначала сообщи о конфликте.
ПРОВЕРКА ЦЕЛОСТНОСТИ ОРИГИНАЛОВ
Перед началом ЭТАПА 2 зафиксируй для каждого исходного файла:
- размер;
- дату изменения;
- SHA-256.
После окончания снова вычисли эти значения.
Сравни их.
Оригинал считается неизменённым, если контрольные данные совпадают.
ФИНАЛЬНЫЙ АУДИТ
После завершения проверь:
1. Каждый найденный исходный файл присутствует в базе ровно один раз.
2. У каждого файла есть организованная копия.
3. Ни один оригинал не изменён.
4. Все пути работают.
5. Все изображения открываются.
6. Нет битых ссылок.
7. Поиск работает без интернета.
8. Поиск находит материалы по OCR-тексту.
9. Поиск находит материалы по тегам.
10. Фильтры работают.
11. Серии отображаются правильно.
12. Части одной серии не разбросаны случайно по разным темам.
13. Нет необъяснимых дублей.
14. Все файлы с низкой уверенностью находятся в «На проверку».
15. Личные карточки не раскрывают чувствительные данные.
16. Изображения при просмотре не обрезаются.
ФИНАЛЬНЫЙ ОТЧЁТ
После полной проверки сообщи:
- сколько исходных изображений найдено;
- сколько обработано;
- сколько копий создано;
- сколько основных тем получилось;
- список тем и количество материалов в каждой;
- сколько уникальных тегов используется;
- сколько серий найдено;
- сколько изображений входят в серии;
- сколько файлов отмечено как личные;
- сколько требуют ручной проверки;
- сколько места занимает RESULT;
- совпали ли SHA-256 оригиналов;
- есть ли ошибки;
- есть ли материалы, которые мне желательно проверить вручную.
КЛЮЧЕВЫЕ ПРАВИЛА ПРИНЯТИЯ РЕШЕНИЙ
Приоритеты в таком порядке:
1. Не повредить оригиналы.
2. Не потерять ни один файл.
3. Правильно понять смысл изображения.
4. Сделать материал легко находимым.
5. Сохранить связанные изображения вместе.
6. Не плодить лишние категории.
7. Не придумывать информацию, которой нет на изображении.
8. Спорный случай отправить на ручную проверку.
Если автоматическая классификация конфликтует с этими принципами, выбирай более безопасный вариант.