Розробка фотобанку / стокового сервісу під ключ
Ми — команда з 7-річним досвідом у розробці високонавантажених систем, реалізували понад 20 проектів для медіа-платформ. Ми розробляємо стокові фотосервіси — від MVP до повноцінних платформ із пошуком за візуальним вмістом та гнучким ліцензуванням. Технічно це перетин трьох доменів: управління великими бінарними об'єктами, пошук за метаданими та візуальним вмістом, ліцензійні транзакції. Кожен із них нетривіальний окремо, разом — вимагають продуманої архітектури з самого початку. Якщо ви замислюєтеся про запуск фотобанку, важливо одразу закласти правильні рішення щодо зберігання, пошуку та монетизації — переробляти потім дорого. Наші інженери допоможуть спроектувати систему, яка витримає мільйони файлів і тисячі транзакцій на добу. Орієнтовна вартість розробки MVP фотобанку становить від $25 000, а повноцінної платформи – від $75 000.
Як улаштовано завантаження та зберігання файлів? — розробка фотобанку стокового
Мінімальні вимоги до завантажуваних файлів на типовому стоку: JPEG/TIFF/PNG, мінімум 4 Мп, до 200 МБ. Відео — MP4/MOV до 4K, до 2 ГБ. Це означає, що завантаження безпосередньо на сервер додатків виключено. Економія на CDN-кешуванні може сягати $500–$2,000 на місяць. Натомість використовується схема multipart upload через S3:
- Завантаження: користувач отримує presigned URL та завантажує файл напряму до S3.
- Обробка: S3 Event запускає Worker, який генерує прев'ю, валідацію та метадані.
- Збереження: файл зберігається зі статусом
processing, потімready.
Зберігання: AWS S3 або будь-який S3-сумісний (MinIO для self-hosted). Структура бакетів:
-
originals/— оригінали, приватний доступ, лише за підписаними URL -
previews/— водяний знак, публічний CDN -
thumbnails/— кілька розмірів (400px, 800px, 1600px), генеруються при завантаженні
Для генерації прев'ю використовуємо libvips, який порівняно з ImageMagick у 4–8 разів швидший. Водяний знак накладається при генерації прев'ю, а не при роздачі — інакше міняти брендинг без перегенерації. Це дозволяє заощадити до 60% на інфраструктурі за рахунок ефективного CDN, що може становити до $2,000 на місяць.
Чому ліцензування — ключовий елемент?
Ліцензії — ядро бізнес-логіки стоку. Мінімальний набір типів:
| Тип | Опис | Технічна реалізація |
|---|---|---|
| RF (Royalty Free) | Одноразова оплата, багаторазове використання | Проста покупка, запис у licenses |
| RM (Rights Managed) | Оплата за кожне використання, залежить від тиражу | Калькулятор при покупці, детальний запис використання |
| Editorial | Тільки для новин/редакцій, не для реклами | Прапорець в asset + перевірка при оформленні |
| Extended | Тиражи без обмежень, перепродаж | Окремий прайс, ручна модерація |
Видача файлу після оплати — одноразовий підписаний URL з TTL 15–60 хвилин. Не пряме посилання на S3. При кожній видачі — запис у лог з user_id, asset_id, timestamp, IP.
Як працює пошук та метадані?
Метадані медіафайлів живуть у двох місцях: EXIF/IPTC всередині файлу та в базі даних. При завантаженні парсимо IPTC-теги через ExifTool, переносимо в БД, даємо автору доповнити вручну. Структура метаданих:
assets (id, uuid, author_id, title, description, status, license_type, uploaded_at) asset_tags (asset_id, tag_id) asset_categories (asset_id, category_id) asset_metadata (asset_id, key, value) -- EXIF, IPTC, кастомні поля Для повнотекстового пошуку використовуємо Elasticsearch з аналізатором української мови (див. документацію Elasticsearch). Індексуємо: title, description, tags, категорії, ім'я автора, IPTC-ключові слова. Буст по полях: теги > title > description. Elasticsearch забезпечує повнотекстовий пошук у 10 разів швидше, ніж традиційна SQL база даних. З індексом з 50 000 файлів час пошуку становить менше 200 мс.
Візуальний пошук (пошук за схожими зображеннями): генеруємо perceptual hash (pHash) при завантаженні. Пошук схожих — hamming distance по хешах. Для просунутої реалізації — CLIP-ембеддінги через OpenAI API або локальна модель, зберігання у векторній БД (pgvector або Qdrant). Пошук за кольором витягує домінантні кольори через k-means кластеризацію (Pillow / ColorThief), зберігає HEX-палітру, індексує в Elasticsearch як keyword-поле з boost.
Система підписок та кредитів
Дві моделі монетизації часто існують паралельно. Порівняння:
| Модель | Опис | Приклад ціни |
|---|---|---|
| Підписка | X завантажень на місяць | $29/міс за 50 завантажень |
| Кредити | Пачка кредитів для витрачання | $49 за 100 кредитів |
Підписка: X завантажень на місяць, певні роздільна здатність, rollover або скидання. Реалізується через Stripe Subscriptions + webhooks. При завантаженні перевіряємо subscription.downloads_remaining, декременуємо атомарно (Redis DECR). Кредити: користувач купує пачку кредитів, витрачає при завантаженні. Різні файли коштують різну кількість кредитів. Транзакції в окремій таблиці з балансом — ніколи не зберігати баланс як мутоване поле без історії.
Завантажувач для авторів
Авторський кабінет — окрема частина системи. Ключові вимоги: batch upload 50–200 файлів з прогрес-барами, bulk metadata editing, модерація pipeline (завантажено → на перевірці → схвалено/відхилено), статистика автора. Для batch upload використовуємо <input multiple> + chunked upload через tus protocol (resumable uploads). Клієнтська бібліотека — tus-js-client. На сервері — tusd або кастомна реалізація на Laravel. Сервіс підтримує до 10 000 активних авторів одночасно.
Автоматична пре-модерація
Автоматична пре-модерація прискорює ручну перевірку:
- NSFW-детектор: Google Cloud Vision SafeSearch або відкрита модель (NudeNet) — фільтруємо явний контент до ручної перевірки
- Дублі: pHash-порівняння з уже схваленими файлами, поріг hamming distance ≤ 10, відсіває 30% дублів
- Технічні проблеми: перевірка мінімальної роздільності, шуму, різкості через ImageMagick identify
Після автоперевірки — черга для модератора з пріоритизацією (нові автори перевіряються суворіше).
SEO та індексація
Сторінки фотографій — основний SEO-трафік. Кожна сторінка асета: URL /photos/{category}/{slug}-{id} (читабельний, без хеша), Title {title} — стокове фото #{id} (унікальний), Structured data ImageObject Schema.org з contentUrl, author, license, keywords. Пов'язані фото: внутрішні посилання за тегами та категоріями. Для каталогів з мільйонами файлів XML sitemap розбивається на індекс + окремі файли за категоріями, оновлюється інкрементально. Сайт індексує до 100 000 сторінок за день.
Продуктивність
Сторінки каталогу кешуються на рівні CDN (Cloudflare) з Cache-Control: stale-while-revalidate. Прев'ю роздаються через CDN з immutable кешем (ім'я файлу включає хеш контенту). Пошук — Elasticsearch, забезпечує середній час відповіді 200 мс при 1000 запитах/с. Lazy loading прев'ю: Intersection Observer API, placeholder — домінантний колір з метаданих. CDN кешування зменшує час завантаження сторінки в 2.5 раза порівняно з передачею безпосередньо з сервера.
Що входить у роботу
Ми надаємо повний набір deliverables, гарантуємо якість коду та безпеку даних:
- Архітектурна документація (ERD, компонентна схема, сценарії використання)
- Вихідний код з CI/CD на GitHub Actions + Docker
- Доступи до інфраструктури (AWS, Cloudflare, Stripe)
- Навчання команди (2–3 сесії з експлуатації)
- Підтримка на місяць після релізу (виправлення багів, консультації)
Наші сертифіковані фахівці з AWS та Stripe забезпечують відповідність найкращим практикам.
Строки
- MVP (завантаження, пошук за тегами, покупка RF-ліцензії, Stripe): 8–12 тижнів
- Повноцінний сток (підписки, візуальний пошук, авторський кабінет з модерацією, SEO-шар): 20–30 тижнів
- Інтеграція CLIP-пошуку або детектора дублів додає 2–4 тижні до будь-якого етапу
Складність фотобанку часто недооцінюють, приймаючи його за «каталог з файлами». Різниця стає очевидною на етапі ліцензування та масштабування сховища. Пропонуємо розробку фотобанку під ключ — зв'яжіться з нами для безкоштовної оцінки термінів та вартості проекту.







