Latest updates for Индексирование Данных

Fresh curated links around индексирование данных are collected here so marketers can spot useful updates and turn timely ideas into posts faster.

Recent items include:

  • Индексируем диапазоны с помощью битовых масок, чтобы k8s не ломал индекс
  • Индекс как алфавитный указатель: как база ищет и почему иногда не находит
  • Как я улучшил векторный поиск в YDB

Post angles to try

Share the most useful takeaway for your audience.
Turn one article into a quick practical checklist.
Ask your audience how this shift affects their work.
Turn angles into scheduled posts

Fresh articles and ideas

Recent curated links from global sources. Generate one free draft from any story, then use SocialBu to schedule and refine your content calendar.

habr.com /1 month ago

Индексируем диапазоны с помощью битовых масок, чтобы k8s не ломал индекс

Привет, это Антон Пионтковский из команды Monium Metrics, и вместе с коллегами мы создаём observability‑платформу для сбора, хранения и анализа телеметрии Yandex Monium. Мы храним...

Read source
habr.com /1 week ago

Индекс как алфавитный указатель: как база ищет и почему иногда не находит

В первой статье я объяснял кэш через холодильник. Продолжу тем же способом. Сейчас будет про индексы, а потом про то, почему индекс есть, а база его игнорирует.Статья для тех, кто...

Read source
habr.com /3 weeks ago

Как я улучшил векторный поиск в YDB

В распределённой СУБД YDB (читается вай‑ди‑би) векторный поиск по kmeans‑tree индексу раскрывался оптимизатором в цепочку из нескольких стадий StreamLookup. Это работало, но порожд...

Read source
habr.com /1 month ago

Как быстро загнать страницу в индекс Яндекса — и почему для Алисы AI этого мало

Новую страницу в поиске Яндекса не видно, пока её не обошёл робот. Пока страницы нет в индексе (базе поиска), её не будет ни в обычной выдаче, ни в ответе Алисы AI. Алиса опирается...

Read source
habr.com /1 month ago

Вслед за Эдвардом Сьоре, или как я писал свою реализацию on disk B+Tree-индекса на Rust

Вслед за Эдвардом Сьоре, или как я писал свою реализацию on disk B+Tree-индекса на Rust. В этой статье попытаюсь осветить нюансы написание своего игрушечного индекса. Читать далее

Read source
habr.com /18 hours ago

А чё, так можно было? +1 ключ = ×12 к скорости

В словарь добавляют 101 ключ — поиск занимает 8 763 наносекунды. Добавляют 102-й — 718.Ключей стало больше, а времени в 12 раз меньше. Разбираемся, что происходит на 102-й вставке....

Read source
habr.com /3 weeks ago

Wazuh без ограничений дашборда: работаем напрямую с индексами

На связи Андрей, руководитель направления безопасности облака в Selectel. В статье расскажу, как работать с индексами Wazuh напрямую через OpenSearch. Такой подход пригодится, когд...

Read source
habr.com /1 day ago

Как ускорить выборку из больших таблиц PostgreSQL без ручного создания индексов: разбираем iHeap

Что, если индекс не нужно создавать вообще? Знакомимся с iHeap — альтернативным методом доступа к таблицам PostgreSQL, где BRIN-индексирование встроено «из коробки» и работает авто...

Read source
habr.com /1 month ago

Персонализация без Big Data: как мы ранжируем новости в Telegram с помощью pgvector и пяти сигналов

У меня накопилось 23 Telegram-канала.Не потому что я специально их коллекционировал. Просто со временем подписывался на новые. В какой-то момент понял, что читаю всего несколько пр...

Read source
habr.com /1 month ago

Бенчмаркая поиск по строке: самописные циклы проигрывают от ×14 до ×154

Уважаемые читатели, в этой статье я хочу рассказать про поиск по строке и представить свои выводы. Началось с оптимизации: сравнил поиск символа циклом со string.IndexOf — и получи...

Read source
habr.com /1 week ago

515 страниц, которых не было в поиске. Мы сами их закрыли и два месяца не замечали

Справочник на 119 тысяч товаров, из которых поиск видел 39 страниц. Разбираемся, как одно условие в шаблоне заперло полтысячи адресов и что дал белый список карты сайта. Читать дал...

Read source
runet.news /3 weeks ago

Программист за выходные создал собственный интернет-поисковик, потратив $10

Британский программист за выходные создал простой поисковый каталог интернет-ресурсов на полмиллиона страниц на интересующую его тематику. Работающей локально системе с веб-интерфе...

Read source
habr.com /1 week ago

redb 3.7.1: поиск по props быстрее до 100 раз. Альтернатива EF Core или дополнение к нему

Цена запроса не зависела от того, что ищешь: фильтр стоял над GROUP BY. Теперь отсечение идёт до агрегата, на трёх движках, без единой правки в коде приложения. До 100 раз на диапа...

Read source
habr.com /1 month ago

MinIO, MongoDB, PostgreSQL для хранения 25 лет истории стоимости акций

💾 MinIO, MongoDB, PostgreSQL для хранения 25 лет истории стоимости акцийКогда строишь эмулятор для проверки торговой стратегии 20 акций на 25 лет исторических данных поминутно, вы...

Read source
habr.com /1 month ago

Вчера в отчёте было 12 480, сегодня 12 517: пять причин, по которым цифры за прошлый месяц продолжают меняться

Цифры за закрытый месяц внезапно меняются, а поиск причины превращается в разбор всего пайплайна — от загрузки событий до логики витрин.В статье разбираем пять типовых сценариев, и...

Read source
runet.news /1 month ago

Российские бигтех-компании обновили стандарты защиты данных

Ассоциация больших данных (АБД), в которую входят «Авито», «Сбер», «Ростелеком», «Яндекс», HH и VK, разработала новый отраслевой стандарт защиты данных. Об этом сообщает «Коммерсан...

Read source
habr.com /4 weeks ago

Как я индексировал экосистему MCP: 9 источников, 80 000 серверов и куча нюансов

Полтора года назад MCP-серверов были десятки, сейчас десятки тысяч. Найти нужный стало отдельной задачей: официальный реестр хранит голые метаданные, awesome-списки устаревают за н...

Read source
computerra.ru /1 month ago

Рейтинг российских ETL-систем 2026

Источник: Компьютерра - Журнал о науке и технологиях Аналитический отдел «Компьютерры» изучил российский рынок ETL-систем и составил рейтинг лучших решений на 2026 год. ETL-систем...

Read source
habr.com /1 month ago

Как я склеиваю 23 тысячи событий из пяти афиш — и почему дедуп нельзя делать необратимым

Зашёл тут на карту и вижу странную картину. На Чистых прудах висят три пина ровно друг на друге. Тыкаю, а там один и тот же «Вишнёвый сад» в Ленкоме. Совпадает всё, вплоть до време...

Read source
habr.com /2 weeks ago

3000 точек на карте грузились полсекунды. Ускорял не там, где думал

Эндпоинт отдавался за 380–510 мс и 811 КБ. Я думал, что причина одна – тяжёлый запрос. Разобрался: причин было три, и они лежали одна под другой. Пока не убираешь верхнюю, следующу...

Read source
habr.com /4 weeks ago

От 12 часов к 30 минутам: как мы join’им миллиарды товарных движений в ClickHouse

Всем привет! Меня зовут Муса. Наша команда занимается витринами данных по товарному учёту. Каждый день мы доставляем около 10 млрд записей в разных форматах. На этих данных строитс...

Read source
habr.com /1 month ago

Предсказывают ли ценовые ожидания бизнеса инфляцию? Проверил на данных за 24 года

Каждый месяц Банк России спрашивает компании, собираются ли они повышать отпускные цены в ближайшие три месяца.И как идея - эти данные можно использовать как почти готовый прогноз...

Read source
habr.com /1 month ago

Бенчмаркая FrozenDictionary: заменил Dictionary — получил от ×0,76 до ×1,9

FrozenDictionary сделан под словари, которые заполняют один раз при старте, а дальше только читают. Замерил на четырёх машинах и трёх рантаймах — разброс вышел от ×0,76 до ×1,9, и...

Read source
runet.news /3 weeks ago

DeepSeek введет «часы пик» для API: отдельные тарифы вырастут более чем в 12 раз

Read source

Turn fresh research into a full content calendar

Use SocialBu to discover ideas, generate post drafts, and schedule them across your social channels.

Sources covering Индексирование Данных

habr.com

Recent coverage from public sources
Public source

runet.news

Recent coverage from public sources
Public source

computerra.ru

Recent coverage from public sources
Public source