Метод фильтрации данных

Модератор: Модераторы разделов

sovereign
Сообщения: 39
ОС: Suse Linux

Метод фильтрации данных

Сообщение sovereign »

Привет всем

Надо по набору правил фильтровать данные.
Данные бинарныйе 32 розряда.
Данных очень много,потому очень важна не только скорость ,но и отсутствия коллизий.
Данные читаю с файла.
Сейчас остановился на двох вариантах:
1.Хеш функции
2.Фильтр Блума
Кто что посоветует?

Наперед всем спасибо.
Спасибо сказали:
Аватара пользователя
RasenHerz
Сообщения: 1341
ОС: Arch Linux amd64

Re: Метод фильтрации данных

Сообщение RasenHerz »

Я обычно использую хеши
Спасибо сказали:
sovereign
Сообщения: 39
ОС: Suse Linux

Re: Метод фильтрации данных

Сообщение sovereign »

У меня данные-ethernet пакеты у бинарном представлении.
Одна разновидность фильтра блюма как раз создана для фильтрации пакетов.
Но пока немогу его реализировать.
Спасибо сказали:
NickLion
Сообщения: 3408
Статус: аватар-невидимка
ОС: openSUSE Tumbleweed x86_64

Re: Метод фильтрации данных

Сообщение NickLion »

sovereign писал(а):
11.11.2009 19:00
...
Данных очень много,потому очень важна не только скорость ,но и отсутствия коллизий.
...
2.Фильтр Блума

Хм... положительный ответ на несуществующий элемент - это нормально? Вписывается в правило отсутствия коллизий? Если нет, то фильтр просто отвергается. А еще нет возможности удалить элемент. Только добавить. Правда это, наверное, не важно в данном случае.
Но этот фильтр может быть полезен для быстрой первичной фильтрации, да.
Спасибо сказали: