# 내가 방문한 모든 웹사이트를 자동 저장하는 개인 검색엔진 ‘Hister’ (셀프호스트·AI 연동 가능)

> https://bookfactory.kr/c/news/7990
> 게시판: 뉴스
> 작성자: cli-bot
> 작성일: 2026-06-27T20:01:21.775Z

---

![](https://i.gzn.jp/img/2026/06/27/hister/00.png)

방문했던 웹페이지를 다시 찾으려고 해도, 키워드가 가물가물해서 브라우저 기록이나 검색엔진으로는 원하는 글을 찾기 어려운 경우가 많습니다. 메타 검색엔진 [searx](https://github.com/searx/searx)의 개발자가 새롭게 만든 **‘Hister’**는 Chrome이나 Firefox에서 열어본 웹페이지를 자동으로 내 서버(셀프호스트)에 저장하고, 나만의 검색 인덱스를 구축해주는 무료 오픈소스 검색엔진입니다. 시맨틱 검색과 MCP(Model Context Protocol) 연동도 지원하며, 방문한 페이지뿐만 아니라 로컬 파일까지 함께 검색할 수 있습니다.

[![](https://i.gzn.jp/img/2026/06/27/hister/00_m.png)](https://i.gzn.jp/img/2026/06/27/hister/00.png)

**Hister - Your Own Search Engine**  
[https://hister.org/](https://hister.org/)

[![](https://i.gzn.jp/img/2026/06/27/hister/01_m.png)](https://hister.org/)

**asciimoo/hister: Your own search engine**  
[https://github.com/asciimoo/hister](https://github.com/asciimoo/hister)

### Hister의 사용법과 동작 방식

Hister 서버를 실행하고, Chrome 또는 Firefox용 확장 기능을 설치한 후 평소처럼 웹사이트를 방문하기만 하면, 다음 정보가 자동으로 서버로 전송됩니다.

*   페이지의 전체 URL

*   페이지 제목

*   페이지 전체 내용

*   파비콘

*   방문한 시각 (타임스탬프)

*   전체 HTML 문서

같은 페이지를 다시 방문했을 때 내용이 업데이트되어 있다면 변경된 내용이 서버로 새롭게 전송됩니다.

### 웹 애플리케이션 및 기능

브라우저에서 `http://127.0.0.1:4433`에 접속하면 Hister의 검색 페이지가 나타납니다. 검색창에 단어를 입력하면…

[![](https://i.gzn.jp/img/2026/06/27/hister/12_m.png)](https://i.gzn.jp/img/2026/06/27/hister/12.png)

검색 결과 페이지로 이동하며, 입력 내용에 따라 실시간으로 후보가 좁혀집니다.

[![](https://i.gzn.jp/img/2026/06/27/hister/13_m.png)](https://i.gzn.jp/img/2026/06/27/hister/13.png)

검색창에서는 여러 단어를 포함하는 AND 검색, 제외할 단어 지정, 특정 도메인으로 검색 범위를 한정하는 것도 가능합니다.

[![](https://i.gzn.jp/img/2026/06/27/hister/14_m.png)](https://i.gzn.jp/img/2026/06/27/hister/14.png)

다만 일본어로 제외 설정을 했을 때 정상 작동하는 경우와 불필요하게 너무 많이 제외되는 경우가 있었습니다.

[![](https://i.gzn.jp/img/2026/06/27/hister/15_m.png)](https://i.gzn.jp/img/2026/06/27/hister/15.png)

서버는 수신한 페이지 데이터를 인덱싱하며 검색 시 다음과 같은 기능을 제공합니다.

*   **관련성 순위**: 검색어가 제목에 포함되고 본문에도 여러 번 등장하는 페이지가 검색어가 한 번만 언급된 페이지보다 상위에 표시됩니다.

*   **키워드 별칭(Alias)**: 예를 들어 `go`를 `go`와 `golang`의 별칭으로 설정하면 `go [문자열]`로 검색했을 때 `Golang [문자열]`을 포함한 페이지도 찾을 수 있습니다.

*   **우선 검색 결과**: 특정 검색어로 어떤 페이지를 열었는지 자동으로 학습하여 다음부터는 그 페이지를 우선적으로 표시합니다. 또한 특정 검색어에 대해 항상 상위에 고정할 결과를 수동으로 지정할 수 있습니다.

*   **중복 감지**: 같은 페이지를 여러 번 방문해도 Hister는 중복 항목을 생성하는 대신 기존 항목을 자동으로 업데이트합니다.

### 명령줄 도구

브라우저 기록을 가져오거나 로컬 파일을 수집하려면 명령줄 도구를 사용합니다. 브라우저 기록을 가져오는 명령어는 다음과 같습니다. 과거의 모든 기록을 실제로 접속하여 가져오기 때문에 시간이 다소 걸립니다.

```

# 파일 이름은 다운로드한 시점의 이름으로 바꾸세요.

# 설치된 모든 브라우저를 자동으로 스캔할 경우

hister_0.15.0_windows_amd64.exe import-browser

# 브라우저를 직접 지정할 경우

hister_0.15.0_windows_amd64.exe import chrome "C:\Users\[사용자명]\AppData\Local\Google\Chrome\User Data\Default\History"
```

로컬 파일을 검색하려면 `config.yml`을 생성하세요.

```
hister_0.15.0_windows_amd64.exe create-config "config.yml"
```

생성된 `config.yml`에 폴더 경로와 확장자를 등록하세요.

```

# indexer 부분을 찾아 directories:에 경로와 확장자를 등록

indexer:
    detect_languages: true
    directories: 
      - path: 'C:\Users\[사용자]\Documents'
        filetypes: ['txt', 'md', 'pdf', 'docx']
        excludes: ['*secret*', '*.tmp']
    max_file_size_mb: 1
```

Hister 서버를 실행하면 자동으로 지정된 폴더를 참조하여 데이터를 수집하며, 폴더에 파일이 추가되거나 수정되어도 자동으로 감지하여 추가하거나 업데이트합니다.

```
hister_0.15.0_windows_amd64.exe listen
```

파일 내용으로 검색하면 검색 결과에 파일 목록이 표시됩니다.

[![](https://i.gzn.jp/img/2026/06/27/hister/16_m.png)](https://i.gzn.jp/img/2026/06/27/hister/16.png)

### 시맨틱 검색

[Ollama](https://ollama.com/) 또는 [OpenAI](https://openai.com/ja-JP/) 호환 Embedding API를 사용할 수 있는 환경이라면, `config.yml`에서 `semantic_search`를 활성화하여 사용할 수 있습니다.

```
semantic_search:
    # 활성화

    enable: true
    embedding_endpoint: http://localhost:11434/v1/embeddings
    # 모델 입력

    embedding_model: qwen3-embedding:8b
    api_key: ""
    headers: {}
    # 모델을 변경할 경우 dimensions도 맞춰주세요

    dimensions: 4096
    max_context_length: 4096
    chunk_overlap: 128
    query_prefix: 'query: '
    document_prefix: ""
    similarity_threshold: 0.1
    result_limit: 50
    semantic_weight: 0.4
```

검색하면 입력한 단어와의 유사도가 숫자로 표시됩니다. 일본어의 경우 문자를 분해하여 일부만 일치해도 카운트되는 경향이 있었습니다.

[![](https://i.gzn.jp/img/2026/06/27/hister/17_m.png)](https://i.gzn.jp/img/2026/06/27/hister/17.png)

### MCP 서버

[Claude Code](https://claude.com/ja/product/claude-code) 등 MCP를 지원하는 클라이언트에서 Hister의 인덱스를 검색할 수 있습니다. Claude Code에 MCP로 추가하는 방법은 다음과 같습니다.

```
claude mcp add --transport http hister http://127.0.0.1:4433/mcp --header "Origin: hister://"
```

Claude Code를 실행하고 “hister를 사용해서 GIGAZINE 기사 중 AI 관련 글을 골라줘”라고 입력하면, 인덱싱된 데이터 중 해당하는 기사가 골라졌습니다. 이는 [대규모 언어 모델에 정확성, 지식 업데이트 속도, 답변 투명성 등을 부여하는 ‘RAG’](https://gigazine.net/news/20231226-retrieval-augmented-generation-llm/) 방식으로도 활용할 수 있습니다.

[![](https://i.gzn.jp/img/2026/06/27/hister/18_m.png)](https://i.gzn.jp/img/2026/06/27/hister/18.png)

### 개발자本人的 사용법

개발자本人은 다음과 같은 흐름으로 사용하고 있다고 합니다.

*   Hister를 바로 열 수 있는 단축키 설정

*   우선 Hister에서 검색

*   결과가 부실하면 외부 검색엔진으로 전환

또한 [Skip Rules](https://hister.org/docs/rules)나 별칭 설정, 우선 결과에서 불필요한 항목을 삭제하는 등의 유지보수를 병행하고 있습니다.

### 정리

시맨틱 검색이 일본어에서는 단순한 문자 분해 수준에 머무는 등, 일본어 환경에서는 완벽하다고 할 수는 없지만, **사이트를 방문하기만 하면 로컬에 데이터가 자동 저장된다는 점만으로도 충분히 사용할 가치가 있습니다.**

### Hister 서버 구축 방법

여기서는 Windows 11 기준으로 설명합니다. 저장소의 [릴리즈 페이지](https://github.com/asciimoo/hister/releases)에서 최신 실행 파일을 다운로드합니다.

[![](https://i.gzn.jp/img/2026/06/27/hister/02_m.png)](https://i.gzn.jp/img/2026/06/27/hister/02.png)

명령줄에서 실행해야 하므로, 명령 프롬프트 또는 PowerShell을 실행한 후 `listen` 옵션을 사용하여 서버를 시작합니다. (이하 서버 구축 상세 과정은 원문 이미지 참조)

---
**원문**: [無料でChrome・Firefoxで訪問したウェブサイトを自動的にローカルに保存しインデックス化＆定](https://gigazine.net/news/20260627-hister/)
**출처**: GIGAZINE (2026-06-27)
**번역**: AI 자동 번역+윤문