v0.1.0:
    date:2026-09-02
    changes:
      - 初始化版本
        1、提供 py3model 命令行工具，安装后执行 `py3model` 即可启动本地 GGUF 模型服务
        2、内置 tkinter 可视化界面，支持选择 GGUF 文件、配置推理参数（基础 + 高级，分组折叠展示）、查看服务状态、复制 base_url、内置多轮测试对话（支持流式输出）
        3、内置基于标准库 http.server 的 ThreadingHTTPServer，提供 OpenAI 兼容的 HTTP 接口：
          - POST /v1/chat/completions（支持流式 SSE 与非流式）
          - POST /v1/completions
          - GET  /v1/models
          - GET  /health
          - POST /v1/internal/load
          - POST /v1/internal/unload
        4、封装 llama_cpp.Llama 为单例加载/卸载（load_model / unload_model），维护 LLAMA_PARAMS 参数元数据（含默认值、类型、悬浮提示说明）
        5、推理层使用 ChatML 模板拼接 messages，并提供 stream_chat / non_stream_chat / stream_complete / non_stream_complete
        6、支持 ~/.py3model/config.json 持久化配置（模型路径、推理参数、host、port 等），原子写入并向前兼容
        7、跨平台支持（Windows / macOS / Linux），含 HiDPI 自适应与窗口最大化处理；支持 --host、--port、--no-gui 命令行参数
