-
Notifications
You must be signed in to change notification settings - Fork 2.4k
All issues
Issue creation is restricted in this repository
- #19 · ZacharyZcR opened
on Jul 10, 2026 20 - #537 · ZacharyZcR opened
on Jul 22, 2026 15
Issues
is:issue state:open
is:issue state:open
Search results
[Bug]: 我下载最新的windows release 1.4.0和glm5.2 g64模型测试,怎么推理能力为0啊?
bugDifetto verificato nel codiceDifetto verificato nel codicequalityQualità del modello / quantizzazioneQualità del modello / quantizzazionequestionFurther information is requestedFurther information is requestedStatus: Open.#814 In JustVugg/colibri;[Bug]: Metal announces "batched routed experts on GPU" and dispatches nothing — expert su GPU 0 in every configuration
bugDifetto verificato nel codiceDifetto verificato nel codicemetalBackend Metal/AppleBackend Metal/AppleperformanceVelocità / tok-s / ottimizzazioniVelocità / tok-s / ottimizzazioniStatus: Open.#813 In JustVugg/colibri;The learned partial mirror is GLM-only, and Kimi K3 is the model that needs it most
enhancementNew feature or requestNew feature or requestmodel-supportSupporto a nuovi modelliSupporto a nuovi modelliperformanceVelocità / tok-s / ottimizzazioniVelocità / tok-s / ottimizzazioniStatus: Open.#812 In JustVugg/colibri;CACHE_ROUTE is worth +33% at 99.1% routing agreement, and nothing in the docs suggests trying it
docsDocumentazioneDocumentazioneperformanceVelocità / tok-s / ottimizzazioniVelocità / tok-s / ottimizzazioniStatus: Open.#811 In JustVugg/colibri;[Bug]: the engine exits 1 on SIGTERM, so every clean systemctl stop leaves the unit failed
bugDifetto verificato nel codiceDifetto verificato nel codiceStatus: Open.#810 In JustVugg/colibri;[Bug]: reasoning_effort is inverted below "high" — minimal/low/medium all render "Reasoning Effort: Max"
bugDifetto verificato nel codiceDifetto verificato nel codicequalityQualità del modello / quantizzazioneQualità del modello / quantizzazioneStatus: Open.#809 In JustVugg/colibri;Intel Optane Storage on PMEM 100 or PMEM 200
discussionProposta / discussione aperta, non un taskProposta / discussione aperta, non un taskhardware-owner-neededServe verifica su silicio specificoServe verifica su silicio specificoperformanceVelocità / tok-s / ottimizzazioniVelocità / tok-s / ottimizzazioniStatus: Open.#797 In JustVugg/colibri;[Bug]: Nvidia GPU's not working with Kimi K3
cudaBackend CUDA/NVIDIABackend CUDA/NVIDIAhelp wantedExtra attention is neededExtra attention is neededStatus: Open.#783 In JustVugg/colibri;KV cache is stored in fp32 and kvb_all materialises the decompressed K/V (x3.2 vs llama.cpp)
enhancementNew feature or requestNew feature or requestperformanceVelocità / tok-s / ottimizzazioniVelocità / tok-s / ottimizzazioniqualityQualità del modello / quantizzazioneQualità del modello / quantizzazioneStatus: Open.#768 In JustVugg/colibri;CUDA_EXPERT_GB=auto leaves no prefill scratch; a real prompt permanently disables a device
bugDifetto verificato nel codiceDifetto verificato nel codicecudaBackend CUDA/NVIDIABackend CUDA/NVIDIAStatus: Open.#767 In JustVugg/colibri;The cap computed by --auto-tier drives the process into the OOM killer
bugDifetto verificato nel codiceDifetto verificato nel codicecudaBackend CUDA/NVIDIABackend CUDA/NVIDIAperformanceVelocità / tok-s / ottimizzazioniVelocità / tok-s / ottimizzazioniStatus: Open.#766 In JustVugg/colibri;[Bug]: RAM_GB is not clamped to the #653-corrected MemAvailable on unified memory; CAP_RAISE then inflates against it and the run is OOM-killed mid-prefill
bugDifetto verificato nel codiceDifetto verificato nel codicecudaBackend CUDA/NVIDIABackend CUDA/NVIDIAhardware-owner-neededServe verifica su silicio specificoServe verifica su silicio specificoStatus: Open.#759 In JustVugg/colibri;