ktransformers

mirror of https://github.com/kvcache-ai/ktransformers.git synced 2026-04-19 22:09:10 +00:00

Author	SHA1	Message	Date
mrhaoxx	503295fc88	[feat](kt-kernel): refactor convert_cpu_weights.py to support conversation for GLM-4.6V (#1687 ) Signed-off-by: mrhaoxx <mr.haoxx@gmail.com>	2025-12-09 14:24:41 +08:00
Jianwei Dong	fd78fe520a	fix(scripts): resolve OOM when converting gpu weights and update README (#1640 )	2025-12-01 14:15:14 +08:00
mrhaoxx	637c49c83f	[feat](kt-kernel): support qwen3-vl weights convert (#1648 )	2025-11-27 22:29:09 +08:00
ZiWei Yuan	1374b98ee5	[feat](moe_kernel): add amd blis support (int8) (#1600 ) * [feat]: init amd adaption * [feat]: add blis support * [fix]: fix setup and moe kernel warpper * [fix](setup.py): support rebuild with cache and import kt_kernel works fine * [feat]: add moe_kernel converter for amd and implement the load method(haven't tested yet) * [feat](moe_kernel/moe.hpp): delete unused memory when using save * [fix](moe_kernel): update PLAIN for pack * [fix](moe_kernel): rm printf debug * [fix](moe_kernel): skip gpu experts * [fix](moe_kernel/moe.hpp): update include memory path * [feat](moe_kernel/moe.hpp): support expert deferral * [feat]: finish amd --------- Co-authored-by: mrhaoxx <mr.haoxx@gmail.com>	2025-11-27 12:08:53 +08:00
Jianwei Dong	51745a9ea1	add ci (#1642 )	2025-11-25 20:52:08 +08:00
DocShotgun	e72a4fb880	[feat](kt-kernel): Add resume arg to CPU weight conversion (#1630 ) * [feat]: kt-kernel: Add resume arg to CPU weight conversion * [docs]: kt-kernel: Document resume arg for CPU weight conversion * [fix]: kt-kernel: Only print resume layer if in use * [fix]: kt-kernel: Don't log skipped layers when using resume_layer	2025-11-22 12:00:15 +08:00
ZiWei Yuan	aef6672dd8	[docs]: add contribuing guide and add hooks install (#1613 ) * [feat]: update kt-kernel hooks and add contribution guide * [docs]: add contributing guide * [style]: format the python file and cpp file in kt-kernel	2025-11-15 18:26:49 +08:00
Jiaqi Liao	13b8ddecd9	AMXMoEWrapper -> KTMoEWrapper (#1604 ) fix import KTMoEWrapper	2025-11-12 16:34:54 +08:00
Oql	34c71ba8bf	Merge pull request #1568 from kvcache-ai/add_bf16_scripts add convert_moe_to_bf16.py	2025-11-07 17:55:38 +08:00
ouqingliang	a18f007d45	add convert_moe_to_bf16.py	2025-11-07 09:53:19 +00:00
Peilin Li	d939e56646	add the convert from fp8 to bf16 for Kimi-K2 model	2025-11-06 17:20:28 +08:00
ovowei	f854d03bd7	update kt-kernel	2025-11-03 15:19:52 +08:00
ovowei	28d8663374	fix	2025-10-22 18:14:34 +08:00
Atream	4c5fcf9774	add kt-kernel	2025-10-12 05:13:00 +00:00

14 Commits