Technology
技术探索
记录我在 AI 创作方向的技术实验:从模型微调到多 Agent 编排,从开源基座到从零预训练。
诗人风格模型(QLoRA / KTO)
基于 Qwen2.5-3B / Qwen3.8-27B 微调李白、海子、顾城风格模型:QLoRA 4-bit 单卡 8GB 可训练,KTO 偏好优化对齐「更像人写的诗」。
MiniMind 从零预训练
以余华 13 册全集、顾城诗集为语料,用 MiniMind(104M)从零预训练小说与诗歌生成模型,公开 AR / dLM / Linear 三架构对比评测。
多 Agent 集群编排
叙事生成器的 9 个 Agent(元素解析 ×5 + 剪辑统筹 + 阅读者审阅 + 叙事语法校验)黑板模式协作,产出可审计的长文本。
诗歌判别器
poetry-judge 系列:基于 5000 条 Hard 难样本(ChineseHardJudgePoem)训练,判断一段文本是不是诗歌——它判断的是「像不像一首诗」,而不是「是不是人写的」,人写的作品也有可能被判为非诗歌。
哲学大模型
为创作注入思辨与哲学视角,探索输出有思想厚度的内核与命题。目前以介绍与实验为主,逐步推进。
BYOK 灵活接入
叙事生成器支持 Bring Your Own Key:填入自己的 API Key 与模型名即可使用,模型下拉只显示已配置的 provider。
研究:中文诗歌「诗歌性」自动评测指标
HumanAlignedPoeticity:用 AI4S 多智能体 Harness 自动化探索中文诗歌「诗性」的可计算边界——13 族 64 维特征、 exhaustive 穷举 8192 个特征组合,构建与人类判断高度一致(v4c 通过 0.95 阈值)的自动评测指标; 并量化指标在 AI 高相似度仿诗下的失效边界(AI 仿诗假阳性归零)。
AI4S Harness特征组合搜索Kappa 一致性v4b / v4c
查看研究仓库 我发布过的模型(Hugging Face)
诗人风格、MiniMind 从零训练、判别器与数据集,全部托管在 Hugging Face。
Qwen2.5-3B-LiBaiQwen2.5-3B-HaiziQwen2.5-3B-Haizi-CNQwen2.5-3B-GuChengQwen2.5-3B-PoetryGenQwen3.8-27B-LiBaiQwen3.8-27B-HaiziQwen3.8-27B-GuChengQwen3.8-27B-LiBai-KTOQwen3.8-27B-Haizi-KTOQwen3.8-27B-GuCheng-KTOQwen2.5-3B-YuHua-V4MiniMind-YuHua-AR-v2MiniMind-YuHua-dLM-v2MiniMind-YuHua-Linear-v2MiniMind-GuCheng-ARMiniMind-GuCheng-dLMMiniMind-GuCheng-Linearpoetry-judge-qwen2.5-1.5b-cnpoetry-judge-qwen2.5-1.5b-cn-neutral
浏览全部模型