中文 embedding 选型实测:五个把我带偏的坑
给聊天机器人配长期记忆时做的 embedding 选型。小样本、简单测试集、错误的性能指标、虚标的上下文、参数量迷信,每一个都足以得出相反的结论。附 OpenRouter 上 29 个商业 embedding 模型的同测试集补测。
3673 字
|
18 分钟
模型在句尾偷偷吐垃圾:一次 LLM 输出污染的排查
2026-07-31
给聊天机器人调人设时,发现回复末尾偶尔粘上色情站关键词和古吉拉特语字符。排查过程、证伪 max_tokens 假设,以及接入新模型前该跑的检测。
1811 字
|
9 分钟
Rust Pin/Unpin 与 Move trait 争议
Rust Pin/Unpin 与 Move trait 争议:从 Place 的状态变化理解不可移动性,梳理 Move trait 与 pinned places 的设计取舍。
1583 字
|
8 分钟
XDNA 空间数据流 LLM Decode
AMD XDNA NPU 将 LLM decode 组织成静态空间数据流机器,用全层融合、片上流转和 DMA/compute 双缓冲缓解 batch=1 decode 的带宽与调度瓶颈。
1709 字
|
9 分钟
非神经学习(Non-neuronal Learning)
非神经学习:没有神经系统的生物通过内部状态、化学反应网络和历史依赖调节未来行为,为 AI Agent 的多时间尺度状态记忆提供生物类比。
1118 字
|
6 分钟
Multi-Timescale Adaptation and Emergent Learning in Single Bacterial Cells
单个 E. coli 在波动营养环境中表现出多时间尺度、幂律记忆和跨代继承的学习式适应,细胞反应网络可类比 RNN。
1555 字
|
8 分钟
Flow Matching 与语言生成
将图像扩散模型的连续空间优势带回语言建模:Flow Matching 在嵌入空间做去噪,最后一步才离散化。
642 字
|
3 分钟
ELF: Embedded Language Flows
ELF 在连续嵌入空间中做 Flow Matching,仅最后一步离散化;实验中以约十分之一的训练 token 超过所比较的 DLM。
1099 字
|
5 分钟