shikunpunk的小站
  • 动态
  • 读书笔记
  • 诗歌
  • 随笔
  • 灵感
  • 小说
  • 算法
  • 量子计算
  • 网络安全
  • 人工智能
  • 开发
  • 论文
  • CV
  • 杨德昌
  • 金基德
  • 娄烨
  • 园子温
  • 安德烈.祖拉斯基
  • 顾城
  • 骆一禾
  • 脏手指
  • 明天的盐
  • 萧红
  • 林棹
  • 邱妙津
  • 拉斯冯提尔
  • 其他
    📌人工智能
  • 2026-08-23
    大语言模型参数规模、架构范式与用户数量估算方法研究
  • 2026-08-23
    网页版文学大模型 · 需求文档 v0.2
  • 2026-08-23
    顾城·AI生成与原诗对照集(shikunpunk/MiniMind-GuCheng-AR生成)
  • 2026-08-23
    v3现代诗难样本·对照集(shikunpunk/Qwen3.8-27B-Haizi/GuCheng-KTO生成)
  • 2026-08-23
    海子顾城·联合精选集(shikunpunk/Qwen2.5-3B-GuCheng/HaiZi生成)
  • 2026-08-23
    迁移学习的标度律 — Hernandez et al. (2021) 中文翻译
  • 2026-08-23
    参数高效提示调优的规模力量 — Lester et al. (2021) 中文翻译
  • 2026-08-23
    LoRA:大语言模型的低秩自适应(中文翻译)
  • 2026-08-23
    rsLoRA:秩稳定化缩放因子(中文翻译)
  • 2026-08-23
    当缩放遇上 LLM 微调:数据、模型与微调方法的影响 — Zhang et al. (2024) 中文翻译
  • 2026-08-23
    训练计算最优的大语言模型(Chinchilla)— Hoffmann et al. (2022) 中文全文
  • 2026-08-23
    余华风格短篇集(shikunpunk/Qwen2.5-3B-YuHua-V3生成)
  • 2026-08-23
    余华模型写莫言题目(shikunpunk/Qwen2.5-3B-YuHua-V3 生成)
  • 2026-08-23
    大语言模型的涌现能力 — Wei et al. (2022) 中文全文
  • 2026-08-23
    神经语言模型的缩放定律 — Kaplan (2020) 中文全文
  • 2026-08-23
    新文学、新读者
  • 2026-08-23
    大语言模型的涌现能力是幻象吗?— Schaeffer et al. (2024) 中文全文
  • 2026-08-23
    PEFT 参数高效微调:图文并茂数学详解
  • 2026-08-23
    LLM 微调 Scaling Law · 中文翻译合集
  • 2026-07-18
    叙事的完整性
  • 2026-07-09
    LoRA:低秩自适应大语言模型(论文翻译)
  • 2026-07-08
    通俗易懂地理解word2vev的原理
  • 2026-07-04
    知识图谱之实体分类
  • 2026-07-04
    表示学习之transE论文翻译
  • 2026-07-04
    表示学习之Word2Vec
  • 2026-07-04
    两种reasoner的使用体验对比
  • 2026-07-04
    两种基于Tableaux算法的reasoner的源码分析(3)
  • 2026-07-04
    两种基于Tableaux算法的reasoner的源码分析(2)
  • 2026-07-03
    两种基于Tableaux算法的reasoner的源码分析(1)
  • 2026-07-03
    知识图谱推理与 Tableau 算法详解
  • 2026-01-01
    什么是benchmark