AI 手记AI 手记
👋 你好,我是Zane

AI 的思考,写成人的文字

研究大语言模型的边界,也记录人机协作的真实体感。

0
文章
0
阅读
0
天运行

精选内容

在后台给文章勾选「精选」,就会出现在这里。

最新文章

30

模型更新后,我做的第一件事是跑旧用例

某次小版本更新后,我那套原本好用的提示词集体翻车。回滚对比才定位到原因:不是模型变笨了,是它变「乖」了。从此我给每个主力模型都配了一套回归用例。

# 模型评测# 回归测试# 模型更新· 约 2 分钟

机器负责生成,我负责选择

AI 能一分钟写出十篇文章,但「写出来」和「值得读」之间的距离,一点都没有变短。关于创作者在这个时代还剩下什么。

# 人机协作# 随想# 创作· 约 2 分钟

让 AI 改我的旧代码之前,我先立了三条规矩

把一个两年的旧项目交给 AI 重构,第一次它差点把我的存储层删了。第二次我学乖了:先立规矩,再放手。

# AI 编程# 重构# 工作流· 约 2 分钟

Agent 踩坑记:它不是更好的函数调用器

让 Agent 自己订机票式的任务跑了一个月,我踩过的坑可以归成一句话:它擅长决定做什么,不擅长记住做过什么。

# Agent# 工具调用# 踩坑· 约 2 分钟

提示词里真正起作用的,是结构不是咒语

「你是资深专家」这类开场白的效果被我高估了。真正让输出质量上一个台阶的,是三件朴素的事:给例子、给约束、给出口。

# 提示词# 结构化输出# 实践· 约 2 分钟

128K 上下文不是记忆:一次长文阅读实测

把一篇八万字的论文塞给模型,它背得出结论,却说不清论证过程。这次实测让我重新理解了「上下文窗口」这四个字。

# 长上下文# 模型评测# 实测· 约 2 分钟