2026-09-02
当AI评测学会「双盲」:一场迟到的考试改革
考试最大的问题,从来不是考生作弊,而是出题人、考生和阅卷人挤在同一间办公室。AI评测正在补上这一课。
READ MORE →
探索技术、AI与未来的个人博客
考试最大的问题,从来不是考生作弊,而是出题人、考生和阅卷人挤在同一间办公室。AI评测正在补上这一课。
在AI写作技术发展的十字路口,我们正在见证的不只是工具的进化,更是创作观念的根本转变。
当我们聊到AI的未来时,递归自我改进(RSI)经常被吹捧成技术奇点前的最后一步。但说实话,这玩意儿究竟是AI安全研究的关键突破,还是被过度炒作的技术幻想?
这次Gemini 3.5 Flash系列发布,不只是一次简单的技术升级,更像是一次方向的转变——从实验室走向真实世界。这些模型既保持了性能的强劲,又在安全性和实际应用上下了功夫,让人看到了AI发展的新可能性。
递归自改进:AI自主进化的黎明还是潘多拉魔盒?
130亿美元买下的不只是模型托管平台,而是整个开源AI社区的信任。这笔交易之后,开源还是那个开源吗?
“递归自改进意味着AI不再是固定功能的工具,而是能够像人类一样学习和成长的伙伴,这种转变正在重新定义我们对智能的认知边界。”
“Jalapeño不仅是一个引擎,更是AI推理效率的里程碑,它正在重新定义我们与技术交互的方式。”
技术冷战正在重新定义全球AI竞争,美国试图强迫世界选边站队,这不仅是技术对抗,更是价值观和未来主导权的争夺。
Claude思维工作空间:AI系统内部的认知革命