今天(2026 年 7 月 31 日),DeepSeek 更新了 DeepSeek-V4-Flash 的正式版本,官方公告如下:

deepseek-v4-flash 原生支持 Responses API 并完全适配 Codex(配置细节见官方文档),正好可以直接接进 Paseo 使用。

Paseo 内置支持 Codex。通过派生 Provider,可以在保留官方 OpenAI GPT 的同时,增加一个使用 DeepSeek 的 Codex Provider。

最终效果:

  • Codex:使用 OpenAI GPT 和 Codex 登录状态。
  • Codex (DeepSeek):使用 DeepSeek 或兼容 Responses API 的网关。
  • 两个 Provider 在 Paseo 中独立显示,可以按任务选择。
阅读全文 »

Intel 新发布的第三代 Ultra 处理器看测评非常给力,于是我首发购入了 Xiaomi Book Pro 14 (2026) ,这台机器的模具非常像荣耀的 art 14 或者华为的 matebook pro x,重量只有 1kg 左右。但是由于设备太新了,Omarchy(Arch Linux) 下有很多驱动不支持的情况,这篇文章记录下各种硬件设备的处理办法。

阅读全文 »

LLM 发展的飞快,现在每天都在使用基于 Transformer 的模型——ChatGPT、Claude、GitHub Copilot 等。
那么 Transformer 是什么?当我们输入一段文字后,这些模型是如何”理解”并生成回复的?

元旦放假,趁着有时间对 Transformer 进行了学习,这篇文章是学习过程中的笔记。我重点将从工程师的视角,来学习 Transformer 在推理阶段的工作原理。对于做工程来说,复杂的数学证明和训练算法是没有必要的,但通过代码类比和直观图解,可以让我们更加深入的理解 LLM 是如何运转的。下次再听到 混合专家模型(MoE) 等等,就不会只从形式上理解,而是有更加深入的算法对应关系了。

阅读全文 »

近期 quickjs 的作者发布了 mquickjs,在保持性能接近的情况下,内存占用大幅缩小,运行时整体内存占用只需要 100kb。

由于好奇 mquickjs 在内存和执行速度上到底怎样,我跑了一些跟 Node.js 和 QuickJS 的对比。

阅读全文 »
0%