跳转至

来源索引

本页记录当前 Wiki 使用的主要一手来源。基础硬件与价格快照按 2026-09-04 核对;Agent、模型训练/对齐、Jev 与 DeepSeek 生命周期于 2026-09-26 重新核对。模型、价格和软件文档会变化,使用时应重新打开原页。

FDE 角色

  1. OpenAI: Forward Deployed Engineer:端到端职责、生产采用、评测反馈和岗位要求。
  2. Anthropic: Careers:Applied AI 与 Forward Deployed Engineer 岗位族。
  3. Anthropic 与 DXC 合作:FDE 进入受监管行业真实系统的例子。

GPU 规格与价格

  1. NVIDIA RTX 50 系列发布:5070、5070 Ti、5080、5090 首发价。
  2. NVIDIA RTX 5090:32GB GDDR7 规格。
  3. NVIDIA RTX 30 系列发布:RTX 3090 24GB 与首发价。
  4. NVIDIA RTX PRO 6000 Blackwell:96GB ECC 规格。
  5. NVIDIA Marketplace RTX PRO 6000:厂商商城标价快照。
  6. NVIDIA HGX H100/H200/B200:H100、H200、B200 显存、带宽与 8 卡节点规格。
  7. NVIDIA HGX H200/B200/B300:B300 的 288GB HBM3e、8TB/s 与 8 卡 HGX 节点规格。
  8. NVIDIA Hopper vGPU 类型:H20 96GB 与 141GB 版本及 MIG/vGPU 配置。
  9. NVIDIA L20 vGPU 类型:L20 48GB vGPU 配置。
  10. 阿里云 L20 实例规格:L20 架构、48GB 显存、FP8 与云实例配置。
  11. AMD RX 7900 XTX 发布:24GB 和首发价。
  12. AMD MI300X:192GB HBM3 与 5.3TB/s。
  13. AMD MI325X 数据表:256GB HBM3e 与 6TB/s。
  14. Intel Arc B 系列发布:B580 12GB 与 US$249 首发价。
  15. Lambda GPU Instances:B200、H100 等公开云 GPU 每小时价格。
  16. DigitalOcean GPU Droplets:B300、H200、H100 的预留、Spot 和按需价格。
  17. AWS EC2 Capacity Blocks Pricing:按区域和加速卡的容量块有效小时价。
  18. 腾讯云 DLC 计费:L20、H20 包年包月整机价格样本。
  19. 京东 RTX 5090 列表页样本:中国市场挂牌价样本,不视为成交价或正式报价。

当前模型

  1. OpenAI Models:当前 API 模型、上下文和价格。
  2. Claude Models Overview:当前 Claude 家族、模型 ID、上下文和价格。
  3. Gemini Models:stable、preview、latest 和 experimental 模型。
  4. Grok Models:模型、价格、上下文和别名规则。
  5. DeepSeek Change Log:V4 Pro GA、V4 Flash 公测、Vision Exp 与 API 别名变更。
  6. DeepSeek V4 Pro 官方模型卡:V4 Pro/Flash 参数、上下文、开放权重、MIT 许可和部署方法。
  7. DeepSeek V4.1-Flash 发布说明:V4.1-Flash、旧 V4-Flash/Vision-Exp 退役和兼容路由变化。
  8. Kimi K3 官方仓库:2.8T-A104B、1M 上下文、原生多模态、API 和推理引擎。
  9. Kimi K3 License:开放权重的商用、模型服务和署名条款。
  10. GLM-5 官方仓库:GLM-5.3/Flash 参数、权重、思考参数和部署入口。
  11. GLM-5.3 官方模型卡:旗舰模型权重与 GLM-5.3 License。
  12. GLM-5.3-Flash 官方模型卡:320B-A18B、原生多模态、MIT 和部署入口。
  13. Qwen3.8 官方仓库:模型大小、下载、部署和微调入口。
  14. Mistral News:模型与产品官方发布记录。
  15. Meta Llama:Llama 官方入口与许可证。

部署与调优

  1. llama.cpp:GGUF、本地/边缘推理、OpenAI 兼容服务和硬件后端。
  2. vLLM Docs:高吞吐 LLM serving、并行和量化。
  3. SGLang Docs:高性能 serving 与 OpenAI 兼容接口。
  4. Hugging Face 量化选型:常见量化方法、内存和质量取舍。
  5. LoRA 论文:低秩适配原始论文。
  6. Hugging Face PEFT LoRA:LoRA 概念与实现。
  7. Hugging Face TRL:SFT、DPO、GRPO 和 Reward Modeling。
  8. LLaMA-Factory:统一微调工具链。
  9. vLLM 分布式推理与服务:单节点与多节点并行部署。
  10. Kubernetes GPU 调度:设备插件与 GPU 资源请求。
  11. NVIDIA GPU Operator:Kubernetes GPU 软件栈自动化。
  12. KServe 生成式推理:生成式模型 serving 控制面与运行时。

评测、安全与治理

  1. OpenAI Evals API:评测数据、grader 与运行结构。
  2. OWASP Top 10 for LLM Applications:LLM 应用风险与缓解措施。
  3. NIST AI Risk Management Framework:Govern、Map、Measure、Manage 框架及生成式 AI Profile。

Agent 与 Harness

  1. DeepSeek Harness / dsh:Cordis、plugin、profile、session、sandbox 和 architecture。
  2. pi-mono / pi.dev:pi-ai、pi-agent-core、coding-agent、session tree、RPC 和 SDK。
  3. M.U.S.E:任务图、specialist、peer review、skills 与交付器;名称归属需持续核对。
  4. OpenCode / 官方文档:build/plan/general、provider、permission、MCP 和 AGENTS.md。
  5. OpenAI Codex / Codex docs:Rust core、sandbox、approval、SDK 和 CLI 边界。
  6. Gemini CLI:policy engine、trusted folders、checkpoint、hooks、MCP 与 headless。
  7. Qwen Code / 文档:多 provider、ACP/MCP、skills 与本地 coding workflow。
  8. Claude Code / 产品页:产品、插件和文档入口;核心实现边界在页面中单独说明。

训练、对齐与 Jev

  1. Anthropic Constitutional AI:Constitutional AI 与 harmlessness 研究。
  2. Gemini 技术报告:多模态训练和系统能力的公开报告。
  3. DeepSeek Transparency Center / DeepSeek V3:参数、token、MoE、MLA、SFT/RL 与数据摘要。
  4. Kimi K3 开放日:KDA、Stable LatentMoE、原生视觉、1M 上下文和开放 Infra。
  5. Qwen3 / 技术报告:dense/MoE、规模、thinking/non-thinking 与后训练生态。
  6. MiniMax M2 / M2.1 post-training:Agent/code/tool-use、Forge/CISPO 与 post-training 方向。
  7. MiniMax M3 / M2.7 self-evolution:MSA、1M context、原生多模态,以及 Agent Teams/skills/memory/harness 自我演进案例。
  8. GLM-5:744B/40B active、28.5T pretraining 和 SFT/RL 入口。
  9. GPT-5 System Card:统一系统、router、reasoning RL 与 safe-completions。
  10. TypeSafe AI:System One 与 Jev:RLCD、并行 sampler、类型化决策和厂商评测边界。
  11. Jev 官方文档 / Workflow Evals:Choice、Score、Noul、confidence 与 workflow harness。

Judge / 评判模型

  1. OpenAI graders:规则、相似度、模型 grader、Python grader 和 multigrader。
  2. OpenAI Evals / GDPval:真实工作任务、专家对齐与 judge 评测。
  3. JudgeLM:开源模型评判研究与实现入口。
  4. JudgeArena:模型评判与比较的近期研究,需结合任务集复测。

最佳继续阅读顺序

  1. 角色起点:OpenAI FDE 岗位说明。
  2. 本地推理:llama.cpp 和 vLLM Docs。
  3. 开放模型实战:Qwen3.8 官方仓库。
  4. 模型调优:PEFT LoRA 和 TRL。
  5. 生产安全:OWASP Top 10 和 NIST AI RMF。