来源索引¶
本页记录当前 Wiki 使用的主要一手来源。基础硬件与价格快照按 2026-09-04 核对;Agent、模型训练/对齐、Jev 与 DeepSeek 生命周期于 2026-09-26 重新核对。模型、价格和软件文档会变化,使用时应重新打开原页。
FDE 角色¶
- OpenAI: Forward Deployed Engineer:端到端职责、生产采用、评测反馈和岗位要求。
- Anthropic: Careers:Applied AI 与 Forward Deployed Engineer 岗位族。
- Anthropic 与 DXC 合作:FDE 进入受监管行业真实系统的例子。
GPU 规格与价格¶
- NVIDIA RTX 50 系列发布:5070、5070 Ti、5080、5090 首发价。
- NVIDIA RTX 5090:32GB GDDR7 规格。
- NVIDIA RTX 30 系列发布:RTX 3090 24GB 与首发价。
- NVIDIA RTX PRO 6000 Blackwell:96GB ECC 规格。
- NVIDIA Marketplace RTX PRO 6000:厂商商城标价快照。
- NVIDIA HGX H100/H200/B200:H100、H200、B200 显存、带宽与 8 卡节点规格。
- NVIDIA HGX H200/B200/B300:B300 的 288GB HBM3e、8TB/s 与 8 卡 HGX 节点规格。
- NVIDIA Hopper vGPU 类型:H20 96GB 与 141GB 版本及 MIG/vGPU 配置。
- NVIDIA L20 vGPU 类型:L20 48GB vGPU 配置。
- 阿里云 L20 实例规格:L20 架构、48GB 显存、FP8 与云实例配置。
- AMD RX 7900 XTX 发布:24GB 和首发价。
- AMD MI300X:192GB HBM3 与 5.3TB/s。
- AMD MI325X 数据表:256GB HBM3e 与 6TB/s。
- Intel Arc B 系列发布:B580 12GB 与 US$249 首发价。
- Lambda GPU Instances:B200、H100 等公开云 GPU 每小时价格。
- DigitalOcean GPU Droplets:B300、H200、H100 的预留、Spot 和按需价格。
- AWS EC2 Capacity Blocks Pricing:按区域和加速卡的容量块有效小时价。
- 腾讯云 DLC 计费:L20、H20 包年包月整机价格样本。
- 京东 RTX 5090 列表页样本:中国市场挂牌价样本,不视为成交价或正式报价。
当前模型¶
- OpenAI Models:当前 API 模型、上下文和价格。
- Claude Models Overview:当前 Claude 家族、模型 ID、上下文和价格。
- Gemini Models:stable、preview、latest 和 experimental 模型。
- Grok Models:模型、价格、上下文和别名规则。
- DeepSeek Change Log:V4 Pro GA、V4 Flash 公测、Vision Exp 与 API 别名变更。
- DeepSeek V4 Pro 官方模型卡:V4 Pro/Flash 参数、上下文、开放权重、MIT 许可和部署方法。
- DeepSeek V4.1-Flash 发布说明:V4.1-Flash、旧 V4-Flash/Vision-Exp 退役和兼容路由变化。
- Kimi K3 官方仓库:2.8T-A104B、1M 上下文、原生多模态、API 和推理引擎。
- Kimi K3 License:开放权重的商用、模型服务和署名条款。
- GLM-5 官方仓库:GLM-5.3/Flash 参数、权重、思考参数和部署入口。
- GLM-5.3 官方模型卡:旗舰模型权重与 GLM-5.3 License。
- GLM-5.3-Flash 官方模型卡:320B-A18B、原生多模态、MIT 和部署入口。
- Qwen3.8 官方仓库:模型大小、下载、部署和微调入口。
- Mistral News:模型与产品官方发布记录。
- Meta Llama:Llama 官方入口与许可证。
部署与调优¶
- llama.cpp:GGUF、本地/边缘推理、OpenAI 兼容服务和硬件后端。
- vLLM Docs:高吞吐 LLM serving、并行和量化。
- SGLang Docs:高性能 serving 与 OpenAI 兼容接口。
- Hugging Face 量化选型:常见量化方法、内存和质量取舍。
- LoRA 论文:低秩适配原始论文。
- Hugging Face PEFT LoRA:LoRA 概念与实现。
- Hugging Face TRL:SFT、DPO、GRPO 和 Reward Modeling。
- LLaMA-Factory:统一微调工具链。
- vLLM 分布式推理与服务:单节点与多节点并行部署。
- Kubernetes GPU 调度:设备插件与 GPU 资源请求。
- NVIDIA GPU Operator:Kubernetes GPU 软件栈自动化。
- KServe 生成式推理:生成式模型 serving 控制面与运行时。
评测、安全与治理¶
- OpenAI Evals API:评测数据、grader 与运行结构。
- OWASP Top 10 for LLM Applications:LLM 应用风险与缓解措施。
- NIST AI Risk Management Framework:Govern、Map、Measure、Manage 框架及生成式 AI Profile。
Agent 与 Harness¶
- DeepSeek Harness / dsh:Cordis、plugin、profile、session、sandbox 和 architecture。
- pi-mono / pi.dev:pi-ai、pi-agent-core、coding-agent、session tree、RPC 和 SDK。
- M.U.S.E:任务图、specialist、peer review、skills 与交付器;名称归属需持续核对。
- OpenCode / 官方文档:build/plan/general、provider、permission、MCP 和 AGENTS.md。
- OpenAI Codex / Codex docs:Rust core、sandbox、approval、SDK 和 CLI 边界。
- Gemini CLI:policy engine、trusted folders、checkpoint、hooks、MCP 与 headless。
- Qwen Code / 文档:多 provider、ACP/MCP、skills 与本地 coding workflow。
- Claude Code / 产品页:产品、插件和文档入口;核心实现边界在页面中单独说明。
训练、对齐与 Jev¶
- Anthropic Constitutional AI:Constitutional AI 与 harmlessness 研究。
- Gemini 技术报告:多模态训练和系统能力的公开报告。
- DeepSeek Transparency Center / DeepSeek V3:参数、token、MoE、MLA、SFT/RL 与数据摘要。
- Kimi K3 开放日:KDA、Stable LatentMoE、原生视觉、1M 上下文和开放 Infra。
- Qwen3 / 技术报告:dense/MoE、规模、thinking/non-thinking 与后训练生态。
- MiniMax M2 / M2.1 post-training:Agent/code/tool-use、Forge/CISPO 与 post-training 方向。
- MiniMax M3 / M2.7 self-evolution:MSA、1M context、原生多模态,以及 Agent Teams/skills/memory/harness 自我演进案例。
- GLM-5:744B/40B active、28.5T pretraining 和 SFT/RL 入口。
- GPT-5 System Card:统一系统、router、reasoning RL 与 safe-completions。
- TypeSafe AI:System One 与 Jev:RLCD、并行 sampler、类型化决策和厂商评测边界。
- Jev 官方文档 / Workflow Evals:Choice、Score、Noul、confidence 与 workflow harness。
Judge / 评判模型¶
- OpenAI graders:规则、相似度、模型 grader、Python grader 和 multigrader。
- OpenAI Evals / GDPval:真实工作任务、专家对齐与 judge 评测。
- JudgeLM:开源模型评判研究与实现入口。
- JudgeArena:模型评判与比较的近期研究,需结合任务集复测。
最佳继续阅读顺序¶
- 角色起点:OpenAI FDE 岗位说明。
- 本地推理:llama.cpp 和 vLLM Docs。
- 开放模型实战:Qwen3.8 官方仓库。
- 模型调优:PEFT LoRA 和 TRL。
- 生产安全:OWASP Top 10 和 NIST AI RMF。