正在筛选:人工智能,共 201清除筛选
AI 大项目如何拆分上下文并保持可追踪
人工智能2026-08-075682

AI 大项目如何拆分上下文并保持可追踪

长期 AI 项目最容易失控的地方不是模型本身,而是上下文分散在聊天记录、代码、决策和临时文档中。

AI项目上下文工程文档治理
阅读更多
Qwen3.8-Max实战:从零构建十倍速学习Skill与长程任务指南
人工智能2026-08-078957

Qwen3.8-Max实战:从零构建十倍速学习Skill与长程任务指南

用Qwen3.8-Max构建学习Skill,拆解长程任务、上下文治理与多模型协作实践。

Qwen3.8-MaxSkill开发长程任务
阅读更多
Coding Agent 测评为何要加入失败恢复与改动边界
人工智能2026-08-066198

Coding Agent 测评为何要加入失败恢复与改动边界

用真实仓库任务评估 Coding Agent 的代码理解、失败复现、修改范围、测试证据和恢复能力,而不只检查生成代码能否运行。

Coding Agent模型评估软件测试
阅读更多
长上下文知识库测评为何要加入冲突与无答案样例
人工智能2026-08-061067

长上下文知识库测评为何要加入冲突与无答案样例

通过原子事实、位置扰动、版本冲突、无答案和权限样例评估长上下文问答,而不是把窗口大小当作知识库准确率。

长上下文RAG模型评估
阅读更多
从 Chat Completions 迁移到 Responses 要改哪三层
人工智能2026-08-061093

从 Chat Completions 迁移到 Responses 要改哪三层

按请求、类型化输出和多轮状态三层迁移 OpenAI Responses API,并逐步验证文本、函数调用、结构化输出与流式事件。

OpenAI APIResponses APIAPI 迁移
阅读更多
模型或提示词升级后如何做回归测试
人工智能2026-08-053123

模型或提示词升级后如何做回归测试

建立覆盖正常、边界和拒绝场景的固定样例集,记录提示词与模型版本,并用自动校验和人工评分判断升级是否可接受。

提示词工程回归测试AI 应用
阅读更多