Khối lượng nâng cấp phụ thuộc nhiều vào cách bạn đang dùng Claude. Chat thủ công hoặc soạn thảo tài liệu chủ yếu cần test lại prompt. API, RAG, agent, coding hoặc vision workflow thì phải kiểm tra kỹ hơn tham số, tool policy và mô hình chi phí.
| Cách dùng Claude | Việc cần kiểm tra trước khi nâng cấp |
|---|---|
| Chat thủ công, soạn thảo, công việc tri thức | Prompt hay dùng, giọng văn, định dạng đầu ra, quy tắc trích dẫn và dùng tool |
| Messages API / SDK | Model ID, thinking setting, sampling parameter, token counting, xử lý lỗi |
| Tool use / RAG / web search | Khi nào bắt buộc dùng tool, khi nào không được đoán, fallback khi tool lỗi |
| Agent dài hơi / coding agent | Effort, task budget, token budget, độ trễ và regression eval |
| Ảnh, screenshot, PDF, computer-use workflow | Độ phân giải ảnh, chính sách downsample, chi phí token và chất lượng nhận diện hình ảnh |
Việc đầu tiên không phải là viết lại prompt, mà là quét cấu hình API. Anthropic nói nhà phát triển có thể gọi claude-opus-4-7 qua Claude API; nếu ứng dụng đang hard-code model ID, hãy đưa bước đổi ID vào canary hoặc shadow eval thay vì bật toàn bộ ngay.
Quan trọng hơn là phần thinking. Migration guide của Anthropic ghi rõ Claude Opus 4.7 hoặc các model mới hơn không còn hỗ trợ extended thinking kiểu cũ với budget_tokens; cấu hình này sẽ trả về lỗi 400. Hướng chuyển đổi là dùng adaptive thinking.
Việc nên làm:
budget_tokens trong code, SDK wrapper, prompt runner và cấu hình nền tảng nội bộ.Anthropic cũng đưa effort levels, task budgets, thinking configuration, sampling-parameter removal và tokenization vào nhóm thay đổi API cần xem khi chuyển từ Opus 4.6 sang Opus 4.7.
Nếu workflow cũ dựa vào temperature, top_p hoặc top_k để điều chỉnh độ sáng tạo, độ ổn định hoặc độ đa dạng, bạn cần thiết kế lại cách kiểm soát. Tài liệu prompting của Anthropic nêu sampling-parameter removal là một điểm cần chú ý khi migrate sang Opus 4.7; hướng dẫn migration của OpenRouter cho Claude 4.7 cũng liệt kê sampling parameters removed, adaptive-only thinking và hành vi effort phụ thuộc provider.
Nhóm nhiệm vụ bị ảnh hưởng thường là:
Cách kiểm soát bền hơn là viết luật vào prompt và đo bằng eval: định nghĩa rõ giọng văn, format, điều cấm và tiêu chí đạt; dùng few-shot để cố định phong cách; yêu cầu structured output cho trích xuất, phân loại và báo cáo; biến các ví dụ đúng của Claude phiên bản cũ thành regression eval để so sánh Opus 4.7 về độ tuân thủ format, độ đúng, chi phí và độ trễ.
Nếu workflow cũ chỉ giao một mục tiêu rộng rồi để Claude tự quyết định khi nào gọi tool, phần đáng gia cố nhất là tool policy. Anthropic cho biết các model Claude mới nhất được huấn luyện để làm theo chỉ dẫn chính xác và hưởng lợi từ việc được yêu cầu rõ ràng phải dùng tool cụ thể; tài liệu này cũng khuyến nghị dùng adaptive thinking cho workload kiểu agent như multi-step tool use, complex coding tasks và long-horizon agent loops.
Bạn có thể đưa các luật sau vào system prompt hoặc policy của workflow:
Điều này thường quan trọng hơn việc chỉ thay model ID, vì tool policy ảnh hưởng trực tiếp đến việc agent có bỏ sót dữ liệu, có bịa khi thiếu dữ liệu hay quá tự tin khi nguồn xung đột hay không.
Một điểm mới cần tính đến với Opus 4.7 là kiểm soát ngân sách cho nhiệm vụ dài và agentic workflow. Tài liệu What’s new của Anthropic cho biết Opus 4.7 giới thiệu task budgets; tài liệu khác mô tả effort là cách đánh đổi giữa năng lực, tốc độ và token spend, còn task budget cho Claude một ước lượng sơ bộ về lượng token dành cho toàn nhiệm vụ.
Nếu bạn đang chạy coding agent, research agent, browser agent, xử lý dữ liệu dài hoặc loop nhiều tool, nên chia ngân sách thành ba lớp:
Đừng chỉ lấy giới hạn output cuối để ước tính chi phí của cả agent loop. Chi phí có thể đến từ nhiều lượt gọi tool, tool result đưa ngược vào context, phân tích ảnh hoặc PDF, retry và final output; task budgets và tokenizer mới của Opus 4.7 khiến việc benchmark lại càng cần thiết.
Đây là mục dễ bị đánh giá thấp nhất. Anthropic cho biết tokenizer mới của Opus 4.7 khi xử lý văn bản có thể dùng khoảng 1x đến 1,35x số token so với model trước đó; /v1/messages/count_tokens cũng sẽ trả về số token khác cho Opus 4.7 so với Opus 4.6.
Trước khi nâng cấp, hãy test lại:
Nếu workflow cũ đã sát trần chi phí hoặc context limit, đừng dùng lại ước tính token cũ. Hãy benchmark trên prompt cốt lõi, mẫu tài liệu dài và nhiệm vụ có lưu lượng cao trước khi quyết định chỉnh chunking, truncation hoặc cache key.
Tài liệu Opus 4.7 đề cập high-resolution image support; tài liệu của Anthropic cũng nhắc rằng nếu không cần thêm độ trung thực của ảnh, nên downsample, tức giảm độ phân giải, trước khi gửi vào Claude để tránh tăng mức dùng token.
Điểm này ảnh hưởng nhiều tới ba nhóm workflow:
Khi đi từ Opus 4.6 lên Opus 4.7, PDF và vision vẫn nằm trong nhóm năng lực nền tảng chính mà Anthropic liệt kê; phần cần test lại là gửi ảnh lớn đến mức nào, có thật sự cần độ phân giải cao không, và sau khi downsample thì chữ nhỏ hoặc thành phần UI quan trọng còn đọc được không.
Nếu bạn không gọi trực tiếp Anthropic API mà đi qua OpenRouter, một cloud platform hoặc gateway nội bộ, đừng mặc định tên trường, quy tắc bỏ qua tham số và hành vi effort giống hệt nhau. Hướng dẫn migration Claude 4.7 của OpenRouter liệt kê riêng sampling parameters removed, adaptive-only thinking và provider-specific effort behavior.
Vì vậy, ngoài tài liệu của Anthropic, hãy đọc migration note của provider bạn đang dùng. Với multi-model router, fallback gateway hoặc nền tảng prompt nội bộ, các tham số API thượng nguồn thường được bọc lại thành field riêng; khi nâng cấp cần xác nhận field nào còn hiệu lực, field nào bị bỏ qua và field nào có thể gây lỗi.
Nếu nâng từ Opus 4.6 lên Opus 4.7, nền tảng không phải được thay mới toàn bộ. Migration guide của Anthropic cho biết Opus 4.7 hỗ trợ cùng nhóm tính năng chính như Opus 4.6, gồm cửa sổ ngữ cảnh 1 triệu token, tối đa 128.000 output token, adaptive thinking, prompt caching, batch processing, Files API, PDF support, vision và đầy đủ server-side / client-side tools.
Nói cách khác, ưu tiên số một thường không phải là viết lại các phần sau:
Phần cần hiệu chỉnh là cách bạn điều khiển các năng lực đó: khi nào dùng tool, tiêu bao nhiêu token, đặt effort ra sao, gửi ảnh lớn đến đâu và fallback thế nào khi thất bại.
Có thể đưa checklist này cho đội engineering, AI platform owner hoặc nhóm phụ trách Claude workflow để khoanh vùng rủi ro nhanh.
claude-opus-4-7, nhưng bắt đầu bằng canary hoặc shadow eval; Anthropic cho biết nhà phát triển có thể dùng model ID này qua Claude API.thinking, budget_tokens và wrapper extended thinking cũ; cấu hình kiểu thinking: {type: "enabled", budget_tokens: N} không còn được hỗ trợ trên Opus 4.7 hoặc model mới hơn và sẽ trả về 400.temperature, top_p, top_k và các cơ chế sampling cũ; chuyển việc kiểm soát ổn định sang prompt, few-shot, schema và eval./v1/messages/count_tokens để ước tính lại prompt lõi, RAG chunks, tài liệu dài và batch task.Cách an toàn không phải là thay toàn bộ một lần, mà là đi theo bốn bước:
Tóm lại: chuyển từ Claude cũ sang Opus 4.7 không nhất thiết là viết lại toàn bộ prompt. Việc quan trọng hơn là làm lộ rõ những logic kiểm soát từng nằm ẩn trong workflow cũ: thinking chuyển sang adaptive, sampling chuyển sang prompt/eval, nhiệm vụ dài chuyển sang tư duy ngân sách, còn ảnh và token cost phải benchmark lại. Làm được vậy, bạn giảm rủi ro nâng cấp mà vẫn giữ được tính kiểm soát của workflow hiện có.