10 tháng 7, 2026
GPT-5.6 Trong Microsoft 365 Copilot: Những điều nhóm sản xuất nên biết
Tìm hiểu cách đánh giá GPT-5.6 Trong Microsoft 365 Copilot với các ví dụ thực tế, kiểm tra bằng chứng, kiểm soát chi phí, cổng đánh giá và tiêu chí triển khai một cách an toàn.
Trọng tâm bài viết
GPT-5.6 Trong Microsoft 365 Copilot bị hỏng khi hệ thống nguồn nằm rải rác, các bài đánh giá vẫn ở chế độ thủ công, quá trình chuyển giao không rõ ràng và khó chứng minh được rủi ro. Hướng dẫn này dành cho người vận hành cần bản đồ thực tế, quy trình làm việc, tín hiệu trên bảng điều khiển, cổng đánh giá và kế hoạch triển khai.
Mục lục
GPT-5.6 Trong Microsoft 365 Copilot bị hỏng khi hệ thống nguồn nằm rải rác, các bài đánh giá vẫn ở chế độ thủ công, quá trình chuyển giao không rõ ràng và khó chứng minh được rủi ro. Hướng dẫn này dành cho người vận hành cần bản đồ thực tế, quy trình làm việc, tín hiệu trên bảng điều khiển, cổng đánh giá và kế hoạch triển khai. Tại Van Data Team, chúng tôi bắt đầu bằng việc truy tìm hệ thống nguồn, quyền sở hữu, ranh giới tự động hóa và đường dẫn báo cáo trước khi chuyển việc đánh giá thành công việc sản xuất.
GPT-5.6 trong Microsoft 365 Copilot có nghĩa là GPT-5.6 của OpenAI hiện là mẫu được ưu tiên đằng sau Microsoft 365 Copilot, với Microsoft cho biết GPT-5.6 có sẵn trên Word, Excel, PowerPoint, Chat và Cowork. Vấn đề của người mua không phải là thông báo đó có xảy ra hay không. Đó là cách nhóm sản phẩm, hoạt động, dữ liệu hoặc CNTT nên đánh giá sự thay đổi trước khi để Copilot tác động đến tài liệu sản xuất, phân tích, quyết định và công việc gồm nhiều bước.
Tại Van Data Team, chúng tôi coi đây là câu hỏi về quy trình làm việc trước câu hỏi mẫu. Một mô hình mạnh hơn có thể cải thiện khả năng soạn thảo, tổng hợp, phân tích và thực thi tác nhân, nhưng giá trị sản xuất vẫn phụ thuộc vào quyền truy cập dữ liệu, ranh giới quyền, cổng xem xét, nhật ký, bảng thông tin và đường dẫn khôi phục. Đó là nơi Phát triển tác nhân AI, quy trình báo cáo và thiết kế đánh giá hoạt động trở nên quan trọng hơn tên mô hình tiêu đề.
Hướng dẫn này giải thích những gì đã thay đổi, "mô hình ưa thích" nên và không nên được coi là có ý nghĩa gì, Copilot Cowork thay đổi gánh nặng đánh giá như thế nào và cách đánh giá hệ thống trong đối tượng thuê của chính bạn mà không phát minh ra các tuyên bố điểm chuẩn mà các thông báo chính thức không cung cấp.
Nhóm Van Data thực hiện hoạt động này như thế nào
Tại Van Data Team, chúng tôi coi GPT-5.6 trong Microsoft 365 Copilot là một quy trình vận hành chứ không phải phần lý thuyết. Chúng tôi bắt đầu bằng cách ánh xạ quá trình chuyển giao hiện tại, hệ thống nguồn, quyết định, cổng xem xét, bảng thông tin và đường dẫn khôi phục. Đầu ra hữu ích là một kế hoạch phân phối trong phạm vi: tín hiệu nào cần thu thập, khoảng trống nào trong quy trình công việc cần đóng, tính năng tự động hóa nào thuộc về cổng đánh giá của con người và bảng thông tin hoặc sổ điều hành nào cho phép nhóm hành động tiếp theo.
Bài học chính
- OpenAI đã công bố vào ngày 9 tháng 7 năm 2026 rằng GPT-5.6 đã trở thành mô hình được ưu tiên trong Microsoft 365 Copilot.
- Microsoft cho biết GPT-5.6 có sẵn trên Word, Excel, PowerPoint, Chat và Cowork, vì vậy, việc đánh giá phải bao gồm nhiều bề mặt ứng dụng chứ không chỉ các lời nhắc trò chuyện.
- "Mô hình ưu tiên" không chứng minh được mọi yêu cầu đều được GPT-5.6 phục vụ; TechCrunch báo cáo rằng cụm từ này không được xác định theo hợp đồng hoặc thực tế trong các thông báo.
- Đơn vị đánh giá phù hợp là quy trình làm việc: lời nhắc, ngữ cảnh ứng dụng, tệp, quyền, hành vi mô hình, thực thi công cụ, đánh giá con người và kết quả kinh doanh có thể đo lường được.
- Copilot Cowork xứng đáng được quản lý chặt chẽ hơn vì công việc tri thức tác nhân có thể ảnh hưởng đến các tệp, phân tích và sản phẩm bàn giao chứ không chỉ văn bản nháp.
Điều gì đã thay đổi với GPT-5.6 trong Microsoft 365 Copilot?
GPT-5.6 đã trở thành mô hình ưa thích cho Microsoft 365 Copilot, nghĩa là các nhóm sử dụng Copilot sẽ mong đợi GPT-5.6 đóng vai trò trung tâm trong cách Copilot hỗ trợ công việc kiến thức trên các nền tảng cốt lõi của Microsoft 365.
OpenAI mô tả GPT-5.6 là mô hình ưu tiên trong Microsoft 365 Copilot và tập trung vào công việc hữu ích hơn từ mỗi mã thông báo, hiệu suất trên mỗi đô la mạnh hơn và khả năng theo yêu cầu cho các tác vụ phức tạp. Microsoft cho biết riêng GPT-5.6 có sẵn trong Word, Excel, PowerPoint, Chat và Cowork.
"GPT-5.6 hiện là mô hình được ưu tiên trong Microsoft 365 Copilot."
Đối với người vận hành, sự thay đổi thực tế không chỉ đơn giản là “mô hình trở nên tốt hơn”. Thay đổi là mô hình hàng đầu được đặt tên hiện là một phần của hệ thống nơi người dùng soạn thảo tài liệu, phân tích bảng tính, xây dựng bản trình bày, tổng hợp bối cảnh công ty và yêu cầu các bề mặt đại lý hoàn thành công việc.
Tuyên bố chính thức hoặc bề mặt | Ý nghĩa thực tiễn | Những gì cần kiểm tra trước khi triển khai |
|---|---|---|
GPT-5.6 is the preferred model | Chất lượng mô hình có thể cải thiện trong các nhiệm vụ Copilot thông thường | Liệu chất lượng đầu ra có cải thiện trong quy trình làm việc thực tế của bạn hay không |
Available in Word, Excel, PowerPoint, Chat, and Cowork | Đánh giá cần phải mở rộng tài liệu, phân tích, trình bày, trò chuyện và công việc đại lý | Các chế độ lỗi dành riêng cho ứng dụng, gánh nặng đánh giá và truy xuất nguồn gốc |
Microsoft định vị Copilot là một hệ thống rộng lớn hơn | Mô hình chỉ có một lớp trong sản phẩm | IQ công việc, quyền, sự tuân thủ và bối cảnh ứng dụng ảnh hưởng như thế nào đến kết quả đầu ra |
Các nguồn chính thức không công bố số điểm chuẩn | Tuyên bố công khai là không đủ để phê duyệt sản xuất | Đánh giá ở cấp độ người thuê dựa trên các đường cơ sở do con người đánh giá |
Cowork hỗ trợ công việc đại lý | Xem xét các chuyển đổi từ kiểm tra văn bản sang kiểm tra việc thực hiện công việc | Nhật ký, giả định, ranh giới hành động và đường dẫn báo cáo |
Một ví dụ đơn giản: trưởng nhóm vận hành bán hàng sử dụng Copilot trong Word để soạn thảo bản tóm tắt đối tác từ các ghi chú đã được phê duyệt. Bản thảo đầu tiên hiện có thể cần ít vòng nhắc nhở hơn nhưng rủi ro khi sản xuất vẫn là các tuyên bố không được hỗ trợ, số liệu cũ, giọng điệu không khớp hoặc vô tình đưa bối cảnh chỉ dành cho nội bộ. Việc kiểm soát bên phải không phải là một biểu ngữ cảnh báo chung chung. Đó là danh sách kiểm tra đánh giá gắn liền với các xác nhận quyền sở hữu, tài liệu nguồn, đối tượng và chủ sở hữu phê duyệt.
"Mô hình ưa thích" có nghĩa là gì trong thực tế
"Mô hình ưu tiên" phải được đọc là tín hiệu sản phẩm quan trọng chứ không phải là bằng chứng cho thấy mọi tương tác Copilot đều được GPT-5.6 phục vụ theo cùng một cách.
Sự khác biệt này quan trọng vì Microsoft 365 Copilot không phải là API mô hình thô. Đây là một hệ thống sản phẩm bao gồm các ứng dụng Microsoft 365, dữ liệu đối tượng thuê, Work IQ, bảo mật, tuân thủ, kiểm soát quyền riêng tư, điều phối và hành vi mô hình. Mô hình được đặt tên rất quan trọng nhưng quy trình làm việc vẫn phụ thuộc vào việc định tuyến, truy xuất, đóng gói ngữ cảnh, quyền và hành vi dành riêng cho ứng dụng.
Báo cáo của TechCrunch rất hữu ích ở đây vì nó làm nổi bật sự mơ hồ xung quanh "mô hình ưa thích" và đặt thông báo bên cạnh báo cáo về các mô hình MAI của Microsoft. Bài học rút ra thực tế rất đơn giản: một mô hình có thể được ưu tiên hơn mà không phải là mô hình duy nhất liên quan đến mọi yêu cầu, mọi ứng dụng hoặc mọi điều kiện của đối tượng thuê.
Điều đó không làm suy yếu thông báo. Nó làm rõ công việc đánh giá.
Sai lầm mà chúng tôi thấy là các nhóm coi việc xây dựng thương hiệu mô hình như một sự thay thế cho bằng chứng về quy trình làm việc. Điểm chuẩn của một mô hình không thể phê duyệt quy trình làm việc của nhiều hệ thống. Nếu nhà phân tích tài chính yêu cầu Copilot giải thích phương sai biên trong Excel thì chất lượng câu trả lời phụ thuộc vào phạm vi nguồn, cấu trúc bảng tính, công thức, giả định ẩn, cách diễn đạt nhanh chóng, hành vi mô hình và đánh giá của nhà phân tích. Nếu người quản lý sản phẩm yêu cầu Copilot chuyển ghi chú giới thiệu thành PowerPoint, thì rủi ro bao gồm bóp méo câu chuyện, thiếu cảnh báo, tuyên bố không được hỗ trợ và đóng khung đối tượng sai.
Quy tắc tốt hơn: đánh giá hành vi Copilot được quan sát trong quy trình làm việc kinh doanh đại diện. Không phê duyệt hoặc từ chối Copilot chỉ từ ngôn ngữ mô hình.
Tại sao GPT-5.6 lại quan trọng đối với công việc tri thức đại lý
GPT-5.6 quan trọng nhất khi Copilot chuyển từ đầu ra trợ lý sang công việc kiến thức tác nhân: lập kế hoạch, lý luận theo ngữ cảnh, sử dụng tệp và trả lại các sản phẩm bàn giao đã hoàn thành.
Copilot Cowork là bề mặt để xem. Microsoft mô tả Cowork là một trải nghiệm Copilot tác nhân, trong đó người dùng mô tả kết quả và hệ thống có thể trợ giúp suy luận về các công cụ và tệp để hoàn thành công việc. Điều đó chuyển vấn đề đánh giá từ "đoạn này có chính xác không?" là "hệ thống có thực hiện đúng công việc, sử dụng đúng ngữ cảnh, với đúng giới hạn không?"
Đó là một sự thay đổi quản trị vật chất.
Đối với việc soạn thảo, những rủi ro chính là giọng điệu, độ chính xác thực tế, bối cảnh bị bỏ qua và những tuyên bố không được hỗ trợ. Để phân tích, rủi ro bao gồm phạm vi sai, giả định không chính xác, công thức đọc sai và khuyến nghị sai lệch. Đối với quy trình làm việc tổng thể, rủi ro có thể bao gồm một chuỗi lỗi nhỏ tạo ra sản phẩm hoàn thiện nhưng sai.
Hãy xem xét một ví dụ về lập kế hoạch đa chức năng. Trưởng nhóm vận hành yêu cầu Cowork chuẩn bị bản tóm tắt sẵn sàng hàng tuần từ các ghi chú cuộc họp, hồ sơ dự án và các rủi ro mở. Đầu ra trông sạch sẽ. Tuy nhiên, một phần phụ thuộc được mô tả là "có thể đã được bỏ chặn" trong chuỗi trò chuyện, trong khi trình theo dõi dự án vẫn đánh dấu phần phụ thuộc đó là chưa được giải quyết. Người đánh giá cần xem dấu vết nguồn, các giả định, cách xử lý xung đột và các điểm báo cáo. Nếu không có điều đó, bài viết có thể trôi chảy nhưng không an toàn khi vận hành.
Đây là lý do tại sao quy trình làm việc của tác nhân AI sản xuất cần nhiều hơn những lời khuyên nhanh chóng. Họ cần ranh giới, nhật ký, đường dẫn phê duyệt và hành vi dự phòng. Nhóm Van Data thiết kế các biện pháp kiểm soát này như một phần của quy trình làm việc của tác nhân AI sản xuất, đặc biệt khi các tác nhân truy xuất ngữ cảnh, gọi công cụ, tóm tắt trạng thái kinh doanh hoặc chuẩn bị tài liệu hỗ trợ quyết định.
Các nhóm nên đánh giá việc nâng cấp phi công phụ như thế nào
Các nhóm nên đánh giá bản nâng cấp Copilot bằng cách kiểm tra quy trình công việc thực tế dựa trên các tiêu chuẩn đầu ra rõ ràng, chứ không phải dựa vào những khoảng trống điểm chuẩn công khai hoặc ngôn ngữ năng suất rộng rãi.
Đánh giá thực tế bắt đầu bằng việc kiểm kê quy trình làm việc. Chọn công việc thực sự tiêu tốn thời gian, tạo ra rủi ro hoặc ảnh hưởng đến quyết định. Sau đó xác định đầu ra tốt trông như thế nào trước khi thử nghiệm Copilot. Điều này tránh được cái bẫy thông thường khi một câu trả lời bóng bẩy có vẻ hữu ích nhưng lại không đạt tiêu chuẩn kinh doanh.
Sử dụng bảng đánh giá đơn giản như thế này:
| Quy trình làm việc | Mục tiêu kinh doanh | Đầu vào bắt buộc | Tiêu chuẩn đầu ra | Chế độ lỗi | Điểm đánh giá con người | Phương pháp đo lường |
|---|---|---|---|---|---|---|
| Tóm tắt từ | Tạo bản nháp sẵn sàng cho đối tác | Ghi chú đã được phê duyệt, xác nhận nguồn, bối cảnh của khán giả | Chính xác, ngắn gọn, không có tuyên bố không được hỗ trợ | Tuyên bố bịa đặt, giọng điệu sai, thiếu cảnh báo | Trước khi chia sẻ ra bên ngoài | Yêu cầu kiểm tra và ghi chú làm lại của người đánh giá |
Phân tích phương sai Excel | Giải thích sự chuyển động tài chính | Sổ làm việc, công thức, định nghĩa thời kỳ | Phạm vi chính xác, giải thích hợp lý | Sai phạm vi, hiểu sai công thức, sai nguyên nhân | Trước khi lãnh đạo xem xét | Nhật ký lỗi và xác thực của nhà phân tích |
Bản nháp đầu tiên của PowerPoint | Kế hoạch khởi động gói thầu được phê duyệt | Ghi chú khởi chạy, định vị, trạng thái lộ trình | Câu chuyện rõ ràng, tuyên bố chính xác, phù hợp với khán giả | Nói quá, thiếu rủi ro, cơ cấu yếu kém | Trước khi các bên liên quan xem xét | Tiêu chí ở cấp độ trang trình bày |
Tổng hợp trò chuyện | Tóm tắt lịch sử dự án | Văn bản, tin nhắn, hồ sơ quyết định | Tổng hợp liên kết nguồn với các câu hỏi mở | Thiếu bối cảnh, khoảng trống trích dẫn, quyết định cũ | Trước khi lập kế hoạch hành động | Kiểm tra truy xuất nguồn gốc |
Cowork có thể giao được | Hoàn thành nhiệm vụ kiến thức nhiều bước | Tệp, mục tiêu, ràng buộc, quyền truy cập công cụ | Kế hoạch đúng, hành động có thể kiểm tra, giả định rõ ràng | Hành động sai, giả định ẩn, xung đột giữa các tệp | Trước khi thực hiện hoặc xuất bản | Nhật ký thực thi và xem xét ngoại lệ |
Đây cũng là nơi BI tác nhân và báo cáo trở nên phù hợp. Nếu Copilot đang được sử dụng để phân tích hoặc báo cáo, thì đầu ra phải kết nối với lớp báo cáo được quản lý chứ không phải là câu trả lời một lần trong cuộc trò chuyện. Các nhóm cần bảng thông tin, số liệu có thể theo dõi, định nghĩa nguồn và cách để xem hệ thống đang cải thiện hay thất bại ở đâu theo thời gian.
Một luồng đánh giá hữu ích trông như thế này trong văn xuôi:
- Chọn quy trình làm việc đại diện từ Word, Excel, PowerPoint, Chat và Cowork.
- Viết tiêu chuẩn đầu ra dự kiến trước khi kiểm tra.
- Chạy tác vụ tương tự thông qua Copilot với đầu vào được tiêu chuẩn hóa.
- So sánh kết quả với đường cơ sở do con người đánh giá.
- Ghi nhật ký lỗi theo loại: thiếu ngữ cảnh, xác nhận quyền sở hữu không được hỗ trợ, tính toán sai, vấn đề về chính sách, vấn đề về quyền hoặc báo cáo không đúng.
- Quyết định xem dòng công việc đã sẵn sàng để sử dụng trực tiếp, sử dụng cần xem xét hay sử dụng bị chặn.
- Lặp lại sau khi thay đổi lời nhắc, dữ liệu, quyền hoặc quy trình làm việc.
Hãy chú ý điều còn thiếu trong danh sách này: tính điểm mức độ hài lòng chung. Cảm tính của người dùng rất quan trọng nhưng việc phê duyệt sản xuất cần chất lượng kết quả. Người dùng có thể yêu thích một bản nháp nhanh nhưng vẫn chứa những tuyên bố hợp pháp nên không bao giờ được phê duyệt.
Trường hợp mô hình có thể trợ giúp trước tiên
Quy trình công việc Copilot được hỗ trợ bởi GPT-5.6 sẽ bắt đầu ở các nhiệm vụ có rủi ro thấp, được đánh giá cao, trong đó đầu ra có thể được kiểm tra trước khi nó ảnh hưởng đến khách hàng, các quyết định tài chính hoặc việc thực hiện hoạt động.
Những ứng cử viên ban đầu tốt nhất là soạn thảo, tái cấu trúc, tổng hợp và phân tích lần đầu. Đây là những quy trình công việc trong đó một mô hình mạnh hơn có thể giảm bớt công việc trên trang trống trong khi vẫn giữ quyền kiểm soát của con người.
Word là tốt nhất cho việc soạn thảo và sàng lọc. Khách hàng tiềm năng có thể tạo bản tóm tắt, tóm tắt chính sách hoặc bản ghi nhớ đối tác nhanh hơn, sau đó xem xét các khiếu nại dựa trên tài liệu nguồn.
Excel là tốt nhất cho việc thăm dò phân tích. Nhà phân tích tài chính có thể yêu cầu Copilot xác định các mẫu phương sai, nhưng việc kiểm tra công thức, phạm vi nguồn và đề xuất cuối cùng vẫn cần được con người xác nhận.
PowerPoint là lựa chọn tốt nhất cho việc đóng gói câu chuyện. Người quản lý sản phẩm có thể biến các ghi chú đã được phê duyệt thành bản nháp đầu tiên, sau đó tinh chỉnh quy trình, bằng chứng và mức độ phù hợp với đối tượng.
Trò chuyện là tốt nhất để tổng hợp. Nhóm vận hành có thể yêu cầu tóm tắt về lịch sử dự án, nhưng kết quả đầu ra hữu ích là kết quả hiển thị các nguồn gốc và các câu hỏi chưa được giải quyết.
Cowork là cách tốt nhất để thực thi đại lý, nhưng nó nên được giới thiệu sau hoặc được xem xét chặt chẽ hơn. Công việc gồm nhiều bước đòi hỏi ranh giới rõ ràng hơn vì kiểu thất bại không còn là một câu trả lời tồi nữa.
Mẫu triển khai thực tế là bắt đầu bằng các quy trình công việc cần xem xét. Ví dụ: nhà phân tích tên Linh sử dụng Copilot để soạn thảo bình luận cho bảng điều khiển doanh thu hàng tuần. Nhóm không công bố bình luận trực tiếp. Họ so sánh nó với các định nghĩa số liệu, gắn cờ các nguyên nhân không được hỗ trợ và ghi nhật ký lỗi về các mẫu lỗi định kỳ. Sau vài chu kỳ, họ biết lời nhắc, nguồn dữ liệu và cổng đánh giá nào đủ tin cậy để giữ lại.
Đó là tư thế vận hành mà chúng tôi khuyến nghị: bắt đầu thu hẹp, đo lường việc làm lại và chỉ mở rộng khi quy trình làm việc chứng tỏ được khả năng của nó.
Những sai lầm thường gặp cần tránh
Sai lầm lớn nhất là coi thông báo về mẫu máy ưa thích là phê duyệt sản xuất.
Việc nâng cấp mô hình có thể cải thiện chất lượng đầu ra trong khi không thay đổi rủi ro trong quy trình làm việc. Dữ liệu vẫn có thể lộn xộn. Quyền vẫn có thể quá rộng. Quyền sở hữu đánh giá vẫn có thể không rõ ràng. Một câu trả lời bóng bẩy vẫn có thể sai.
Hãy tránh những sai lầm sau:
- Coi "mô hình ưa thích" là bằng chứng cho thấy mọi yêu cầu đều sử dụng GPT-5.6.
- Sử dụng điểm chuẩn của một mô hình để phê duyệt quy trình làm việc của Copilot.
- Triển khai Cowork mà không có nhật ký hành động, điểm kiểm tra đánh giá và quy tắc báo cáo.
- Chỉ đo lường sự hài lòng thay vì chất lượng kết quả kinh doanh.
- Giả sử đầu ra mô hình tốt hơn sẽ loại bỏ nhu cầu quản trị dữ liệu.
- Trích dẫn giá cả hoặc số liệu chuẩn từ các nguồn không chính thức như thể chúng là sự đảm bảo cho sản phẩm.
Chi phí xứng đáng được quan tâm đặc biệt. Trang định giá của bên thứ ba báo cáo Copilot Pro ở mức 20 USD mỗi người dùng mỗi tháng, Microsoft 365 Copilot Business ở mức 25,20 USD mỗi người dùng mỗi tháng, thanh toán hàng năm cho Doanh nghiệp ở mức [21 USD mỗi người dùng mỗi tháng] tháng](https://comparedge.com/tools/microsoft-copilot/pricing) và Enterprise ở mức khoảng $30 mỗi người dùng mỗi tháng. Những con số đó có thể giúp định hình cuộc thảo luận về ngân sách, nhưng chúng phải được xác minh bởi Microsoft trước khi mua sắm hoặc xuất bản.
Đánh giá chi phí cũng nên bao gồm gánh nặng xem xét. Nếu Copilot tiết kiệm thời gian soạn thảo nhưng tăng thời gian đánh giá cấp cao thì quy trình làm việc có thể không rẻ hơn. Nếu nó giảm thời gian thực hiện bản thảo đầu tiên và cải thiện tính nhất quán với quy trình xem xét có kiểm soát thì phương án kinh doanh sẽ hiệu quả hơn.
Khung đánh giá sản xuất
Hình minh họa sau đây tóm tắt đường dẫn đánh giá quy trình làm việc của phi công phụ:
Hình 1. Triển khai Copilot trong vận hành cần đánh giá toàn bộ đường đi của quy trình, từ ngữ cảnh ứng dụng và quyền truy cập đến rà soát của con người và chất lượng đầu ra được đo lường.
Khung đánh giá sản xuất cho Copilot phải bao gồm việc lựa chọn quy trình làm việc, truy cập dữ liệu, tiêu chuẩn nhanh chóng, phiếu tự đánh giá đầu ra, cổng đánh giá, xử lý ngoại lệ, giám sát và lặp lại.
Tại Van Data Team, chúng tôi bắt đầu bằng việc lập bản đồ công việc trước khi chọn mẫu tự động hóa. Ai yêu cầu đầu ra? Những tập tin và hệ thống nào quan trọng? AI có thể nhìn thấy gì? Nó được phép thay đổi những gì? Ai phê duyệt kết quả? Điều gì xảy ra khi câu trả lời không đầy đủ, không chắc chắn hoặc sai?
Sử dụng khung này:
| Lớp đánh giá | Câu hỏi của nhà điều hành | Kiểm soát sản xuất |
|---|---|---|
Lựa chọn quy trình làm việc | Nhiệm vụ này có thường xuyên, tốn kém hoặc đủ rủi ro để đánh giá không? | Kiểm kê quy trình làm việc và bản đồ ưu tiên |
Dữ liệu và quyền | Copilot có thể truy cập những nguồn nào và có nên truy cập chúng không? | Xem xét quyền và phân loại nguồn |
Tiêu chuẩn hóa nhanh chóng | Người dùng có đưa ra hướng dẫn tương tự không? | Mẫu nhắc nhở và yêu cầu đầu vào |
Tiêu chí đầu ra | Điều gì làm cho kết quả có thể chấp nhận được? | Danh sách kiểm tra chất lượng theo loại quy trình làm việc |
Đánh giá của con người | Ai phê duyệt, chỉnh sửa hoặc chặn đầu ra? | Cổng xem xét được đặt tên và đường dẫn leo thang |
Xử lý ngoại lệ | Điều gì xảy ra khi xung đột bối cảnh hoặc độ tin cậy thấp? | Dừng quy tắc và quá trình dự phòng |
| Giám sát | Thất bại có giảm dần theo thời gian không? | Bảng thông tin phân loại và báo cáo lỗi |
| Lặp lại | Những thay đổi nào sau khi tích lũy bằng chứng đánh giá? | Giao hàng tồn đọng và chu kỳ cải tiến |
Đây cũng chính là nguyên tắc chúng tôi sử dụng trên các dịch vụ kỹ thuật dữ liệu và AI: ngăn xếp quan trọng nhưng quy trình làm việc mới quyết định kiến trúc. Đối với Copilot, kiến trúc có thể bao gồm chính sách đối tượng thuê, quản trị SharePoint và OneDrive, thư viện lời nhắc, xác thực mô hình Excel, kiểm soát nguồn PowerPoint, bảng thông tin quy trình làm việc và các bước xem xét thủ công.
Một đề nghị cụ thể: nếu Copilot đang tham gia quy trình sản xuất của bạn, Van Data Team có thể tiến hành đánh giá quy trình làm việc theo phạm vi để tạo ra bản đồ tín hiệu, đăng ký rủi ro, thiết kế cổng đánh giá, đánh giá khoảng cách trên trang tổng quan và phạm vi triển khai. Đầu ra không phải là một bộ bài chiến lược chung chung. Đó là một kế hoạch thực tế để cho phép quy trình làm việc của Copilot, xem xét nội dung nào, chặn nội dung nào và theo dõi dữ liệu từ xa nào sau khi triển khai. Bạn có thể xem lại mô hình phân phối do người sáng lập của Van Data Team lãnh đạo và các tùy chọn tương tác thông qua Đường dẫn chiến lược Sprint.
Kết luận
GPT-5.6 trong Microsoft 365 Copilot là một thay đổi quan trọng về sản phẩm vì nó đặt loạt mô hình hàng đầu của OpenAI vào bên trong các công cụ hàng ngày nơi công việc tri thức đã diễn ra. Nhưng câu hỏi sản xuất không chỉ là "mô hình có tốt hơn không?" Câu hỏi hữu ích là liệu quy trình làm việc Copilot có tạo ra kết quả kinh doanh đáng tin cậy theo dữ liệu, quyền, quy trình xem xét và áp lực vận hành của bạn hay không.
Các nhóm nên bắt đầu với quy trình làm việc tiêu biểu trong Word, Excel, PowerPoint, Chat và Cowork. Xác định tiêu chuẩn đầu ra So sánh kết quả với đường cơ sở được con người đánh giá. Theo dõi các chế độ lỗi. Thêm các cổng đánh giá trong đó chi phí sai sót có ý nghĩa. Hãy coi Cowork như một bề mặt có khả năng quản trị cao hơn vì công việc đại lý sẽ thay đổi những gì phải được kiểm toán.
Nhóm Van Data giúp các nhóm biến những thay đổi mô hình này thành hệ thống sản xuất: quy trình làm việc của tổng đài viên, lớp báo cáo, quy trình đánh giá, bảng thông tin và kế hoạch phân phối vẫn tiếp xúc với hoạt động thực tế. Thông báo về mô hình là sự kích hoạt. Hệ điều hành xung quanh nó là nơi giành được giá trị.
Câu hỏi thường gặp
Những câu hỏi người đọc thường đặt ra tiếp theo.
Các câu trả lời ngắn này làm rõ những câu hỏi thực tế thường xuất hiện sau khi đọc bài viết.
Bạn cần một hệ thống tương tự?
Nếu bài viết này phản ánh một quy trình đội ngũ bạn đang vận hành, bước tiếp theo thường là rà soát có phạm vi về hệ thống, ràng buộc và lộ trình triển khai.
Đánh giá phi công phụ miễn phí
Đánh giá mức độ sẵn sàng của phi công phụ GPT-5.6
Xem lại GPT-5.6 trong Microsoft 365 Copilot dựa trên hệ thống nguồn, cổng xem lại và quy trình báo cáo của bạn, sau đó thực hiện các bước cụ thể tiếp theo.
Kế hoạch đánh giá phi công phụ