Hiểu trạng thái
Mô hình diễn giải ngôn ngữ tự nhiên hoặc văn bản có cấu trúc: ticket hỗ trợ, trace của Agent, bản ghi sản phẩm hoặc trạng thái trò chơi.
System One là lớp mô hình AI của TypeSafe dành cho nhà phát triển cần chuyển trạng thái ứng dụng phi cấu trúc thành câu trả lời có kiểu và xác suất. Jev là triển khai đầu tiên: một thành phần quyết định có giới hạn, được thiết kế để nằm trong mã ứng dụng.
Đây là hướng dẫn độc lập dành cho nhà phát triển. Chi tiết sản phẩm và tuyên bố hiệu năng được dẫn từ TypeSafe. Hãy kiểm thử Jev trên dữ liệu của bạn trước khi dùng trong production.
state → decisions“Tôi bị tính phí hai lần và cần giải quyết việc này hôm nay.”
if (confidence < threshold) → reviewSystem One đọc ý nghĩa từ đầu vào nhưng không tiếp tục hội thoại hay soạn câu trả lời. Bạn khai báo trước câu hỏi và dạng câu trả lời được phép; mô hình trả về một phán đoán có giới hạn để chương trình kiểm tra.
Mô hình diễn giải ngôn ngữ tự nhiên hoặc văn bản có cấu trúc: ticket hỗ trợ, trace của Agent, bản ghi sản phẩm hoặc trạng thái trò chơi.
Ứng dụng xác định không gian câu trả lời trước khi gọi. Mô hình chọn một phương án, đặt đầu vào lên thang đo hoặc đánh giá mệnh đề có/không.
Mỗi câu trả lời đều có tín hiệu xác suất. Choice và Score còn tóm tắt độ phân tán bằng confidence.
Threshold, kiểm tra chính sách, tác dụng phụ, retry, fallback và đánh giá của con người vẫn nằm trong mã thông thường.
Jev biến một lần gọi mô hình thành tập hợp tín hiệu quyết định. Đơn vị hữu ích không phải một lượt chat mà là hợp đồng nhỏ, có kiểu giữa mô hình và ứng dụng.
Gửi thông tin cần thiết cho quyết định. Jev hiện nhận đầu vào dạng văn bản, gồm string, đối tượng JSON và mảng văn bản.
Tin nhắn khách hàng + dữ liệu tài khoảnĐặt tên từng câu hỏi, chọn primitive và mô tả các phương án hoặc thang đo được phép. Nhiều câu hỏi độc lập có thể đi trong cùng một request.
bộ phận · độ khẩn cấp · mức bức xúcJev trả về câu trả lời có kiểu và tín hiệu xác suất cho từng câu hỏi. Choice và Score còn có giá trị confidence riêng.
thanh toán · 0,93 · confidence caoKết hợp đầu ra mô hình với kiểm tra xác định. Tự động xử lý trường hợp rõ ràng, ít rủi ro; chuyển trường hợp mơ hồ hoặc tác động lớn cho con người hay reasoning model.
định tuyến · hỏi · duyệt · dừngbillingChọn một phương án từ tập được định trước và trả về xác suất cho từng phương án.
1.43 / 2Đặt đầu vào lên phổ được mô tả bằng các mức có thứ tự; điểm số có thể nằm giữa các mức.
0.95Đánh giá mệnh đề có/không và trả về xác suất của mô hình cho câu trả lời “có”.
Mô hình tạo sinh được thiết kế để tạo string linh hoạt cho con người. Luận điểm của TypeSafe là phần mềm cần một dạng trí tuệ hẹp hơn: có thể nằm trong mã, chạy lặp lại, bộc lộ độ bất định và giữ luồng điều khiển minh bạch.
Đầu ra có thể là văn bản, mã, JSON, lời từ chối hoặc sai định dạng. Ứng dụng thường phải parse, xác thực và xử lý lỗi trước khi hành động.
Khi mô hình chạy nền, chương trình cần biết trước các kết quả có thể xảy ra và hành động mà mỗi kết quả cho phép.
Phân phối xác suất cho phép tự động hóa trường hợp rõ ràng và chuyển trường hợp mơ hồ sang đường an toàn hơn.
Workflow phức tạp có thể tách thành các đánh giá ngữ nghĩa tập trung rồi ghép bằng logic xác định, thay vì giấu mọi thứ trong một prompt lớn.
Trường hợp tốt nhất xuất hiện thường xuyên, cần hiểu đầu vào lộn xộn và dẫn đến một số ít hành động mà ứng dụng đã biết cách thực hiện.
Phân loại ticket, xác định ý định và độ khẩn cấp, chấm điểm cảm xúc và chuyển trường hợp không chắc chắn để duyệt.
Thanh toán, kỹ thuật, tài khoản hay vấn đề khác?
Chọn mô hình hoặc công cụ, quyết định có cần retrieval, kiểm tra độ đầy đủ của kết quả hoặc tool call được đề xuất.
Agent nên tiếp tục, thử lại hay chuyển cấp?
Chấm điểm mức phù hợp của ứng viên với truy vấn, hồ sơ, chính sách hoặc ngữ cảnh rồi kết hợp tín hiệu với quy tắc nghiệp vụ.
Ứng viên này liên quan đến yêu cầu đến mức nào?
Đánh giá tin nhắn, đầu ra, trace hoặc thay đổi mã theo tiêu chí rõ ràng; giữ rủi ro cao sau các gate xác định.
Điều này có vi phạm quy tắc đã nêu không?
Chọn hành động được phép cho trò chơi, mô phỏng, UI hoặc thiết bị mà không cần chờ câu trả lời tạo sinh dài.
Hành động được phép nào phù hợp nhất với trạng thái này?
Chuyển lượng lớn bản ghi thành danh mục, điểm, cờ và feature cho các hệ thống tiếp theo.
Danh mục và mức rủi ro của bản ghi này là gì?
Các phương án đã biết, đầu vào phức tạp về ngữ nghĩa, quyết định lặp lại, latency quan trọng và mã có hành động hoặc fallback cho từng kết quả.
Cần tạo văn bản hoặc mã mới, suy luận sâu nhiều bước, nghiên cứu rộng, giải thích, đầu vào đa phương thức hoặc không thể xác định trước kết quả.
Cả hai đều hiểu ngôn ngữ và LLM có thể bị ràng buộc bằng đầu ra có cấu trúc. Khác biệt sâu hơn nằm ở thứ mô hình được thiết kế để tạo ra và cách phần mềm sử dụng nó.
| Khía cạnh | Jev / System One | LLM tạo sinh phổ biến |
|---|---|---|
| Tác vụ chính | Đánh giá các kết quả đã xác định | Tạo phần tiếp theo hoặc câu trả lời |
| Đầu ra tự nhiên | Lựa chọn có kiểu, điểm số hoặc xác suất “có” | Chuỗi token: văn bản, mã, JSON hoặc dạng khác |
| Không gian câu trả lời | Được xác định trước khi gọi | Về bản chất là mở, ngay cả khi schema giới hạn định dạng cuối |
| Độ bất định | Xác suất cho mọi câu trả lời; confidence cho Choice và Score | Có thể có xác suất token hoặc confidence tự khai báo, hiếm khi là tín hiệu đã hiệu chỉnh cho tác vụ |
| Sampling | Theo TypeSafe, các câu hỏi và đầu ra được đánh giá song song | Thường tuần tự, từng token một |
| Điểm mạnh | Nhánh ngữ nghĩa lặp lại, scoring, routing và kiểm tra | Viết, hội thoại, mã, tổng hợp và suy luận mở |
| Dạng lỗi chính | Quyết định đúng kiểu nhưng sai về ngữ nghĩa | Nội dung sai, sai định dạng, thiếu căn cứ hoặc lạc hướng |
| Vai trò trong hệ thống | Thành phần quyết định có giới hạn trong mã hiển thị rõ | Bộ tạo hoặc reasoning model linh hoạt, thường cần orchestration rộng hơn |
Với nhà phát triển đánh giá System One ngoài Jev, bên dưới là cùng mô-đun cộng đồng từ trang Projects. Mô-đun phân biệt mô hình được huấn luyện độc lập với giao diện kiểu Jev xây trên trọng số mô hình có sẵn.
Các mô hình và thử nghiệm giao diện của cộng đồng này lấy cảm hứng từ Jev hoặc khám phá những cách tiếp cận tương tự cho quyết định có cấu trúc. Đây không phải bản Jev chính thức do TypeSafe phát hành và không nằm trong bảng xếp hạng dự án GitHub phía trên.
Qwen3.5-9BBộ điều hợp LoRA và công thức huấn luyện lấy cảm hứng từ Jev cho câu hỏi lựa chọn và có/không. Chạy cục bộ, hiện chỉ nhận văn bản.
GitHubQwen3-0.6BMô hình nhỏ có các đầu ra quyết định, mã huấn luyện công khai và bản demo trò chơi để thử chọn hành động.
GitHubQwen3.5-2BMô hình tinh chỉnh trả về phân bố xác suất cho câu hỏi có cấu trúc chỉ trong một lượt. Bản hiện tại chỉ hỗ trợ tiếng Anh.
GitHubModernBERT 151MMô hình quyết định nhỏ dựa trên encoder, công bố trọng số và có bản demo WebGPU trong trình duyệt.
GitHubQwen3.5-0.8BMô hình quyết định đa phương thức 0,8B có công bố trọng số, mã huấn luyện và kết quả đánh giá. Mô hình xử lý văn bản lẫn hình ảnh trong một lượt; trọng số chỉ dành cho nghiên cứu phi thương mại.
GitHubDiffusionGemma 26B-A4BDùng mô hình DiffusionGemma hiện có để trả lời các câu hỏi có cấu trúc qua API tương tự Jev. Không công bố trọng số mô hình mới.
GitHubOpen-model logitsDùng mô hình mở sẵn có để chấm điểm các đáp án cho phép qua giao diện tương tự Jev. Không công bố trọng số mô hình mới.
GitHubSpark-X2.5-4BMáy chủ chạy cục bộ, tương thích với Jev và đọc logit câu trả lời từ Spark-X2.5. Nhiều câu hỏi dùng chung một lần nạp trước trạng thái; dự án có cả sân thử nghiệm và benchmark.
GitHubAny causal LLMBộ công cụ biến mô hình ngôn ngữ nhân quả thành mô hình quyết định có kiểu mà không cần huấn luyện, kèm khử thiên lệch thứ tự lựa chọn, hiệu chuẩn tùy chọn và benchmark có thể tái lập.
GitHubQwen3.5 / DeBERTaMáy chủ Jev tương thích chạy ngoại tuyến cho Qwen hoặc DeBERTa, đã thử với SDK chính thức và công bố kết quả JevBench.
GitHubĐây là dự án độc lập của cộng đồng, không phải bản Jev chính thức.
Hướng dẫn Jev AI Dev này giải thích khuôn khổ TypeSafe bằng lời của chúng tôi. Hãy xác minh chi tiết API, tuyên bố sản phẩm, phương pháp đánh giá và cập nhật qua nguồn chính thức.
Xác định câu trả lời, thu thập ví dụ đại diện, quyết định cách xử lý độ bất định và so sánh Jev với quy tắc hoặc mô hình hiện tại. Không trực tiếp tự động hóa quyết định có tác động cao.