Files
xiaohei 428644e286
Revalidate Docs / Revalidate Docs (push) Failing after 2s
E2E CI / Check Duplicate Run (push) Failing after 5s
Test CI / Check Duplicate Run (push) Failing after 6s
E2E CI / Test Web App (push) Has been skipped
Test CI / Test Packages (push) Has been skipped
Test CI / Test App (shard 1/3) (push) Has been skipped
Test CI / Test App (shard 2/3) (push) Has been skipped
Test CI / Test App (shard 3/3) (push) Has been skipped
Test CI / Test Desktop App (push) Has been skipped
🔄 Branch Synchronization / sync-branches (push) Failing after 11s
Test CI / Test Database (push) Has been skipped
Test CI / Merge and Upload App Coverage (push) Has been skipped
Database Schema Visualization CI / build (push) Failing after 4m14s
Enterprise AI Workspace prototype: LobeChat (de-branded) + Enterprise Gateway + Postgres/Redis stack
2026-04-21 12:58:00 +08:00

1416 lines
406 KiB
JSON
Raw Permalink Blame History

This file contains ambiguous Unicode characters
This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.
{
"01-ai/yi-1.5-34b-chat.description": "Mô hình mã nguồn mở mới nhất của 01.AI với 34 tỷ tham số, hỗ trợ nhiều tình huống hội thoại, được huấn luyện trên dữ liệu chất lượng cao và điều chỉnh theo sở thích của con người.",
"01-ai/yi-1.5-9b-chat.description": "Mô hình mã nguồn mở mới nhất của 01.AI với 9 tỷ tham số, hỗ trợ nhiều tình huống hội thoại, được huấn luyện trên dữ liệu chất lượng cao và điều chỉnh theo sở thích của con người.",
"360/deepseek-r1.description": "DeepSeek-R1 do 360 triển khai sử dụng học tăng cường quy mô lớn trong giai đoạn hậu huấn luyện để tăng cường khả năng suy luận với lượng nhãn tối thiểu. Mô hình đạt hiệu suất tương đương OpenAI o1 trong các bài toán toán học, lập trình và suy luận ngôn ngữ tự nhiên.",
"360gpt-pro-trans.description": "Mô hình chuyên biệt cho dịch thuật, được tinh chỉnh sâu để đạt chất lượng dịch hàng đầu.",
"360gpt-pro.description": "360GPT Pro là mô hình AI chủ lực của 360 với khả năng xử lý văn bản hiệu quả trong nhiều tình huống NLP, hỗ trợ hiểu văn bản dài và hội thoại nhiều lượt.",
"360gpt-turbo-responsibility-8k.description": "360GPT Turbo Responsibility 8K nhấn mạnh tính an toàn ngữ nghĩa và trách nhiệm trong các ứng dụng nhạy cảm về nội dung, đảm bảo trải nghiệm người dùng chính xác và ổn định.",
"360gpt-turbo.description": "360GPT Turbo cung cấp khả năng tính toán và hội thoại mạnh mẽ với khả năng hiểu và sinh ngữ nghĩa xuất sắc, lý tưởng cho doanh nghiệp và nhà phát triển.",
"360gpt2-o1.description": "360gpt2-o1 xây dựng chuỗi suy nghĩ thông qua tìm kiếm cây kết hợp cơ chế phản chiếu và huấn luyện bằng học tăng cường, cho phép tự phản ánh và tự điều chỉnh.",
"360gpt2-pro.description": "360GPT2 Pro là mô hình NLP tiên tiến của 360 với khả năng sinh và hiểu văn bản xuất sắc, đặc biệt phù hợp với các tác vụ sáng tạo, xử lý chuyển đổi phức tạp và nhập vai.",
"360zhinao2-o1.5.description": "360 Zhinao là mô hình suy luận mạnh mẽ nhất, với khả năng vượt trội và hỗ trợ cả việc gọi công cụ lẫn suy luận nâng cao.",
"360zhinao2-o1.description": "360zhinao2-o1 xây dựng chuỗi suy nghĩ thông qua tìm kiếm cây kết hợp cơ chế phản chiếu và huấn luyện bằng học tăng cường, cho phép tự phản ánh và tự điều chỉnh.",
"360zhinao3-o1.5.description": "360 Zhinao là mô hình suy luận thế hệ tiếp theo.",
"4.0Ultra.description": "Spark Ultra là mô hình mạnh mẽ nhất trong dòng Spark, nâng cao khả năng hiểu và tóm tắt văn bản đồng thời cải thiện tìm kiếm web. Đây là giải pháp toàn diện giúp tăng năng suất làm việc và phản hồi chính xác, định vị như một sản phẩm trí tuệ hàng đầu.",
"AnimeSharp.description": "AnimeSharp (còn gọi là \"4x-AnimeSharp\") là mô hình nâng cấp độ phân giải mã nguồn mở dựa trên ESRGAN của Kim2091, tập trung vào việc phóng to và làm sắc nét hình ảnh phong cách anime. Mô hình được đổi tên từ \"4x-TextSharpV1\" vào tháng 2 năm 2022, ban đầu cũng dùng cho hình ảnh văn bản nhưng đã được tối ưu mạnh cho nội dung anime.",
"Baichuan2-Turbo.description": "Sử dụng tăng cường tìm kiếm để kết nối mô hình với tri thức chuyên ngành và web. Hỗ trợ tải lên PDF/Word và nhập URL để truy xuất kịp thời, toàn diện và tạo đầu ra chuyên nghiệp, chính xác.",
"Baichuan3-Turbo-128k.description": "Với cửa sổ ngữ cảnh siêu dài 128K, mô hình được tối ưu cho các tình huống doanh nghiệp có tần suất cao với giá trị và hiệu quả vượt trội. So với Baichuan2, khả năng sáng tạo nội dung tăng 20%, hỏi đáp tri thức tăng 17% và nhập vai tăng 40%. Hiệu suất tổng thể vượt GPT-3.5.",
"Baichuan3-Turbo.description": "Tối ưu cho các tình huống doanh nghiệp có tần suất cao với giá trị và hiệu quả vượt trội. So với Baichuan2, khả năng sáng tạo nội dung tăng 20%, hỏi đáp tri thức tăng 17% và nhập vai tăng 40%. Hiệu suất tổng thể vượt GPT-3.5.",
"Baichuan4-Air.description": "Mô hình hàng đầu tại Trung Quốc, vượt qua nhiều mô hình quốc tế trong các tác vụ tiếng Trung như tri thức, văn bản dài và sáng tạo. Ngoài ra còn có khả năng đa phương tiện hàng đầu với kết quả mạnh mẽ trên các bảng đánh giá uy tín.",
"Baichuan4-Turbo.description": "Mô hình hàng đầu tại Trung Quốc, vượt qua nhiều mô hình quốc tế trong các tác vụ tiếng Trung như tri thức, văn bản dài và sáng tạo. Ngoài ra còn có khả năng đa phương tiện hàng đầu với kết quả mạnh mẽ trên các bảng đánh giá uy tín.",
"Baichuan4.description": "Hiệu suất hàng đầu trong nước, vượt qua các mô hình quốc tế hàng đầu trong các tác vụ tiếng Trung như tri thức bách khoa, văn bản dài và sáng tạo. Đồng thời cung cấp khả năng đa phương tiện hàng đầu và kết quả mạnh mẽ trên các bảng đánh giá.",
"ByteDance-Seed/Seed-OSS-36B-Instruct.description": "Seed-OSS là dòng mô hình LLM mã nguồn mở từ ByteDance Seed, được thiết kế để xử lý ngữ cảnh dài, suy luận, tác vụ đại lý và khả năng tổng quát mạnh mẽ. Seed-OSS-36B-Instruct là mô hình 36B được tinh chỉnh theo hướng dẫn với khả năng xử lý ngữ cảnh siêu dài, phù hợp cho tài liệu hoặc mã nguồn lớn. Mô hình được tối ưu cho suy luận, sinh mã và tác vụ đại lý (sử dụng công cụ) trong khi vẫn giữ được khả năng tổng quát mạnh. Tính năng nổi bật là \"Ngân sách Suy nghĩ\" cho phép điều chỉnh độ dài suy luận linh hoạt để tăng hiệu quả.",
"DeepSeek-OCR.description": "DeepSeek-OCR là mô hình thị giác-ngôn ngữ của DeepSeek AI, tập trung vào OCR và “nén ngữ cảnh quang học”. Mô hình khám phá cách nén ngữ cảnh từ hình ảnh, xử lý tài liệu hiệu quả và chuyển đổi chúng thành văn bản có cấu trúc (ví dụ: Markdown). Nó nhận dạng văn bản trong hình ảnh với độ chính xác cao, phù hợp cho số hóa tài liệu, trích xuất văn bản và xử lý có cấu trúc.",
"DeepSeek-R1-Distill-Llama-70B.description": "DeepSeek R1, mô hình lớn và thông minh hơn trong bộ DeepSeek, được chưng cất vào kiến trúc Llama 70B. Các bài đánh giá và đánh giá người dùng cho thấy mô hình thông minh hơn Llama 70B gốc, đặc biệt trong các tác vụ toán học và độ chính xác tri thức.",
"DeepSeek-R1-Distill-Qwen-1.5B.description": "Mô hình chưng cất DeepSeek-R1 dựa trên Qwen2.5-Math-1.5B. Học tăng cường và dữ liệu khởi đầu lạnh được sử dụng để tối ưu hóa hiệu suất suy luận, thiết lập các chuẩn mới cho mô hình mã nguồn mở đa nhiệm.",
"DeepSeek-R1-Distill-Qwen-14B.description": "Các mô hình DeepSeek-R1-Distill được tinh chỉnh từ các mô hình mã nguồn mở bằng cách sử dụng dữ liệu mẫu do DeepSeek-R1 tạo ra.",
"DeepSeek-R1-Distill-Qwen-32B.description": "Các mô hình DeepSeek-R1-Distill được tinh chỉnh từ các mô hình mã nguồn mở bằng cách sử dụng dữ liệu mẫu do DeepSeek-R1 tạo ra.",
"DeepSeek-R1-Distill-Qwen-7B.description": "Mô hình chưng cất DeepSeek-R1 dựa trên Qwen2.5-Math-7B. Học tăng cường và dữ liệu khởi đầu lạnh được sử dụng để tối ưu hóa hiệu suất suy luận, thiết lập các chuẩn mới cho mô hình mã nguồn mở đa nhiệm.",
"DeepSeek-R1.description": "DeepSeek-R1 áp dụng học tăng cường quy mô lớn trong giai đoạn hậu huấn luyện, giúp tăng cường khả năng suy luận với rất ít dữ liệu gán nhãn. Mô hình đạt hiệu suất tương đương với OpenAI o1 trong các tác vụ toán học, lập trình và suy luận ngôn ngữ tự nhiên.",
"DeepSeek-V3-1.description": "DeepSeek V3.1 là mô hình suy luận thế hệ tiếp theo với khả năng suy luận phức tạp và chuỗi suy nghĩ được cải thiện, phù hợp với các tác vụ phân tích chuyên sâu.",
"DeepSeek-V3-Fast.description": "Nhà cung cấp: sophnet. DeepSeek V3 Fast là phiên bản tốc độ cao của DeepSeek V3 0324, sử dụng độ chính xác đầy đủ (không nén) với khả năng lập trình và toán học mạnh hơn cùng phản hồi nhanh hơn.",
"DeepSeek-V3.1-Fast.description": "DeepSeek V3.1 Fast là biến thể tốc độ cao của DeepSeek V3.1. Chế độ suy nghĩ kết hợp: thông qua mẫu hội thoại, một mô hình hỗ trợ cả suy nghĩ và không suy nghĩ. Sử dụng công cụ thông minh hơn: hậu huấn luyện tăng hiệu suất tác vụ công cụ và đại lý.",
"DeepSeek-V3.1-Think.description": "Chế độ suy nghĩ DeepSeek-V3.1: mô hình suy luận kết hợp mới với chế độ suy nghĩ và không suy nghĩ, hiệu quả hơn DeepSeek-R1-0528. Tối ưu hóa hậu huấn luyện cải thiện đáng kể việc sử dụng công cụ đại lý và hiệu suất tác vụ đại lý.",
"DeepSeek-V3.2.description": "deepseek-v3.2 giới thiệu cơ chế attention thưa, nhằm cải thiện hiệu quả huấn luyện và suy luận khi xử lý văn bản dài, với mức giá thấp hơn deepseek-v3.1.",
"DeepSeek-V3.description": "DeepSeek-V3 là mô hình MoE do DeepSeek phát triển. Mô hình vượt qua các mô hình mã nguồn mở khác như Qwen2.5-72B và Llama-3.1-405B trên nhiều bảng đánh giá và cạnh tranh với các mô hình đóng hàng đầu như GPT-4o và Claude 3.5 Sonnet.",
"Doubao-lite-128k.description": "Doubao-lite cung cấp phản hồi siêu nhanh và giá trị tốt hơn, với các tùy chọn linh hoạt cho nhiều tình huống. Hỗ trợ ngữ cảnh 128K cho suy luận và tinh chỉnh.",
"Doubao-lite-32k.description": "Doubao-lite cung cấp phản hồi siêu nhanh và giá trị tốt hơn, với các tùy chọn linh hoạt cho nhiều tình huống. Hỗ trợ ngữ cảnh 32K cho suy luận và tinh chỉnh.",
"Doubao-lite-4k.description": "Doubao-lite cung cấp phản hồi siêu nhanh và giá trị tốt hơn, với các tùy chọn linh hoạt cho nhiều tình huống. Hỗ trợ ngữ cảnh 4K cho suy luận và tinh chỉnh.",
"Doubao-pro-128k.description": "Mô hình chủ lực có hiệu suất tốt nhất cho các tác vụ phức tạp, mạnh về hỏi đáp tham chiếu, tóm tắt, sáng tạo, phân loại và nhập vai. Hỗ trợ ngữ cảnh 128K cho suy luận và tinh chỉnh.",
"Doubao-pro-32k.description": "Mô hình chủ lực có hiệu suất tốt nhất cho các tác vụ phức tạp, mạnh về hỏi đáp tham chiếu, tóm tắt, sáng tạo, phân loại và nhập vai. Hỗ trợ ngữ cảnh 32K cho suy luận và tinh chỉnh.",
"Doubao-pro-4k.description": "Mô hình chủ lực có hiệu suất tốt nhất cho các tác vụ phức tạp, mạnh về hỏi đáp tham chiếu, tóm tắt, sáng tạo, phân loại và nhập vai. Hỗ trợ ngữ cảnh 4K cho suy luận và tinh chỉnh.",
"DreamO.description": "DreamO là mô hình tùy chỉnh hình ảnh mã nguồn mở do ByteDance và Đại học Bắc Kinh phát triển, sử dụng kiến trúc thống nhất để hỗ trợ tạo hình ảnh đa nhiệm. Mô hình sử dụng mô hình hóa thành phần hiệu quả để tạo ra hình ảnh tùy chỉnh, nhất quán cao dựa trên danh tính, chủ đề, phong cách, nền và các điều kiện khác do người dùng chỉ định.",
"ERNIE-3.5-128K.description": "Mô hình LLM quy mô lớn hàng đầu của Baidu, được huấn luyện trên kho dữ liệu tiếng Trung/Anh khổng lồ, có khả năng vượt trội trong trò chuyện, sáng tạo và sử dụng plugin; hỗ trợ tích hợp tự động plugin Tìm kiếm Baidu để cung cấp câu trả lời mới nhất.",
"ERNIE-3.5-8K-Preview.description": "Mô hình LLM quy mô lớn hàng đầu của Baidu, được huấn luyện trên kho dữ liệu tiếng Trung/Anh khổng lồ, có khả năng vượt trội trong trò chuyện, sáng tạo và sử dụng plugin; hỗ trợ tích hợp tự động plugin Tìm kiếm Baidu để cung cấp câu trả lời mới nhất.",
"ERNIE-3.5-8K.description": "Mô hình LLM quy mô lớn hàng đầu của Baidu, được huấn luyện trên kho dữ liệu tiếng Trung/Anh khổng lồ, có khả năng vượt trội trong trò chuyện, sáng tạo và sử dụng plugin; hỗ trợ tích hợp tự động plugin Tìm kiếm Baidu để cung cấp câu trả lời mới nhất.",
"ERNIE-4.0-8K-Latest.description": "Mô hình LLM siêu lớn hàng đầu của Baidu với các nâng cấp toàn diện so với ERNIE 3.5, phù hợp cho các tác vụ phức tạp đa lĩnh vực; hỗ trợ tích hợp plugin Tìm kiếm Baidu để cung cấp câu trả lời mới nhất.",
"ERNIE-4.0-8K-Preview.description": "Mô hình LLM siêu lớn hàng đầu của Baidu với các nâng cấp toàn diện so với ERNIE 3.5, phù hợp cho các tác vụ phức tạp đa lĩnh vực; hỗ trợ tích hợp plugin Tìm kiếm Baidu để cung cấp câu trả lời mới nhất.",
"ERNIE-4.0-Turbo-8K-Latest.description": "Mô hình LLM siêu lớn hàng đầu của Baidu với hiệu suất tổng thể mạnh mẽ cho các tác vụ phức tạp, tích hợp plugin Tìm kiếm Baidu để cung cấp câu trả lời mới nhất. Vượt trội hơn ERNIE 4.0.",
"ERNIE-4.0-Turbo-8K-Preview.description": "Mô hình LLM siêu lớn hàng đầu của Baidu với hiệu suất tổng thể mạnh mẽ cho các tác vụ phức tạp, tích hợp plugin Tìm kiếm Baidu để cung cấp câu trả lời mới nhất. Vượt trội hơn ERNIE 4.0.",
"ERNIE-Character-8K.description": "Mô hình LLM chuyên biệt theo lĩnh vực của Baidu dành cho NPC trong game, dịch vụ khách hàng và nhập vai, với tính nhất quán nhân vật rõ ràng hơn, khả năng tuân thủ hướng dẫn tốt hơn và tư duy logic mạnh mẽ hơn.",
"ERNIE-Lite-Pro-128K.description": "Mô hình LLM nhẹ của Baidu cân bằng giữa chất lượng và hiệu suất suy luận, vượt trội hơn ERNIE Lite và phù hợp với các thiết bị tăng tốc tính toán thấp.",
"ERNIE-Speed-128K.description": "Mô hình LLM hiệu suất cao mới nhất của Baidu (2024) với khả năng tổng quát mạnh mẽ, phù hợp làm nền tảng tinh chỉnh cho các tình huống cụ thể, có hiệu suất tư duy xuất sắc.",
"ERNIE-Speed-Pro-128K.description": "Mô hình LLM hiệu suất cao mới nhất của Baidu (2024) với khả năng tổng quát mạnh mẽ, vượt trội hơn ERNIE Speed, phù hợp làm nền tảng tinh chỉnh với hiệu suất tư duy xuất sắc.",
"FLUX-1.1-pro.description": "FLUX.1.1 Pro",
"FLUX.1-Kontext-dev.description": "FLUX.1-Kontext-dev là một mô hình tạo và chỉnh sửa hình ảnh đa phương thức từ Black Forest Labs, dựa trên kiến trúc Rectified Flow Transformer với 12 tỷ tham số. Mô hình tập trung vào việc tạo, tái tạo, nâng cao hoặc chỉnh sửa hình ảnh theo các điều kiện ngữ cảnh được cung cấp. Nó kết hợp khả năng tạo có kiểm soát của các mô hình khuếch tán với mô hình hóa ngữ cảnh của Transformer, hỗ trợ đầu ra chất lượng cao cho các tác vụ như inpainting, outpainting và tái tạo cảnh thị giác.",
"FLUX.1-Kontext-pro.description": "FLUX.1 Kontext [pro]",
"FLUX.1-dev.description": "FLUX.1-dev là một mô hình ngôn ngữ đa phương thức mã nguồn mở (MLLM) từ Black Forest Labs, được tối ưu hóa cho các tác vụ hình ảnh-văn bản, kết hợp khả năng hiểu và tạo hình ảnh/văn bản. Dựa trên các LLM tiên tiến (như Mistral-7B), mô hình sử dụng bộ mã hóa thị giác được thiết kế cẩn thận và tinh chỉnh theo nhiều giai đoạn để hỗ trợ phối hợp đa phương thức và suy luận các tác vụ phức tạp.",
"GLM-4.5-Air.description": "GLM-4.5-Air: Phiên bản nhẹ để phản hồi nhanh.",
"GLM-4.5.description": "GLM-4.5: Mô hình hiệu suất cao cho các nhiệm vụ lý luận, lập trình và tác vụ đại lý.",
"GLM-4.6.description": "GLM-4.6: Mô hình thế hệ trước.",
"GLM-4.7.description": "GLM-4.7 là mô hình hàng đầu mới nhất của Zhipu, được cải tiến cho các kịch bản Lập trình Đại lý với khả năng lập trình nâng cao, lập kế hoạch nhiệm vụ dài hạn và hợp tác công cụ.",
"GLM-5-Turbo.description": "GLM-5-Turbo là mô hình nền tảng được tối ưu sâu cho các kịch bản tác tử (agentic). Mô hình được tinh chỉnh từ giai đoạn huấn luyện để đáp ứng những yêu cầu cốt lõi của tác vụ agent, tăng cường các năng lực như gọi công cụ, tuân thủ lệnh và thực thi chuỗi dài. Đây là lựa chọn lý tưởng để xây dựng các trợ lý tác vụ hiệu suất cao.",
"GLM-5.1.description": "GLM-5.1 là mô hình hàng đầu mới nhất của Zhipu, một phiên bản nâng cao của GLM-5 với khả năng kỹ thuật tác nhân được cải thiện cho các hệ thống kỹ thuật phức tạp và các nhiệm vụ dài hạn.",
"GLM-5.description": "GLM-5 là mô hình nền tảng thế hệ tiếp theo của Zhipu, được xây dựng chuyên biệt cho Agentic Engineering. Mô hình mang lại năng suất đáng tin cậy trong kỹ thuật hệ thống phức tạp và các tác vụ agent tầm xa. Trong khả năng lập trình và tác tử, GLM-5 đạt hiệu suất hàng đầu trong số các mô hình mã nguồn mở. Trong các tình huống lập trình thực tế, trải nghiệm người dùng tiệm cận Claude Opus 4.5. Mô hình vượt trội trong kỹ thuật hệ thống phức tạp và tác vụ tác tử dài hạn, là nền tảng lý tưởng cho trợ lý agent đa dụng.",
"Gryphe/MythoMax-L2-13b.description": "MythoMax-L2 (13B) là một mô hình sáng tạo cho nhiều lĩnh vực và tác vụ phức tạp.",
"HY-Image-V3.0.description": "Khả năng trích xuất đặc điểm hình ảnh gốc mạnh mẽ và bảo toàn chi tiết, mang lại kết cấu hình ảnh phong phú hơn và tạo ra hình ảnh có độ chính xác cao, bố cục tốt, đạt tiêu chuẩn sản xuất.",
"HelloMeme.description": "HelloMeme là một công cụ AI tạo meme, GIF hoặc video ngắn từ hình ảnh hoặc chuyển động bạn cung cấp. Không cần kỹ năng vẽ hoặc lập trình—chỉ cần một hình ảnh tham chiếu—để tạo ra nội dung vui nhộn, hấp dẫn và nhất quán về mặt phong cách.",
"HiDream-E1-Full.description": "HiDream-E1-Full là một mô hình chỉnh sửa hình ảnh đa phương thức mã nguồn mở từ HiDream.ai, dựa trên kiến trúc Diffusion Transformer tiên tiến và khả năng hiểu ngôn ngữ mạnh mẽ (tích hợp LLaMA 3.1-8B-Instruct). Nó hỗ trợ tạo hình ảnh dựa trên ngôn ngữ tự nhiên, chuyển đổi phong cách, chỉnh sửa cục bộ và vẽ lại, với khả năng hiểu và thực thi hình ảnh-văn bản xuất sắc.",
"HiDream-I1-Full.description": "HiDream-I1 là mô hình tạo hình ảnh cơ bản mã nguồn mở mới được phát hành bởi HiDream. Với 17 tỷ tham số (Flux có 12 tỷ), nó có thể cung cấp chất lượng hình ảnh hàng đầu trong ngành chỉ trong vài giây.",
"HunyuanDiT-v1.2-Diffusers-Distilled.description": "hunyuandit-v1.2-distilled là một mô hình chuyển văn bản thành hình ảnh nhẹ, được tối ưu hóa thông qua quá trình chưng cất để tạo hình ảnh chất lượng cao nhanh chóng, đặc biệt phù hợp với môi trường tài nguyên thấp và yêu cầu tạo thời gian thực.",
"I2V-01-Director.description": "Mô hình tạo video cấp đạo diễn đã chính thức ra mắt, cung cấp khả năng tuân thủ tốt hơn các hướng dẫn về chuyển động camera và ngôn ngữ kể chuyện điện ảnh.",
"I2V-01-live.description": "Hiệu suất nhân vật được cải thiện: ổn định hơn, mượt mà hơn và sống động hơn.",
"I2V-01.description": "Mô hình cơ bản chuyển đổi hình ảnh thành video của dòng 01.",
"InstantCharacter.description": "InstantCharacter là một mô hình tạo nhân vật cá nhân hóa không cần tinh chỉnh do Tencent AI phát hành năm 2025, hướng đến việc tạo nhân vật nhất quán, độ trung thực cao trong nhiều bối cảnh khác nhau. Mô hình có thể tạo nhân vật từ một hình ảnh tham chiếu duy nhất và linh hoạt chuyển đổi qua các phong cách, hành động và nền khác nhau.",
"InternVL2-8B.description": "InternVL2-8B là một mô hình ngôn ngữ-thị giác mạnh mẽ hỗ trợ xử lý hình ảnh-văn bản đa phương thức, nhận diện chính xác nội dung hình ảnh và tạo mô tả hoặc câu trả lời phù hợp.",
"InternVL2.5-26B.description": "InternVL2.5-26B là một mô hình ngôn ngữ-thị giác mạnh mẽ hỗ trợ xử lý hình ảnh-văn bản đa phương thức, nhận diện chính xác nội dung hình ảnh và tạo mô tả hoặc câu trả lời phù hợp.",
"KAT-Coder-Air-V1.description": "Phiên bản gọn nhẹ trong dòng KAT-Coder. Được thiết kế đặc biệt cho Agentic Coding, bao phủ toàn diện các nhiệm vụ và tình huống lập trình. Tận dụng học tăng cường quy mô lớn dựa trên agent, mô hình tạo ra hành vi thông minh nổi bật và vượt trội đáng kể so với các mô hình cùng loại trong hiệu suất mã hóa.",
"KAT-Coder-Exp-72B-1010.description": "KAT-Coder-Exp-72B là phiên bản thử nghiệm tăng cường (RL) trong dòng KAT-Coder, đạt hiệu suất nổi bật 74.6% trên chuẩn SWE-Bench verified, thiết lập kỷ lục mới cho mô hình mã nguồn mở. Mô hình tập trung vào Agentic Coding và hiện chỉ hỗ trợ khung SWE-Agent, nhưng cũng có thể dùng cho hội thoại đơn giản.",
"KAT-Coder-Pro-V1.description": "Được thiết kế cho Agentic Coding, bao phủ toàn diện các tác vụ và kịch bản lập trình, đạt được hành vi thông minh thông qua học tăng cường quy mô lớn, vượt trội đáng kể so với các mô hình tương tự trong hiệu suất viết mã.",
"KAT-Coder-Pro-V2.description": "Mô hình hiệu suất cao mới nhất của đội ngũ Kuaishou Kwaipilot, được thiết kế cho các dự án doanh nghiệp phức tạp và tích hợp SaaS. Mô hình vượt trội trong kịch bản liên quan đến mã nguồn và tương thích với nhiều loại khung tác tử (Claude Code, OpenCode, KiloCode), hỗ trợ OpenClaw nguyên bản và được tối ưu đặc biệt cho thẩm mỹ giao diện front-end.",
"Kimi-K2.5.description": "Kimi K2.5 là mô hình mạnh mẽ nhất trong dòng Kimi, đạt SOTA mã nguồn mở trong tác vụ agent, lập trình và hiểu hình ảnh. Mô hình hỗ trợ đầu vào đa phương thức và hai chế độ tư duy và không tư duy.",
"Kolors.description": "Kolors là một mô hình chuyển văn bản thành hình ảnh do nhóm Kuaishou Kolors phát triển. Được huấn luyện với hàng tỷ tham số, mô hình có ưu thế nổi bật về chất lượng hình ảnh, hiểu ngữ nghĩa tiếng Trung và hiển thị văn bản.",
"Kwai-Kolors/Kolors.description": "Kolors là một mô hình chuyển văn bản thành hình ảnh quy mô lớn dựa trên khuếch tán tiềm ẩn do nhóm Kuaishou Kolors phát triển. Được huấn luyện trên hàng tỷ cặp văn bản-hình ảnh, mô hình vượt trội về chất lượng hình ảnh, độ chính xác ngữ nghĩa phức tạp và hiển thị văn bản tiếng Trung/Anh, với khả năng hiểu và tạo nội dung tiếng Trung mạnh mẽ.",
"Kwaipilot/KAT-Dev.description": "KAT-Dev (32B) là một mô hình mã nguồn mở 32B dành cho các tác vụ kỹ thuật phần mềm. Mô hình đạt tỷ lệ giải quyết 62,4% trên SWE-Bench Verified, xếp hạng thứ 5 trong số các mô hình mã nguồn mở. Được tối ưu thông qua huấn luyện trung gian, SFT và RL cho các tác vụ hoàn thành mã, sửa lỗi và đánh giá mã.",
"Llama-3.2-11B-Vision-Instruct.description": "Khả năng suy luận hình ảnh mạnh mẽ trên hình ảnh độ phân giải cao, phù hợp cho các ứng dụng hiểu thị giác.",
"Llama-3.2-90B-Vision-Instruct\t.description": "Khả năng suy luận hình ảnh tiên tiến cho các ứng dụng tác tử hiểu thị giác.",
"LongCat-Flash-Chat.description": "Mô hình LongCat-Flash-Chat đã được nâng cấp lên phiên bản mới. Bản cập nhật này chỉ cải thiện khả năng của mô hình; tên mô hình và phương pháp gọi API vẫn không thay đổi. Dựa trên đặc điểm nổi bật “hiệu suất cực cao” và “phản hồi nhanh như chớp,” phiên bản mới tăng cường khả năng hiểu ngữ cảnh và hiệu suất lập trình thực tế: Khả năng Lập Trình Được Nâng Cao Đáng Kể: Được tối ưu hóa sâu cho các tình huống tập trung vào nhà phát triển, mô hình mang lại cải tiến đáng kể trong các nhiệm vụ tạo mã, gỡ lỗi và giải thích. Các nhà phát triển được khuyến khích mạnh mẽ để đánh giá và so sánh các cải tiến này. Hỗ Trợ Ngữ Cảnh Siêu Dài 256K: Cửa sổ ngữ cảnh đã tăng gấp đôi từ thế hệ trước (128K) lên 256K, cho phép xử lý hiệu quả các tài liệu lớn và nhiệm vụ chuỗi dài. Hiệu Suất Đa Ngôn Ngữ Được Cải Thiện Toàn Diện: Cung cấp hỗ trợ mạnh mẽ cho chín ngôn ngữ, bao gồm tiếng Tây Ban Nha, tiếng Pháp, tiếng Ả Rập, tiếng Bồ Đào Nha, tiếng Nga và tiếng Indonesia. Khả Năng Tác Nhân Mạnh Mẽ Hơn: Thể hiện sự ổn định và hiệu quả cao hơn trong việc gọi công cụ phức tạp và thực hiện nhiệm vụ nhiều bước.",
"LongCat-Flash-Lite.description": "Mô hình LongCat-Flash-Lite đã được chính thức phát hành. Nó áp dụng kiến trúc Mixture-of-Experts (MoE) hiệu quả, với tổng số 68,5 tỷ tham số và khoảng 3 tỷ tham số được kích hoạt. Thông qua việc sử dụng bảng nhúng N-gram, nó đạt được hiệu quả sử dụng tham số cao và được tối ưu hóa sâu cho hiệu quả suy luận và các tình huống ứng dụng cụ thể. So với các mô hình có quy mô tương tự, các tính năng cốt lõi của nó như sau: Hiệu Quả Suy Luận Nổi Bật: Bằng cách tận dụng bảng nhúng N-gram để giảm thiểu cơ bản nút thắt I/O vốn có trong các kiến trúc MoE, kết hợp với các cơ chế lưu trữ chuyên dụng và tối ưu hóa cấp độ kernel, nó giảm đáng kể độ trễ suy luận và cải thiện hiệu quả tổng thể. Hiệu Suất Tác Nhân và Lập Trình Mạnh Mẽ: Nó thể hiện khả năng cạnh tranh cao trong các nhiệm vụ gọi công cụ và phát triển phần mềm, mang lại hiệu suất xuất sắc so với kích thước mô hình của nó.",
"LongCat-Flash-Thinking-2601.description": "Mô hình LongCat-Flash-Thinking-2601 đã được chính thức phát hành. Là một mô hình suy luận nâng cấp dựa trên kiến trúc Mixture-of-Experts (MoE), nó có tổng số 560 tỷ tham số. Trong khi duy trì tính cạnh tranh mạnh mẽ trên các tiêu chuẩn suy luận truyền thống, nó tăng cường có hệ thống khả năng suy luận cấp độ Tác Nhân thông qua học tăng cường đa môi trường quy mô lớn. So với mô hình LongCat-Flash-Thinking, các nâng cấp chính như sau: Độ Ổn Định Cực Cao Trong Môi Trường Nhiễu: Thông qua đào tạo theo kiểu giáo trình có hệ thống nhắm vào nhiễu và sự không chắc chắn trong các tình huống thực tế, mô hình thể hiện hiệu suất xuất sắc trong việc gọi công cụ Tác Nhân, tìm kiếm dựa trên Tác Nhân và suy luận tích hợp công cụ, với khả năng tổng quát được cải thiện đáng kể. Khả Năng Tác Nhân Mạnh Mẽ: Bằng cách xây dựng đồ thị phụ thuộc chặt chẽ bao gồm hơn 60 công cụ, và mở rộng đào tạo thông qua mở rộng đa môi trường và học khám phá quy mô lớn, mô hình cải thiện đáng kể khả năng tổng quát hóa đối với các tình huống thực tế phức tạp và ngoài phân phối. Chế Độ Suy Nghĩ Sâu Tiên Tiến: Nó mở rộng phạm vi suy luận thông qua suy luận song song và làm sâu sắc khả năng phân tích thông qua các cơ chế tóm tắt và trừu tượng hóa dựa trên phản hồi đệ quy, giải quyết hiệu quả các vấn đề rất thách thức.",
"LongCat-Flash-Thinking.description": "LongCat-Flash-Thinking đã được chính thức phát hành và đồng thời mã nguồn mở. Đây là một mô hình suy luận sâu có thể được sử dụng cho các cuộc trò chuyện tự do trong LongCat Chat, hoặc truy cập qua API bằng cách chỉ định model=LongCat-Flash-Thinking.",
"M2-her.description": "Một mô hình đối thoại văn bản được thiết kế cho nhập vai và hội thoại nhiều lượt, với khả năng tùy chỉnh nhân vật và biểu đạt cảm xúc.",
"Meta-Llama-3-3-70B-Instruct.description": "Llama 3.3 70B là một mô hình Transformer đa năng cho các tác vụ trò chuyện và tạo nội dung.",
"Meta-Llama-3.1-405B-Instruct.description": "Llama 3.1 là mô hình văn bản được tinh chỉnh theo hướng dẫn, tối ưu cho trò chuyện đa ngôn ngữ, đạt hiệu suất cao trên các tiêu chuẩn ngành phổ biến trong cả mô hình mở và đóng.",
"Meta-Llama-3.1-70B-Instruct.description": "Llama 3.1 là mô hình văn bản được tinh chỉnh theo hướng dẫn, tối ưu cho trò chuyện đa ngôn ngữ, đạt hiệu suất cao trên các tiêu chuẩn ngành phổ biến trong cả mô hình mở và đóng.",
"Meta-Llama-3.1-8B-Instruct.description": "Llama 3.1 là mô hình văn bản được tinh chỉnh theo hướng dẫn, tối ưu cho trò chuyện đa ngôn ngữ, đạt hiệu suất cao trên các tiêu chuẩn ngành phổ biến trong cả mô hình mở và đóng.",
"Meta-Llama-3.2-1B-Instruct.description": "Mô hình ngôn ngữ nhỏ tiên tiến với khả năng hiểu ngôn ngữ mạnh mẽ, suy luận xuất sắc và tạo văn bản hiệu quả.",
"Meta-Llama-3.2-3B-Instruct.description": "Mô hình ngôn ngữ nhỏ tiên tiến với khả năng hiểu ngôn ngữ mạnh mẽ, suy luận xuất sắc và tạo văn bản hiệu quả.",
"Meta-Llama-3.3-70B-Instruct.description": "Llama 3.3 là mô hình Llama mã nguồn mở đa ngôn ngữ tiên tiến nhất, đạt hiệu suất gần tương đương 405B với chi phí rất thấp. Dựa trên kiến trúc Transformer và được cải tiến bằng SFT và RLHF để tăng tính hữu ích và an toàn. Phiên bản tinh chỉnh theo hướng dẫn được tối ưu cho trò chuyện đa ngôn ngữ và vượt qua nhiều mô hình mở và đóng trên các tiêu chuẩn ngành. Ngày cắt kiến thức: Tháng 12 năm 2023.",
"Meta-Llama-4-Maverick-17B-128E-Instruct-FP8.description": "Llama 4 Maverick là một mô hình MoE lớn với kích hoạt chuyên gia hiệu quả, mang lại hiệu suất suy luận mạnh mẽ.",
"MiMo-V2-Pro.description": "MiMo-V2-Pro được thiết kế chuyên biệt cho quy trình agent cường độ cao trong các tình huống thực tế. Mô hình có hơn 1 nghìn tỷ tham số tổng (42B tham số kích hoạt), sử dụng kiến trúc attention lai sáng tạo và hỗ trợ độ dài ngữ cảnh siêu dài lên đến 1 triệu token. Được xây dựng trên một mô hình nền tảng mạnh mẽ, chúng tôi liên tục mở rộng tài nguyên tính toán cho nhiều kịch bản agent hơn, mở rộng không gian hành động và đạt khả năng khái quát mạnh mẽ—từ lập trình đến thực thi tác vụ thực (“claw”).",
"MiniMax-Hailuo-02.description": "Mô hình tạo video thế hệ tiếp theo, MiniMax Hailuo 02, đã chính thức ra mắt, hỗ trợ độ phân giải 1080P và tạo video dài 10 giây.",
"MiniMax-Hailuo-2.3-Fast.description": "Mô hình tạo video hoàn toàn mới với các nâng cấp toàn diện về chuyển động cơ thể, tính hiện thực vật lý và tuân thủ hướng dẫn.",
"MiniMax-Hailuo-2.3.description": "Mô hình tạo video hoàn toàn mới với các nâng cấp toàn diện về chuyển động cơ thể, tính hiện thực vật lý và tuân thủ hướng dẫn.",
"MiniMax-M1.description": "Mô hình suy luận nội bộ mới với 80K chuỗi suy nghĩ và đầu vào 1M, đạt hiệu suất tương đương các mô hình hàng đầu toàn cầu.",
"MiniMax-M2-Stable.description": "Được xây dựng cho lập trình hiệu quả và quy trình tác tử, với khả năng đồng thời cao hơn cho mục đích thương mại.",
"MiniMax-M2.1-Lightning.description": "Khả năng lập trình đa ngôn ngữ mạnh mẽ với khả năng suy luận nhanh hơn và hiệu quả hơn.",
"MiniMax-M2.1-highspeed.description": "Khả năng lập trình đa ngôn ngữ mạnh mẽ, trải nghiệm lập trình được nâng cấp toàn diện. Nhanh hơn và hiệu quả hơn.",
"MiniMax-M2.1.description": "Khả năng lập trình đa ngôn ngữ mạnh mẽ, trải nghiệm lập trình được nâng cấp toàn diện",
"MiniMax-M2.5-highspeed.description": "MiniMax M2.5 Highspeed: Hiệu suất tương tự như M2.5 với suy luận nhanh hơn.",
"MiniMax-M2.5.description": "MiniMax-M2.5 là mô hình lớn mã nguồn mở hàng đầu từ MiniMax, tập trung vào việc giải quyết các nhiệm vụ thực tế phức tạp. Điểm mạnh cốt lõi của nó là khả năng lập trình đa ngôn ngữ và khả năng giải quyết các nhiệm vụ phức tạp như một Agent.",
"MiniMax-M2.7-highspeed.description": "MiniMax M2.7 Highspeed: Hiệu suất tương tự như M2.7 với suy luận nhanh hơn đáng kể.",
"MiniMax-M2.7.description": "Mô hình tự tiến hóa đầu tiên với hiệu suất lập trình và tác tử hàng đầu (~60 tps).",
"MiniMax-M2.description": "MiniMax M2: Mô hình thế hệ trước.",
"MiniMax-Text-01.description": "MiniMax-01 giới thiệu cơ chế chú ý tuyến tính quy mô lớn vượt ra ngoài Transformer cổ điển, với 456B tham số và 45.9B được kích hoạt mỗi lượt. Mô hình đạt hiệu suất hàng đầu và hỗ trợ ngữ cảnh lên đến 4M token (gấp 32 lần GPT-4o, 20 lần Claude-3.5-Sonnet).",
"MiniMaxAI/MiniMax-M1-80k.description": "MiniMax-M1 là mô hình suy luận chú ý lai quy mô lớn với 456 tỷ tham số tổng cộng và ~45,9 tỷ tham số hoạt động trên mỗi token. Nó hỗ trợ tự nhiên ngữ cảnh 1 triệu và sử dụng Flash Attention để giảm FLOPs 75% trên thế hệ 100K-token so với DeepSeek R1. Với kiến trúc MoE cộng CISPO và huấn luyện RL chú ý lai, nó đạt hiệu suất hàng đầu trong suy luận đầu vào dài và các nhiệm vụ kỹ thuật phần mềm thực tế.",
"MiniMaxAI/MiniMax-M2.description": "MiniMax-M2 tái định nghĩa hiệu quả đại lý. Đây là mô hình MoE nhỏ gọn, nhanh, tiết kiệm chi phí với 230 tỷ tham số tổng cộng và 10 tỷ tham số hoạt động, được xây dựng cho các nhiệm vụ lập trình và đại lý hàng đầu trong khi vẫn giữ được trí thông minh tổng quát mạnh mẽ. Với chỉ 10 tỷ tham số hoạt động, nó cạnh tranh với các mô hình lớn hơn nhiều, làm cho nó lý tưởng cho các ứng dụng hiệu quả cao.",
"Moonshot-Kimi-K2-Instruct.description": "Tổng số tham số 1T với 32B đang hoạt động. Trong số các mô hình không tư duy, đây là mô hình hàng đầu về kiến thức tiên tiến, toán học và lập trình, và mạnh hơn trong các tác vụ đại lý tổng quát. Được tối ưu hóa cho khối lượng công việc của đại lý, nó có thể thực hiện hành động chứ không chỉ trả lời câu hỏi. Phù hợp nhất cho trò chuyện ứng biến, trò chuyện tổng quát và trải nghiệm đại lý như một mô hình phản xạ không cần suy nghĩ lâu.",
"NousResearch/Nous-Hermes-2-Mixtral-8x7B-DPO.description": "Nous Hermes 2 - Mixtral 8x7B-DPO (46.7B) là một mô hình hướng dẫn có độ chính xác cao dành cho các phép tính phức tạp.",
"OmniConsistency.description": "OmniConsistency cải thiện tính nhất quán về phong cách và khả năng tổng quát trong các tác vụ chuyển đổi hình ảnh bằng cách giới thiệu các bộ khuếch tán quy mô lớn (DiTs) và dữ liệu phong cách hóa theo cặp, tránh suy giảm phong cách.",
"PaddlePaddle/PaddleOCR-VL-1.5.description": "PaddleOCR-VL-1.5 là phiên bản nâng cấp của dòng PaddleOCR-VL, đạt độ chính xác 94,5% trên bộ đánh giá phân tích tài liệu OmniDocBench v1.5, vượt qua các mô hình lớn tổng quát và mô hình chuyên biệt về phân tích tài liệu. Mô hình hỗ trợ định vị hộp giới hạn không đều cho các thành phần tài liệu, xử lý hiệu quả hình ảnh được quét, nghiêng và chụp màn hình.",
"Phi-3-medium-128k-instruct.description": "Cùng một mô hình Phi-3-medium với cửa sổ ngữ cảnh lớn hơn để sử dụng trong RAG hoặc các lời nhắc few-shot.",
"Phi-3-medium-4k-instruct.description": "Mô hình 14B tham số với chất lượng cao hơn Phi-3-mini, tập trung vào dữ liệu chất lượng cao và yêu cầu suy luận.",
"Phi-3-mini-128k-instruct.description": "Cùng một mô hình Phi-3-mini với cửa sổ ngữ cảnh lớn hơn để sử dụng trong RAG hoặc các lời nhắc few-shot.",
"Phi-3-mini-4k-instruct.description": "Thành viên nhỏ nhất trong dòng Phi-3, được tối ưu hóa cho chất lượng và độ trễ thấp.",
"Phi-3-small-128k-instruct.description": "Cùng một mô hình Phi-3-small với cửa sổ ngữ cảnh lớn hơn để sử dụng trong RAG hoặc các lời nhắc few-shot.",
"Phi-3-small-8k-instruct.description": "Mô hình 7B tham số với chất lượng cao hơn Phi-3-mini, tập trung vào dữ liệu chất lượng cao và yêu cầu suy luận.",
"Phi-3.5-mini-instruct.description": "Phiên bản cập nhật của mô hình Phi-3-mini.",
"Phi-3.5-vision-instrust.description": "Phiên bản cập nhật của mô hình Phi-3-vision.",
"Pro/MiniMaxAI/MiniMax-M2.5.description": "MiniMax-M2.5 là mô hình ngôn ngữ lớn mới nhất được phát triển bởi MiniMax, được huấn luyện thông qua học tăng cường quy mô lớn trên hàng trăm nghìn môi trường thực tế phức tạp. Với kiến trúc MoE và 229 tỷ tham số, nó đạt hiệu suất hàng đầu trong các nhiệm vụ như lập trình, gọi công cụ đại lý, tìm kiếm và các kịch bản văn phòng.",
"Pro/Qwen/Qwen2.5-7B-Instruct.description": "Qwen2.5-7B-Instruct là một phần của dòng LLM mới nhất từ Alibaba Cloud. Mô hình 7B mang lại cải tiến đáng kể trong lập trình và toán học, hỗ trợ hơn 29 ngôn ngữ, và cải thiện khả năng tuân theo hướng dẫn, hiểu dữ liệu có cấu trúc và xuất dữ liệu có cấu trúc (đặc biệt là JSON).",
"Pro/THUDM/GLM-4.1V-9B-Thinking.description": "GLM-4.1V-9B-Thinking là mô hình VLM mã nguồn mở từ Zhipu AI và Phòng thí nghiệm KEG của Đại học Thanh Hoa, được thiết kế cho nhận thức đa phương thức phức tạp. Dựa trên GLM-4-9B-0414, nó bổ sung suy luận chuỗi tư duy và học tăng cường (RL) để cải thiện đáng kể khả năng suy luận xuyên phương thức và độ ổn định.",
"Pro/deepseek-ai/DeepSeek-R1-Distill-Qwen-7B.description": "DeepSeek-R1-Distill-Qwen-7B được chưng cất từ Qwen2.5-Math-7B và tinh chỉnh trên 800K mẫu DeepSeek-R1 được chọn lọc. Nó hoạt động mạnh mẽ, đạt 92,8% trên MATH-500, 55,5% trên AIME 2024, và xếp hạng 1189 CodeForces cho mô hình 7B.",
"Pro/deepseek-ai/DeepSeek-R1.description": "DeepSeek-R1 là mô hình suy luận dựa trên học tăng cường (RL) giúp giảm lặp lại và cải thiện khả năng đọc. Nó sử dụng dữ liệu khởi động lạnh trước RL để tăng cường khả năng suy luận, đạt hiệu suất tương đương OpenAI-o1 trong các tác vụ toán học, lập trình và suy luận, và cải thiện kết quả tổng thể thông qua huấn luyện cẩn thận.",
"Pro/deepseek-ai/DeepSeek-V3.1-Terminus.description": "DeepSeek-V3.1-Terminus là phiên bản cập nhật của mô hình V3.1, được định vị là LLM đại lý lai. Nó khắc phục các vấn đề do người dùng báo cáo và cải thiện độ ổn định, tính nhất quán ngôn ngữ, đồng thời giảm ký tự bất thường và trộn tiếng Trung/Anh. Nó tích hợp chế độ Tư duy và Không tư duy với mẫu trò chuyện để chuyển đổi linh hoạt. Ngoài ra, nó còn cải thiện hiệu suất của Code Agent và Search Agent để sử dụng công cụ đáng tin cậy hơn và thực hiện các tác vụ nhiều bước.",
"Pro/deepseek-ai/DeepSeek-V3.2.description": "DeepSeek-V3.2 là một mô hình kết hợp hiệu suất tính toán cao với khả năng suy luận và hiệu suất Agent xuất sắc. Phương pháp của nó dựa trên ba đột phá công nghệ chính: DeepSeek Sparse Attention (DSA), một cơ chế chú ý hiệu quả giúp giảm đáng kể độ phức tạp tính toán trong khi duy trì hiệu suất mô hình, và được tối ưu hóa đặc biệt cho các kịch bản ngữ cảnh dài; một khung học tăng cường có thể mở rộng, qua đó hiệu suất mô hình có thể cạnh tranh với GPT-5, với phiên bản tính toán cao của nó tương đương với Gemini-3.0-Pro về khả năng suy luận; và một quy trình tổng hợp nhiệm vụ Agent quy mô lớn nhằm tích hợp khả năng suy luận vào các kịch bản sử dụng công cụ, từ đó cải thiện khả năng theo dõi hướng dẫn và tổng quát hóa trong các môi trường tương tác phức tạp. Mô hình đã đạt thành tích huy chương vàng tại Olympic Toán học Quốc tế (IMO) và Olympic Tin học Quốc tế (IOI) năm 2025.",
"Pro/deepseek-ai/DeepSeek-V3.description": "DeepSeek-V3 là mô hình MoE với 671B tham số, sử dụng MLA và DeepSeekMoE với cân bằng tải không mất mát để suy luận và huấn luyện hiệu quả. Được huấn luyện sơ bộ trên 14.8T token chất lượng cao và tinh chỉnh thêm bằng SFT và RL, nó vượt trội hơn các mô hình mã nguồn mở khác và tiệm cận các mô hình đóng hàng đầu.",
"Pro/moonshotai/Kimi-K2-Instruct-0905.description": "Kimi K2-Instruct-0905 là phiên bản mới nhất và mạnh nhất của Kimi K2. Đây là mô hình MoE hàng đầu với tổng 1T và 32B tham số đang hoạt động. Các tính năng chính bao gồm trí tuệ lập trình đại lý mạnh hơn với cải tiến đáng kể trên các điểm chuẩn và tác vụ đại lý thực tế, cùng với thẩm mỹ và khả năng sử dụng mã giao diện người dùng được cải thiện.",
"Pro/moonshotai/Kimi-K2-Thinking.description": "Kimi K2 Thinking Turbo là biến thể Turbo được tối ưu hóa cho tốc độ suy luận và thông lượng trong khi vẫn giữ khả năng suy luận nhiều bước và sử dụng công cụ của K2 Thinking. Đây là mô hình MoE với khoảng 1T tham số, hỗ trợ ngữ cảnh gốc 256K và gọi công cụ quy mô lớn ổn định cho các tình huống sản xuất có yêu cầu nghiêm ngặt về độ trễ và đồng thời.",
"Pro/moonshotai/Kimi-K2.5.description": "Kimi K2.5 là mô hình tác tử đa phương thức mã nguồn mở, được xây dựng trên nền tảng Kimi-K2-Base, huấn luyện với khoảng 1,5 nghìn tỷ token kết hợp giữa thị giác và văn bản. Mô hình sử dụng kiến trúc MoE với tổng 1 nghìn tỷ tham số và 32 tỷ tham số hoạt động, hỗ trợ cửa sổ ngữ cảnh 256K, tích hợp liền mạch khả năng hiểu thị giác và ngôn ngữ.",
"Pro/zai-org/GLM-5.1.description": "GLM-5.1 là mô hình flagship thế hệ mới dành cho kỹ thuật agent, sử dụng kiến trúc Mixture of Experts (MoE) với 754B tham số. Mô hình tăng cường đáng kể năng lực lập trình, đạt kết quả dẫn đầu trên SWE-Bench Pro và vượt xa phiên bản trước trên các chuẩn như NL2Repo và Terminal-Bench 2.0. Được thiết kế cho các tác vụ agent kéo dài, mô hình xử lý câu hỏi mơ hồ với khả năng phán đoán tốt hơn, phân rã tác vụ phức tạp, thực hiện thử nghiệm, phân tích kết quả và tối ưu liên tục qua hàng trăm vòng lặp và hàng nghìn lần gọi công cụ.",
"Pro/zai-org/glm-4.7.description": "GLM-4.7 là mô hình hàng đầu thế hệ mới của Zhipu với 355 tỷ tham số tổng cộng và 32 tỷ tham số hoạt động, được nâng cấp toàn diện về đối thoại chung, lý luận và khả năng đại lý. GLM-4.7 cải tiến Tư duy Đan xen và giới thiệu Tư duy Bảo tồn và Tư duy Cấp độ Lượt.",
"Pro/zai-org/glm-5.description": "GLM-5 là mô hình ngôn ngữ lớn thế hệ tiếp theo của Zhipu, tập trung vào kỹ thuật hệ thống phức tạp và các nhiệm vụ Agent kéo dài. Các tham số mô hình đã được mở rộng lên 744 tỷ (40 tỷ hoạt động) và tích hợp DeepSeek Sparse Attention.",
"QwQ-32B-Preview.description": "Qwen QwQ là một mô hình nghiên cứu thử nghiệm tập trung vào việc cải thiện khả năng suy luận.",
"Qwen/QVQ-72B-Preview.description": "QVQ-72B-Preview là mô hình nghiên cứu từ Qwen tập trung vào lý luận hình ảnh, với thế mạnh trong hiểu các cảnh phức tạp và các vấn đề toán học hình ảnh.",
"Qwen/QwQ-32B-Preview.description": "Qwen QwQ là một mô hình nghiên cứu thử nghiệm tập trung vào việc nâng cao khả năng suy luận của AI.",
"Qwen/QwQ-32B.description": "QwQ là một mô hình suy luận thuộc họ Qwen. So với các mô hình huấn luyện theo hướng dẫn tiêu chuẩn, nó bổ sung khả năng tư duy và suy luận giúp cải thiện đáng kể hiệu suất trong các tác vụ phức tạp. QwQ-32B là một mô hình suy luận tầm trung có khả năng cạnh tranh với các mô hình hàng đầu như DeepSeek-R1 và o1-mini. Nó sử dụng RoPE, SwiGLU, RMSNorm và thiên vị QKV trong attention, với 64 lớp và 40 đầu attention Q (8 KV trong GQA).",
"Qwen/Qwen-Image-Edit-2509.description": "Qwen-Image-Edit-2509 là phiên bản chỉnh sửa mới nhất của Qwen-Image từ nhóm Qwen. Dựa trên mô hình Qwen-Image 20B, nó mở rộng khả năng hiển thị văn bản mạnh mẽ sang chỉnh sửa hình ảnh để thực hiện các chỉnh sửa văn bản chính xác. Mô hình sử dụng kiến trúc điều khiển kép, gửi đầu vào đến Qwen2.5-VL để kiểm soát ngữ nghĩa và bộ mã hóa VAE để kiểm soát hình thức, cho phép chỉnh sửa ở cả cấp độ ngữ nghĩa và hình thức. Nó hỗ trợ chỉnh sửa cục bộ (thêm/xóa/chỉnh sửa) và chỉnh sửa ngữ nghĩa cấp cao như tạo IP và chuyển đổi phong cách trong khi vẫn giữ nguyên ý nghĩa. Mô hình đạt kết quả SOTA trên nhiều bộ đánh giá.",
"Qwen/Qwen-Image.description": "Qwen-Image là một mô hình nền tảng tạo hình ảnh với 20 tỷ tham số từ nhóm Qwen. Mô hình đạt được những tiến bộ lớn trong hiển thị văn bản phức tạp và chỉnh sửa hình ảnh chính xác, đặc biệt là với văn bản tiếng Trung/Anh có độ trung thực cao. Nó hỗ trợ bố cục nhiều dòng và đoạn văn trong khi vẫn giữ được sự nhất quán về kiểu chữ. Ngoài hiển thị văn bản, mô hình còn hỗ trợ nhiều phong cách từ ảnh thực tế đến anime, và các chỉnh sửa nâng cao như chuyển đổi phong cách, thêm/xóa đối tượng, tăng cường chi tiết, chỉnh sửa văn bản và điều khiển tư thế, hướng tới việc trở thành nền tảng sáng tạo hình ảnh toàn diện.",
"Qwen/Qwen2-72B-Instruct.description": "Qwen 2 Instruct (72B) cung cấp khả năng tuân thủ hướng dẫn chính xác cho các tác vụ doanh nghiệp.",
"Qwen/Qwen2-7B-Instruct.description": "Qwen2-7B-Instruct là một mô hình 7B được tinh chỉnh theo hướng dẫn trong dòng Qwen2, sử dụng Transformer, SwiGLU, QKV bias và attention truy vấn nhóm. Mô hình xử lý đầu vào lớn và thể hiện hiệu suất mạnh mẽ trong các bài đánh giá về hiểu ngôn ngữ, sinh văn bản, đa ngôn ngữ, lập trình, toán học và suy luận, vượt trội hơn hầu hết các mô hình mã nguồn mở và vượt qua Qwen1.5-7B-Chat trong nhiều đánh giá.",
"Qwen/Qwen2-VL-72B-Instruct.description": "Qwen2-VL là mô hình Qwen-VL mới nhất, đạt SOTA trên các bộ đánh giá thị giác như MathVista, DocVQA, RealWorldQA và MTVQA. Mô hình có thể hiểu video dài hơn 20 phút để trả lời câu hỏi, đối thoại và tạo nội dung. Nó cũng hỗ trợ suy luận phức tạp và ra quyết định, tích hợp với thiết bị/robot để thực hiện hành động dựa trên thị giác. Ngoài tiếng Anh và tiếng Trung, mô hình còn có thể đọc văn bản bằng nhiều ngôn ngữ khác như hầu hết các ngôn ngữ châu Âu, tiếng Nhật, Hàn, Ả Rập và tiếng Việt.",
"Qwen/Qwen2.5-14B-Instruct.description": "Qwen2.5-14B-Instruct là một phần trong dòng mô hình LLM mới nhất của Alibaba Cloud. Mô hình 14B mang lại cải tiến đáng kể trong lập trình và toán học, hỗ trợ hơn 29 ngôn ngữ và cải thiện khả năng tuân thủ hướng dẫn, hiểu dữ liệu có cấu trúc và xuất dữ liệu có cấu trúc (đặc biệt là JSON).",
"Qwen/Qwen2.5-32B-Instruct.description": "Qwen2.5-32B-Instruct là một phần trong dòng mô hình LLM mới nhất của Alibaba Cloud. Mô hình 32B mang lại cải tiến đáng kể trong lập trình và toán học, hỗ trợ hơn 29 ngôn ngữ và cải thiện khả năng tuân thủ hướng dẫn, hiểu dữ liệu có cấu trúc và xuất dữ liệu có cấu trúc (đặc biệt là JSON).",
"Qwen/Qwen2.5-72B-Instruct-128K.description": "Qwen2.5-72B-Instruct là một phần trong dòng mô hình LLM mới nhất của Alibaba Cloud. Mô hình 72B cải thiện khả năng lập trình và toán học, hỗ trợ đầu vào lên đến 128K và đầu ra hơn 8K, cung cấp hơn 29 ngôn ngữ và cải thiện khả năng tuân thủ hướng dẫn và xuất dữ liệu có cấu trúc (đặc biệt là JSON).",
"Qwen/Qwen2.5-72B-Instruct-Turbo.description": "Qwen2.5 là dòng mô hình LLM mới được tối ưu hóa cho các tác vụ theo kiểu hướng dẫn.",
"Qwen/Qwen2.5-72B-Instruct.description": "Qwen2.5-72B-Instruct là một phần trong dòng mô hình LLM mới nhất của Alibaba Cloud. Mô hình 72B mang lại cải tiến đáng kể trong lập trình và toán học, hỗ trợ hơn 29 ngôn ngữ và cải thiện khả năng tuân thủ hướng dẫn, hiểu dữ liệu có cấu trúc và xuất dữ liệu có cấu trúc (đặc biệt là JSON).",
"Qwen/Qwen2.5-7B-Instruct-Turbo.description": "Qwen2.5 là dòng mô hình LLM mới được tối ưu hóa cho các tác vụ theo kiểu hướng dẫn.",
"Qwen/Qwen2.5-7B-Instruct.description": "Qwen2.5-7B-Instruct là một phần trong dòng mô hình LLM mới nhất của Alibaba Cloud. Mô hình 7B mang lại cải tiến đáng kể trong lập trình và toán học, hỗ trợ hơn 29 ngôn ngữ và cải thiện khả năng tuân thủ hướng dẫn, hiểu dữ liệu có cấu trúc và xuất dữ liệu có cấu trúc (đặc biệt là JSON).",
"Qwen/Qwen2.5-Coder-32B-Instruct.description": "Qwen2.5 Coder 32B Instruct là mô hình LLM mới nhất của Alibaba Cloud tập trung vào lập trình. Dựa trên Qwen2.5 và được huấn luyện với 5.5 nghìn tỷ token, mô hình cải thiện đáng kể khả năng sinh mã, suy luận và sửa lỗi trong khi vẫn giữ được thế mạnh về toán học và khả năng tổng quát, cung cấp nền tảng vững chắc cho các tác nhân lập trình.",
"Qwen/Qwen2.5-VL-32B-Instruct.description": "Qwen2.5-VL-32B-Instruct là một mô hình đa phương thức từ nhóm Qwen. Mô hình nhận diện các đối tượng phổ biến và phân tích văn bản, biểu đồ, biểu tượng, đồ họa và bố cục. Là một tác nhân thị giác, nó có thể suy luận và điều khiển công cụ một cách linh hoạt, bao gồm cả việc sử dụng máy tính và điện thoại. Mô hình định vị chính xác các đối tượng và tạo đầu ra có cấu trúc cho hóa đơn và bảng biểu. So với Qwen2-VL, RL cải thiện thêm khả năng toán học và giải quyết vấn đề, với phản hồi được người dùng ưa thích hơn.",
"Qwen/Qwen2.5-VL-72B-Instruct.description": "Qwen2.5-VL là mô hình thị giác-ngôn ngữ trong dòng Qwen2.5 với các nâng cấp lớn: khả năng hiểu hình ảnh mạnh mẽ hơn đối với vật thể, văn bản, biểu đồ và bố cục; suy luận như một tác nhân thị giác với khả năng sử dụng công cụ linh hoạt; hiểu video dài hơn 1 giờ và nắm bắt các sự kiện chính; định vị vật thể chính xác qua hộp hoặc điểm; và xuất dữ liệu có cấu trúc cho các tài liệu quét như hóa đơn và bảng biểu.",
"Qwen/Qwen3-14B.description": "Qwen3 là mô hình Tongyi Qwen thế hệ mới với những cải tiến vượt bậc về suy luận, năng lực tổng quát, khả năng tác nhân và hiệu suất đa ngôn ngữ, đồng thời hỗ trợ chuyển đổi giữa các chế độ tư duy.",
"Qwen/Qwen3-235B-A22B-Instruct-2507.description": "Qwen3-235B-A22B-Instruct-2507 là mô hình MoE hàng đầu trong dòng Qwen3 với tổng 235 tỷ và 22 tỷ tham số hoạt động. Đây là phiên bản không tư duy được cập nhật, tập trung vào việc cải thiện khả năng làm theo hướng dẫn, suy luận logic, hiểu văn bản, toán học, khoa học, lập trình và sử dụng công cụ. Mô hình cũng mở rộng kiến thức đa ngôn ngữ hiếm gặp và điều chỉnh tốt hơn với sở thích người dùng trong các tác vụ mở mang tính chủ quan.",
"Qwen/Qwen3-235B-A22B-Thinking-2507.description": "Qwen3-235B-A22B-Thinking-2507 là mô hình Qwen3 tập trung vào suy luận phức tạp. Sử dụng kiến trúc MoE với tổng 235 tỷ và khoảng 22 tỷ tham số hoạt động mỗi token để tăng hiệu quả. Là mô hình tư duy chuyên biệt, nó đạt được cải tiến lớn trong logic, toán học, khoa học, lập trình và các chuẩn học thuật, đạt hiệu suất tư duy hàng đầu. Mô hình cũng cải thiện khả năng làm theo hướng dẫn, sử dụng công cụ và tạo văn bản, đồng thời hỗ trợ ngữ cảnh 256K gốc cho suy luận sâu và tài liệu dài.",
"Qwen/Qwen3-235B-A22B.description": "Qwen3 235B A22B là mô hình siêu quy mô của Qwen3, mang lại khả năng AI hàng đầu.",
"Qwen/Qwen3-30B-A3B-Instruct-2507.description": "Qwen3-30B-A3B-Instruct-2507 là phiên bản không tư duy được cập nhật của Qwen3-30B-A3B. Đây là mô hình MoE với tổng 30,5 tỷ và 3,3 tỷ tham số hoạt động. Mô hình cải thiện đáng kể khả năng làm theo hướng dẫn, suy luận logic, hiểu văn bản, toán học, khoa học, lập trình và sử dụng công cụ, mở rộng kiến thức đa ngôn ngữ hiếm gặp và điều chỉnh tốt hơn với sở thích người dùng trong các tác vụ mở mang tính chủ quan. Hỗ trợ ngữ cảnh 256K. Phiên bản này chỉ hỗ trợ chế độ không tư duy và sẽ không tạo thẻ `<think></think>`.",
"Qwen/Qwen3-30B-A3B-Thinking-2507.description": "Qwen3-30B-A3B-Thinking-2507 là mô hình tư duy mới nhất trong dòng Qwen3. Đây là mô hình MoE với tổng 30,5 tỷ và 3,3 tỷ tham số hoạt động, tập trung vào các tác vụ phức tạp. Mô hình đạt được cải tiến đáng kể trong logic, toán học, khoa học, lập trình và các chuẩn học thuật, đồng thời cải thiện khả năng làm theo hướng dẫn, sử dụng công cụ, tạo văn bản và điều chỉnh theo sở thích. Hỗ trợ ngữ cảnh 256K gốc và có thể mở rộng đến 1 triệu token. Phiên bản này được thiết kế cho chế độ tư duy với suy luận từng bước chi tiết và khả năng tác nhân mạnh mẽ.",
"Qwen/Qwen3-32B.description": "Qwen3 là mô hình Tongyi Qwen thế hệ mới với những cải tiến vượt bậc về suy luận, năng lực tổng quát, khả năng tác nhân và hiệu suất đa ngôn ngữ, đồng thời hỗ trợ chuyển đổi giữa các chế độ tư duy.",
"Qwen/Qwen3-8B.description": "Qwen3 là mô hình Tongyi Qwen thế hệ mới với những cải tiến vượt bậc về suy luận, năng lực tổng quát, khả năng tác nhân và hiệu suất đa ngôn ngữ, đồng thời hỗ trợ chuyển đổi giữa các chế độ tư duy.",
"Qwen/Qwen3-Coder-30B-A3B-Instruct.description": "Qwen3-Coder-30B-A3B-Instruct là mô hình lập trình Qwen3 từ nhóm Qwen. Mô hình được tối ưu hóa để đạt hiệu suất cao và hiệu quả, đồng thời tăng cường khả năng lập trình. Nó thể hiện ưu thế vượt trội trong lập trình tác nhân, thao tác trình duyệt tự động và sử dụng công cụ trong số các mô hình mã nguồn mở. Hỗ trợ ngữ cảnh 256K gốc và có thể mở rộng đến 1 triệu token để hiểu ở cấp độ mã nguồn. Mô hình hỗ trợ lập trình tác nhân trên các nền tảng như Qwen Code và CLINE với định dạng gọi hàm chuyên biệt.",
"Qwen/Qwen3-Coder-480B-A35B-Instruct.description": "Qwen3-Coder-480B-A35B-Instruct là mô hình lập trình tác nhân mạnh mẽ nhất của Alibaba cho đến nay. Đây là mô hình MoE với tổng 480 tỷ và 35 tỷ tham số hoạt động, cân bằng giữa hiệu suất và hiệu quả. Hỗ trợ ngữ cảnh 256K gốc và có thể mở rộng đến 1 triệu token qua YaRN, cho phép xử lý mã nguồn lớn. Được thiết kế cho quy trình lập trình tác nhân, mô hình có thể tương tác với công cụ và môi trường để giải quyết các tác vụ lập trình phức tạp. Đạt kết quả hàng đầu trong số các mô hình mã nguồn mở về lập trình và chuẩn tác nhân, sánh ngang với các mô hình hàng đầu như Claude Sonnet 4.",
"Qwen/Qwen3-Omni-30B-A3B-Captioner.description": "Qwen3-Omni-30B-A3B-Captioner là mô hình VLM trong dòng Qwen3 được xây dựng để tạo mô tả hình ảnh chất lượng cao, chi tiết và chính xác. Sử dụng kiến trúc MoE 30B tham số để hiểu sâu hình ảnh và tạo mô tả trôi chảy, xuất sắc trong việc nắm bắt chi tiết, hiểu cảnh, nhận diện vật thể và suy luận quan hệ.",
"Qwen/Qwen3-Omni-30B-A3B-Instruct.description": "Qwen3-Omni-30B-A3B-Instruct là mô hình MoE dòng Qwen3 với tổng 30B và 3B tham số hoạt động, mang lại hiệu suất mạnh mẽ với chi phí suy luận thấp hơn. Được huấn luyện trên dữ liệu đa nguồn đa ngôn ngữ chất lượng cao, mô hình hỗ trợ đầu vào toàn bộ các phương thức (văn bản, hình ảnh, âm thanh, video) và hiểu/generating xuyên phương thức.",
"Qwen/Qwen3-Omni-30B-A3B-Thinking.description": "Qwen3-Omni-30B-A3B-Thinking là thành phần \"Thinker\" cốt lõi của Qwen3-Omni. Mô hình xử lý đầu vào đa phương thức (văn bản, âm thanh, hình ảnh, video) và thực hiện suy luận chuỗi phức tạp, hợp nhất đầu vào thành biểu diễn chung để hiểu sâu xuyên phương thức. Đây là mô hình MoE với tổng 30B và 3B tham số hoạt động, cân bằng giữa suy luận mạnh và hiệu quả tính toán.",
"Qwen/Qwen3-VL-235B-A22B-Instruct.description": "Qwen3-VL-235B-A22B-Instruct là mô hình Qwen3-VL lớn được tinh chỉnh theo hướng dẫn, xây dựng trên kiến trúc MoE, mang lại khả năng hiểu và tạo đa phương thức xuất sắc. Hỗ trợ ngữ cảnh 256K gốc và phù hợp cho các dịch vụ đa phương thức sản xuất có độ đồng thời cao.",
"Qwen/Qwen3-VL-235B-A22B-Thinking.description": "Qwen3-VL-235B-A22B-Thinking là phiên bản tư duy hàng đầu của Qwen3-VL, được tối ưu hóa cho suy luận đa phương thức phức tạp, suy luận ngữ cảnh dài và tương tác tác nhân trong các tình huống doanh nghiệp.",
"Qwen/Qwen3-VL-30B-A3B-Instruct.description": "Qwen3-VL-30B-A3B-Instruct là mô hình Qwen3-VL được tinh chỉnh theo hướng dẫn với khả năng hiểu và tạo thị giác-ngôn ngữ mạnh mẽ. Hỗ trợ ngữ cảnh 256K gốc cho trò chuyện đa phương thức và tạo nội dung dựa trên hình ảnh.",
"Qwen/Qwen3-VL-30B-A3B-Thinking.description": "Qwen3-VL-30B-A3B-Thinking là phiên bản tăng cường suy luận của Qwen3-VL, được tối ưu hóa cho suy luận đa phương thức, chuyển đổi hình ảnh thành mã và hiểu thị giác phức tạp. Hỗ trợ ngữ cảnh 256K với khả năng chuỗi suy nghĩ mạnh mẽ.",
"Qwen/Qwen3-VL-32B-Instruct.description": "Qwen3-VL-32B-Instruct là mô hình thị giác-ngôn ngữ từ nhóm Qwen với kết quả SOTA hàng đầu trên nhiều chuẩn VL. Hỗ trợ hình ảnh độ phân giải megapixel và cung cấp khả năng hiểu thị giác mạnh mẽ, OCR đa ngôn ngữ, định vị thị giác chi tiết và đối thoại thị giác. Mô hình xử lý các tác vụ đa phương thức phức tạp và hỗ trợ gọi công cụ và hoàn thành tiền tố.",
"Qwen/Qwen3-VL-32B-Thinking.description": "Qwen3-VL-32B-Thinking được tối ưu hóa cho suy luận thị giác phức tạp. Bao gồm chế độ tư duy tích hợp tạo các bước suy luận trung gian trước khi đưa ra câu trả lời, tăng cường logic nhiều bước, lập kế hoạch và suy luận phức tạp. Hỗ trợ hình ảnh megapixel, hiểu thị giác mạnh, OCR đa ngôn ngữ, định vị chi tiết, đối thoại thị giác, gọi công cụ và hoàn thành tiền tố.",
"Qwen/Qwen3-VL-8B-Instruct.description": "Qwen3-VL-8B-Instruct là mô hình thị giác-ngôn ngữ Qwen3 được xây dựng trên Qwen3-8B-Instruct và huấn luyện trên dữ liệu hình ảnh-văn bản lớn. Mô hình xuất sắc trong hiểu thị giác tổng quát, đối thoại tập trung vào hình ảnh và nhận diện văn bản đa ngôn ngữ trong hình ảnh, phù hợp cho hỏi đáp thị giác, tạo chú thích, làm theo hướng dẫn đa phương thức và sử dụng công cụ.",
"Qwen/Qwen3-VL-8B-Thinking.description": "Qwen3-VL-8B-Thinking là phiên bản tư duy thị giác của Qwen3, được tối ưu hóa cho suy luận nhiều bước phức tạp. Mô hình tạo chuỗi suy nghĩ trước khi đưa ra câu trả lời để cải thiện độ chính xác, lý tưởng cho hỏi đáp thị giác sâu và phân tích hình ảnh chi tiết.",
"Qwen/Qwen3.5-122B-A10B.description": "Qwen3.5-122B-A10B là mô hình ngôn ngữ lớn đa phương thức từ đội ngũ Qwen với tổng số 122 tỷ tham số và chỉ 10 tỷ tham số hoạt động. Nó áp dụng kiến trúc lai hiệu quả kết hợp Gated Delta Networks và Sparse Mixture-of-Experts (MoE), hỗ trợ ngữ cảnh dài 256K với khả năng mở rộng lên khoảng 1 triệu token.",
"Qwen/Qwen3.5-27B.description": "Qwen3.5-27B là mô hình ngôn ngữ lớn đa phương thức từ đội ngũ Qwen với 27 tỷ tham số. Nó áp dụng kiến trúc lai hiệu quả kết hợp Gated Delta Networks và Gated Attention, hỗ trợ ngữ cảnh dài 256K với khả năng mở rộng lên khoảng 1 triệu token.",
"Qwen/Qwen3.5-35B-A3B.description": "Qwen3.5-35B-A3B là mô hình ngôn ngữ lớn đa phương thức từ đội ngũ Qwen với tổng số 35 tỷ tham số và chỉ 3 tỷ tham số hoạt động. Nó áp dụng kiến trúc lai hiệu quả kết hợp Gated Delta Networks và Sparse Mixture-of-Experts (MoE), hỗ trợ ngữ cảnh dài 256K với khả năng mở rộng lên khoảng 1 triệu token.",
"Qwen/Qwen3.5-397B-A17B.description": "Qwen3.5-397B-A17B là mô hình ngôn ngữ hình ảnh mới nhất trong dòng Qwen3.5, sử dụng kiến trúc Mixture-of-Experts (MoE) với tổng số 397 tỷ tham số và 17 tỷ tham số hoạt động. Nó hỗ trợ ngữ cảnh dài 256K với khả năng mở rộng lên khoảng 1 triệu token, hỗ trợ 201 ngôn ngữ và cung cấp khả năng hiểu ngôn ngữ-hình ảnh thống nhất, gọi công cụ và suy luận.",
"Qwen/Qwen3.5-4B.description": "Qwen3.5-4B là mô hình ngôn ngữ lớn đa phương thức từ đội ngũ Qwen với 4 tỷ tham số, là mô hình Dense nhẹ nhất trong dòng Qwen3.5. Nó áp dụng kiến trúc lai hiệu quả kết hợp Gated Delta Networks và Gated Attention, hỗ trợ ngữ cảnh dài 256K với khả năng mở rộng lên khoảng 1 triệu token.",
"Qwen/Qwen3.5-9B.description": "Qwen3.5-9B là mô hình ngôn ngữ lớn đa phương thức từ đội ngũ Qwen với 9 tỷ tham số. Là mô hình Dense nhẹ trong dòng Qwen3.5, nó áp dụng kiến trúc lai hiệu quả kết hợp Gated Delta Networks và Gated Attention, hỗ trợ ngữ cảnh dài 256K với khả năng mở rộng lên khoảng 1 triệu token.",
"Qwen2-72B-Instruct.description": "Qwen2 là dòng Qwen mới nhất, hỗ trợ cửa sổ ngữ cảnh 128k. So với các mô hình mã nguồn mở hàng đầu hiện nay, Qwen2-72B vượt trội đáng kể trong hiểu ngôn ngữ tự nhiên, kiến thức, lập trình, toán học và khả năng đa ngôn ngữ.",
"Qwen2-7B-Instruct.description": "Qwen2 là dòng Qwen mới nhất, vượt qua các mô hình mã nguồn mở tốt nhất cùng kích thước và thậm chí cả các mô hình lớn hơn. Qwen2 7B thể hiện ưu thế rõ rệt trên nhiều chuẩn, đặc biệt là trong lập trình và hiểu tiếng Trung.",
"Qwen2-VL-72B.description": "Qwen2-VL-72B là mô hình thị giác-ngôn ngữ mạnh mẽ hỗ trợ xử lý hình ảnh-văn bản đa phương thức, nhận diện chính xác nội dung hình ảnh và tạo mô tả hoặc câu trả lời phù hợp.",
"Qwen2.5-14B-Instruct.description": "Qwen2.5-14B-Instruct là mô hình LLM 14B tham số với hiệu suất mạnh mẽ, được tối ưu hóa cho các tình huống tiếng Trung và đa ngôn ngữ, hỗ trợ hỏi đáp thông minh và tạo nội dung.",
"Qwen2.5-32B-Instruct.description": "Qwen2.5-32B-Instruct là mô hình LLM 32B tham số với hiệu suất cân bằng, được tối ưu hóa cho các tình huống tiếng Trung và đa ngôn ngữ, hỗ trợ hỏi đáp thông minh và tạo nội dung.",
"Qwen2.5-72B-Instruct.description": "LLM cho tiếng Trung và tiếng Anh, được tinh chỉnh cho ngôn ngữ, lập trình, toán học và suy luận.",
"Qwen2.5-7B-Instruct.description": "Qwen2.5-7B-Instruct là mô hình LLM 7B tham số hỗ trợ gọi hàm và tích hợp liền mạch với hệ thống bên ngoài, cải thiện đáng kể tính linh hoạt và khả năng mở rộng. Mô hình được tối ưu hóa cho các tình huống tiếng Trung và đa ngôn ngữ, hỗ trợ hỏi đáp thông minh và tạo nội dung.",
"Qwen2.5-Coder-14B-Instruct.description": "Qwen2.5-Coder-14B-Instruct là mô hình hướng dẫn lập trình quy mô lớn được huấn luyện trước với khả năng hiểu và tạo mã mạnh mẽ. Mô hình xử lý hiệu quả nhiều tác vụ lập trình, lý tưởng cho lập trình thông minh, tạo script tự động và hỏi đáp lập trình.",
"Qwen2.5-Coder-32B-Instruct.description": "LLM tiên tiến cho tạo mã, suy luận và sửa lỗi trên các ngôn ngữ lập trình chính.",
"Qwen3-235B-A22B-Instruct-2507-FP8.description": "Qwen3 235B A22B Instruct 2507 được tối ưu hóa cho lập luận nâng cao và tuân theo hướng dẫn, sử dụng MoE để duy trì hiệu quả suy luận ở quy mô lớn.",
"Qwen3-235B.description": "Qwen3-235B-A22B là một mô hình MoE giới thiệu chế độ suy luận lai, cho phép người dùng chuyển đổi mượt mà giữa trạng thái suy nghĩ và không suy nghĩ. Mô hình hỗ trợ hiểu và suy luận trên 119 ngôn ngữ và phương ngữ, có khả năng gọi công cụ mạnh mẽ, cạnh tranh với các mô hình phổ biến như DeepSeek R1, OpenAI o1, o3-mini, Grok 3 và Google Gemini 2.5 Pro trong các bài kiểm tra về năng lực tổng quát, lập trình và toán học, khả năng đa ngôn ngữ và suy luận kiến thức.",
"Qwen3-32B.description": "Qwen3-32B là một mô hình dense giới thiệu chế độ suy luận lai, cho phép người dùng chuyển đổi giữa trạng thái suy nghĩ và không suy nghĩ. Với cải tiến kiến trúc, dữ liệu phong phú hơn và huấn luyện tốt hơn, mô hình đạt hiệu suất tương đương với Qwen2.5-72B.",
"Qwen3.5-Plus.description": "Qwen3.5 Plus hỗ trợ đầu vào văn bản, hình ảnh và video. Hiệu suất trên tác vụ văn bản thuần tương đương Qwen3 Max, nhưng với chi phí thấp hơn và hiệu quả hơn. Khả năng đa phương thức được cải thiện đáng kể so với dòng Qwen3 VL.",
"S2V-01.description": "Mô hình cơ bản tham chiếu thành video của dòng 01.",
"SenseChat-128K.description": "Phiên bản Base V4 với ngữ cảnh 128K, mạnh về hiểu và tạo văn bản dài.",
"SenseChat-32K.description": "Phiên bản Base V4 với ngữ cảnh 32K, linh hoạt cho nhiều tình huống sử dụng.",
"SenseChat-5-1202.description": "Phiên bản mới nhất dựa trên V5.5, cải thiện đáng kể về nền tảng tiếng Trung/Anh, trò chuyện, kiến thức STEM, nhân văn, viết lách, toán học/lôgic và kiểm soát độ dài.",
"SenseChat-5-Cantonese.description": "Thiết kế phù hợp với thói quen hội thoại, tiếng lóng và kiến thức địa phương của Hồng Kông; vượt GPT-4 về hiểu tiếng Quảng Đông và ngang tầm GPT-4 Turbo về kiến thức, suy luận, toán học và lập trình.",
"SenseChat-5-beta.description": "Một số hiệu suất vượt trội hơn SenseChat-5-1202.",
"SenseChat-5.description": "Phiên bản V5.5 mới nhất với ngữ cảnh 128K; cải thiện lớn về suy luận toán học, trò chuyện tiếng Anh, tuân theo hướng dẫn và hiểu văn bản dài, tương đương GPT-4o.",
"SenseChat-Character-Pro.description": "Mô hình trò chuyện nhân vật nâng cao với ngữ cảnh 32K, năng lực cải thiện và hỗ trợ tiếng Trung/Anh.",
"SenseChat-Character.description": "Mô hình trò chuyện nhân vật tiêu chuẩn với ngữ cảnh 8K và tốc độ phản hồi cao.",
"SenseChat-Turbo-1202.description": "Mô hình nhẹ mới nhất đạt hơn 90% năng lực của mô hình đầy đủ với chi phí suy luận thấp hơn đáng kể.",
"SenseChat-Turbo.description": "Phù hợp cho các tình huống hỏi đáp nhanh và tinh chỉnh mô hình.",
"SenseChat-Vision.description": "Phiên bản V5.5 mới nhất hỗ trợ đầu vào đa hình ảnh và cải tiến toàn diện về nhận diện thuộc tính, quan hệ không gian, phát hiện hành động/sự kiện, hiểu cảnh, nhận diện cảm xúc, suy luận thông thường và hiểu/tạo văn bản.",
"SenseChat.description": "Phiên bản Base V4 với ngữ cảnh 4K và năng lực tổng quát mạnh.",
"SenseNova-V6-5-Pro.description": "Với cập nhật toàn diện về dữ liệu đa phương thức, ngôn ngữ và suy luận cùng tối ưu hóa chiến lược huấn luyện, mô hình mới cải thiện đáng kể khả năng suy luận đa phương thức và tuân theo hướng dẫn tổng quát, hỗ trợ cửa sổ ngữ cảnh lên đến 128K và xuất sắc trong các tác vụ nhận diện OCR và IP du lịch văn hóa.",
"SenseNova-V6-5-Turbo.description": "Với cập nhật toàn diện về dữ liệu đa phương thức, ngôn ngữ và suy luận cùng tối ưu hóa chiến lược huấn luyện, mô hình mới cải thiện đáng kể khả năng suy luận đa phương thức và tuân theo hướng dẫn tổng quát, hỗ trợ cửa sổ ngữ cảnh lên đến 128K và xuất sắc trong các tác vụ nhận diện OCR và IP du lịch văn hóa.",
"SenseNova-V6-Pro.description": "Hợp nhất tự nhiên hình ảnh, văn bản và video, phá vỡ rào cản truyền thống của mô hình đa phương thức; đạt vị trí hàng đầu trên OpenCompass và SuperCLUE.",
"SenseNova-V6-Reasoner.description": "Kết hợp suy luận sâu giữa thị giác và ngôn ngữ, hỗ trợ tư duy chậm và chuỗi suy nghĩ đầy đủ.",
"SenseNova-V6-Turbo.description": "Hợp nhất tự nhiên hình ảnh, văn bản và video, phá vỡ rào cản truyền thống của mô hình đa phương thức. Dẫn đầu về năng lực cốt lõi đa phương thức và ngôn ngữ, xếp hạng hàng đầu trong nhiều đánh giá.",
"Skylark2-lite-8k.description": "Mô hình Skylark thế hệ thứ hai. Skylark2-lite phản hồi nhanh cho các tình huống thời gian thực, nhạy cảm về chi phí với yêu cầu độ chính xác thấp hơn, hỗ trợ ngữ cảnh 8K.",
"Skylark2-pro-32k.description": "Mô hình Skylark thế hệ thứ hai. Skylark2-pro cung cấp độ chính xác cao hơn cho các tác vụ tạo văn bản phức tạp như viết nội dung chuyên nghiệp, tiểu thuyết và dịch chất lượng cao, hỗ trợ ngữ cảnh 32K.",
"Skylark2-pro-4k.description": "Mô hình Skylark thế hệ thứ hai. Skylark2-pro cung cấp độ chính xác cao hơn cho các tác vụ tạo văn bản phức tạp như viết nội dung chuyên nghiệp, tiểu thuyết và dịch chất lượng cao, hỗ trợ ngữ cảnh 4K.",
"Skylark2-pro-character-4k.description": "Mô hình Skylark thế hệ thứ hai. Skylark2-pro-character xuất sắc trong nhập vai và trò chuyện, phù hợp với phong cách nhân vật riêng biệt và đối thoại tự nhiên cho chatbot, trợ lý ảo và dịch vụ khách hàng, phản hồi nhanh.",
"Skylark2-pro-turbo-8k.description": "Mô hình Skylark thế hệ thứ hai. Skylark2-pro-turbo-8k cung cấp suy luận nhanh hơn với chi phí thấp hơn, hỗ trợ ngữ cảnh 8K.",
"T2V-01-Director.description": "Mô hình tạo video cấp đạo diễn đã chính thức ra mắt, cung cấp khả năng tuân thủ tốt hơn các hướng dẫn về chuyển động camera và ngôn ngữ kể chuyện điện ảnh.",
"T2V-01.description": "Mô hình cơ bản chuyển đổi văn bản thành video của dòng 01.",
"THUDM/GLM-4-32B-0414.description": "GLM-4-32B-0414 là mô hình GLM thế hệ tiếp theo mã nguồn mở với 32 tỷ tham số, hiệu suất tương đương OpenAI GPT và dòng DeepSeek V3/R1.",
"THUDM/GLM-4-9B-0414.description": "GLM-4-9B-0414 là mô hình GLM 9B kế thừa kỹ thuật từ GLM-4-32B nhưng triển khai nhẹ hơn. Mô hình hoạt động tốt trong tạo mã, thiết kế web, tạo SVG và viết dựa trên tìm kiếm.",
"THUDM/GLM-4.1V-9B-Thinking.description": "GLM-4.1V-9B-Thinking là mô hình VLM mã nguồn mở từ Zhipu AI và Tsinghua KEG Lab, được thiết kế cho nhận thức đa phương thức phức tạp. Dựa trên GLM-4-9B-0414, nó bổ sung lý luận chuỗi tư duy và RL để cải thiện đáng kể lý luận đa phương thức và độ ổn định.",
"THUDM/GLM-Z1-32B-0414.description": "GLM-Z1-32B-0414 là mô hình suy luận sâu được xây dựng từ GLM-4-32B-0414 với dữ liệu khởi động lạnh và RL mở rộng, được huấn luyện thêm về toán học, mã và logic. Mô hình cải thiện đáng kể khả năng toán học và giải quyết nhiệm vụ phức tạp so với mô hình gốc.",
"THUDM/GLM-Z1-9B-0414.description": "GLM-Z1-9B-0414 là mô hình GLM nhỏ với 9 tỷ tham số, giữ vững thế mạnh mã nguồn mở và cung cấp năng lực ấn tượng. Mô hình hoạt động mạnh về suy luận toán học và các tác vụ tổng quát, dẫn đầu phân khúc kích thước của mình trong số các mô hình mở.",
"Tongyi-Zhiwen/QwenLong-L1-32B.description": "QwenLong-L1-32B là mô hình lý luận ngữ cảnh dài đầu tiên (LRM) được huấn luyện với RL, tối ưu hóa cho lý luận văn bản dài. RL mở rộng ngữ cảnh tiến bộ của nó cho phép chuyển đổi ổn định từ ngữ cảnh ngắn sang dài. Nó vượt qua OpenAI-o3-mini và Qwen3-235B-A22B trên bảy tiêu chuẩn QA tài liệu ngữ cảnh dài, cạnh tranh với Claude-3.7-Sonnet-Thinking. Nó đặc biệt mạnh về toán học, logic và lý luận đa bước.",
"Wan-AI/Wan2.2-I2V-A14B.description": "Wan2.2-I2V-A14B là một trong những mô hình tạo video từ hình ảnh (I2V) mã nguồn mở đầu tiên được phát hành bởi Wan-AI, một sáng kiến AI thuộc Alibaba, áp dụng kiến trúc Mixture of Experts (MoE). Mô hình tập trung vào việc tạo ra các chuỗi video động mượt mà và tự nhiên bằng cách kết hợp hình ảnh tĩnh với các gợi ý văn bản. Đổi mới cốt lõi của nó nằm ở kiến trúc MoE: một chuyên gia xử lý nhiễu cao chịu trách nhiệm xử lý cấu trúc thô ở giai đoạn đầu của quá trình tạo video, trong khi một chuyên gia xử lý nhiễu thấp tinh chỉnh các chi tiết tinh tế ở giai đoạn sau. Thiết kế này cải thiện hiệu suất tổng thể của mô hình mà không tăng chi phí suy luận. So với các phiên bản trước, Wan2.2 được đào tạo trên một tập dữ liệu lớn hơn đáng kể, dẫn đến những cải tiến đáng kể trong việc hiểu chuyển động phức tạp, phong cách thẩm mỹ và nội dung ngữ nghĩa. Nó tạo ra các video ổn định hơn và giảm các chuyển động camera không thực tế.",
"Wan-AI/Wan2.2-T2V-A14B.description": "Wan2.2-T2V-A14B là mô hình tạo video từ văn bản (T2V) mã nguồn mở đầu tiên được phát hành bởi Alibaba, áp dụng kiến trúc Mixture of Experts (MoE). Mô hình được thiết kế cho các nhiệm vụ tạo video từ văn bản và có khả năng tạo video dài đến 5 giây với độ phân giải 480P hoặc 720P. Bằng cách giới thiệu kiến trúc MoE, mô hình tăng đáng kể khả năng tổng thể của nó trong khi giữ chi phí suy luận gần như không đổi. Nó bao gồm một chuyên gia xử lý nhiễu cao để xử lý cấu trúc toàn cầu ở giai đoạn đầu của quá trình tạo, và một chuyên gia xử lý nhiễu thấp để tinh chỉnh các chi tiết ở giai đoạn sau của video. Ngoài ra, Wan2.2 tích hợp dữ liệu thẩm mỹ được chọn lọc kỹ lưỡng, với các chú thích chi tiết trên các khía cạnh như ánh sáng, bố cục và màu sắc. Điều này cho phép tạo ra các hình ảnh chất lượng điện ảnh chính xác và có thể kiểm soát được. So với các phiên bản trước, mô hình được đào tạo trên một tập dữ liệu lớn hơn, dẫn đến sự cải thiện đáng kể về khả năng tổng quát hóa trong chuyển động, ngữ nghĩa và thẩm mỹ, cũng như xử lý tốt hơn các hiệu ứng động phức tạp.",
"Yi-34B-Chat.description": "Yi-1.5-34B giữ vững năng lực ngôn ngữ tổng quát mạnh mẽ của dòng Yi, đồng thời sử dụng huấn luyện gia tăng trên 500 tỷ token chất lượng cao để cải thiện đáng kể logic toán học và lập trình.",
"abab5.5-chat.description": "Thiết kế cho các tình huống năng suất với khả năng xử lý tác vụ phức tạp và tạo văn bản hiệu quả cho mục đích chuyên nghiệp.",
"abab5.5s-chat.description": "Thiết kế cho trò chuyện nhân vật tiếng Trung, mang lại đối thoại tiếng Trung chất lượng cao cho nhiều ứng dụng.",
"abab6.5g-chat.description": "Thiết kế cho trò chuyện nhân vật đa ngôn ngữ, hỗ trợ tạo đối thoại chất lượng cao bằng tiếng Anh và các ngôn ngữ khác.",
"abab6.5s-chat.description": "Phù hợp với nhiều tác vụ NLP, bao gồm tạo văn bản và hệ thống đối thoại.",
"abab6.5t-chat.description": "Tối ưu hóa cho trò chuyện nhân vật tiếng Trung, cung cấp đối thoại trôi chảy phù hợp với thói quen biểu đạt tiếng Trung.",
"accounts/fireworks/models/deepseek-r1.description": "DeepSeek-R1 là một mô hình ngôn ngữ tiên tiến được tối ưu hóa bằng học tăng cường và dữ liệu khởi đầu lạnh, mang lại hiệu suất vượt trội trong lập luận, toán học và lập trình.",
"accounts/fireworks/models/deepseek-v3.description": "Một mô hình ngôn ngữ Mixture-of-Experts (MoE) mạnh mẽ từ DeepSeek với tổng số tham số là 671 tỷ và 37 tỷ tham số hoạt động cho mỗi token.",
"accounts/fireworks/models/llama-v3-70b-instruct.description": "Meta đã phát triển và phát hành dòng mô hình Meta Llama 3 LLM, bao gồm các mô hình tạo văn bản được huấn luyện trước và tinh chỉnh theo hướng dẫn với kích thước 8B và 70B. Các mô hình Llama 3 được tinh chỉnh theo hướng dẫn được tối ưu hóa cho hội thoại và vượt trội hơn nhiều mô hình trò chuyện mở hiện có trong các bài kiểm tra tiêu chuẩn của ngành.",
"accounts/fireworks/models/llama-v3-8b-instruct-hf.description": "Các mô hình Llama 3 được tinh chỉnh theo hướng dẫn của Meta được tối ưu hóa cho hội thoại và vượt trội hơn nhiều mô hình trò chuyện mở hiện có trong các bài kiểm tra tiêu chuẩn của ngành. Llama 3 8B Instruct (phiên bản HF) là phiên bản FP16 gốc của Llama 3 8B Instruct, với kết quả dự kiến tương đương với triển khai chính thức trên Hugging Face.",
"accounts/fireworks/models/llama-v3-8b-instruct.description": "Meta đã phát triển và phát hành dòng mô hình Meta Llama 3 LLM, bao gồm các mô hình tạo văn bản được huấn luyện trước và tinh chỉnh theo hướng dẫn với kích thước 8B và 70B. Các mô hình Llama 3 được tinh chỉnh theo hướng dẫn được tối ưu hóa cho hội thoại và vượt trội hơn nhiều mô hình trò chuyện mở hiện có trong các bài kiểm tra tiêu chuẩn của ngành.",
"accounts/fireworks/models/llama-v3p1-405b-instruct.description": "Meta Llama 3.1 là một dòng mô hình LLM đa ngôn ngữ với các mô hình tạo văn bản được huấn luyện trước và tinh chỉnh theo hướng dẫn ở các kích thước 8B, 70B và 405B. Các mô hình văn bản được tinh chỉnh theo hướng dẫn được tối ưu hóa cho hội thoại đa ngôn ngữ và vượt trội hơn nhiều mô hình trò chuyện mở và đóng hiện có trong các bài kiểm tra tiêu chuẩn của ngành. 405B là mô hình mạnh nhất trong dòng Llama 3.1, sử dụng suy luận FP8 gần như tương đương với triển khai tham chiếu.",
"accounts/fireworks/models/llama-v3p1-70b-instruct.description": "Meta Llama 3.1 là một dòng mô hình LLM đa ngôn ngữ với các mô hình tạo văn bản được huấn luyện trước và tinh chỉnh theo hướng dẫn ở các kích thước 8B, 70B và 405B. Các mô hình văn bản được tinh chỉnh theo hướng dẫn được tối ưu hóa cho hội thoại đa ngôn ngữ và vượt trội hơn nhiều mô hình trò chuyện mở và đóng hiện có trong các bài kiểm tra tiêu chuẩn của ngành.",
"accounts/fireworks/models/llama-v3p1-8b-instruct.description": "Meta Llama 3.1 là một dòng mô hình LLM đa ngôn ngữ với các mô hình tạo văn bản được huấn luyện trước và tinh chỉnh theo hướng dẫn ở các kích thước 8B, 70B và 405B. Các mô hình văn bản được tinh chỉnh theo hướng dẫn được tối ưu hóa cho hội thoại đa ngôn ngữ và vượt trội hơn nhiều mô hình trò chuyện mở và đóng hiện có trong các bài kiểm tra tiêu chuẩn của ngành.",
"accounts/fireworks/models/llama-v3p2-11b-vision-instruct.description": "Một mô hình suy luận thị giác được tinh chỉnh theo hướng dẫn từ Meta với 11 tỷ tham số, được tối ưu hóa cho nhận diện hình ảnh, suy luận hình ảnh, tạo chú thích và hỏi đáp liên quan đến hình ảnh. Mô hình hiểu dữ liệu thị giác như biểu đồ và đồ thị, kết nối giữa thị giác và ngôn ngữ bằng cách tạo mô tả văn bản cho chi tiết hình ảnh.",
"accounts/fireworks/models/llama-v3p2-3b-instruct.description": "Llama 3.2 3B Instruct là một mô hình đa ngôn ngữ nhẹ từ Meta, được thiết kế để chạy hiệu quả với độ trễ thấp và chi phí thấp hơn so với các mô hình lớn hơn. Các trường hợp sử dụng phổ biến bao gồm viết lại truy vấn/lời nhắc và hỗ trợ viết.",
"accounts/fireworks/models/llama-v3p2-90b-vision-instruct.description": "Một mô hình suy luận thị giác được tinh chỉnh theo hướng dẫn từ Meta với 90 tỷ tham số, được tối ưu hóa cho nhận diện hình ảnh, suy luận hình ảnh, tạo chú thích và hỏi đáp liên quan đến hình ảnh. Mô hình hiểu dữ liệu thị giác như biểu đồ và đồ thị, kết nối giữa thị giác và ngôn ngữ bằng cách tạo mô tả văn bản cho chi tiết hình ảnh. Lưu ý: mô hình này hiện đang được cung cấp thử nghiệm dưới dạng không máy chủ. Đối với môi trường sản xuất, lưu ý rằng Fireworks có thể ngừng triển khai mà không báo trước.",
"accounts/fireworks/models/llama-v3p3-70b-instruct.description": "Llama 3.3 70B Instruct là bản cập nhật tháng 12 cho Llama 3.1 70B. Nó cải thiện khả năng sử dụng công cụ, hỗ trợ văn bản đa ngôn ngữ, toán học và lập trình so với bản phát hành tháng 7 năm 2024. Mô hình đạt hiệu suất hàng đầu trong ngành về lập luận, toán học và tuân theo hướng dẫn, mang lại hiệu suất tương đương với Llama 3.1 405B nhưng với tốc độ và chi phí tốt hơn đáng kể.",
"accounts/fireworks/models/mistral-small-24b-instruct-2501.description": "Mô hình với 24 tỷ tham số có khả năng tiên tiến tương đương với các mô hình lớn hơn.",
"accounts/fireworks/models/mixtral-8x22b-instruct.description": "Mixtral MoE 8x22B Instruct v0.1 là phiên bản được tinh chỉnh theo hướng dẫn của Mixtral MoE 8x22B v0.1, với API hoàn thành hội thoại được kích hoạt.",
"accounts/fireworks/models/mixtral-8x7b-instruct.description": "Mixtral MoE 8x7B Instruct là phiên bản được tinh chỉnh theo hướng dẫn của Mixtral MoE 8x7B, với API hoàn thành hội thoại được kích hoạt.",
"accounts/fireworks/models/mythomax-l2-13b.description": "Một biến thể cải tiến của MythoMix, có thể là phiên bản tinh tế hơn, kết hợp MythoLogic-L2 và Huginn bằng kỹ thuật hợp nhất tensor thử nghiệm cao. Tính độc đáo của nó khiến nó rất phù hợp cho kể chuyện và nhập vai.",
"accounts/fireworks/models/phi-3-vision-128k-instruct.description": "Phi-3-Vision-128K-Instruct là một mô hình đa phương thức tiên tiến, nhẹ, được xây dựng từ dữ liệu tổng hợp và tập dữ liệu công khai được chọn lọc, tập trung vào dữ liệu văn bản và hình ảnh chất lượng cao, đòi hỏi suy luận. Nó thuộc dòng Phi-3, với phiên bản đa phương thức hỗ trợ độ dài ngữ cảnh 128K (tính theo token). Mô hình được nâng cấp kỹ lưỡng, bao gồm tinh chỉnh có giám sát và tối ưu hóa theo sở thích trực tiếp, để đảm bảo tuân theo hướng dẫn chính xác và các biện pháp an toàn mạnh mẽ.",
"accounts/fireworks/models/qwen-qwq-32b-preview.description": "Mô hình Qwen QwQ tập trung vào việc nâng cao khả năng suy luận của AI, chứng minh rằng các mô hình mở có thể cạnh tranh với các mô hình tiên tiến đóng trong suy luận. QwQ-32B-Preview là bản phát hành thử nghiệm đạt mức o1 và vượt qua GPT-4o và Claude 3.5 Sonnet về suy luận và phân tích trên các bài kiểm tra GPQA, AIME, MATH-500 và LiveCodeBench. Lưu ý: mô hình này hiện đang được cung cấp thử nghiệm dưới dạng không máy chủ. Đối với môi trường sản xuất, lưu ý rằng Fireworks có thể ngừng triển khai mà không báo trước.",
"accounts/fireworks/models/qwen2-vl-72b-instruct.description": "Mô hình Qwen-VL 72B là phiên bản mới nhất của Alibaba, phản ánh gần một năm đổi mới.",
"accounts/fireworks/models/qwen2p5-72b-instruct.description": "Qwen2.5 là dòng mô hình LLM chỉ giải mã do nhóm Qwen và Alibaba Cloud phát triển, cung cấp các kích thước 0.5B, 1.5B, 3B, 7B, 14B, 32B và 72B, với cả biến thể cơ bản và được tinh chỉnh theo hướng dẫn.",
"accounts/fireworks/models/qwen2p5-coder-32b-instruct.description": "Qwen2.5-Coder là mô hình LLM mới nhất của Qwen được thiết kế cho lập trình (trước đây là CodeQwen). Lưu ý: mô hình này hiện đang được cung cấp thử nghiệm dưới dạng không máy chủ. Đối với môi trường sản xuất, lưu ý rằng Fireworks có thể ngừng triển khai mà không báo trước.",
"accounts/yi-01-ai/models/yi-large.description": "Yi-Large là một mô hình LLM hàng đầu, chỉ xếp sau GPT-4, Gemini 1.5 Pro và Claude 3 Opus trên bảng xếp hạng LMSYS. Nó xuất sắc trong khả năng đa ngôn ngữ, đặc biệt là tiếng Tây Ban Nha, Trung Quốc, Nhật Bản, Đức và Pháp. Yi-Large cũng thân thiện với nhà phát triển, sử dụng cùng cấu trúc API như OpenAI để dễ dàng tích hợp.",
"ai21-jamba-1.5-large.description": "Mô hình đa ngôn ngữ với 398 tỷ tham số (94 tỷ đang hoạt động), hỗ trợ cửa sổ ngữ cảnh 256K, gọi hàm, đầu ra có cấu trúc và sinh văn bản có căn cứ.",
"ai21-jamba-1.5-mini.description": "Mô hình đa ngôn ngữ với 52 tỷ tham số (12 tỷ đang hoạt động), hỗ trợ cửa sổ ngữ cảnh 256K, gọi hàm, đầu ra có cấu trúc và sinh văn bản có căn cứ.",
"ai21-labs/AI21-Jamba-1.5-Large.description": "Mô hình đa ngôn ngữ với 398 tỷ tham số (94 tỷ đang hoạt động), hỗ trợ cửa sổ ngữ cảnh 256K, gọi hàm, đầu ra có cấu trúc và sinh văn bản có căn cứ.",
"ai21-labs/AI21-Jamba-1.5-Mini.description": "Mô hình đa ngôn ngữ với 52 tỷ tham số (12 tỷ đang hoạt động), hỗ trợ cửa sổ ngữ cảnh 256K, gọi hàm, đầu ra có cấu trúc và sinh văn bản có căn cứ.",
"alibaba/qwen-3-14b.description": "Qwen3 là thế hệ mới nhất trong dòng Qwen, cung cấp bộ mô hình dày đặc và MoE toàn diện. Được huấn luyện trên dữ liệu lớn, nó mang lại đột phá trong suy luận, tuân theo hướng dẫn, khả năng tác tử và hỗ trợ đa ngôn ngữ.",
"alibaba/qwen-3-235b.description": "Qwen3 là thế hệ mới nhất trong dòng Qwen, cung cấp bộ mô hình dày đặc và MoE toàn diện. Được huấn luyện trên dữ liệu lớn, nó mang lại đột phá trong suy luận, tuân theo hướng dẫn, khả năng tác tử và hỗ trợ đa ngôn ngữ.",
"alibaba/qwen-3-30b.description": "Qwen3 là thế hệ mới nhất trong dòng Qwen, cung cấp bộ mô hình dày đặc và MoE toàn diện. Được huấn luyện trên dữ liệu lớn, nó mang lại đột phá trong suy luận, tuân theo hướng dẫn, khả năng tác tử và hỗ trợ đa ngôn ngữ.",
"alibaba/qwen-3-32b.description": "Qwen3 là thế hệ mới nhất trong dòng Qwen, cung cấp bộ mô hình dày đặc và MoE toàn diện. Được huấn luyện trên dữ liệu lớn, nó mang lại đột phá trong suy luận, tuân theo hướng dẫn, khả năng tác tử và hỗ trợ đa ngôn ngữ.",
"alibaba/qwen3-coder.description": "Qwen3-Coder-480B-A35B-Instruct là mô hình mã hóa có khả năng tác tử cao nhất của Qwen, thể hiện hiệu suất vượt trội trong lập trình tác tử, sử dụng trình duyệt và các tác vụ mã hóa cốt lõi khác, đạt kết quả tương đương với Claude Sonnet.",
"amazon/nova-lite.description": "Mô hình đa phương tiện chi phí cực thấp với khả năng xử lý cực nhanh các đầu vào hình ảnh, video và văn bản.",
"amazon/nova-micro.description": "Mô hình chỉ xử lý văn bản với độ trễ cực thấp và chi phí rất thấp.",
"amazon/nova-pro.description": "Mô hình đa phương tiện mạnh mẽ với sự cân bằng tối ưu giữa độ chính xác, tốc độ và chi phí cho nhiều tác vụ khác nhau.",
"amazon/titan-embed-text-v2.description": "Amazon Titan Text Embeddings V2 là mô hình nhúng đa ngôn ngữ nhẹ, hiệu quả, hỗ trợ các kích thước 1024, 512 và 256.",
"anthropic.claude-3-5-sonnet-20240620-v1:0.description": "Claude 3.5 Sonnet nâng tầm tiêu chuẩn ngành, vượt trội so với các đối thủ và Claude 3 Opus trong nhiều đánh giá, đồng thời duy trì tốc độ và chi phí ở mức trung bình.",
"anthropic.claude-3-5-sonnet-20241022-v2:0.description": "Claude 3.5 Sonnet nâng tầm tiêu chuẩn ngành, vượt trội so với các đối thủ và Claude 3 Opus trong nhiều đánh giá, đồng thời duy trì tốc độ và chi phí ở mức trung bình.",
"anthropic.claude-3-haiku-20240307-v1:0.description": "Claude 3 Haiku là mô hình nhanh nhất và nhỏ gọn nhất của Anthropic, cung cấp phản hồi gần như tức thì cho các truy vấn đơn giản. Nó mang lại trải nghiệm AI mượt mà, giống con người và hỗ trợ đầu vào hình ảnh với cửa sổ ngữ cảnh 200K.",
"anthropic.claude-3-opus-20240229-v1:0.description": "Claude 3 Opus là mô hình AI mạnh mẽ nhất của Anthropic với hiệu suất hàng đầu trong các tác vụ phức tạp. Nó xử lý các yêu cầu mở và tình huống mới với độ trôi chảy và hiểu biết giống con người, đồng thời hỗ trợ đầu vào hình ảnh với cửa sổ ngữ cảnh 200K.",
"anthropic.claude-3-sonnet-20240229-v1:0.description": "Claude 3 Sonnet cân bằng giữa trí tuệ và tốc độ cho khối lượng công việc doanh nghiệp, mang lại giá trị cao với chi phí thấp hơn. Nó được thiết kế như một công cụ đáng tin cậy cho triển khai AI quy mô lớn và hỗ trợ đầu vào hình ảnh với cửa sổ ngữ cảnh 200K.",
"anthropic.claude-instant-v1.description": "Mô hình nhanh, tiết kiệm nhưng vẫn mạnh mẽ cho trò chuyện hàng ngày, phân tích văn bản, tóm tắt và hỏi đáp tài liệu.",
"anthropic.claude-v2.description": "Mô hình có khả năng cao trong các tác vụ từ đối thoại phức tạp và sáng tạo đến tuân theo hướng dẫn chi tiết.",
"anthropic.claude-v2:1.description": "Claude 2 được cập nhật với cửa sổ ngữ cảnh gấp đôi và cải thiện độ tin cậy, giảm ảo giác và tăng độ chính xác dựa trên bằng chứng cho tài liệu dài và RAG.",
"anthropic/claude-3-haiku.description": "Claude 3 Haiku là mô hình nhanh nhất của Anthropic, được thiết kế cho khối lượng công việc doanh nghiệp với các yêu cầu dài. Nó có thể nhanh chóng phân tích các tài liệu lớn như báo cáo quý, hợp đồng hoặc vụ kiện với chi phí bằng một nửa so với các đối thủ.",
"anthropic/claude-3-opus.description": "Claude 3 Opus là mô hình thông minh nhất của Anthropic với hiệu suất hàng đầu trong các tác vụ phức tạp, xử lý các yêu cầu mở và tình huống mới với độ trôi chảy và hiểu biết giống con người.",
"anthropic/claude-3.5-haiku.description": "Claude 3.5 Haiku có tốc độ, độ chính xác mã hóa và khả năng sử dụng công cụ được nâng cao, phù hợp với các tình huống yêu cầu cao về tốc độ và tương tác công cụ.",
"anthropic/claude-3.5-sonnet.description": "Claude 3.5 Sonnet là mô hình nhanh và hiệu quả trong dòng Sonnet, cung cấp hiệu suất mã hóa và suy luận tốt hơn, với một số phiên bản dần được thay thế bởi Sonnet 3.7 trở đi.",
"anthropic/claude-3.7-sonnet.description": "Claude 3.7 Sonnet là phiên bản nâng cấp của dòng Sonnet với khả năng suy luận và mã hóa mạnh mẽ hơn, phù hợp cho các tác vụ phức tạp cấp doanh nghiệp.",
"anthropic/claude-haiku-4.5.description": "Claude Haiku 4.5 là mô hình nhanh hiệu suất cao của Anthropic, mang lại độ trễ rất thấp trong khi vẫn duy trì độ chính xác cao.",
"anthropic/claude-opus-4.1.description": "Opus 4.1 là mô hình cao cấp của Anthropic được tối ưu hóa cho lập trình, suy luận phức tạp và các tác vụ kéo dài.",
"anthropic/claude-opus-4.5.description": "Claude Opus 4.5 là mô hình hàng đầu của Anthropic, kết hợp trí tuệ đỉnh cao với hiệu suất có thể mở rộng cho các tác vụ suy luận phức tạp và chất lượng cao.",
"anthropic/claude-opus-4.description": "Opus 4 là mô hình hàng đầu của Anthropic được thiết kế cho các tác vụ phức tạp và ứng dụng doanh nghiệp.",
"anthropic/claude-sonnet-4.5.description": "Claude Sonnet 4.5 là mô hình suy luận lai mới nhất của Anthropic, được tối ưu hóa cho suy luận phức tạp và mã hóa.",
"anthropic/claude-sonnet-4.description": "Claude Sonnet 4 là mô hình suy luận lai của Anthropic với khả năng tư duy và không tư duy kết hợp.",
"ascend-tribe/pangu-pro-moe.description": "Pangu-Pro-MoE 72B-A16B là một mô hình ngôn ngữ lớn dạng thưa với 72 tỷ tham số tổng và 16 tỷ tham số kích hoạt, dựa trên kiến trúc MoE nhóm (MoGE). Nó nhóm các chuyên gia trong quá trình lựa chọn và giới hạn số token để kích hoạt số chuyên gia bằng nhau trong mỗi nhóm, giúp cân bằng tải và nâng cao hiệu quả triển khai trên Ascend.",
"aya.description": "Aya 23 là mô hình đa ngôn ngữ của Cohere, hỗ trợ 23 ngôn ngữ cho nhiều tình huống sử dụng khác nhau.",
"aya:35b.description": "Aya 23 là mô hình đa ngôn ngữ của Cohere, hỗ trợ 23 ngôn ngữ cho nhiều tình huống sử dụng khác nhau.",
"azure-DeepSeek-R1-0528.description": "Triển khai bởi Microsoft; DeepSeek R1 đã được nâng cấp thành DeepSeek-R1-0528. Bản cập nhật tăng cường tính toán và tối ưu hóa thuật toán hậu huấn luyện, cải thiện đáng kể độ sâu suy luận và khả năng suy diễn. Mô hình thể hiện mạnh mẽ trong các bài kiểm tra toán học, lập trình và logic tổng quát, tiệm cận các mô hình hàng đầu như O3 và Gemini 2.5 Pro.",
"baichuan-m2-32b.description": "Baichuan M2 32B là mô hình MoE từ Baichuan Intelligence với khả năng suy luận mạnh mẽ.",
"baichuan/baichuan2-13b-chat.description": "Baichuan-13B là mô hình mã nguồn mở với 13 tỷ tham số, có thể sử dụng thương mại từ Baichuan, đạt kết quả hàng đầu trong phân khúc trên các bài kiểm tra tiếng Trung và tiếng Anh uy tín.",
"baidu/ERNIE-4.5-300B-A47B.description": "ERNIE-4.5-300B-A47B là mô hình MoE của Baidu với 300 tỷ tham số tổng và 47 tỷ tham số kích hoạt mỗi token, cân bằng giữa hiệu suất mạnh mẽ và hiệu quả tính toán. Là mô hình cốt lõi của ERNIE 4.5, nó xuất sắc trong hiểu ngôn ngữ, sinh văn bản, suy luận và lập trình. Mô hình sử dụng phương pháp tiền huấn luyện MoE đa phương thức dị thể với huấn luyện kết hợp văn bản-hình ảnh để tăng cường năng lực tổng thể, đặc biệt là khả năng tuân thủ hướng dẫn và kiến thức thế giới.",
"baidu/ernie-5.0-thinking-preview.description": "ERNIE 5.0 Thinking Preview là mô hình ERNIE đa phương thức thế hệ mới của Baidu, mạnh mẽ trong hiểu đa phương thức, tuân thủ hướng dẫn, sáng tạo, hỏi đáp thực tế và gọi công cụ.",
"black-forest-labs/flux-1.1-pro.description": "FLUX 1.1 Pro là phiên bản nâng cấp nhanh hơn của FLUX Pro với chất lượng hình ảnh xuất sắc và khả năng tuân thủ prompt tốt.",
"black-forest-labs/flux-dev.description": "FLUX Dev là phiên bản phát triển của FLUX dành cho mục đích phi thương mại.",
"black-forest-labs/flux-pro.description": "FLUX Pro là mô hình FLUX chuyên nghiệp cho đầu ra hình ảnh chất lượng cao.",
"black-forest-labs/flux-schnell.description": "FLUX Schnell là mô hình tạo ảnh nhanh được tối ưu hóa cho tốc độ.",
"c4ai-aya-expanse-32b.description": "Aya Expanse là mô hình đa ngôn ngữ hiệu suất cao với 32 tỷ tham số, sử dụng tinh chỉnh theo hướng dẫn, phân bổ dữ liệu, huấn luyện theo sở thích và hợp nhất mô hình để cạnh tranh với các mô hình đơn ngữ. Hỗ trợ 23 ngôn ngữ.",
"c4ai-aya-expanse-8b.description": "Aya Expanse là mô hình đa ngôn ngữ hiệu suất cao với 8 tỷ tham số, sử dụng tinh chỉnh theo hướng dẫn, phân bổ dữ liệu, huấn luyện theo sở thích và hợp nhất mô hình để cạnh tranh với các mô hình đơn ngữ. Hỗ trợ 23 ngôn ngữ.",
"c4ai-aya-vision-32b.description": "Aya Vision là mô hình đa phương thức tiên tiến với hiệu suất mạnh mẽ trên các bài kiểm tra ngôn ngữ, văn bản và hình ảnh. Hỗ trợ 23 ngôn ngữ. Phiên bản 32B tập trung vào hiệu suất đa ngôn ngữ hàng đầu.",
"c4ai-aya-vision-8b.description": "Aya Vision là mô hình đa phương thức tiên tiến với hiệu suất mạnh mẽ trên các bài kiểm tra ngôn ngữ, văn bản và hình ảnh. Phiên bản 8B tập trung vào độ trễ thấp và hiệu suất mạnh mẽ.",
"charglm-3.description": "CharGLM-3 được xây dựng cho nhập vai và đồng hành cảm xúc, hỗ trợ bộ nhớ nhiều lượt siêu dài và đối thoại cá nhân hóa.",
"charglm-4.description": "CharGLM-4 được xây dựng cho nhập vai và đồng hành cảm xúc, hỗ trợ bộ nhớ nhiều lượt siêu dài và đối thoại cá nhân hóa.",
"chatgpt-4o-latest.description": "ChatGPT-4o là mô hình động được cập nhật theo thời gian thực. Nó kết hợp khả năng hiểu và tạo ngôn ngữ mạnh mẽ cho các trường hợp sử dụng quy mô lớn như hỗ trợ khách hàng, giáo dục và hỗ trợ kỹ thuật.",
"claude-2.0.description": "Claude 2 mang đến những cải tiến quan trọng cho doanh nghiệp, bao gồm ngữ cảnh 200K token hàng đầu, giảm ảo giác, prompt hệ thống và tính năng thử nghiệm mới: gọi công cụ.",
"claude-2.1.description": "Claude 2 mang đến những cải tiến quan trọng cho doanh nghiệp, bao gồm ngữ cảnh 200K token hàng đầu, giảm ảo giác, prompt hệ thống và tính năng thử nghiệm mới: gọi công cụ.",
"claude-3-5-haiku-20241022.description": "Claude 3.5 Haiku là mô hình thế hệ tiếp theo nhanh nhất của Anthropic. So với Claude 3 Haiku, nó cải thiện trên nhiều kỹ năng và vượt qua mô hình lớn nhất trước đó Claude 3 Opus trên nhiều tiêu chuẩn trí tuệ.",
"claude-3-5-haiku-latest.description": "Claude 3.5 Haiku cung cấp phản hồi nhanh cho các tác vụ nhẹ.",
"claude-3-7-sonnet-20250219.description": "Claude 3.7 Sonnet là mô hình thông minh nhất của Anthropic và là mô hình suy luận lai đầu tiên trên thị trường. Nó có thể tạo ra phản hồi gần như tức thì hoặc suy luận từng bước mở rộng mà người dùng có thể thấy. Sonnet đặc biệt mạnh mẽ trong các nhiệm vụ lập trình, khoa học dữ liệu, thị giác và tác nhân.",
"claude-3-7-sonnet-latest.description": "Claude 3.7 Sonnet là mô hình mới nhất và mạnh mẽ nhất của Anthropic cho các tác vụ phức tạp, xuất sắc về hiệu suất, trí tuệ, lưu loát và hiểu biết.",
"claude-3-haiku-20240307.description": "Claude 3 Haiku là mô hình nhanh nhất và nhỏ gọn nhất của Anthropic, được thiết kế cho phản hồi gần như tức thì với hiệu suất nhanh và chính xác.",
"claude-3-opus-20240229.description": "Claude 3 Opus là mô hình mạnh mẽ nhất của Anthropic cho các tác vụ phức tạp, xuất sắc về hiệu suất, trí tuệ, lưu loát và hiểu biết.",
"claude-3-sonnet-20240229.description": "Claude 3 Sonnet cân bằng giữa trí tuệ và tốc độ cho khối lượng công việc doanh nghiệp, mang lại giá trị cao với chi phí thấp hơn và triển khai quy mô lớn đáng tin cậy.",
"claude-haiku-4-5-20251001.description": "Claude Haiku 4.5 là mô hình Haiku nhanh nhất và thông minh nhất của Anthropic, với tốc độ cực nhanh và khả năng suy luận mở rộng.",
"claude-haiku-4.5.description": "Claude Haiku 4.5 là mô hình Haiku nhanh nhất và thông minh nhất của Anthropic, với tốc độ vượt trội và khả năng suy luận mở rộng.",
"claude-opus-4-1-20250805-thinking.description": "Claude Opus 4.1 Thinking là biến thể nâng cao có thể hiển thị quá trình suy luận của nó.",
"claude-opus-4-1-20250805.description": "Claude Opus 4.1 là mô hình mới nhất và mạnh mẽ nhất của Anthropic dành cho các tác vụ có độ phức tạp cao, nổi bật về hiệu năng, trí tuệ, độ trôi chảy và khả năng hiểu ngữ cảnh.",
"claude-opus-4-20250514.description": "Claude Opus 4 là mô hình mạnh mẽ nhất của Anthropic dành cho các tác vụ cực kỳ phức tạp, vượt trội về hiệu suất, trí tuệ, độ lưu loát và khả năng thấu hiểu.",
"claude-opus-4-5-20251101.description": "Claude Opus 4.5 là mô hình hàng đầu của Anthropic, kết hợp trí tuệ vượt trội với hiệu suất có thể mở rộng, lý tưởng cho các tác vụ phức tạp đòi hỏi phản hồi và suy luận chất lượng cao nhất.",
"claude-opus-4-6.description": "Claude Opus 4.6 là mô hình thông minh nhất của Anthropic dành cho việc xây dựng tác nhân và lập trình.",
"claude-opus-4.5.description": "Claude Opus 4.5 là mô hình hàng đầu của Anthropic, kết hợp trí tuệ đỉnh cao với hiệu suất mở rộng cho các nhiệm vụ suy luận phức tạp, chất lượng cao.",
"claude-opus-4.6-fast.description": "Claude Opus 4.6 là mô hình thông minh nhất của Anthropic dành cho việc xây dựng các tác nhân và lập trình.",
"claude-opus-4.6.description": "Claude Opus 4.6 là mô hình thông minh nhất của Anthropic dành cho việc xây dựng các tác nhân và lập trình.",
"claude-sonnet-4-20250514-thinking.description": "Claude Sonnet 4 Thinking có thể tạo phản hồi gần như tức thì hoặc suy luận từng bước mở rộng với quy trình hiển thị.",
"claude-sonnet-4-20250514.description": "Claude Sonnet 4 là mô hình thông minh nhất của Anthropic cho đến nay, cung cấp phản hồi gần như tức thì hoặc khả năng suy luận từng bước mở rộng với khả năng kiểm soát chi tiết dành cho người dùng API.",
"claude-sonnet-4-5-20250929.description": "Claude Sonnet 4.5 là mô hình thông minh nhất của Anthropic cho đến nay.",
"claude-sonnet-4-6.description": "Claude Sonnet 4.6 là sự kết hợp tối ưu giữa tốc độ và trí tuệ của Anthropic.",
"claude-sonnet-4.5.description": "Claude Sonnet 4.5 là mô hình thông minh nhất của Anthropic cho đến nay.",
"claude-sonnet-4.6.description": "Claude Sonnet 4.6 là sự kết hợp tốt nhất giữa tốc độ và trí tuệ của Anthropic.",
"claude-sonnet-4.description": "Claude Sonnet 4 có thể tạo ra các phản hồi gần như tức thì hoặc suy luận từng bước mở rộng mà người dùng có thể theo dõi. Người dùng API có thể kiểm soát chi tiết thời gian suy nghĩ của mô hình.",
"codegeex-4.description": "CodeGeeX-4 là trợ lý lập trình AI mạnh mẽ hỗ trợ hỏi đáp đa ngôn ngữ và hoàn thành mã để tăng năng suất lập trình viên.",
"codegeex4-all-9b.description": "CodeGeeX4-ALL-9B là mô hình tạo mã đa ngôn ngữ hỗ trợ hoàn thành và sinh mã, thông dịch mã, tìm kiếm web, gọi hàm và hỏi đáp mã ở cấp độ kho lưu trữ, bao phủ nhiều tình huống phát triển phần mềm. Đây là mô hình mã hàng đầu dưới 10 tỷ tham số.",
"codegemma.description": "CodeGemma là mô hình nhẹ cho các tác vụ lập trình đa dạng, cho phép lặp lại nhanh và tích hợp dễ dàng.",
"codegemma:2b.description": "CodeGemma là mô hình nhẹ cho các tác vụ lập trình đa dạng, cho phép lặp lại nhanh và tích hợp dễ dàng.",
"codellama.description": "Code Llama là mô hình ngôn ngữ lớn tập trung vào sinh mã và thảo luận mã, hỗ trợ nhiều ngôn ngữ lập trình cho quy trình làm việc của lập trình viên.",
"codellama/CodeLlama-34b-Instruct-hf.description": "Code Llama là mô hình ngôn ngữ lớn tập trung vào sinh mã và thảo luận mã, hỗ trợ nhiều ngôn ngữ lập trình cho quy trình làm việc của lập trình viên.",
"codellama:13b.description": "Code Llama là mô hình ngôn ngữ lớn tập trung vào sinh mã và thảo luận mã, hỗ trợ nhiều ngôn ngữ lập trình cho quy trình làm việc của lập trình viên.",
"codellama:34b.description": "Code Llama là mô hình ngôn ngữ lớn tập trung vào sinh mã và thảo luận mã, hỗ trợ nhiều ngôn ngữ lập trình cho quy trình làm việc của lập trình viên.",
"codellama:70b.description": "Code Llama là mô hình ngôn ngữ lớn tập trung vào sinh mã và thảo luận mã, hỗ trợ nhiều ngôn ngữ lập trình cho quy trình làm việc của lập trình viên.",
"codeqwen.description": "CodeQwen1.5 là mô hình ngôn ngữ lớn được huấn luyện trên dữ liệu mã phong phú, được xây dựng cho các tác vụ lập trình phức tạp.",
"codestral-latest.description": "Codestral là mô hình lập trình tiên tiến nhất của chúng tôi; phiên bản v2 (tháng 1 năm 2025) nhắm đến các tác vụ tần suất cao, độ trễ thấp như FIM, sửa mã và sinh bài kiểm tra.",
"codestral.description": "Codestral là mô hình lập trình đầu tiên của Mistral AI, cung cấp hỗ trợ sinh mã mạnh mẽ.",
"cogito-2.1:671b.description": "Cogito v2.1 671B là một mô hình ngôn ngữ mã nguồn mở của Mỹ, miễn phí cho mục đích thương mại, có hiệu suất sánh ngang với các mô hình hàng đầu, hiệu quả suy luận theo token cao hơn, hỗ trợ ngữ cảnh dài 128k và khả năng tổng thể mạnh mẽ.",
"cogvideox-2.description": "CogVideoX-2 là mô hình nền tảng tạo video thế hệ mới của Zhipu, với khả năng chuyển đổi hình ảnh thành video được cải thiện 38%. Nó mang lại những cải tiến đáng kể trong xử lý chuyển động quy mô lớn, độ ổn định hình ảnh, tuân thủ hướng dẫn, phong cách nghệ thuật và thẩm mỹ hình ảnh tổng thể.",
"cogvideox-3.description": "CogVideoX-3 bổ sung tính năng tạo khung hình bắt đầu và kết thúc, cải thiện đáng kể độ ổn định và rõ ràng của hình ảnh. Nó cho phép chuyển động chủ thể quy mô lớn mượt mà và tự nhiên, cung cấp khả năng tuân thủ hướng dẫn tốt hơn và mô phỏng vật lý thực tế hơn, đồng thời nâng cao hiệu suất trong các cảnh thực tế độ nét cao và phong cách 3D.",
"cogvideox-flash.description": "CogVideoX-Flash là mô hình tạo video miễn phí được phát hành bởi Zhipu, có khả năng tạo video tuân theo hướng dẫn của người dùng trong khi đạt được điểm chất lượng thẩm mỹ cao hơn.",
"cogview-3-flash.description": "CogView-3-Flash là một mô hình tạo hình ảnh miễn phí được ra mắt bởi Zhipu. Nó tạo ra các hình ảnh phù hợp với hướng dẫn của người dùng đồng thời đạt được điểm chất lượng thẩm mỹ cao hơn. CogView-3-Flash chủ yếu được sử dụng trong các lĩnh vực như sáng tạo nghệ thuật, tham khảo thiết kế, phát triển trò chơi và thực tế ảo, giúp người dùng nhanh chóng chuyển đổi mô tả văn bản thành hình ảnh.",
"cogview-4.description": "CogView-4 là mô hình chuyển văn bản thành hình ảnh mã nguồn mở đầu tiên của Zhipu có khả năng tạo ký tự Trung Quốc. Mô hình cải thiện khả năng hiểu ngữ nghĩa, chất lượng hình ảnh và hiển thị văn bản Trung/Anh, hỗ trợ lời nhắc song ngữ với độ dài tùy ý và có thể tạo hình ảnh ở bất kỳ độ phân giải nào trong phạm vi chỉ định.",
"cohere-command-r-plus.description": "Command R+ là một mô hình tiên tiến được tối ưu hóa cho RAG, được xây dựng để xử lý khối lượng công việc doanh nghiệp.",
"cohere-command-r.description": "Command R là một mô hình sinh văn bản có khả năng mở rộng, được thiết kế cho RAG và sử dụng công cụ, cho phép triển khai AI ở cấp độ sản xuất.",
"cohere/Cohere-command-r-plus.description": "Command R+ là một mô hình tiên tiến được tối ưu hóa cho RAG, được xây dựng để xử lý khối lượng công việc doanh nghiệp.",
"cohere/Cohere-command-r.description": "Command R là một mô hình sinh văn bản có khả năng mở rộng, được thiết kế cho RAG và sử dụng công cụ, cho phép triển khai AI ở cấp độ sản xuất.",
"cohere/command-a.description": "Command A là mô hình mạnh nhất của Cohere cho đến nay, vượt trội trong việc sử dụng công cụ, tác tử, RAG và các trường hợp đa ngôn ngữ. Mô hình có độ dài ngữ cảnh 256K, chạy chỉ với hai GPU và đạt thông lượng cao hơn 150% so với Command R+ 08-2024.",
"cohere/embed-v4.0.description": "Một mô hình phân loại hoặc chuyển đổi văn bản, hình ảnh hoặc nội dung hỗn hợp thành các vector nhúng.",
"comfyui/flux-dev.description": "FLUX.1 Dev là mô hình chuyển văn bản thành hình ảnh chất lượng cao (10–50 bước), lý tưởng cho các sản phẩm sáng tạo và nghệ thuật cao cấp.",
"comfyui/flux-kontext-dev.description": "FLUX.1 Kontext-dev là mô hình chỉnh sửa hình ảnh hỗ trợ chỉnh sửa theo hướng dẫn văn bản, bao gồm chỉnh sửa cục bộ và chuyển đổi phong cách.",
"comfyui/flux-krea-dev.description": "FLUX.1 Krea-dev là mô hình chuyển văn bản thành hình ảnh được tăng cường an toàn, đồng phát triển với Krea, có bộ lọc an toàn tích hợp.",
"comfyui/flux-schnell.description": "FLUX.1 Schnell là mô hình chuyển văn bản thành hình ảnh siêu nhanh, tạo hình ảnh chất lượng cao chỉ trong 1–4 bước, lý tưởng cho sử dụng thời gian thực và tạo mẫu nhanh.",
"comfyui/stable-diffusion-15.description": "Stable Diffusion 1.5 là mô hình chuyển văn bản thành hình ảnh cổ điển với độ phân giải 512x512, lý tưởng cho tạo mẫu nhanh và thử nghiệm sáng tạo.",
"comfyui/stable-diffusion-35-inclclip.description": "Stable Diffusion 3.5 với bộ mã hóa CLIP/T5 tích hợp, không cần tệp mã hóa bên ngoài, phù hợp với các mô hình như sd3.5_medium_incl_clips sử dụng ít tài nguyên hơn.",
"comfyui/stable-diffusion-35.description": "Stable Diffusion 3.5 là mô hình chuyển văn bản thành hình ảnh thế hệ mới với các biến thể Large và Medium. Cần tệp mã hóa CLIP bên ngoài và mang lại chất lượng hình ảnh xuất sắc cùng khả năng tuân thủ lời nhắc cao.",
"comfyui/stable-diffusion-custom-refiner.description": "Mô hình SDXL chuyển hình ảnh thành hình ảnh tùy chỉnh. Sử dụng tên tệp mô hình là custom_sd_lobe.safetensors; nếu có VAE, sử dụng custom_sd_vae_lobe.safetensors. Đặt các tệp mô hình vào thư mục yêu cầu của Comfy.",
"comfyui/stable-diffusion-custom.description": "Mô hình SD chuyển văn bản thành hình ảnh tùy chỉnh. Sử dụng tên tệp mô hình là custom_sd_lobe.safetensors; nếu có VAE, sử dụng custom_sd_vae_lobe.safetensors. Đặt các tệp mô hình vào thư mục yêu cầu của Comfy.",
"comfyui/stable-diffusion-refiner.description": "Mô hình SDXL chuyển hình ảnh thành hình ảnh thực hiện các chuyển đổi chất lượng cao từ hình ảnh đầu vào, hỗ trợ chuyển đổi phong cách, phục hồi và biến thể sáng tạo.",
"comfyui/stable-diffusion-xl.description": "SDXL là mô hình chuyển văn bản thành hình ảnh hỗ trợ tạo hình ảnh độ phân giải cao 1024x1024 với chất lượng và chi tiết tốt hơn.",
"command-a-03-2025.description": "Command A là mô hình mạnh nhất của chúng tôi cho đến nay, vượt trội trong việc sử dụng công cụ, tác tử, RAG và các tình huống đa ngôn ngữ. Mô hình có cửa sổ ngữ cảnh 256K, chạy chỉ với hai GPU và đạt thông lượng cao hơn 150% so với Command R+ 08-2024.",
"command-light-nightly.description": "Để rút ngắn khoảng cách giữa các bản phát hành chính, chúng tôi cung cấp các bản dựng Command hàng đêm. Với dòng command-light, đây là command-light-nightly. Đây là phiên bản mới nhất, mang tính thử nghiệm cao (và có thể không ổn định), được cập nhật thường xuyên mà không báo trước, do đó không khuyến nghị sử dụng trong môi trường sản xuất.",
"command-light.description": "Biến thể Command nhỏ hơn, nhanh hơn, gần như mạnh mẽ như bản gốc nhưng có tốc độ cao hơn.",
"command-nightly.description": "Để rút ngắn khoảng cách giữa các bản phát hành chính, chúng tôi cung cấp các bản dựng Command hàng đêm. Với dòng Command, đây là command-nightly. Đây là phiên bản mới nhất, mang tính thử nghiệm cao (và có thể không ổn định), được cập nhật thường xuyên mà không báo trước, do đó không khuyến nghị sử dụng trong môi trường sản xuất.",
"command-r-03-2024.description": "command-r là mô hình chat theo hướng dẫn, thực hiện các nhiệm vụ ngôn ngữ với chất lượng cao hơn, độ tin cậy được cải thiện và ngữ cảnh dài hơn so với các mô hình trước đó. Nó hỗ trợ các quy trình phức tạp như tạo mã, RAG, sử dụng công cụ và Agent.",
"command-r-08-2024.description": "command-r-08-2024 là phiên bản cập nhật của mô hình Command R được phát hành vào tháng 8 năm 2024.",
"command-r-plus-04-2024.description": "command-r-plus là bí danh của command-r-plus-04-2024, vì vậy sử dụng command-r-plus trong API sẽ trỏ đến mô hình đó.",
"command-r-plus-08-2024.description": "Command R+ là mô hình trò chuyện theo hướng dẫn với chất lượng cao hơn, độ tin cậy lớn hơn và cửa sổ ngữ cảnh dài hơn so với các mô hình trước đó. Mô hình phù hợp nhất cho các quy trình RAG phức tạp và sử dụng công cụ nhiều bước.",
"command-r-plus.description": "Command R+ là mô hình LLM hiệu suất cao được thiết kế cho các tình huống doanh nghiệp thực tế và ứng dụng phức tạp.",
"command-r.description": "Command R là mô hình LLM được tối ưu hóa cho trò chuyện và các tác vụ ngữ cảnh dài, lý tưởng cho tương tác động và quản lý tri thức.",
"command-r7b-12-2024.description": "command-r7b-12-2024 là bản cập nhật nhỏ, hiệu quả được phát hành vào tháng 12 năm 2024. Mô hình vượt trội trong các tác vụ RAG, sử dụng công cụ và tác tử đòi hỏi suy luận phức tạp nhiều bước.",
"command.description": "Mô hình trò chuyện theo hướng dẫn cung cấp chất lượng và độ tin cậy cao hơn trong các tác vụ ngôn ngữ, với cửa sổ ngữ cảnh dài hơn so với các mô hình sinh văn bản cơ bản của chúng tôi.",
"computer-use-preview.description": "computer-use-preview là mô hình chuyên biệt cho công cụ \"sử dụng máy tính\", được huấn luyện để hiểu và thực hiện các tác vụ liên quan đến máy tính.",
"dall-e-2.description": "DALL·E thế hệ thứ hai với khả năng tạo hình ảnh thực tế, chính xác hơn và độ phân giải gấp 4 lần thế hệ đầu.",
"dall-e-3.description": "Mô hình DALL·E mới nhất, phát hành vào tháng 11 năm 2023, hỗ trợ tạo hình ảnh thực tế, chính xác hơn với chi tiết mạnh mẽ hơn.",
"databricks/dbrx-instruct.description": "DBRX Instruct cung cấp khả năng xử lý hướng dẫn đáng tin cậy cao trong nhiều ngành công nghiệp.",
"deepseek-ai/DeepSeek-OCR.description": "DeepSeek-OCR là một mô hình thị giác-ngôn ngữ từ DeepSeek AI tập trung vào OCR và \"nén quang học theo ngữ cảnh.\" Mô hình này khám phá cách nén thông tin ngữ cảnh từ hình ảnh, xử lý tài liệu một cách hiệu quả và chuyển đổi chúng thành văn bản có cấu trúc (ví dụ: Markdown). Nó nhận diện văn bản trong hình ảnh một cách chính xác, phù hợp cho số hóa tài liệu, trích xuất văn bản và xử lý có cấu trúc.",
"deepseek-ai/DeepSeek-R1-0528-Qwen3-8B.description": "DeepSeek-R1-0528-Qwen3-8B chắt lọc chuỗi suy nghĩ từ DeepSeek-R1-0528 vào Qwen3 8B Base. Mô hình này đạt trạng thái tiên tiến nhất (SOTA) trong số các mô hình mã nguồn mở, vượt Qwen3 8B 10% trên AIME 2024 và tương đương hiệu suất của Qwen3-235B-thinking. Nó vượt trội trong các bài kiểm tra suy luận toán học, lập trình và logic tổng quát. Mô hình sử dụng kiến trúc Qwen3-8B nhưng dùng bộ mã hóa của DeepSeek-R1-0528.",
"deepseek-ai/DeepSeek-R1-0528.description": "DeepSeek R1 tận dụng sức mạnh tính toán bổ sung và tối ưu hóa thuật toán sau huấn luyện để tăng cường khả năng suy luận. Mô hình thể hiện hiệu suất mạnh mẽ trên các bài kiểm tra toán học, lập trình và logic tổng quát, tiệm cận các mô hình hàng đầu như o3 và Gemini 2.5 Pro.",
"deepseek-ai/DeepSeek-R1-Distill-Llama-70B.description": "Các mô hình chắt lọc DeepSeek-R1 sử dụng học tăng cường (RL) và dữ liệu khởi đầu lạnh để cải thiện khả năng suy luận và thiết lập các chuẩn mực mới cho mô hình mã nguồn mở đa nhiệm.",
"deepseek-ai/DeepSeek-R1-Distill-Qwen-1.5B.description": "Các mô hình chắt lọc DeepSeek-R1 sử dụng học tăng cường (RL) và dữ liệu khởi đầu lạnh để cải thiện khả năng suy luận và thiết lập các chuẩn mực mới cho mô hình mã nguồn mở đa nhiệm.",
"deepseek-ai/DeepSeek-R1-Distill-Qwen-14B.description": "Các mô hình chắt lọc DeepSeek-R1 sử dụng học tăng cường (RL) và dữ liệu khởi đầu lạnh để cải thiện khả năng suy luận và thiết lập các chuẩn mực mới cho mô hình mã nguồn mở đa nhiệm.",
"deepseek-ai/DeepSeek-R1-Distill-Qwen-32B.description": "DeepSeek-R1-Distill-Qwen-32B được chắt lọc từ Qwen2.5-32B và tinh chỉnh trên 800K mẫu dữ liệu được chọn lọc từ DeepSeek-R1. Mô hình này vượt trội trong toán học, lập trình và suy luận, đạt kết quả cao trên AIME 2024, MATH-500 (độ chính xác 94.3%) và GPQA Diamond.",
"deepseek-ai/DeepSeek-R1-Distill-Qwen-7B.description": "DeepSeek-R1-Distill-Qwen-7B được chưng cất từ Qwen2.5-Math-7B và tinh chỉnh trên 800K mẫu DeepSeek-R1 được chọn lọc. Nó hoạt động mạnh mẽ, đạt 92,8% trên MATH-500, 55,5% trên AIME 2024, và xếp hạng 1189 CodeForces cho mô hình 7B.",
"deepseek-ai/DeepSeek-R1.description": "DeepSeek-R1 cải thiện khả năng suy luận thông qua học tăng cường (RL) và dữ liệu khởi đầu lạnh, thiết lập các chuẩn mực mới cho mô hình mã nguồn mở đa nhiệm và vượt qua OpenAI-o1-mini.",
"deepseek-ai/DeepSeek-V2.5.description": "DeepSeek-V2.5 nâng cấp từ DeepSeek-V2-Chat và DeepSeek-Coder-V2-Instruct, kết hợp khả năng tổng quát và lập trình. Mô hình cải thiện khả năng viết và tuân thủ hướng dẫn để phù hợp hơn với sở thích người dùng, và đạt tiến bộ đáng kể trên các bài kiểm tra như AlpacaEval 2.0, ArenaHard, AlignBench và MT-Bench.",
"deepseek-ai/DeepSeek-V3.1-Terminus.description": "DeepSeek-V3.1-Terminus là phiên bản cập nhật của mô hình V3.1, được định vị như một mô hình đại lý lai (hybrid agent LLM). Mô hình khắc phục các vấn đề do người dùng báo cáo, cải thiện độ ổn định, tính nhất quán ngôn ngữ và giảm ký tự bất thường hoặc pha trộn Trung-Anh. Nó tích hợp chế độ Suy nghĩ và Không suy nghĩ với mẫu trò chuyện để chuyển đổi linh hoạt. Ngoài ra, mô hình còn nâng cao hiệu suất của Code Agent và Search Agent để sử dụng công cụ đáng tin cậy hơn và thực hiện các tác vụ nhiều bước.",
"deepseek-ai/DeepSeek-V3.1.description": "DeepSeek V3.1 sử dụng kiến trúc suy luận lai và hỗ trợ cả chế độ suy nghĩ và không suy nghĩ.",
"deepseek-ai/DeepSeek-V3.2-Exp.description": "DeepSeek V3.2 Exp sử dụng kiến trúc suy luận lai và hỗ trợ cả chế độ suy nghĩ và không suy nghĩ.",
"deepseek-ai/DeepSeek-V3.2.description": "DeepSeek-V3.2 là một mô hình kết hợp hiệu suất tính toán cao với khả năng suy luận và hiệu suất Agent xuất sắc. Phương pháp của nó dựa trên ba đột phá công nghệ chính: DeepSeek Sparse Attention (DSA), một cơ chế chú ý hiệu quả giúp giảm đáng kể độ phức tạp tính toán trong khi duy trì hiệu suất mô hình, và được tối ưu hóa đặc biệt cho các kịch bản ngữ cảnh dài; một khung học tăng cường có thể mở rộng, qua đó hiệu suất mô hình có thể cạnh tranh với GPT-5, và phiên bản tính toán cao của nó có thể cạnh tranh với Gemini-3.0-Pro về khả năng suy luận; và một quy trình tổng hợp nhiệm vụ Agent quy mô lớn, được thiết kế để tích hợp khả năng suy luận vào các kịch bản sử dụng công cụ, từ đó cải thiện khả năng theo dõi hướng dẫn và khả năng tổng quát hóa trong các môi trường tương tác phức tạp. Mô hình đã đạt thành tích huy chương vàng tại Olympic Toán học Quốc tế (IMO) và Olympic Tin học Quốc tế (IOI) năm 2025.",
"deepseek-ai/DeepSeek-V3.description": "DeepSeek-V3 là mô hình MoE với 671 tỷ tham số, sử dụng MLA và DeepSeekMoE với cân bằng tải không tổn thất để huấn luyện và suy luận hiệu quả. Được huấn luyện trước trên 14.8T token chất lượng cao với SFT và RL, mô hình vượt trội so với các mô hình mã nguồn mở khác và tiệm cận các mô hình đóng hàng đầu.",
"deepseek-ai/deepseek-llm-67b-chat.description": "DeepSeek LLM Chat (67B) là một mô hình sáng tạo cung cấp khả năng hiểu và tương tác ngôn ngữ sâu sắc.",
"deepseek-ai/deepseek-v3.1-terminus.description": "DeepSeek V3.1 là mô hình suy luận thế hệ mới với khả năng suy luận phức tạp mạnh mẽ và chuỗi suy nghĩ cho các tác vụ phân tích chuyên sâu.",
"deepseek-ai/deepseek-v3.1.description": "DeepSeek V3.1 là mô hình suy luận thế hệ mới với khả năng suy luận phức tạp mạnh mẽ và chuỗi suy nghĩ cho các tác vụ phân tích chuyên sâu.",
"deepseek-ai/deepseek-v3.2.description": "DeepSeek V3.2 là mô hình suy luận thế hệ mới với khả năng suy luận phức tạp mạnh mẽ và tư duy chuỗi.",
"deepseek-chat.description": "DeepSeek V3.2 cân bằng giữa khả năng suy luận và độ dài phản hồi cho các tác vụ hỏi đáp hằng ngày và tác vụ tác nhân (agent). Trên các bảng đánh giá công khai, mô hình đạt hiệu suất ngang tầm GPT-5 và là mô hình đầu tiên tích hợp quá trình suy nghĩ vào việc sử dụng công cụ, dẫn đầu trong các đánh giá tác nhân mã nguồn mở.",
"deepseek-coder-33B-instruct.description": "DeepSeek Coder 33B là mô hình ngôn ngữ lập trình được huấn luyện trên 2 nghìn tỷ token (87% mã nguồn, 13% văn bản tiếng Trung/Anh). Mô hình này hỗ trợ cửa sổ ngữ cảnh 16K và nhiệm vụ điền vào giữa đoạn mã, cung cấp khả năng hoàn thành mã ở cấp độ dự án và chèn đoạn mã chính xác.",
"deepseek-coder-v2.description": "DeepSeek Coder V2 là mô hình mã nguồn MoE mã nguồn mở với hiệu suất mạnh mẽ trong các tác vụ lập trình, có thể so sánh với GPT-4 Turbo.",
"deepseek-coder-v2:236b.description": "DeepSeek Coder V2 là mô hình mã nguồn MoE mã nguồn mở với hiệu suất mạnh mẽ trong các tác vụ lập trình, có thể so sánh với GPT-4 Turbo.",
"deepseek-ocr.description": "DeepSeek-OCR là mô hình thị giác-ngôn ngữ từ DeepSeek AI tập trung vào nhận dạng ký tự quang học (OCR) và \"nén quang học theo ngữ cảnh\". Mô hình này khám phá cách nén thông tin ngữ cảnh từ hình ảnh, xử lý tài liệu hiệu quả và chuyển đổi chúng thành định dạng văn bản có cấu trúc như Markdown. Nó nhận diện văn bản trong hình ảnh một cách chính xác, lý tưởng cho số hóa tài liệu, trích xuất văn bản và xử lý có cấu trúc.",
"deepseek-r1-0528.description": "Mô hình đầy đủ 685B được phát hành vào ngày 28-05-2025. DeepSeek-R1 sử dụng học tăng cường quy mô lớn trong giai đoạn hậu huấn luyện, cải thiện đáng kể khả năng suy luận với dữ liệu gán nhãn tối thiểu, và thể hiện hiệu suất vượt trội trong toán học, lập trình và suy luận ngôn ngữ tự nhiên.",
"deepseek-r1-250528.description": "DeepSeek R1 250528 là mô hình suy luận đầy đủ của DeepSeek-R1 dành cho các tác vụ toán học và logic phức tạp.",
"deepseek-r1-70b-fast-online.description": "DeepSeek R1 70B phiên bản nhanh với tìm kiếm web thời gian thực, mang lại phản hồi nhanh hơn mà vẫn duy trì hiệu suất.",
"deepseek-r1-70b-online.description": "DeepSeek R1 70B phiên bản tiêu chuẩn với tìm kiếm web thời gian thực, phù hợp cho trò chuyện và xử lý văn bản cập nhật.",
"deepseek-r1-distill-llama-70b.description": "DeepSeek R1 Distill Llama 70B kết hợp khả năng suy luận của R1 với hệ sinh thái Llama.",
"deepseek-r1-distill-llama-8b.description": "DeepSeek-R1-Distill-Llama-8B được chưng cất từ Llama-3.1-8B sử dụng đầu ra từ DeepSeek R1.",
"deepseek-r1-distill-llama.description": "deepseek-r1-distill-llama được chưng cất từ DeepSeek-R1 trên nền tảng Llama.",
"deepseek-r1-distill-qianfan-70b.description": "DeepSeek R1 Distill Qianfan 70B là phiên bản chưng cất R1 dựa trên Qianfan-70B với giá trị vượt trội.",
"deepseek-r1-distill-qianfan-8b.description": "DeepSeek R1 Distill Qianfan 8B là phiên bản chưng cất R1 dựa trên Qianfan-8B, phù hợp cho các ứng dụng quy mô nhỏ và trung bình.",
"deepseek-r1-distill-qianfan-llama-70b.description": "DeepSeek R1 Distill Qianfan Llama 70B là phiên bản chưng cất R1 dựa trên Llama-70B.",
"deepseek-r1-distill-qwen-1.5b.description": "DeepSeek R1 Distill Qwen 1.5B là mô hình chưng cất siêu nhẹ dành cho môi trường tài nguyên rất hạn chế.",
"deepseek-r1-distill-qwen-14b.description": "DeepSeek R1 Distill Qwen 14B là mô hình chưng cất cỡ trung cho triển khai đa kịch bản.",
"deepseek-r1-distill-qwen-32b.description": "DeepSeek R1 Distill Qwen 32B là phiên bản chưng cất R1 dựa trên Qwen-32B, cân bằng giữa hiệu suất và chi phí.",
"deepseek-r1-distill-qwen-7b.description": "DeepSeek R1 Distill Qwen 7B là mô hình chưng cất nhẹ dành cho môi trường biên và doanh nghiệp riêng tư.",
"deepseek-r1-distill-qwen.description": "deepseek-r1-distill-qwen được chưng cất từ DeepSeek-R1 trên nền tảng Qwen.",
"deepseek-r1-fast-online.description": "Phiên bản đầy đủ DeepSeek R1 nhanh với tìm kiếm web thời gian thực, kết hợp khả năng 671B và phản hồi nhanh hơn.",
"deepseek-r1-online.description": "Phiên bản đầy đủ DeepSeek R1 với 671B tham số và tìm kiếm web thời gian thực, mang lại khả năng hiểu và tạo nội dung mạnh mẽ hơn.",
"deepseek-r1.description": "DeepSeek-R1 sử dụng dữ liệu khởi động lạnh trước khi áp dụng học tăng cường và đạt hiệu suất tương đương OpenAI-o1 trong các tác vụ toán học, lập trình và suy luận.",
"deepseek-reasoner.description": "DeepSeek V3.2 Thinking là mô hình suy luận chuyên sâu tạo ra chuỗi lập luận trước khi đưa ra kết quả nhằm đạt độ chính xác cao hơn, với thành tích hàng đầu trong các cuộc thi và khả năng suy luận tương đương Gemini-3.0-Pro.",
"deepseek-v2.description": "DeepSeek V2 là mô hình MoE hiệu quả cho xử lý tiết kiệm chi phí.",
"deepseek-v2:236b.description": "DeepSeek V2 236B là mô hình tập trung vào mã nguồn của DeepSeek với khả năng tạo mã mạnh mẽ.",
"deepseek-v3-0324.description": "DeepSeek-V3-0324 là mô hình MoE với 671B tham số, nổi bật về lập trình, khả năng kỹ thuật, hiểu ngữ cảnh và xử lý văn bản dài.",
"deepseek-v3.1-terminus.description": "DeepSeek-V3.1-Terminus là mô hình LLM tối ưu hóa cho thiết bị đầu cuối từ DeepSeek.",
"deepseek-v3.1-think-250821.description": "DeepSeek V3.1 Think 250821 là mô hình suy nghĩ sâu tương ứng với phiên bản Terminus, được xây dựng cho suy luận hiệu suất cao.",
"deepseek-v3.1.description": "DeepSeek-V3.1 là mô hình suy luận lai mới từ DeepSeek, hỗ trợ cả chế độ suy nghĩ và không suy nghĩ, mang lại hiệu quả suy luận cao hơn so với DeepSeek-R1-0528. Tối ưu hóa sau huấn luyện giúp cải thiện đáng kể việc sử dụng công cụ và hiệu suất tác vụ của tác nhân. Hỗ trợ cửa sổ ngữ cảnh 128k và đầu ra lên đến 64k token.",
"deepseek-v3.1:671b.description": "DeepSeek V3.1 là mô hình suy luận thế hệ tiếp theo với khả năng suy luận phức tạp và chuỗi suy nghĩ được cải thiện, phù hợp cho các tác vụ yêu cầu phân tích sâu.",
"deepseek-v3.2-exp.description": "deepseek-v3.2-exp giới thiệu cơ chế chú ý thưa để cải thiện hiệu quả huấn luyện và suy luận trên văn bản dài, với chi phí thấp hơn deepseek-v3.1.",
"deepseek-v3.2-speciale.description": "Đối với các nhiệm vụ cực kỳ phức tạp, mô hình Speciale vượt trội hơn đáng kể so với phiên bản tiêu chuẩn, nhưng tiêu thụ nhiều token hơn và chi phí cao hơn. Hiện tại, DeepSeek-V3.2-Speciale chỉ dành cho mục đích nghiên cứu, không hỗ trợ gọi công cụ và chưa được tối ưu hóa đặc biệt cho các nhiệm vụ hội thoại hoặc viết hàng ngày.",
"deepseek-v3.2-think.description": "DeepSeek V3.2 Think là mô hình suy nghĩ sâu đầy đủ với khả năng suy luận chuỗi dài mạnh mẽ hơn.",
"deepseek-v3.2-thinking.description": "DeepSeek-V3.2 Thinking là biến thể chế độ tư duy của DeepSeek-V3.2, tập trung vào các nhiệm vụ lý luận.",
"deepseek-v3.2.description": "DeepSeek-V3.2 là mô hình lập trình mới nhất của DeepSeek với khả năng lý luận mạnh mẽ.",
"deepseek-v3.description": "DeepSeek-V3 là mô hình MoE mạnh mẽ với tổng số tham số 671B và 37B hoạt động trên mỗi token.",
"deepseek-vl2-small.description": "DeepSeek VL2 Small là phiên bản đa phương thức nhẹ, phù hợp cho môi trường hạn chế tài nguyên và yêu cầu đồng thời cao.",
"deepseek-vl2.description": "DeepSeek VL2 là mô hình đa phương thức cho hiểu hình ảnh-văn bản và hỏi đáp thị giác chi tiết.",
"deepseek/deepseek-chat-v3-0324.description": "DeepSeek V3 là mô hình MoE với 685 tỷ tham số và là phiên bản mới nhất trong dòng mô hình trò chuyện hàng đầu của DeepSeek.\n\nMô hình kế thừa từ [DeepSeek V3](/deepseek/deepseek-chat-v3) và thể hiện hiệu suất mạnh mẽ trên nhiều tác vụ.",
"deepseek/deepseek-chat-v3-0324:free.description": "DeepSeek V3 là mô hình MoE với 685 tỷ tham số và là phiên bản mới nhất trong dòng mô hình trò chuyện hàng đầu của DeepSeek.\n\nMô hình kế thừa từ [DeepSeek V3](/deepseek/deepseek-chat-v3) và thể hiện hiệu suất mạnh mẽ trên nhiều tác vụ.",
"deepseek/deepseek-chat-v3.1.description": "DeepSeek-V3.1 là mô hình suy luận lai với ngữ cảnh dài của DeepSeek, hỗ trợ chế độ tư duy và không tư duy, tích hợp công cụ.",
"deepseek/deepseek-chat.description": "DeepSeek-V3 là mô hình suy luận lai hiệu suất cao của DeepSeek dành cho các tác vụ phức tạp và tích hợp công cụ.",
"deepseek/deepseek-math-v2.description": "DeepSeek Math V2 là mô hình đạt đột phá lớn trong khả năng suy luận toán học. Đổi mới cốt lõi nằm ở cơ chế huấn luyện \"tự xác minh\", giúp mô hình đạt cấp huy chương vàng trong nhiều cuộc thi toán học hàng đầu.",
"deepseek/deepseek-r1-0528.description": "DeepSeek R1 0528 là phiên bản cập nhật tập trung vào khả năng truy cập mở và suy luận sâu hơn.",
"deepseek/deepseek-r1-0528:free.description": "DeepSeek-R1 cải thiện đáng kể khả năng suy luận với dữ liệu gán nhãn tối thiểu và tạo chuỗi tư duy trước khi đưa ra câu trả lời cuối cùng để nâng cao độ chính xác.",
"deepseek/deepseek-r1-distill-llama-70b.description": "DeepSeek R1 Distill Llama 70B là mô hình LLM chưng cất dựa trên Llama 3.3 70B, được tinh chỉnh bằng đầu ra từ DeepSeek R1 để đạt hiệu suất cạnh tranh với các mô hình tiên phong quy mô lớn.",
"deepseek/deepseek-r1-distill-llama-8b.description": "DeepSeek R1 Distill Llama 8B là mô hình LLM chưng cất dựa trên Llama-3.1-8B-Instruct, được huấn luyện bằng đầu ra từ DeepSeek R1.",
"deepseek/deepseek-r1-distill-qwen-14b.description": "DeepSeek R1 Distill Qwen 14B là mô hình LLM chưng cất dựa trên Qwen 2.5 14B, được huấn luyện bằng đầu ra từ DeepSeek R1. Mô hình vượt qua OpenAI o1-mini trên nhiều tiêu chuẩn, đạt kết quả hàng đầu trong các mô hình đặc.",
"deepseek/deepseek-r1-distill-qwen-32b.description": "DeepSeek R1 Distill Qwen 32B là mô hình LLM chưng cất dựa trên Qwen 2.5 32B, được huấn luyện bằng đầu ra từ DeepSeek R1. Mô hình vượt qua OpenAI o1-mini trên nhiều tiêu chuẩn, đạt kết quả hàng đầu trong các mô hình đặc.",
"deepseek/deepseek-r1.description": "DeepSeek R1 đã được cập nhật thành DeepSeek-R1-0528. Với tài nguyên tính toán lớn hơn và tối ưu hóa thuật toán sau huấn luyện, mô hình cải thiện đáng kể độ sâu và khả năng suy luận. Mô hình thể hiện hiệu suất mạnh mẽ trên các tiêu chuẩn toán học, lập trình và logic tổng quát, tiệm cận các mô hình hàng đầu như o3 và Gemini 2.5 Pro.",
"deepseek/deepseek-r1/community.description": "DeepSeek R1 là mô hình mã nguồn mở mới nhất do nhóm DeepSeek phát hành, có hiệu suất suy luận rất mạnh, đặc biệt trong các tác vụ toán học, lập trình và suy luận, tương đương với OpenAI o1.",
"deepseek/deepseek-r1:free.description": "DeepSeek-R1 cải thiện đáng kể khả năng suy luận với dữ liệu gán nhãn tối thiểu và tạo chuỗi tư duy trước khi đưa ra câu trả lời cuối cùng để nâng cao độ chính xác.",
"deepseek/deepseek-reasoner.description": "DeepSeek-V3 Thinking (reasoner) là mô hình suy luận thử nghiệm của DeepSeek, phù hợp với các tác vụ suy luận có độ phức tạp cao.",
"deepseek/deepseek-v3.description": "Mô hình LLM đa năng tốc độ cao với khả năng suy luận nâng cao.",
"deepseek/deepseek-v3/community.description": "DeepSeek-V3 mang lại đột phá lớn về tốc độ suy luận so với các mô hình trước. Mô hình xếp hạng đầu trong các mô hình mã nguồn mở và cạnh tranh với các mô hình đóng tiên tiến nhất. DeepSeek-V3 áp dụng kiến trúc Multi-Head Latent Attention (MLA) và DeepSeekMoE, cả hai đều đã được xác thực trong DeepSeek-V2. Mô hình cũng giới thiệu chiến lược phụ trợ không mất dữ liệu để cân bằng tải và mục tiêu huấn luyện dự đoán đa token để tăng cường hiệu suất.",
"deepseek_r1.description": "DeepSeek-R1 là mô hình suy luận dựa trên học tăng cường, giải quyết các vấn đề lặp lại và khả năng đọc hiểu. Trước khi áp dụng học tăng cường, mô hình sử dụng dữ liệu khởi đầu lạnh để cải thiện thêm khả năng suy luận. Mô hình đạt hiệu suất tương đương OpenAI-o1 trong các tác vụ toán học, lập trình và suy luận, với quy trình huấn luyện được thiết kế cẩn thận để nâng cao kết quả tổng thể.",
"deepseek_r1_distill_llama_70b.description": "DeepSeek-R1-Distill-Llama-70B được chưng cất từ Llama-3.3-70B-Instruct. Là một phần của dòng DeepSeek-R1, mô hình được tinh chỉnh trên các mẫu do DeepSeek-R1 tạo ra và thể hiện hiệu suất mạnh mẽ trong toán học, lập trình và suy luận.",
"deepseek_r1_distill_qwen_14b.description": "DeepSeek-R1-Distill-Qwen-14B được chưng cất từ Qwen2.5-14B và tinh chỉnh trên 800K mẫu được chọn lọc do DeepSeek-R1 tạo ra, mang lại khả năng suy luận mạnh mẽ.",
"deepseek_r1_distill_qwen_32b.description": "DeepSeek-R1-Distill-Qwen-32B được chưng cất từ Qwen2.5-32B và tinh chỉnh trên 800K mẫu được chọn lọc do DeepSeek-R1 tạo ra, vượt trội trong toán học, lập trình và suy luận.",
"devstral-2512.description": "Devstral 2 là mô hình văn bản cấp doanh nghiệp, xuất sắc trong việc sử dụng công cụ để khám phá cơ sở mã, chỉnh sửa nhiều tệp và hỗ trợ các Agent kỹ thuật phần mềm.",
"devstral-2:123b.description": "Devstral 2 123B vượt trội trong việc sử dụng công cụ để khám phá mã nguồn, chỉnh sửa nhiều tệp và hỗ trợ các đại lý kỹ thuật phần mềm.",
"doubao-1.5-lite-32k.description": "Doubao-1.5-lite là mô hình nhẹ mới với phản hồi siêu nhanh, mang lại chất lượng và độ trễ hàng đầu.",
"doubao-1.5-pro-256k.description": "Doubao-1.5-pro-256k là bản nâng cấp toàn diện của Doubao-1.5-Pro, cải thiện hiệu suất tổng thể 10%. Mô hình hỗ trợ cửa sổ ngữ cảnh 256k và tối đa 12k token đầu ra, mang lại hiệu suất cao hơn, cửa sổ lớn hơn và giá trị mạnh mẽ cho nhiều trường hợp sử dụng.",
"doubao-1.5-pro-32k.description": "Doubao-1.5-pro là mô hình hàng đầu thế hệ mới với nâng cấp toàn diện, vượt trội về kiến thức, lập trình và suy luận.",
"doubao-1.5-thinking-pro-m.description": "Doubao-1.5 là mô hình suy luận sâu mới (phiên bản m hỗ trợ suy luận sâu đa phương thức gốc), nổi bật trong toán học, lập trình, suy luận khoa học và các tác vụ tổng quát như sáng tác sáng tạo. Mô hình đạt hoặc tiệm cận kết quả hàng đầu trên các chuẩn đánh giá như AIME 2024, Codeforces và GPQA. Hỗ trợ cửa sổ ngữ cảnh 128k và đầu ra lên đến 16k.",
"doubao-1.5-thinking-pro.description": "Doubao-1.5 là mô hình suy luận sâu mới, nổi bật trong toán học, lập trình, suy luận khoa học và các tác vụ tổng quát như sáng tác sáng tạo. Mô hình đạt hoặc tiệm cận kết quả hàng đầu trên các chuẩn đánh giá như AIME 2024, Codeforces và GPQA. Hỗ trợ cửa sổ ngữ cảnh 128k và đầu ra lên đến 16k.",
"doubao-1.5-thinking-vision-pro.description": "Mô hình suy luận sâu thị giác mới với khả năng hiểu và suy luận đa phương thức mạnh mẽ hơn, đạt kết quả SOTA trên 37 trong số 59 chuẩn đánh giá công khai.",
"doubao-1.5-ui-tars.description": "Doubao-1.5-UI-TARS là mô hình tác tử tập trung vào giao diện người dùng gốc, tương tác liền mạch với giao diện thông qua nhận thức, suy luận và hành động giống con người.",
"doubao-1.5-vision-lite.description": "Doubao-1.5-vision-lite là mô hình đa phương thức nâng cấp hỗ trợ hình ảnh ở mọi độ phân giải và tỷ lệ khung hình cực đoan, nâng cao khả năng suy luận thị giác, nhận diện tài liệu, hiểu chi tiết và tuân thủ hướng dẫn. Hỗ trợ cửa sổ ngữ cảnh 128k và đầu ra lên đến 16k token.",
"doubao-1.5-vision-pro-32k.description": "Doubao-1.5-vision-pro là mô hình đa phương thức nâng cấp hỗ trợ hình ảnh ở mọi độ phân giải và tỷ lệ khung hình cực đoan, nâng cao khả năng suy luận thị giác, nhận diện tài liệu, hiểu chi tiết và tuân thủ hướng dẫn.",
"doubao-1.5-vision-pro.description": "Doubao-1.5-vision-pro là mô hình đa phương thức nâng cấp hỗ trợ hình ảnh ở mọi độ phân giải và tỷ lệ khung hình cực đoan, nâng cao khả năng suy luận thị giác, nhận diện tài liệu, hiểu chi tiết và tuân thủ hướng dẫn.",
"doubao-lite-32k.description": "Phản hồi siêu nhanh với giá trị vượt trội, cung cấp lựa chọn linh hoạt hơn cho nhiều tình huống. Hỗ trợ suy luận và tinh chỉnh với cửa sổ ngữ cảnh 32k.",
"doubao-pro-32k.description": "Mô hình hàng đầu có hiệu suất tốt nhất cho các tác vụ phức tạp, đạt kết quả mạnh mẽ trong hỏi đáp tham chiếu, tóm tắt, sáng tạo, phân loại văn bản và nhập vai. Hỗ trợ suy luận và tinh chỉnh với cửa sổ ngữ cảnh 32k.",
"doubao-seed-1.6-flash.description": "Doubao-Seed-1.6-flash là mô hình suy luận sâu đa phương thức siêu nhanh với TPOT chỉ 10ms. Hỗ trợ cả văn bản và hình ảnh, vượt trội mô hình lite trước đó về hiểu văn bản và ngang tầm các mô hình pro cạnh tranh về thị giác. Hỗ trợ cửa sổ ngữ cảnh 256k và đầu ra lên đến 16k token.",
"doubao-seed-1.6-lite.description": "Doubao-Seed-1.6-lite là mô hình suy luận sâu đa phương thức mới với mức độ suy luận có thể điều chỉnh (Tối thiểu, Thấp, Trung bình, Cao), mang lại giá trị tốt hơn và là lựa chọn mạnh mẽ cho các tác vụ phổ biến, hỗ trợ cửa sổ ngữ cảnh lên đến 256k.",
"doubao-seed-1.6-thinking.description": "Doubao-Seed-1.6-thinking tăng cường đáng kể khả năng suy luận, cải thiện hơn nữa năng lực cốt lõi trong lập trình, toán học và suy luận logic so với Doubao-1.5-thinking-pro, đồng thời bổ sung khả năng hiểu thị giác. Hỗ trợ cửa sổ ngữ cảnh 256k và đầu ra lên đến 16k token.",
"doubao-seed-1.6-vision.description": "Doubao-Seed-1.6-vision là mô hình suy luận sâu thị giác cung cấp khả năng hiểu và suy luận đa phương thức mạnh mẽ hơn cho giáo dục, đánh giá hình ảnh, kiểm tra/an ninh và hỏi đáp AI. Hỗ trợ cửa sổ ngữ cảnh 256k và đầu ra lên đến 64k token.",
"doubao-seed-1.6.description": "Doubao-Seed-1.6 là mô hình suy luận sâu đa phương thức mới với các chế độ tự động, suy luận và không suy luận. Ở chế độ không suy luận, mô hình vượt trội đáng kể so với Doubao-1.5-pro/250115. Hỗ trợ cửa sổ ngữ cảnh 256k và đầu ra lên đến 16k token.",
"doubao-seed-1.8.description": "Doubao-Seed-1.8 có khả năng hiểu đa phương thức và tác tử mạnh mẽ hơn, hỗ trợ đầu vào văn bản/hình ảnh/video và lưu trữ ngữ cảnh, mang lại hiệu suất xuất sắc trong các tác vụ phức tạp.",
"doubao-seed-2.0-code.description": "Doubao-Seed-2.0-code được tối ưu hóa sâu cho lập trình tác nhân, hỗ trợ đầu vào đa phương thức và cửa sổ ngữ cảnh 256k, phù hợp với lập trình, hiểu biết thị giác và quy trình làm việc của tác nhân.",
"doubao-seed-2.0-lite.description": "Doubao-Seed-2.0-lite là mô hình suy luận sâu đa phương thức mới, mang lại giá trị tốt hơn và là lựa chọn mạnh mẽ cho các nhiệm vụ thông thường, với cửa sổ ngữ cảnh lên đến 256k.",
"doubao-seed-2.0-mini.description": "Doubao-Seed-2.0-mini là mô hình nhẹ với phản hồi nhanh và hiệu suất cao, phù hợp cho các nhiệm vụ nhỏ và các tình huống đồng thời cao.",
"doubao-seed-2.0-pro.description": "Doubao-Seed-2.0-pro là mô hình Agent hàng đầu của ByteDance, với những bước nhảy vọt toàn diện trong khả năng lập kế hoạch và thực hiện nhiệm vụ phức tạp.",
"doubao-seed-code.description": "Doubao-Seed-Code được tối ưu hóa sâu cho lập trình tác tử, hỗ trợ đầu vào đa phương thức (văn bản/hình ảnh/video) và cửa sổ ngữ cảnh 256k, tương thích với API Anthropic, phù hợp với lập trình, hiểu thị giác và quy trình tác tử.",
"doubao-seedance-1-0-lite-i2v-250428.description": "Chất lượng tạo ổn định với hiệu quả chi phí cao, có khả năng tạo video từ khung hình đầu tiên, khung hình đầu và cuối, hoặc hình ảnh tham chiếu.",
"doubao-seedance-1-0-lite-t2v-250428.description": "Chất lượng tạo ổn định với hiệu quả chi phí cao, có khả năng tạo video dựa trên hướng dẫn bằng văn bản.",
"doubao-seedance-1-0-pro-250528.description": "Seedance 1.0 Pro là mô hình nền tảng tạo video hỗ trợ kể chuyện đa khung hình. Nó mang lại hiệu suất mạnh mẽ trên nhiều khía cạnh. Mô hình đạt được những đột phá trong việc hiểu ngữ nghĩa và tuân theo hướng dẫn, cho phép tạo video độ phân giải cao 1080P với chuyển động mượt mà, chi tiết phong phú, phong cách đa dạng và thẩm mỹ hình ảnh cấp độ điện ảnh.",
"doubao-seedance-1-0-pro-fast-251015.description": "Seedance 1.0 Pro Fast là mô hình toàn diện được thiết kế để giảm thiểu chi phí trong khi tối đa hóa hiệu suất, đạt được sự cân bằng tuyệt vời giữa chất lượng tạo video, tốc độ và giá cả. Nó kế thừa những điểm mạnh cốt lõi của Seedance 1.0 Pro, đồng thời cung cấp tốc độ tạo nhanh hơn và giá cả cạnh tranh hơn, mang lại sự tối ưu kép về hiệu quả và chi phí cho người sáng tạo.",
"doubao-seedance-1-5-pro-251215.description": "Seedance 1.5 Pro của ByteDance hỗ trợ tạo video từ văn bản, hình ảnh (khung hình đầu tiên, khung hình đầu tiên + cuối cùng), và âm thanh đồng bộ với hình ảnh.",
"doubao-seedance-2-0-260128.description": "Seedance 2.0 của ByteDance là mô hình tạo video mạnh mẽ nhất, hỗ trợ tạo video tham chiếu đa phương thức, chỉnh sửa video, mở rộng video, chuyển văn bản thành video và chuyển hình ảnh thành video với âm thanh đồng bộ.",
"doubao-seedance-2-0-fast-260128.description": "Seedance 2.0 Fast của ByteDance cung cấp các khả năng tương tự như Seedance 2.0 với tốc độ tạo nhanh hơn và giá cả cạnh tranh hơn.",
"doubao-seededit-3-0-i2i-250628.description": "Mô hình hình ảnh Doubao từ ByteDance Seed hỗ trợ đầu vào văn bản và hình ảnh với khả năng tạo hình ảnh chất lượng cao, dễ kiểm soát. Hỗ trợ chỉnh sửa hình ảnh theo văn bản, với kích thước đầu ra từ 512 đến 1536 theo cạnh dài.",
"doubao-seedream-3-0-t2i-250415.description": "Seedream 3.0 là mô hình tạo hình ảnh từ ByteDance Seed, hỗ trợ đầu vào văn bản và hình ảnh với khả năng tạo hình ảnh chất lượng cao, dễ kiểm soát. Mô hình tạo hình ảnh từ văn bản gợi ý.",
"doubao-seedream-4-0-250828.description": "Seedream 4.0 là mô hình tạo hình ảnh từ ByteDance Seed, hỗ trợ đầu vào văn bản và hình ảnh với khả năng tạo hình ảnh chất lượng cao, dễ kiểm soát. Mô hình tạo hình ảnh từ văn bản gợi ý.",
"doubao-seedream-4-5-251128.description": "Seedream 4.5 là mô hình hình ảnh đa phương thức mới nhất của ByteDance, tích hợp khả năng tạo hình ảnh từ văn bản, chỉnh sửa hình ảnh và tạo hình ảnh hàng loạt, đồng thời kết hợp khả năng suy luận và kiến thức thông thường. So với phiên bản 4.0 trước đó, nó mang lại chất lượng tạo hình ảnh được cải thiện đáng kể, với sự nhất quán chỉnh sửa tốt hơn và khả năng hợp nhất nhiều hình ảnh. Nó cung cấp khả năng kiểm soát chi tiết hình ảnh chính xác hơn, tạo ra văn bản nhỏ và khuôn mặt nhỏ một cách tự nhiên hơn, và đạt được bố cục và màu sắc hài hòa hơn, nâng cao tính thẩm mỹ tổng thể.",
"doubao-seedream-5-0-260128.description": "Doubao-Seedream-5.0-lite là mô hình tạo hình ảnh mới nhất của ByteDance. Lần đầu tiên, nó tích hợp khả năng truy xuất trực tuyến, cho phép kết hợp thông tin web theo thời gian thực và nâng cao tính kịp thời của hình ảnh được tạo. Trí tuệ của mô hình cũng được nâng cấp, cho phép diễn giải chính xác các hướng dẫn phức tạp và nội dung hình ảnh. Ngoài ra, nó cung cấp phạm vi kiến thức toàn cầu được cải thiện, tính nhất quán tham chiếu và chất lượng tạo hình ảnh trong các tình huống chuyên nghiệp, đáp ứng tốt hơn nhu cầu sáng tạo hình ảnh ở cấp độ doanh nghiệp.",
"emohaa.description": "Emohaa là mô hình hỗ trợ sức khỏe tinh thần với khả năng tư vấn chuyên nghiệp, giúp người dùng hiểu rõ các vấn đề cảm xúc.",
"ernie-4.5-0.3b.description": "ERNIE 4.5 0.3B là mô hình nhẹ mã nguồn mở, phù hợp để triển khai cục bộ và tùy chỉnh.",
"ernie-4.5-21b-a3b-thinking.description": "ERNIE-4.5-21B-A3B-Thinking là mô hình văn bản MoE (Hỗn hợp chuyên gia) được huấn luyện sau với tổng cộng 21 tỷ tham số và 3 tỷ tham số hoạt động, mang lại chất lượng và chiều sâu suy luận được cải thiện đáng kể.",
"ernie-4.5-21b-a3b.description": "ERNIE 4.5 21B A3B là mô hình mã nguồn mở với số lượng tham số lớn, có khả năng hiểu và tạo nội dung mạnh mẽ hơn.",
"ernie-4.5-300b-a47b.description": "ERNIE 4.5 300B A47B là mô hình MoE siêu lớn của Baidu ERNIE với khả năng lý luận xuất sắc.",
"ernie-4.5-8k-preview.description": "ERNIE 4.5 8K Preview là mô hình xem trước với ngữ cảnh 8K để đánh giá ERNIE 4.5.",
"ernie-4.5-turbo-128k-preview.description": "Bản xem trước ERNIE 4.5 Turbo 128K với khả năng tương đương bản phát hành chính thức, phù hợp để tích hợp và thử nghiệm canary.",
"ernie-4.5-turbo-128k.description": "ERNIE 4.5 Turbo 128K là mô hình tổng quát hiệu suất cao với khả năng tăng cường tìm kiếm và gọi công cụ cho các tình huống hỏi đáp, lập trình và đại lý.",
"ernie-4.5-turbo-32k.description": "ERNIE 4.5 Turbo 32K là phiên bản ngữ cảnh trung bình dành cho hỏi đáp, truy xuất cơ sở tri thức và đối thoại nhiều lượt.",
"ernie-4.5-turbo-latest.description": "Phiên bản ERNIE 4.5 Turbo mới nhất với hiệu suất tổng thể được tối ưu hóa, lý tưởng để sử dụng làm mô hình sản xuất chính.",
"ernie-4.5-turbo-vl-32k-preview.description": "ERNIE 4.5 Turbo VL 32K Preview là bản xem trước đa phương thức 32K để đánh giá khả năng thị giác ngữ cảnh dài.",
"ernie-4.5-turbo-vl-32k.description": "ERNIE 4.5 Turbo VL 32K là phiên bản đa phương thức trung-dài cho việc hiểu tài liệu dài và hình ảnh kết hợp.",
"ernie-4.5-turbo-vl-latest.description": "ERNIE 4.5 Turbo VL Latest là phiên bản đa phương thức mới nhất với khả năng hiểu và lý luận hình ảnh-văn bản được cải thiện.",
"ernie-4.5-turbo-vl-preview.description": "ERNIE 4.5 Turbo VL Preview là mô hình xem trước đa phương thức để hiểu và tạo nội dung hình ảnh-văn bản, phù hợp cho hỏi đáp trực quan và hiểu nội dung.",
"ernie-4.5-turbo-vl.description": "ERNIE 4.5 Turbo VL là mô hình đa phương thức trưởng thành để hiểu và nhận diện hình ảnh-văn bản trong sản xuất.",
"ernie-4.5-vl-28b-a3b.description": "ERNIE 4.5 VL 28B A3B là mô hình đa phương thức mã nguồn mở để hiểu và lý luận hình ảnh-văn bản.",
"ernie-5.0-thinking-latest.description": "Wenxin 5.0 Thinking là mô hình chủ lực toàn phương thức bản địa với khả năng mô hình hóa văn bản, hình ảnh, âm thanh và video thống nhất. Nó mang lại nâng cấp toàn diện cho các tình huống hỏi đáp phức tạp, sáng tạo và đại lý.",
"ernie-5.0-thinking-preview.description": "Wenxin 5.0 Thinking Preview là mô hình chủ lực toàn phương thức bản địa với khả năng mô hình hóa văn bản, hình ảnh, âm thanh và video thống nhất. Nó mang lại nâng cấp toàn diện cho các tình huống hỏi đáp phức tạp, sáng tạo và đại lý.",
"ernie-char-8k.description": "ERNIE Character 8K là mô hình đối thoại nhân vật để xây dựng nhân vật IP và trò chuyện đồng hành lâu dài.",
"ernie-char-fiction-8k-preview.description": "ERNIE Character Fiction 8K Preview là bản xem trước mô hình tạo nhân vật và cốt truyện để đánh giá và thử nghiệm tính năng.",
"ernie-char-fiction-8k.description": "ERNIE Character Fiction 8K là mô hình nhân vật dành cho tiểu thuyết và sáng tạo cốt truyện, phù hợp để tạo truyện dài.",
"ernie-irag-edit.description": "ERNIE iRAG Edit là mô hình chỉnh sửa hình ảnh hỗ trợ xóa, vẽ lại và tạo biến thể.",
"ernie-lite-pro-128k.description": "ERNIE Lite Pro 128K là mô hình nhẹ hiệu suất cao dành cho các tình huống nhạy cảm về độ trễ và chi phí.",
"ernie-novel-8k.description": "ERNIE Novel 8K được xây dựng để tạo tiểu thuyết dài và cốt truyện IP với nhiều nhân vật.",
"ernie-speed-pro-128k.description": "ERNIE Speed Pro 128K là mô hình giá trị cao, hỗ trợ đồng thời cao dành cho dịch vụ trực tuyến quy mô lớn và ứng dụng doanh nghiệp.",
"ernie-x1-turbo-32k-preview.description": "ERNIE X1 Turbo 32K Preview là mô hình suy nghĩ nhanh với ngữ cảnh 32K dành cho suy luận phức tạp và hội thoại nhiều lượt.",
"ernie-x1-turbo-32k.description": "ERNIE X1 Turbo 32K là mô hình tư duy nhanh với ngữ cảnh 32K dành cho lý luận phức tạp và trò chuyện nhiều lượt.",
"ernie-x1.1-preview.description": "ERNIE X1.1 Preview là bản xem trước mô hình tư duy để đánh giá và thử nghiệm.",
"ernie-x1.1.description": "ERNIE X1.1 là mô hình suy nghĩ thử nghiệm dành cho đánh giá và kiểm tra.",
"fal-ai/bytedance/seedream/v4.5.description": "Seedream 4.5, được phát triển bởi đội ngũ ByteDance Seed, hỗ trợ chỉnh sửa và kết hợp nhiều hình ảnh. Tính năng bao gồm tăng cường độ nhất quán của chủ thể, tuân thủ hướng dẫn chính xác, hiểu logic không gian, thể hiện thẩm mỹ, thiết kế bố cục poster và logo với khả năng kết xuất văn bản-hình ảnh độ chính xác cao.",
"fal-ai/bytedance/seedream/v4.description": "Seedream 4.0, được phát triển bởi ByteDance Seed, hỗ trợ đầu vào văn bản và hình ảnh để tạo ra hình ảnh chất lượng cao, có khả năng kiểm soát linh hoạt dựa trên nội dung mô tả.",
"fal-ai/flux-kontext/dev.description": "Mô hình FLUX.1 tập trung vào chỉnh sửa hình ảnh, hỗ trợ đầu vào văn bản và hình ảnh.",
"fal-ai/flux-pro/kontext.description": "FLUX.1 Kontext [pro] chấp nhận đầu vào là văn bản và hình ảnh tham chiếu, cho phép chỉnh sửa cục bộ chính xác và biến đổi toàn cảnh phức tạp.",
"fal-ai/flux/krea.description": "Flux Krea [dev] là mô hình tạo hình ảnh với thiên hướng thẩm mỹ hướng đến hình ảnh chân thực và tự nhiên hơn.",
"fal-ai/flux/schnell.description": "FLUX.1 [schnell] là mô hình tạo hình ảnh với 12 tỷ tham số, được thiết kế để tạo ra hình ảnh chất lượng cao một cách nhanh chóng.",
"fal-ai/hunyuan-image/v3.description": "Mô hình tạo hình ảnh đa phương thức mạnh mẽ bản địa.",
"fal-ai/imagen4/preview.description": "Mô hình tạo hình ảnh chất lượng cao từ Google.",
"fal-ai/nano-banana.description": "Nano Banana là mô hình đa phương thức bản địa mới nhất, nhanh nhất và hiệu quả nhất của Google, cho phép tạo và chỉnh sửa hình ảnh thông qua hội thoại.",
"fal-ai/qwen-image-edit.description": "Một mô hình chỉnh sửa hình ảnh chuyên nghiệp từ đội ngũ Qwen, hỗ trợ chỉnh sửa ngữ nghĩa và ngoại hình, chỉnh sửa văn bản tiếng Trung/tiếng Anh chính xác, chuyển đổi phong cách, xoay ảnh và nhiều tính năng khác.",
"fal-ai/qwen-image.description": "Một mô hình tạo ảnh mạnh mẽ từ đội ngũ Qwen với khả năng hiển thị văn bản tiếng Trung xuất sắc và phong cách hình ảnh đa dạng.",
"flux-1-schnell.description": "Mô hình chuyển văn bản thành hình ảnh với 12 tỷ tham số từ Black Forest Labs, sử dụng phương pháp khuếch tán đối kháng tiềm ẩn để tạo hình ảnh chất lượng cao chỉ trong 1–4 bước. Mô hình cạnh tranh với các lựa chọn đóng và được phát hành theo giấy phép Apache-2.0 cho mục đích cá nhân, nghiên cứu và thương mại.",
"flux-dev.description": "Mô hình tạo ảnh R&D mã nguồn mở, tối ưu hiệu quả cho nghiên cứu sáng tạo phi thương mại.",
"flux-kontext-max.description": "Tạo và chỉnh sửa hình ảnh theo ngữ cảnh tiên tiến, kết hợp văn bản và hình ảnh để tạo ra kết quả chính xác và mạch lạc.",
"flux-kontext-pro.description": "Tạo và chỉnh sửa hình ảnh theo ngữ cảnh tiên tiến, kết hợp văn bản và hình ảnh để tạo ra kết quả chính xác và mạch lạc.",
"flux-pro-1.1-ultra.description": "Tạo hình ảnh độ phân giải siêu cao với đầu ra 4MP, tạo hình ảnh sắc nét chỉ trong 10 giây.",
"flux-pro-1.1.description": "Mô hình tạo hình ảnh chuyên nghiệp nâng cấp với chất lượng hình ảnh xuất sắc và khả năng tuân thủ lời nhắc chính xác.",
"flux-pro.description": "Mô hình tạo hình ảnh thương mại hàng đầu với chất lượng hình ảnh vượt trội và đầu ra đa dạng.",
"flux.1-schnell.description": "FLUX.1-schnell là mô hình tạo hình ảnh hiệu suất cao cho đầu ra nhanh với nhiều phong cách.",
"gemini-1.0-pro-001.description": "Gemini 1.0 Pro 001 (Tuning) cung cấp hiệu suất ổn định và có thể điều chỉnh cho các tác vụ phức tạp.",
"gemini-1.0-pro-002.description": "Gemini 1.0 Pro 002 (Tuning) hỗ trợ đa phương thức mạnh mẽ cho các tác vụ phức tạp.",
"gemini-1.0-pro-latest.description": "Gemini 1.0 Pro là mô hình AI hiệu suất cao của Google, được thiết kế để mở rộng quy mô cho nhiều tác vụ.",
"gemini-1.5-flash-001.description": "Gemini 1.5 Flash 001 là mô hình đa phương thức hiệu quả cho việc mở rộng ứng dụng rộng rãi.",
"gemini-1.5-flash-002.description": "Gemini 1.5 Flash 002 là mô hình đa phương thức hiệu quả được xây dựng để triển khai quy mô lớn.",
"gemini-1.5-flash-8b-exp-0924.description": "Gemini 1.5 Flash 8B 0924 là mô hình thử nghiệm mới nhất với cải tiến đáng kể trong các trường hợp sử dụng văn bản và đa phương thức.",
"gemini-1.5-flash-8b-latest.description": "Gemini 1.5 Flash 8B là mô hình đa phương thức hiệu quả được xây dựng để triển khai quy mô lớn.",
"gemini-1.5-flash-8b.description": "Gemini 1.5 Flash 8B là mô hình đa phương thức hiệu quả cho việc mở rộng ứng dụng rộng rãi.",
"gemini-1.5-flash-exp-0827.description": "Gemini 1.5 Flash 0827 cung cấp xử lý đa phương thức tối ưu cho các tác vụ phức tạp.",
"gemini-1.5-flash-latest.description": "Gemini 1.5 Flash là mô hình AI đa phương thức mới nhất của Google với khả năng xử lý nhanh, hỗ trợ đầu vào văn bản, hình ảnh và video để mở rộng hiệu quả trên nhiều tác vụ.",
"gemini-1.5-pro-001.description": "Gemini 1.5 Pro 001 là giải pháp AI đa phương thức có thể mở rộng cho các tác vụ phức tạp.",
"gemini-1.5-pro-002.description": "Gemini 1.5 Pro 002 là mô hình sẵn sàng sản xuất mới nhất với đầu ra chất lượng cao hơn, đặc biệt trong toán học, ngữ cảnh dài và thị giác.",
"gemini-1.5-pro-exp-0801.description": "Gemini 1.5 Pro 0801 cung cấp xử lý đa phương thức mạnh mẽ với tính linh hoạt cao hơn cho phát triển ứng dụng.",
"gemini-1.5-pro-exp-0827.description": "Gemini 1.5 Pro 0827 áp dụng các tối ưu hóa mới nhất để xử lý đa phương thức hiệu quả hơn.",
"gemini-1.5-pro-latest.description": "Gemini 1.5 Pro hỗ trợ lên đến 2 triệu token, là mô hình đa phương thức tầm trung lý tưởng cho các tác vụ phức tạp.",
"gemini-2.0-flash-001.description": "Gemini 2.0 Flash mang đến các tính năng thế hệ mới bao gồm tốc độ vượt trội, sử dụng công cụ gốc, tạo nội dung đa phương thức và cửa sổ ngữ cảnh 1 triệu token.",
"gemini-2.0-flash-lite-001.description": "Biến thể Gemini 2.0 Flash được tối ưu hóa cho hiệu quả chi phí và độ trễ thấp.",
"gemini-2.0-flash-lite.description": "Biến thể Gemini 2.0 Flash được tối ưu hóa cho hiệu quả chi phí và độ trễ thấp.",
"gemini-2.0-flash.description": "Gemini 2.0 Flash mang đến các tính năng thế hệ mới bao gồm tốc độ vượt trội, sử dụng công cụ gốc, tạo nội dung đa phương thức và cửa sổ ngữ cảnh 1 triệu token.",
"gemini-2.5-flash-image.description": "Nano Banana là mô hình đa phương thức gốc mới nhất, nhanh nhất và hiệu quả nhất của Google, cho phép tạo và chỉnh sửa hình ảnh thông qua hội thoại.",
"gemini-2.5-flash-image:image.description": "Nano Banana là mô hình đa phương thức gốc mới nhất, nhanh nhất và hiệu quả nhất của Google, cho phép tạo và chỉnh sửa hình ảnh thông qua hội thoại.",
"gemini-2.5-flash-lite-preview-06-17.description": "Gemini 2.5 Flash-Lite Preview là mô hình nhỏ nhất và có giá trị tốt nhất của Google, được thiết kế cho các trường hợp sử dụng quy mô lớn.",
"gemini-2.5-flash-lite-preview-09-2025.description": "Phiên bản xem trước (25 tháng 9, 2025) của Gemini 2.5 Flash-Lite",
"gemini-2.5-flash-lite.description": "Gemini 2.5 Flash-Lite là mô hình nhỏ nhất và có giá trị tốt nhất của Google, được thiết kế cho các trường hợp sử dụng quy mô lớn.",
"gemini-2.5-flash-preview-04-17.description": "Gemini 2.5 Flash Preview là mô hình có giá trị tốt nhất của Google với đầy đủ tính năng.",
"gemini-2.5-flash.description": "Gemini 2.5 Flash là mô hình có giá trị tốt nhất của Google với đầy đủ tính năng.",
"gemini-2.5-pro-preview-03-25.description": "Gemini 2.5 Pro Preview là mô hình suy luận tiên tiến nhất của Google, có khả năng suy luận trên mã, toán học và các vấn đề STEM, cũng như phân tích tập dữ liệu lớn, mã nguồn và tài liệu với ngữ cảnh dài.",
"gemini-2.5-pro-preview-05-06.description": "Gemini 2.5 Pro Preview là mô hình suy luận tiên tiến nhất của Google, có khả năng suy luận trên mã, toán học và các vấn đề STEM, cũng như phân tích tập dữ liệu lớn, mã nguồn và tài liệu với ngữ cảnh dài.",
"gemini-2.5-pro.description": "Gemini 2.5 Pro là mô hình suy luận tiên tiến nhất của Google, có khả năng suy luận trên mã, toán học và các vấn đề STEM, cũng như phân tích tập dữ liệu lớn, mã nguồn và tài liệu với ngữ cảnh dài.",
"gemini-3-flash-preview.description": "Gemini 3 Flash là mô hình thông minh nhất được xây dựng để tối ưu tốc độ, kết hợp trí tuệ tiên tiến với khả năng tìm kiếm chính xác.",
"gemini-3-pro-image-preview.description": "Gemini 3 Pro Image (Nano Banana Pro) là mô hình tạo hình ảnh của Google, cũng hỗ trợ đối thoại đa phương thức.",
"gemini-3-pro-image-preview:image.description": "Gemini 3 Pro Image (Nano Banana Pro) là mô hình tạo hình ảnh của Google và cũng hỗ trợ trò chuyện đa phương thức.",
"gemini-3-pro-preview.description": "Gemini 3 Pro là mô hình mạnh mẽ nhất của Google, kết hợp khả năng mã hóa cảm xúc và suy luận tiên tiến, mang đến hình ảnh phong phú và tương tác sâu sắc.",
"gemini-3.1-flash-image-preview.description": "Gemini 3.1 Flash Image (Nano Banana 2) là mô hình tạo hình ảnh bản địa nhanh nhất của Google với hỗ trợ suy nghĩ, tạo hình ảnh đối thoại và chỉnh sửa.",
"gemini-3.1-flash-image-preview:image.description": "Gemini 3.1 Flash Image (Nano Banana 2) mang đến chất lượng hình ảnh đẳng cấp Pro với tốc độ Flash cùng hỗ trợ trò chuyện đa phương thức.",
"gemini-3.1-flash-lite-preview.description": "Gemini 3.1 Flash-Lite Preview là mô hình đa phương thức tiết kiệm chi phí nhất của Google, được tối ưu hóa cho các nhiệm vụ tác nhân khối lượng lớn, dịch thuật và xử lý dữ liệu.",
"gemini-3.1-pro-preview.description": "Gemini 3.1 Pro Preview cải tiến Gemini 3 Pro với khả năng suy luận nâng cao và bổ sung hỗ trợ mức suy nghĩ trung bình.",
"gemini-flash-latest.description": "Phiên bản mới nhất của Gemini Flash",
"gemini-flash-lite-latest.description": "Phiên bản mới nhất của Gemini Flash-Lite",
"gemini-pro-latest.description": "Phiên bản mới nhất của Gemini Pro",
"gemma-7b-it.description": "Gemma 7B là lựa chọn tiết kiệm chi phí cho các tác vụ quy mô nhỏ đến trung bình.",
"gemma2-9b-it.description": "Gemma 2 9B được tối ưu hóa cho các tác vụ cụ thể và tích hợp công cụ.",
"gemma2.description": "Gemma 2 là mô hình hiệu quả của Google, phục vụ từ ứng dụng nhỏ đến xử lý dữ liệu phức tạp.",
"gemma2:27b.description": "Gemma 2 là mô hình hiệu quả của Google, phục vụ từ ứng dụng nhỏ đến xử lý dữ liệu phức tạp.",
"gemma2:2b.description": "Gemma 2 là mô hình hiệu quả của Google, phục vụ từ ứng dụng nhỏ đến xử lý dữ liệu phức tạp.",
"generalv3.5.description": "Spark Max là phiên bản đầy đủ tính năng nhất, hỗ trợ tìm kiếm web và nhiều plugin tích hợp. Các khả năng cốt lõi được tối ưu hóa hoàn toàn, vai trò hệ thống và gọi hàm mang lại hiệu suất vượt trội trong các tình huống ứng dụng phức tạp.",
"generalv3.description": "Spark Pro là mô hình LLM hiệu suất cao được tối ưu cho các lĩnh vực chuyên môn, tập trung vào toán học, lập trình, y tế và giáo dục, với tìm kiếm web và các plugin tích hợp như thời tiết và ngày tháng. Nó mang lại hiệu suất mạnh mẽ và hiệu quả trong hỏi đáp kiến thức phức tạp, hiểu ngôn ngữ và sáng tạo văn bản nâng cao, là lựa chọn lý tưởng cho các trường hợp sử dụng chuyên nghiệp.",
"glm-4-0520.description": "GLM-4-0520 là phiên bản mô hình mới nhất, được thiết kế cho các tác vụ phức tạp và đa dạng với hiệu suất vượt trội.",
"glm-4-7.description": "GLM-4.7 là mô hình hàng đầu mới nhất từ Zhipu AI. GLM-4.7 nâng cao khả năng lập trình, lập kế hoạch nhiệm vụ dài hạn và phối hợp công cụ trong các tình huống Lập trình Tác nhân (Agentic Coding), đạt hiệu suất dẫn đầu trong số các mô hình mã nguồn mở trên nhiều bảng xếp hạng công khai. Khả năng tổng thể được cải thiện, với phản hồi ngắn gọn, tự nhiên hơn và phong cách viết hấp dẫn hơn. Trong các nhiệm vụ tác nhân phức tạp, khả năng tuân thủ hướng dẫn khi gọi công cụ được tăng cường, đồng thời tính thẩm mỹ của giao diện Artifacts và Agentic Coding cũng như hiệu quả hoàn thành nhiệm vụ dài hạn được cải thiện hơn nữa. • Khả năng lập trình mạnh mẽ hơn: Cải thiện đáng kể hiệu suất lập trình đa ngôn ngữ và tác nhân dòng lệnh; GLM-4.7 hiện có thể triển khai cơ chế \"nghĩ trước, hành động sau\" trong các khung lập trình như Claude Code, Kilo Code, TRAE, Cline và Roo Code, với hiệu suất ổn định hơn trong các tác vụ phức tạp. • Cải thiện thẩm mỹ giao diện: GLM-4.7 thể hiện tiến bộ rõ rệt trong chất lượng tạo giao diện, có thể tạo trang web, bản trình chiếu và áp phích với tính thẩm mỹ cao hơn. • Khả năng gọi công cụ mạnh mẽ hơn: GLM-4.7 nâng cao khả năng gọi công cụ, đạt 67 điểm trong đánh giá nhiệm vụ web BrowseComp; đạt 84.7 điểm trong đánh giá gọi công cụ tương tác τ²-Bench, vượt qua Claude Sonnet 4.5 và trở thành SOTA mã nguồn mở. • Cải thiện khả năng suy luận: Tăng cường đáng kể khả năng toán học và suy luận, đạt 42.8% trong bài kiểm tra HLE (\"Kỳ thi cuối cùng của nhân loại\"), tăng 41% so với GLM-4.6, vượt qua GPT-5.1. • Tăng cường khả năng tổng thể: Các cuộc hội thoại với GLM-4.7 trở nên ngắn gọn, thông minh và tự nhiên hơn; khả năng viết và nhập vai trở nên văn học và sống động hơn.",
"glm-4-9b-chat.description": "GLM-4-9B-Chat thể hiện hiệu suất mạnh mẽ trong ngữ nghĩa, toán học, suy luận, mã hóa và kiến thức. Nó cũng hỗ trợ duyệt web, thực thi mã, gọi công cụ tùy chỉnh và suy luận văn bản dài, hỗ trợ 26 ngôn ngữ bao gồm tiếng Nhật, Hàn và Đức.",
"glm-4-air-250414.description": "GLM-4-Air là lựa chọn có giá trị cao với hiệu suất gần GLM-4, tốc độ nhanh và chi phí thấp hơn.",
"glm-4-air.description": "GLM-4-Air là lựa chọn có giá trị cao với hiệu suất gần GLM-4, tốc độ nhanh và chi phí thấp hơn.",
"glm-4-airx.description": "GLM-4-AirX là biến thể hiệu quả hơn của GLM-4-Air với khả năng suy luận nhanh hơn đến 2.6 lần.",
"glm-4-alltools.description": "GLM-4-AllTools là mô hình tác tử đa năng được tối ưu hóa cho lập kế hoạch hướng dẫn phức tạp và sử dụng công cụ như duyệt web, giải thích mã và tạo văn bản, phù hợp cho thực thi đa nhiệm.",
"glm-4-flash-250414.description": "GLM-4-Flash lý tưởng cho các tác vụ đơn giản: nhanh nhất và miễn phí.",
"glm-4-flash.description": "GLM-4-Flash lý tưởng cho các tác vụ đơn giản: nhanh nhất và miễn phí.",
"glm-4-flashx.description": "GLM-4-FlashX là phiên bản Flash nâng cao với khả năng suy luận siêu nhanh.",
"glm-4-long.description": "GLM-4-Long hỗ trợ đầu vào siêu dài cho các tác vụ kiểu ghi nhớ và xử lý tài liệu quy mô lớn.",
"glm-4-plus.description": "GLM-4-Plus là mô hình cao cấp với trí tuệ vượt trội, xử lý tốt văn bản dài và tác vụ phức tạp, hiệu suất tổng thể được nâng cấp.",
"glm-4.1v-thinking-flash.description": "GLM-4.1V-Thinking là mô hình VLM ~10B mạnh nhất hiện nay, bao phủ các tác vụ SOTA như hiểu video, hỏi đáp hình ảnh, giải đề, OCR, đọc tài liệu và biểu đồ, tác tử GUI, lập trình giao diện và liên kết ngữ nghĩa. Với học tăng cường tiên tiến, nó sử dụng suy luận chuỗi tư duy để cải thiện độ chính xác và độ phong phú, vượt trội hơn các mô hình không suy nghĩ truyền thống cả về kết quả và khả năng giải thích.",
"glm-4.1v-thinking-flashx.description": "GLM-4.1V-Thinking là mô hình VLM ~10B mạnh nhất hiện nay, bao phủ các tác vụ SOTA như hiểu video, hỏi đáp hình ảnh, giải đề, OCR, đọc tài liệu và biểu đồ, tác tử GUI, lập trình giao diện và liên kết ngữ nghĩa. Với học tăng cường tiên tiến, nó sử dụng suy luận chuỗi tư duy để cải thiện độ chính xác và độ phong phú, vượt trội hơn các mô hình không suy nghĩ truyền thống cả về kết quả và khả năng giải thích.",
"glm-4.5-air.description": "Phiên bản nhẹ của GLM-4.5 cân bằng giữa hiệu suất và chi phí, với chế độ suy nghĩ kết hợp linh hoạt.",
"glm-4.5-airx.description": "Phiên bản nhanh của GLM-4.5-Air với phản hồi nhanh hơn cho các trường hợp sử dụng quy mô lớn, tốc độ cao.",
"glm-4.5-x.description": "Phiên bản nhanh của GLM-4.5, mang lại hiệu suất mạnh mẽ với tốc độ tạo lên đến 100 token/giây.",
"glm-4.5.description": "Mô hình hàng đầu của Zhipu với chế độ suy nghĩ có thể chuyển đổi, cung cấp SOTA mã nguồn mở tổng thể và hỗ trợ ngữ cảnh lên đến 128K.",
"glm-4.5v.description": "Mô hình suy luận thị giác thế hệ tiếp theo của Zhipu với tổng 106B tham số, 12B hoạt động, đạt SOTA trong các mô hình đa phương thức mã nguồn mở cùng kích thước về hình ảnh, video, hiểu tài liệu và tác vụ GUI.",
"glm-4.6.description": "GLM-4.6 là mô hình hàng đầu mới nhất của Zhipu (355B), vượt trội hoàn toàn so với các phiên bản trước về mã hóa nâng cao, xử lý văn bản dài, suy luận và khả năng tác tử. Đặc biệt phù hợp với Claude Sonnet 4 về khả năng lập trình, trở thành mô hình mã hóa hàng đầu tại Trung Quốc.",
"glm-4.6v-flash.description": "Dòng GLM-4.6V đại diện cho một bước tiến lớn của gia đình GLM trong hướng đa phương thức, bao gồm GLM-4.6V (phiên bản hàng đầu), GLM-4.6V-FlashX (nhẹ và tốc độ cao), và GLM-4.6V-Flash (hoàn toàn miễn phí). Nó mở rộng cửa sổ ngữ cảnh trong thời gian huấn luyện lên đến 128k token, đạt độ chính xác hiểu biết hình ảnh tiên tiến nhất ở quy mô tham số tương đương, và lần đầu tiên tích hợp nguyên bản khả năng Function Call (triệu hồi công cụ) vào kiến trúc mô hình hình ảnh. Điều này thống nhất quy trình từ “nhận thức hình ảnh” đến “hành động thực thi,” cung cấp nền tảng kỹ thuật nhất quán cho các tác nhân đa phương thức trong các kịch bản sản xuất thực tế.",
"glm-4.6v-flashx.description": "Dòng GLM-4.6V đại diện cho một bước tiến lớn của gia đình GLM trong hướng đa phương thức, bao gồm GLM-4.6V (phiên bản hàng đầu), GLM-4.6V-FlashX (nhẹ và tốc độ cao), và GLM-4.6V-Flash (hoàn toàn miễn phí). Nó mở rộng cửa sổ ngữ cảnh trong thời gian huấn luyện lên đến 128k token, đạt độ chính xác hiểu biết hình ảnh tiên tiến nhất ở quy mô tham số tương đương, và lần đầu tiên tích hợp nguyên bản khả năng Function Call (triệu hồi công cụ) vào kiến trúc mô hình hình ảnh. Điều này thống nhất quy trình từ “nhận thức hình ảnh” đến “hành động thực thi,” cung cấp nền tảng kỹ thuật nhất quán cho các tác nhân đa phương thức trong các kịch bản sản xuất thực tế.",
"glm-4.6v.description": "Dòng GLM-4.6V đại diện cho một bước tiến lớn của gia đình GLM trong hướng đa phương thức, bao gồm GLM-4.6V (phiên bản hàng đầu), GLM-4.6V-FlashX (nhẹ và tốc độ cao), và GLM-4.6V-Flash (hoàn toàn miễn phí). Nó mở rộng cửa sổ ngữ cảnh trong thời gian huấn luyện lên đến 128k token, đạt độ chính xác hiểu biết hình ảnh tiên tiến nhất ở quy mô tham số tương đương, và lần đầu tiên tích hợp nguyên bản khả năng Function Call (triệu hồi công cụ) vào kiến trúc mô hình hình ảnh. Điều này thống nhất quy trình từ “nhận thức hình ảnh” đến “hành động thực thi,” cung cấp nền tảng kỹ thuật nhất quán cho các tác nhân đa phương thức trong các kịch bản sản xuất thực tế.",
"glm-4.7-flash.description": "GLM-4.7-Flash, là một mô hình SOTA cấp 30B, mang đến lựa chọn mới cân bằng giữa hiệu suất và hiệu quả. Mô hình nâng cao khả năng lập trình, lập kế hoạch nhiệm vụ dài hạn và phối hợp công cụ trong các tình huống Lập trình Tác nhân (Agentic Coding), đạt hiệu suất hàng đầu trong số các mô hình mã nguồn mở cùng kích thước trên nhiều bảng xếp hạng hiện tại. Khi thực hiện các nhiệm vụ tác nhân thông minh phức tạp, mô hình thể hiện khả năng tuân thủ hướng dẫn mạnh mẽ hơn khi gọi công cụ, đồng thời cải thiện tính thẩm mỹ của giao diện và hiệu quả hoàn thành nhiệm vụ dài hạn cho Artifacts và Agentic Coding.",
"glm-4.7-flashx.description": "GLM-4.7-Flash, là một mô hình SOTA cấp 30B, mang đến lựa chọn mới cân bằng giữa hiệu suất và hiệu quả. Mô hình nâng cao khả năng lập trình, lập kế hoạch nhiệm vụ dài hạn và phối hợp công cụ trong các tình huống Lập trình Tác nhân (Agentic Coding), đạt hiệu suất hàng đầu trong số các mô hình mã nguồn mở cùng kích thước trên nhiều bảng xếp hạng hiện tại. Khi thực hiện các nhiệm vụ tác nhân thông minh phức tạp, mô hình thể hiện khả năng tuân thủ hướng dẫn mạnh mẽ hơn khi gọi công cụ, đồng thời cải thiện tính thẩm mỹ của giao diện và hiệu quả hoàn thành nhiệm vụ dài hạn cho Artifacts và Agentic Coding.",
"glm-4.7.description": "GLM-4.7 là mô hình chủ lực mới nhất của Zhipu, được nâng cấp cho các tình huống Lập trình Tác nhân (Agentic Coding) với khả năng lập trình vượt trội, lập kế hoạch nhiệm vụ dài hạn và phối hợp công cụ. Mô hình đạt hiệu suất hàng đầu trong số các mô hình mã nguồn mở trên nhiều bộ đánh giá công khai. Năng lực tổng quát được cải thiện với phản hồi ngắn gọn, tự nhiên hơn và khả năng viết lôi cuốn hơn. Đối với các tác vụ tác nhân phức tạp, khả năng tuân thủ hướng dẫn khi gọi công cụ được tăng cường, đồng thời giao diện người dùng và hiệu quả hoàn thành nhiệm vụ dài hạn trong Artifacts và Agentic Coding cũng được cải thiện.",
"glm-4.description": "GLM-4 là mô hình chủ lực cũ được phát hành vào tháng 1 năm 2024, hiện đã được thay thế bởi GLM-4-0520 mạnh mẽ hơn.",
"glm-4v-flash.description": "GLM-4V-Flash tập trung vào khả năng hiểu hình ảnh đơn hiệu quả cho các tình huống phân tích nhanh như xử lý hình ảnh theo thời gian thực hoặc theo lô.",
"glm-4v-plus-0111.description": "GLM-4V-Plus có khả năng hiểu video và nhiều hình ảnh, phù hợp với các tác vụ đa phương thức.",
"glm-4v-plus.description": "GLM-4V-Plus có khả năng hiểu video và nhiều hình ảnh, phù hợp với các tác vụ đa phương thức.",
"glm-4v.description": "GLM-4V cung cấp khả năng hiểu và suy luận hình ảnh mạnh mẽ trong các tác vụ thị giác.",
"glm-5-turbo.description": "GLM-5-Turbo là mô hình nền tảng được tối ưu hóa sâu cho các kịch bản tác nhân. Nó được tối ưu hóa đặc biệt cho các yêu cầu cốt lõi của các nhiệm vụ tác nhân từ giai đoạn đào tạo, nâng cao các khả năng chính như gọi công cụ, tuân thủ lệnh và thực thi chuỗi dài. Lý tưởng để xây dựng trợ lý tác nhân hiệu suất cao.",
"glm-5.1.description": "GLM-5.1 là mô hình chủ lực mới nhất của Zhipu, được căn chỉnh tương đương Claude Opus 4.6 về năng lực tổng thể và lập trình. Mô hình vượt trội trong các tác vụ dài hạn, có khả năng tự động lập kế hoạch, thực thi và lặp lại trong tối đa 8 giờ cho một nhiệm vụ duy nhất, trở thành nền tảng lý tưởng cho các Tác nhân Tự động (Autonomous Agents) và các Tác nhân Lập trình dài hạn (Long-horizon Coding Agents).",
"glm-5.description": "GLM-5 là mô hình nền tảng thế hệ tiếp theo của Zhipu, được thiết kế đặc biệt cho Kỹ thuật Tác nhân (Agentic Engineering). Nó mang lại năng suất đáng tin cậy trong các hệ thống kỹ thuật phức tạp và các nhiệm vụ tác nhân dài hạn. Trong khả năng mã hóa và tác nhân, GLM-5 đạt hiệu suất tiên tiến nhất trong số các mô hình mã nguồn mở. Trong các kịch bản lập trình thực tế, trải nghiệm người dùng của nó gần đạt đến mức của Claude Opus 4.5. Nó vượt trội trong kỹ thuật hệ thống phức tạp và các nhiệm vụ tác nhân dài hạn, làm cho nó trở thành mô hình nền tảng lý tưởng cho các trợ lý tác nhân đa năng.",
"glm-5v-turbo.description": "GLM-5V-Turbo là mô hình nền tảng mã hóa đa phương thức đầu tiên của Zhipu, được thiết kế cho các nhiệm vụ lập trình trực quan. Nó có thể xử lý đầu vào đa phương thức như hình ảnh, video và văn bản, đồng thời vượt trội trong lập kế hoạch dài hạn, lập trình phức tạp và thực thi hành động. Tích hợp sâu với quy trình làm việc của tác nhân, nó có thể hợp tác liền mạch với các tác nhân như Claude Code và OpenClaw để hoàn thành một vòng khép kín đầy đủ từ \"hiểu môi trường → lập kế hoạch hành động → thực hiện nhiệm vụ.\"",
"glm-image.description": "GLM-Image là mô hình tạo hình ảnh hàng đầu mới của Zhipu. Mô hình này được huấn luyện từ đầu đến cuối trên các chip sản xuất trong nước và áp dụng kiến trúc lai nguyên bản kết hợp mô hình tự hồi quy với bộ giải mã khuếch tán. Thiết kế này cho phép hiểu biết hướng dẫn toàn cầu mạnh mẽ cùng với khả năng hiển thị chi tiết cục bộ tinh vi, vượt qua các thách thức lâu dài trong việc tạo nội dung giàu kiến thức như áp phích, bài thuyết trình và sơ đồ giáo dục. Nó đại diện cho một sự khám phá quan trọng hướng tới thế hệ mới của các mô hình công nghệ “tạo nhận thức,” được minh họa bởi Nano Banana Pro.",
"glm-z1-air.description": "Mô hình suy luận với khả năng suy luận sâu cho các tác vụ yêu cầu phân tích phức tạp.",
"glm-z1-airx.description": "Suy luận siêu nhanh với chất lượng suy luận cao.",
"glm-z1-flash.description": "Dòng GLM-Z1 cung cấp khả năng suy luận phức tạp mạnh mẽ, vượt trội trong logic, toán học và lập trình.",
"glm-z1-flashx.description": "Nhanh và tiết kiệm chi phí: Được tăng tốc với khả năng suy luận siêu nhanh và hỗ trợ đồng thời cao.",
"glm-zero-preview.description": "GLM-Zero-Preview mang lại khả năng suy luận phức tạp mạnh mẽ, vượt trội trong logic, toán học và lập trình.",
"global.anthropic.claude-haiku-4-5-20251001-v1:0.description": "Claude Haiku 4.5 là mô hình Haiku nhanh nhất và thông minh nhất của Anthropic, với tốc độ vượt trội và khả năng tư duy mở rộng.",
"global.anthropic.claude-opus-4-5-20251101-v1:0.description": "Claude Opus 4.5 là mô hình chủ lực của Anthropic, kết hợp trí thông minh vượt trội và hiệu suất mở rộng cho các tác vụ phức tạp đòi hỏi phản hồi và suy luận chất lượng cao nhất.",
"global.anthropic.claude-opus-4-6-v1.description": "Claude Opus 4.6 là mô hình thông minh nhất của Anthropic dành cho việc xây dựng tác nhân và lập trình.",
"global.anthropic.claude-sonnet-4-5-20250929-v1:0.description": "Claude Sonnet 4.5 là mô hình thông minh nhất của Anthropic cho đến nay.",
"global.anthropic.claude-sonnet-4-6.description": "Claude Sonnet 4.6 là sự kết hợp tốt nhất giữa tốc độ và trí thông minh của Anthropic.",
"google/gemini-2.0-flash-001.description": "Gemini 2.0 Flash mang đến các khả năng thế hệ mới, bao gồm tốc độ vượt trội, sử dụng công cụ tích hợp, tạo nội dung đa phương thức và cửa sổ ngữ cảnh lên đến 1 triệu token.",
"google/gemini-2.0-flash-lite-001.description": "Gemini 2.0 Flash Lite là biến thể nhẹ của Gemini với chế độ suy nghĩ bị tắt mặc định để cải thiện độ trễ và chi phí, nhưng có thể bật thông qua tham số.",
"google/gemini-2.0-flash-lite.description": "Gemini 2.0 Flash Lite cung cấp các tính năng thế hệ mới bao gồm tốc độ vượt trội, sử dụng công cụ tích hợp, tạo nội dung đa phương thức và cửa sổ ngữ cảnh lên đến 1 triệu token.",
"google/gemini-2.0-flash.description": "Gemini 2.0 Flash là mô hình suy luận hiệu suất cao của Google dành cho các tác vụ đa phương thức mở rộng.",
"google/gemini-2.5-flash-image.description": "Gemini 2.5 Flash Image (Nano Banana) là mô hình tạo hình ảnh của Google với hỗ trợ hội thoại đa phương thức.",
"google/gemini-2.5-flash-lite.description": "Gemini 2.5 Flash Lite là biến thể nhẹ của Gemini 2.5 được tối ưu hóa cho độ trễ và chi phí, phù hợp với các tình huống yêu cầu thông lượng cao.",
"google/gemini-2.5-flash-preview.description": "Gemini 2.5 Flash là mô hình chủ lực tiên tiến nhất của Google, được xây dựng cho các tác vụ suy luận, lập trình, toán học và khoa học nâng cao. Mô hình tích hợp khả năng “suy nghĩ” để cung cấp phản hồi chính xác hơn với xử lý ngữ cảnh tinh tế hơn.\n\nLưu ý: Mô hình này có hai biến thể — có suy nghĩ và không suy nghĩ. Giá đầu ra khác nhau đáng kể tùy theo việc suy nghĩ có được bật hay không. Nếu bạn chọn biến thể tiêu chuẩn (không có hậu tố “:thinking”), mô hình sẽ tránh tạo token suy nghĩ.\n\nĐể sử dụng suy nghĩ và nhận token suy nghĩ, bạn phải chọn biến thể “:thinking”, điều này sẽ tính giá cao hơn cho đầu ra suy nghĩ.\n\nGemini 2.5 Flash cũng có thể được cấu hình thông qua tham số “max reasoning tokens” như được tài liệu hóa (https://openrouter.ai/docs/use-cases/reasoning-tokens#max-tokens-for-reasoning).",
"google/gemini-2.5-flash-preview:thinking.description": "Gemini 2.5 Flash là mô hình chủ lực tiên tiến nhất của Google, được xây dựng cho các tác vụ suy luận, lập trình, toán học và khoa học nâng cao. Mô hình tích hợp khả năng “suy nghĩ” để cung cấp phản hồi chính xác hơn với xử lý ngữ cảnh tinh tế hơn.\n\nLưu ý: Mô hình này có hai biến thể — có suy nghĩ và không suy nghĩ. Giá đầu ra khác nhau đáng kể tùy theo việc suy nghĩ có được bật hay không. Nếu bạn chọn biến thể tiêu chuẩn (không có hậu tố “:thinking”), mô hình sẽ tránh tạo token suy nghĩ.\n\nĐể sử dụng suy nghĩ và nhận token suy nghĩ, bạn phải chọn biến thể “:thinking”, điều này sẽ tính giá cao hơn cho đầu ra suy nghĩ.\n\nGemini 2.5 Flash cũng có thể được cấu hình thông qua tham số “max reasoning tokens” như được tài liệu hóa (https://openrouter.ai/docs/use-cases/reasoning-tokens#max-tokens-for-reasoning).",
"google/gemini-2.5-flash.description": "Gemini 2.5 Flash là dòng sản phẩm của Google trải dài từ độ trễ thấp đến suy luận hiệu suất cao.",
"google/gemini-2.5-pro-preview.description": "Gemini 2.5 Pro Preview là mô hình suy nghĩ tiên tiến nhất của Google để suy luận các vấn đề phức tạp trong lập trình, toán học và STEM, cũng như phân tích tập dữ liệu lớn, mã nguồn và tài liệu với ngữ cảnh dài.",
"google/gemini-2.5-pro.description": "Gemini 2.5 Pro là mô hình suy luận chủ lực của Google với hỗ trợ ngữ cảnh dài cho các tác vụ phức tạp.",
"google/gemini-3-pro-image-preview.description": "Gemini 3 Pro Image (Nano Banana Pro) là mô hình tạo hình ảnh của Google với hỗ trợ hội thoại đa phương thức.",
"google/gemini-3-pro-preview.description": "Gemini 3 Pro là mô hình suy luận đa phương thức thế hệ tiếp theo trong dòng Gemini, có khả năng hiểu văn bản, âm thanh, hình ảnh và video, xử lý các tác vụ phức tạp và mã nguồn lớn.",
"google/gemini-3.1-flash-image-preview.description": "Gemini 3.1 Flash Image Preview, còn được gọi là \"Nano Banana 2,\" là mô hình tạo và chỉnh sửa hình ảnh tiên tiến nhất của Google, cung cấp chất lượng hình ảnh cấp Pro với tốc độ Flash. Nó kết hợp hiểu ngữ cảnh nâng cao với suy luận nhanh, hiệu quả về chi phí, làm cho việc tạo hình ảnh phức tạp và chỉnh sửa lặp lại trở nên dễ tiếp cận hơn đáng kể.",
"google/gemini-embedding-001.description": "Mô hình embedding tiên tiến với hiệu suất mạnh mẽ trong tiếng Anh, đa ngôn ngữ và lập trình.",
"google/gemini-flash-1.5.description": "Gemini 1.5 Flash cung cấp xử lý đa phương tiện tối ưu cho nhiều tác vụ phức tạp.",
"google/gemini-pro-1.5.description": "Gemini 1.5 Pro kết hợp các tối ưu hóa mới nhất để xử lý dữ liệu đa phương tiện hiệu quả hơn.",
"google/gemma-2-27b-it.description": "Gemma 2 27B là mô hình ngôn ngữ tổng quát với hiệu suất mạnh mẽ trong nhiều tình huống.",
"google/gemma-2-27b.description": "Gemma 2 là dòng mô hình hiệu quả của Google, phù hợp từ ứng dụng nhỏ đến xử lý dữ liệu phức tạp.",
"google/gemma-2-2b-it.description": "Mô hình ngôn ngữ nhỏ tiên tiến được thiết kế cho các ứng dụng biên.",
"google/gemma-2-9b-it.description": "Gemma 2 9B, do Google phát triển, cung cấp khả năng tuân theo hướng dẫn hiệu quả và năng lực tổng thể vững chắc.",
"google/gemma-2-9b-it:free.description": "Gemma 2 là dòng mô hình văn bản mã nguồn mở nhẹ của Google.",
"google/gemma-2-9b.description": "Gemma 2 là dòng mô hình hiệu quả của Google, phù hợp từ ứng dụng nhỏ đến xử lý dữ liệu phức tạp.",
"google/gemma-2b-it.description": "Gemma Instruct (2B) cung cấp khả năng xử lý hướng dẫn cơ bản cho các ứng dụng nhẹ.",
"google/gemma-3-12b-it.description": "Gemma 3 12B là mô hình ngôn ngữ mã nguồn mở của Google, thiết lập tiêu chuẩn mới về hiệu quả và hiệu suất.",
"google/gemma-3-27b-it.description": "Gemma 3 27B là mô hình ngôn ngữ mã nguồn mở của Google, thiết lập tiêu chuẩn mới về hiệu quả và hiệu suất.",
"google/text-embedding-005.description": "Mô hình embedding văn bản tập trung vào tiếng Anh, tối ưu cho các tác vụ ngôn ngữ và lập trình.",
"google/text-multilingual-embedding-002.description": "Mô hình embedding văn bản đa ngôn ngữ, tối ưu cho các tác vụ xuyên ngôn ngữ trên nhiều ngôn ngữ.",
"gpt-3.5-turbo-0125.description": "GPT 3.5 Turbo cho tạo và hiểu văn bản; hiện đang trỏ đến gpt-3.5-turbo-0125.",
"gpt-3.5-turbo-1106.description": "GPT 3.5 Turbo cho tạo và hiểu văn bản; hiện đang trỏ đến gpt-3.5-turbo-0125.",
"gpt-3.5-turbo-instruct.description": "GPT 3.5 Turbo cho các tác vụ tạo và hiểu văn bản, được tối ưu để tuân theo hướng dẫn.",
"gpt-3.5-turbo.description": "GPT 3.5 Turbo cho tạo và hiểu văn bản; hiện đang trỏ đến gpt-3.5-turbo-0125.",
"gpt-35-turbo-16k.description": "GPT-3.5 Turbo 16k là mô hình tạo văn bản dung lượng cao cho các tác vụ phức tạp.",
"gpt-35-turbo.description": "GPT-3.5 Turbo là mô hình hiệu quả của OpenAI cho trò chuyện và tạo văn bản, hỗ trợ gọi hàm song song.",
"gpt-4-0125-preview.description": "GPT-4 Turbo mới nhất bổ sung khả năng xử lý hình ảnh. Yêu cầu hình ảnh hỗ trợ chế độ JSON và gọi hàm. Đây là mô hình đa phương tiện tiết kiệm chi phí, cân bằng giữa độ chính xác và hiệu quả cho các ứng dụng thời gian thực.",
"gpt-4-0613.description": "GPT-4 cung cấp cửa sổ ngữ cảnh lớn hơn để xử lý đầu vào dài, phù hợp cho tổng hợp thông tin rộng và phân tích dữ liệu.",
"gpt-4-1106-preview.description": "GPT-4 Turbo mới nhất bổ sung khả năng xử lý hình ảnh. Yêu cầu hình ảnh hỗ trợ chế độ JSON và gọi hàm. Đây là mô hình đa phương tiện tiết kiệm chi phí, cân bằng giữa độ chính xác và hiệu quả cho các ứng dụng thời gian thực.",
"gpt-4-32k-0613.description": "GPT-4 cung cấp cửa sổ ngữ cảnh lớn hơn để xử lý đầu vào dài trong các tình huống cần tích hợp thông tin rộng và phân tích dữ liệu.",
"gpt-4-32k.description": "GPT-4 cung cấp cửa sổ ngữ cảnh lớn hơn để xử lý đầu vào dài trong các tình huống cần tích hợp thông tin rộng và phân tích dữ liệu.",
"gpt-4-turbo-2024-04-09.description": "GPT-4 Turbo mới nhất bổ sung khả năng xử lý hình ảnh. Yêu cầu hình ảnh hỗ trợ chế độ JSON và gọi hàm. Đây là mô hình đa phương tiện tiết kiệm chi phí, cân bằng giữa độ chính xác và hiệu quả cho các ứng dụng thời gian thực.",
"gpt-4-turbo-preview.description": "GPT-4 Turbo mới nhất bổ sung khả năng xử lý hình ảnh. Yêu cầu hình ảnh hỗ trợ chế độ JSON và gọi hàm. Đây là mô hình đa phương tiện tiết kiệm chi phí, cân bằng giữa độ chính xác và hiệu quả cho các ứng dụng thời gian thực.",
"gpt-4-turbo.description": "GPT-4 Turbo mới nhất bổ sung khả năng xử lý hình ảnh. Yêu cầu hình ảnh hỗ trợ chế độ JSON và gọi hàm. Đây là mô hình đa phương tiện tiết kiệm chi phí, cân bằng giữa độ chính xác và hiệu quả cho các ứng dụng thời gian thực.",
"gpt-4-vision-preview.description": "Bản xem trước GPT-4 Vision, được thiết kế cho các tác vụ phân tích và xử lý hình ảnh.",
"gpt-4.1-mini.description": "GPT-4.1 mini cân bằng giữa trí tuệ, tốc độ và chi phí, phù hợp với nhiều trường hợp sử dụng.",
"gpt-4.1-nano.description": "GPT-4.1 nano là mô hình nhanh nhất và tiết kiệm chi phí nhất trong dòng GPT-4.1.",
"gpt-4.1.description": "GPT-4.1 là mô hình hàng đầu của chúng tôi cho các tác vụ phức tạp và giải quyết vấn đề liên ngành.",
"gpt-4.5-preview.description": "GPT-4.5-preview là mô hình đa năng mới nhất với kiến thức thế giới sâu rộng và khả năng hiểu ý định tốt hơn, mạnh mẽ trong các tác vụ sáng tạo và lập kế hoạch tác nhân. Mốc kiến thức là tháng 10 năm 2023.",
"gpt-4.description": "GPT-4 cung cấp cửa sổ ngữ cảnh lớn hơn để xử lý đầu vào dài, phù hợp cho tổng hợp thông tin rộng và phân tích dữ liệu.",
"gpt-4o-2024-05-13.description": "ChatGPT-4o là mô hình động được cập nhật theo thời gian thực, kết hợp khả năng hiểu và tạo nội dung mạnh mẽ cho các trường hợp sử dụng quy mô lớn như hỗ trợ khách hàng, giáo dục và hỗ trợ kỹ thuật.",
"gpt-4o-2024-08-06.description": "ChatGPT-4o là mô hình động được cập nhật theo thời gian thực. Nó kết hợp khả năng hiểu và tạo ngôn ngữ mạnh mẽ cho các trường hợp sử dụng quy mô lớn như hỗ trợ khách hàng, giáo dục và hỗ trợ kỹ thuật.",
"gpt-4o-2024-11-20.description": "ChatGPT-4o là mô hình động được cập nhật theo thời gian thực, kết hợp khả năng hiểu và tạo nội dung mạnh mẽ cho các trường hợp sử dụng quy mô lớn như hỗ trợ khách hàng, giáo dục và hỗ trợ kỹ thuật.",
"gpt-4o-audio-preview.description": "Mô hình xem trước GPT-4o Audio với đầu vào và đầu ra âm thanh.",
"gpt-4o-mini-audio-preview.description": "Mô hình âm thanh GPT-4o mini với đầu vào và đầu ra âm thanh.",
"gpt-4o-mini-realtime-preview.description": "Biến thể GPT-4o-mini thời gian thực với đầu vào/ra văn bản và âm thanh theo thời gian thực.",
"gpt-4o-mini-search-preview.description": "GPT-4o mini Search Preview được huấn luyện để hiểu và thực thi truy vấn tìm kiếm web qua API Chat Completions. Tìm kiếm web được tính phí theo mỗi lần gọi công cụ ngoài chi phí token.",
"gpt-4o-mini-transcribe.description": "GPT-4o Mini Transcribe là mô hình chuyển giọng nói thành văn bản sử dụng GPT-4o, cải thiện tỷ lệ lỗi từ, nhận diện ngôn ngữ và độ chính xác so với mô hình Whisper gốc.",
"gpt-4o-mini-tts.description": "GPT-4o mini TTS là mô hình chuyển văn bản thành giọng nói dựa trên GPT-4o mini, chuyển đổi văn bản thành giọng nói tự nhiên với đầu vào tối đa 2000 token.",
"gpt-4o-mini.description": "GPT-4o mini là mô hình mới nhất của OpenAI sau GPT-4 Omni, hỗ trợ đầu vào văn bản+hình ảnh với đầu ra văn bản. Đây là mô hình nhỏ tiên tiến nhất, rẻ hơn nhiều so với các mô hình tiên tiến gần đây và rẻ hơn GPT-3.5 Turbo hơn 60%, trong khi vẫn duy trì trí tuệ hàng đầu (82% MMLU).",
"gpt-4o-realtime-preview-2024-10-01.description": "Biến thể GPT-4o thời gian thực với đầu vào/ra âm thanh và văn bản theo thời gian thực.",
"gpt-4o-realtime-preview-2025-06-03.description": "Biến thể GPT-4o thời gian thực với đầu vào/ra âm thanh và văn bản theo thời gian thực.",
"gpt-4o-realtime-preview.description": "Biến thể GPT-4o thời gian thực với đầu vào/ra âm thanh và văn bản theo thời gian thực.",
"gpt-4o-search-preview.description": "GPT-4o Search Preview được huấn luyện để hiểu và thực thi các truy vấn tìm kiếm web thông qua API Chat Completions. Tìm kiếm web được tính phí theo mỗi lần sử dụng công cụ, ngoài chi phí token.",
"gpt-4o-transcribe.description": "GPT-4o Transcribe là mô hình chuyển giọng nói thành văn bản sử dụng GPT-4o, cải thiện tỷ lệ lỗi từ, nhận diện ngôn ngữ và độ chính xác so với mô hình Whisper gốc.",
"gpt-4o.description": "ChatGPT-4o là mô hình động được cập nhật theo thời gian thực, kết hợp khả năng hiểu và tạo nội dung mạnh mẽ cho các trường hợp sử dụng quy mô lớn như hỗ trợ khách hàng, giáo dục và hỗ trợ kỹ thuật.",
"gpt-5-chat-latest.description": "Mô hình GPT-5 được sử dụng trong ChatGPT, kết hợp khả năng hiểu và tạo nội dung mạnh mẽ cho các ứng dụng hội thoại.",
"gpt-5-chat.description": "GPT-5 Chat là mô hình xem trước được tối ưu hóa cho các tình huống hội thoại. Hỗ trợ đầu vào văn bản và hình ảnh, đầu ra chỉ là văn bản, phù hợp với chatbot và các ứng dụng AI hội thoại.",
"gpt-5-codex.description": "GPT-5 Codex là biến thể GPT-5 được tối ưu hóa cho các tác vụ lập trình mang tính tác nhân trong môi trường giống Codex.",
"gpt-5-mini.description": "Biến thể GPT-5 nhanh hơn và tiết kiệm chi phí hơn cho các tác vụ được xác định rõ, cung cấp phản hồi nhanh hơn mà vẫn đảm bảo chất lượng.",
"gpt-5-nano.description": "Biến thể GPT-5 nhanh nhất và tiết kiệm chi phí nhất, lý tưởng cho các ứng dụng yêu cầu độ trễ thấp và chi phí thấp.",
"gpt-5-pro.description": "GPT-5 Pro sử dụng nhiều tài nguyên tính toán hơn để suy nghĩ sâu hơn và liên tục đưa ra câu trả lời tốt hơn.",
"gpt-5.1-chat-latest.description": "GPT-5.1 Chat: biến thể ChatGPT của GPT-5.1, được xây dựng cho các tình huống hội thoại.",
"gpt-5.1-codex-max.description": "GPT-5.1 Codex Max: Mô hình lập trình thông minh nhất của OpenAI, được tối ưu hóa cho các nhiệm vụ lập trình dài hạn, hỗ trợ token suy luận.",
"gpt-5.1-codex-mini.description": "GPT-5.1 Codex mini: biến thể Codex nhỏ hơn, chi phí thấp hơn, được tối ưu hóa cho các tác vụ lập trình mang tính tác nhân.",
"gpt-5.1-codex.description": "GPT-5.1 Codex: biến thể GPT-5.1 được tối ưu hóa cho các tác vụ lập trình mang tính tác nhân, phù hợp với quy trình mã hóa/phản hồi phức tạp trong API Responses.",
"gpt-5.1.description": "GPT-5.1 — mô hình hàng đầu được tối ưu hóa cho lập trình và tác vụ tác nhân với khả năng suy luận có thể cấu hình và ngữ cảnh dài hơn.",
"gpt-5.2-chat-latest.description": "GPT-5.2 Chat là biến thể ChatGPT (chat-latest) với các cải tiến hội thoại mới nhất.",
"gpt-5.2-codex.description": "GPT-5.2-Codex là biến thể nâng cấp của GPT-5.2 được tối ưu hóa cho các nhiệm vụ lập trình dài hạn và tác nhân.",
"gpt-5.2-pro.description": "GPT-5.2 Pro: biến thể GPT-5.2 thông minh và chính xác hơn (chỉ dùng qua API Responses), phù hợp với các vấn đề khó và suy luận nhiều lượt dài.",
"gpt-5.2.description": "GPT-5.2 là mô hình hàng đầu cho lập trình và quy trình tác nhân với khả năng suy luận mạnh mẽ và hiệu suất ngữ cảnh dài vượt trội.",
"gpt-5.3-chat-latest.description": "GPT-5.3 Chat là mô hình ChatGPT mới nhất được sử dụng trong ChatGPT với trải nghiệm trò chuyện được cải thiện.",
"gpt-5.3-codex.description": "GPT-5.3-Codex là mô hình lập trình tác nhân mạnh mẽ nhất cho đến nay, được tối ưu hóa cho các nhiệm vụ lập trình tác nhân trong Codex hoặc các môi trường tương tự.",
"gpt-5.4-mini.description": "GPT-5.4 mini là mô hình mini mạnh nhất của OpenAI dành cho mã hóa, sử dụng máy tính và các tác vụ phụ.",
"gpt-5.4-nano.description": "GPT-5.4 nano là mô hình rẻ nhất thuộc lớp GPT-5.4 của OpenAI dành cho các tác vụ đơn giản với khối lượng lớn.",
"gpt-5.4-pro.description": "GPT-5.4 Pro sử dụng nhiều tài nguyên tính toán hơn để suy nghĩ kỹ hơn và cung cấp câu trả lời tốt hơn một cách nhất quán, chỉ có sẵn trong API Responses.",
"gpt-5.4.description": "GPT-5.4 là mô hình tiên phong cho công việc chuyên nghiệp phức tạp với khả năng suy luận cao nhất.",
"gpt-5.description": "Mô hình tốt nhất cho các tác vụ lập trình và tác nhân đa lĩnh vực. GPT-5 vượt trội về độ chính xác, tốc độ, suy luận, nhận thức ngữ cảnh, tư duy có cấu trúc và giải quyết vấn đề.",
"gpt-audio.description": "GPT Audio là mô hình trò chuyện tổng quát hỗ trợ đầu vào/ra âm thanh, được hỗ trợ trong API Chat Completions.",
"gpt-image-1-mini.description": "Biến thể GPT Image 1 chi phí thấp với đầu vào văn bản và hình ảnh gốc, đầu ra hình ảnh.",
"gpt-image-1.5.description": "Mô hình GPT Image 1 nâng cao với tốc độ tạo nhanh gấp 4 lần, chỉnh sửa chính xác hơn và hiển thị văn bản tốt hơn.",
"gpt-image-1.description": "Mô hình tạo hình ảnh đa phương thức gốc của ChatGPT.",
"gpt-oss-120b.description": "Cần đăng ký để truy cập. GPT-OSS-120B là mô hình ngôn ngữ lớn mã nguồn mở từ OpenAI với khả năng tạo văn bản mạnh mẽ.",
"gpt-oss-20b.description": "Cần đăng ký để truy cập. GPT-OSS-20B là mô hình ngôn ngữ cỡ trung mã nguồn mở từ OpenAI với khả năng tạo văn bản hiệu quả.",
"gpt-oss:120b.description": "GPT-OSS 120B là mô hình LLM mã nguồn mở lớn của OpenAI sử dụng lượng tử hóa MXFP4, được định vị là mô hình hàng đầu. Yêu cầu môi trường đa GPU hoặc máy trạm cao cấp và mang lại hiệu suất xuất sắc trong suy luận phức tạp, tạo mã và xử lý đa ngôn ngữ, với khả năng gọi hàm và tích hợp công cụ nâng cao.",
"gpt-oss:20b.description": "GPT-OSS 20B là LLM mã nguồn mở từ OpenAI sử dụng lượng tử hóa MXFP4, phù hợp với GPU cao cấp cho người dùng hoặc máy Mac Apple Silicon. Hiệu quả trong tạo hội thoại, lập trình và suy luận, hỗ trợ gọi hàm và sử dụng công cụ.",
"gpt-realtime.description": "Mô hình thời gian thực tổng quát hỗ trợ đầu vào/ra văn bản và âm thanh theo thời gian thực, cùng với đầu vào hình ảnh.",
"grok-3-mini.description": "Mô hình nhẹ, suy nghĩ trước khi phản hồi. Nhanh và thông minh cho các tác vụ logic không yêu cầu kiến thức chuyên sâu, với khả năng truy vết suy luận thô.",
"grok-3.description": "Mô hình hàng đầu vượt trội trong các trường hợp doanh nghiệp như trích xuất dữ liệu, lập trình và tóm tắt, với kiến thức chuyên sâu trong tài chính, y tế, pháp luật và khoa học.",
"grok-4-0709.description": "Grok 4 của xAI với khả năng suy luận mạnh mẽ.",
"grok-4-1-fast-non-reasoning.description": "Mô hình đa phương thức tiên phong được tối ưu hóa cho việc sử dụng công cụ tác nhân hiệu suất cao.",
"grok-4-1-fast-reasoning.description": "Mô hình đa phương thức tiên phong được tối ưu hóa cho việc sử dụng công cụ tác nhân hiệu suất cao.",
"grok-4-fast-non-reasoning.description": "Chúng tôi rất vui mừng ra mắt Grok 4 Fast, bước tiến mới nhất trong các mô hình suy luận tiết kiệm chi phí.",
"grok-4-fast-reasoning.description": "Chúng tôi rất vui mừng ra mắt Grok 4 Fast, bước tiến mới nhất trong các mô hình suy luận tiết kiệm chi phí.",
"grok-4.20-beta-0309-non-reasoning.description": "Biến thể không suy luận dành cho các trường hợp sử dụng đơn giản.",
"grok-4.20-beta-0309-reasoning.description": "Mô hình thông minh, cực nhanh, có khả năng suy luận trước khi phản hồi.",
"grok-4.20-multi-agent-beta-0309.description": "Một nhóm gồm 4 hoặc 16 tác nhân, xuất sắc trong các trường hợp nghiên cứu. Hiện không hỗ trợ các công cụ phía khách hàng. Chỉ hỗ trợ các công cụ phía máy chủ xAI (ví dụ: X Search, công cụ tìm kiếm web) và các công cụ MCP từ xa.",
"grok-4.description": "Mô hình hàng đầu mới nhất và mạnh nhất của chúng tôi, vượt trội trong NLP, toán học và suy luận — một lựa chọn toàn diện lý tưởng.",
"grok-code-fast-1.description": "Chúng tôi rất vui mừng ra mắt grok-code-fast-1, một mô hình suy luận nhanh và tiết kiệm chi phí, nổi bật trong lập trình tác vụ tự động.",
"grok-imagine-image-pro.description": "Tạo hình ảnh từ các gợi ý văn bản, chỉnh sửa hình ảnh hiện có bằng ngôn ngữ tự nhiên hoặc tinh chỉnh hình ảnh thông qua hội thoại nhiều lượt.",
"grok-imagine-image.description": "Tạo hình ảnh từ các gợi ý văn bản, chỉnh sửa hình ảnh hiện có bằng ngôn ngữ tự nhiên hoặc tinh chỉnh hình ảnh thông qua hội thoại nhiều lượt.",
"grok-imagine-video.description": "Tạo video tiên tiến nhất về chất lượng, chi phí và độ trễ.",
"groq/compound-mini.description": "Compound-mini là hệ thống AI tổng hợp sử dụng các mô hình công khai được hỗ trợ trên GroqCloud, lựa chọn và sử dụng công cụ một cách thông minh để trả lời câu hỏi của người dùng.",
"groq/compound.description": "Compound là hệ thống AI tổng hợp sử dụng nhiều mô hình công khai được hỗ trợ trên GroqCloud, lựa chọn và sử dụng công cụ một cách thông minh để trả lời câu hỏi của người dùng.",
"gryphe/mythomax-l2-13b.description": "MythoMax L2 13B là một mô hình ngôn ngữ sáng tạo và thông minh, được kết hợp từ nhiều mô hình hàng đầu.",
"hunyuan-2.0-instruct-20251111.description": "Các tính năng phát hành: Nền tảng mô hình đã được nâng cấp từ TurboS lên **Hunyuan 2.0**, mang lại cải tiến toàn diện về khả năng. Nó cải thiện đáng kể khả năng tuân theo hướng dẫn, hiểu văn bản nhiều lượt và dài, sáng tạo văn học, độ chính xác kiến thức, mã hóa và khả năng suy luận.",
"hunyuan-2.0-thinking-20251109.description": "Các tính năng phát hành: Nền tảng mô hình đã được nâng cấp từ TurboS lên **Hunyuan 2.0**, mang lại cải tiến toàn diện về khả năng. Nó cải thiện đáng kể khả năng tuân theo hướng dẫn phức tạp, hiểu văn bản nhiều lượt và dài, xử lý mã, hoạt động như một tác nhân và thực hiện các nhiệm vụ suy luận.",
"hunyuan-a13b.description": "Mô hình suy luận lai đầu tiên từ Hunyuan, được nâng cấp từ hunyuan-standard-256K (80B tổng, 13B hoạt động). Mặc định suy nghĩ chậm và hỗ trợ chuyển đổi nhanh/chậm thông qua tham số hoặc tiền tố /no_think. Năng lực tổng thể được cải thiện so với thế hệ trước, đặc biệt trong toán học, khoa học, hiểu văn bản dài và các tác vụ tác nhân.",
"hunyuan-code.description": "Mô hình mã mới nhất của Hunyuan được huấn luyện trên 200 tỷ dữ liệu mã chất lượng cao cộng với sáu tháng dữ liệu SFT, với ngữ cảnh 8K. Nó xếp gần đầu trong các tiêu chuẩn mã hóa tự động và trong các đánh giá của chuyên gia con người trên năm ngôn ngữ.",
"hunyuan-functioncall.description": "Mô hình MoE FunctionCall mới nhất của Hunyuan được huấn luyện trên dữ liệu gọi công cụ chất lượng cao, với cửa sổ ngữ cảnh 32K và đạt tiêu chuẩn hàng đầu trên nhiều khía cạnh.",
"hunyuan-large-longcontext.description": "Xuất sắc trong các nhiệm vụ tài liệu dài như tóm tắt và hỏi đáp, đồng thời xử lý việc tạo nội dung chung. Mạnh mẽ trong phân tích và tạo văn bản dài cho nội dung phức tạp, chi tiết.",
"hunyuan-large.description": "Hunyuan-large có ~389 tỷ tham số tổng cộng và ~52 tỷ được kích hoạt, là mô hình MoE mở lớn nhất và mạnh nhất trong kiến trúc Transformer.",
"hunyuan-lite.description": "Được nâng cấp lên kiến trúc MoE với cửa sổ ngữ cảnh 256K, dẫn đầu nhiều mô hình mở trong các bài kiểm tra NLP, mã hóa, toán học và ngành công nghiệp.",
"hunyuan-pro.description": "Mô hình MoE-32K với hàng nghìn tỷ tham số, dẫn đầu các bài kiểm tra, mạnh mẽ trong hướng dẫn phức tạp và suy luận, toán học nâng cao, gọi hàm và tối ưu hóa cho dịch đa ngôn ngữ, tài chính, pháp lý và y tế.",
"hunyuan-role.description": "Mô hình nhập vai mới nhất của Hunyuan, được tinh chỉnh chính thức với dữ liệu nhập vai, mang lại hiệu suất cơ bản mạnh mẽ hơn trong các tình huống nhập vai.",
"hunyuan-standard-256K.description": "Sử dụng định tuyến cải tiến để giảm thiểu cân bằng tải và sụp đổ chuyên gia. Đạt 99,9% tìm kim trong đống rơm trên ngữ cảnh dài. MOE-256K mở rộng thêm độ dài và chất lượng ngữ cảnh.",
"hunyuan-standard.description": "Sử dụng định tuyến cải tiến để giảm thiểu cân bằng tải và sụp đổ chuyên gia. Đạt 99,9% tìm kim trong đống rơm trên ngữ cảnh dài. MOE-32K mang lại giá trị mạnh mẽ trong khi xử lý các đầu vào dài.",
"hunyuan-t1-20250321.description": "Xây dựng khả năng cân bằng giữa nghệ thuật và STEM với khả năng nắm bắt thông tin văn bản dài mạnh mẽ. Hỗ trợ trả lời suy luận cho các vấn đề toán học, logic, khoa học và mã hóa ở các mức độ khó khác nhau.",
"hunyuan-t1-20250403.description": "Cải thiện chất lượng viết mã cấp dự án và viết văn, tăng cường hiểu biết về chủ đề nhiều lượt và theo dõi hướng dẫn ToB, cải thiện hiểu biết từ cấp độ từ, và giảm các vấn đề đầu ra hỗn hợp giữa giản thể/truyền thống và tiếng Trung/tiếng Anh.",
"hunyuan-t1-20250529.description": "Cải thiện viết sáng tạo và sáng tác, tăng cường mã hóa giao diện, toán học và suy luận logic, và nâng cao khả năng theo dõi hướng dẫn.",
"hunyuan-t1-20250711.description": "Cải thiện đáng kể toán học khó, logic và mã hóa, tăng cường độ ổn định đầu ra, và nâng cao khả năng văn bản dài.",
"hunyuan-t1-latest.description": "Cải thiện đáng kể mô hình suy nghĩ chậm trong toán học khó, suy luận phức tạp, mã hóa khó, tuân theo hướng dẫn và chất lượng viết sáng tạo.",
"hunyuan-t1-vision-20250916.description": "Mô hình suy luận sâu t1-vision mới nhất với cải tiến lớn trong VQA, định vị hình ảnh, OCR, biểu đồ, giải bài toán qua ảnh và sáng tạo dựa trên hình ảnh, cùng khả năng tiếng Anh và ngôn ngữ ít tài nguyên mạnh hơn.",
"hunyuan-turbo-20241223.description": "Phiên bản này tăng cường khả năng mở rộng hướng dẫn để tổng quát hóa tốt hơn, cải thiện đáng kể suy luận toán học/mã hóa/logic, nâng cao hiểu biết từ cấp độ từ, và cải thiện chất lượng viết.",
"hunyuan-turbo-latest.description": "Cải thiện trải nghiệm tổng thể trong hiểu biết NLP, viết, chat, hỏi đáp, dịch thuật và các lĩnh vực; phản hồi giống con người hơn, làm rõ ý định mơ hồ tốt hơn, cải thiện phân tích từ, chất lượng sáng tạo cao hơn và tương tác, và tăng cường các cuộc trò chuyện nhiều lượt.",
"hunyuan-turbo.description": "Bản xem trước của LLM thế hệ tiếp theo từ Hunyuan với kiến trúc MoE mới, mang lại suy luận nhanh hơn và kết quả mạnh mẽ hơn so với hunyuan-pro.",
"hunyuan-turbos-latest.description": "Mô hình hàng đầu Hunyuan TurboS mới nhất với khả năng suy luận mạnh mẽ hơn và trải nghiệm tổng thể tốt hơn.",
"hunyuan-turbos-longtext-128k-20250325.description": "Xuất sắc trong các nhiệm vụ tài liệu dài như tóm tắt và hỏi đáp, đồng thời xử lý việc tạo nội dung chung. Mạnh mẽ trong phân tích và tạo văn bản dài cho nội dung phức tạp, chi tiết.",
"hunyuan-turbos-vision-video.description": "Áp dụng cho các tình huống hiểu video. Các tính năng phát hành: Dựa trên mô hình hiểu video **Hunyuan Turbos-Vision**, hỗ trợ các khả năng hiểu video cơ bản như mô tả video và trả lời câu hỏi về nội dung video.",
"hunyuan-vision-1.5-instruct.description": "Mô hình hình ảnh-to-văn bản suy nghĩ nhanh được xây dựng trên nền tảng văn bản TurboS, cho thấy những cải tiến đáng chú ý so với phiên bản trước trong nhận diện hình ảnh cơ bản và suy luận phân tích hình ảnh.",
"hunyuan-vision.description": "Mô hình đa phương thức mới nhất của Hunyuan hỗ trợ đầu vào hình ảnh + văn bản để tạo văn bản.",
"image-01-live.description": "Mô hình tạo ảnh với chi tiết tinh xảo, hỗ trợ chuyển văn bản thành hình ảnh và các kiểu dáng có thể điều chỉnh.",
"image-01.description": "Mô hình tạo ảnh mới với chi tiết tinh xảo, hỗ trợ chuyển văn bản thành hình ảnh và từ hình ảnh sang hình ảnh.",
"imagen-4.0-fast-generate-001.description": "Phiên bản Nhanh của dòng mô hình chuyển văn bản thành hình ảnh thế hệ thứ tư Imagen",
"imagen-4.0-generate-001.description": "Dòng mô hình chuyển văn bản thành hình ảnh thế hệ thứ tư Imagen",
"imagen-4.0-ultra-generate-001.description": "Phiên bản Ultra của dòng mô hình chuyển văn bản thành hình ảnh thế hệ thứ tư Imagen",
"inception/mercury-coder-small.description": "Mercury Coder Small lý tưởng cho việc tạo mã, gỡ lỗi và tái cấu trúc với độ trễ tối thiểu.",
"inclusionAI/Ling-flash-2.0.description": "Ling-flash-2.0 là mô hình kiến trúc Ling 2.0 thứ ba từ nhóm Bailing của Ant Group. Đây là mô hình MoE với tổng số tham số 100B nhưng chỉ có 6.1B tham số hoạt động mỗi token (4.8B không bao gồm embedding). Dù cấu hình nhẹ, nó vẫn đạt hoặc vượt qua các mô hình dense 40B và các mô hình MoE lớn hơn trong nhiều bài kiểm tra, khám phá hiệu quả cao thông qua kiến trúc và chiến lược huấn luyện.",
"inclusionAI/Ling-mini-2.0.description": "Ling-mini-2.0 là mô hình MoE nhỏ, hiệu suất cao với tổng 16B tham số và chỉ 1.4B tham số hoạt động mỗi token (789M không bao gồm embedding), mang lại tốc độ tạo văn bản rất nhanh. Với thiết kế MoE hiệu quả và dữ liệu huấn luyện chất lượng cao, nó đạt hiệu suất hàng đầu tương đương với các mô hình dense dưới 10B và các mô hình MoE lớn hơn.",
"inclusionAI/Ring-flash-2.0.description": "Ring-flash-2.0 là mô hình tư duy hiệu suất cao được tối ưu từ Ling-flash-2.0-base. Nó sử dụng kiến trúc MoE với tổng 100B tham số và chỉ 6.1B tham số hoạt động mỗi lần suy luận. Thuật toán icepop của nó ổn định huấn luyện RL cho các mô hình MoE, cho phép cải thiện liên tục trong suy luận phức tạp. Nó đạt đột phá lớn trong các bài kiểm tra khó (thi toán, tạo mã, suy luận logic), vượt qua các mô hình dense hàng đầu dưới 40B và cạnh tranh với các mô hình MoE mở lớn hơn và mô hình suy luận đóng. Nó cũng thể hiện tốt trong sáng tác sáng tạo, và kiến trúc hiệu quả của nó mang lại suy luận nhanh với chi phí triển khai thấp cho các tình huống đồng thời cao.",
"inclusionai/ling-1t.description": "Ling-1T là mô hình MoE 1T của inclusionAI, được tối ưu cho các tác vụ suy luận cường độ cao và khối lượng ngữ cảnh lớn.",
"inclusionai/ling-flash-2.0.description": "Ling-flash-2.0 là mô hình MoE của inclusionAI được tối ưu cho hiệu suất và khả năng suy luận, phù hợp với các tác vụ từ trung bình đến lớn.",
"inclusionai/ling-mini-2.0.description": "Ling-mini-2.0 là mô hình MoE nhẹ của inclusionAI, giảm đáng kể chi phí trong khi vẫn giữ được khả năng suy luận.",
"inclusionai/ming-flash-omini-preview.description": "Ming-flash-omni Preview là mô hình đa phương thức của inclusionAI, hỗ trợ đầu vào giọng nói, hình ảnh và video, với khả năng hiển thị hình ảnh và nhận diện giọng nói được cải thiện.",
"inclusionai/ring-1t.description": "Ring-1T là mô hình MoE với hàng nghìn tỷ tham số của inclusionAI, phù hợp cho các tác vụ suy luận quy mô lớn và nghiên cứu.",
"inclusionai/ring-flash-2.0.description": "Ring-flash-2.0 là biến thể mô hình Ring từ inclusionAI dành cho các tình huống thông lượng cao, nhấn mạnh vào tốc độ và hiệu quả chi phí.",
"inclusionai/ring-mini-2.0.description": "Ring-mini-2.0 là mô hình MoE nhẹ, thông lượng cao của inclusionAI, được xây dựng cho môi trường đồng thời.",
"intern-latest.description": "Theo mặc định, nó trỏ đến mô hình mới nhất của dòng Intern, hiện được đặt là intern-s1-pro.",
"intern-s1-mini.description": "Mô hình lớn đa phương thức nhẹ với khả năng suy luận khoa học mạnh mẽ.",
"intern-s1-pro.description": "Chúng tôi đã ra mắt mô hình suy luận đa phương thức tiên tiến nhất mã nguồn mở, hiện là mô hình ngôn ngữ lớn đa phương thức mã nguồn mở có hiệu suất tổng thể hàng đầu.",
"intern-s1.description": "Mô hình suy luận đa phương thức mã nguồn mở không chỉ thể hiện khả năng mục đích chung mạnh mẽ mà còn đạt hiệu suất hàng đầu trong nhiều nhiệm vụ khoa học.",
"internlm/internlm2_5-7b-chat.description": "InternLM2.5-7B-Chat là mô hình trò chuyện mã nguồn mở dựa trên kiến trúc InternLM2. Mô hình 7B tập trung vào tạo hội thoại, hỗ trợ tiếng Trung và tiếng Anh, sử dụng huấn luyện hiện đại để tạo ra cuộc trò chuyện trôi chảy và thông minh. Phù hợp với nhiều tình huống trò chuyện như hỗ trợ khách hàng và trợ lý cá nhân.",
"internvl2.5-38b-mpo.description": "InternVL2.5 38B MPO là mô hình tiền huấn luyện đa phương thức cho suy luận hình ảnh-văn bản phức tạp.",
"internvl3-14b.description": "InternVL3 14B là mô hình đa phương thức cỡ trung cân bằng giữa hiệu suất và chi phí.",
"internvl3-1b.description": "InternVL3 1B là mô hình đa phương thức nhẹ dành cho triển khai trong môi trường hạn chế tài nguyên.",
"internvl3-38b.description": "InternVL3 38B là mô hình đa phương thức mã nguồn mở lớn dành cho hiểu hình ảnh-văn bản chính xác cao.",
"internvl3.5-241b-a28b.description": "Mô hình lớn đa phương thức mới được phát hành của chúng tôi có khả năng hiểu hình ảnh và văn bản nâng cao và khả năng hiểu hình ảnh chuỗi dài, đạt hiệu suất tương đương với các mô hình mã nguồn đóng hàng đầu.",
"internvl3.5-latest.description": "Theo mặc định, nó trỏ đến mô hình mới nhất trong dòng InternVL3.5, hiện được đặt là internvl3.5-241b-a28b.",
"irag-1.0.description": "ERNIE iRAG là mô hình tạo nội dung tăng cường truy xuất hình ảnh, dùng cho tìm kiếm hình ảnh, truy xuất hình ảnh-văn bản và tạo nội dung.",
"jamba-large.description": "Mô hình mạnh mẽ và tiên tiến nhất của chúng tôi, được thiết kế cho các tác vụ doanh nghiệp phức tạp với hiệu suất vượt trội.",
"jamba-mini.description": "Mô hình hiệu quả nhất trong phân khúc, cân bằng giữa tốc độ và chất lượng với dung lượng nhỏ gọn.",
"jina-deepsearch-v1.description": "DeepSearch kết hợp tìm kiếm web, đọc hiểu và suy luận để phục vụ các cuộc điều tra chuyên sâu. Hãy hình dung nó như một tác nhân nhận nhiệm vụ nghiên cứu của bạn, thực hiện các lượt tìm kiếm rộng rãi qua nhiều vòng lặp, và chỉ sau đó mới đưa ra câu trả lời. Quá trình này bao gồm nghiên cứu liên tục, suy luận và giải quyết vấn đề từ nhiều góc độ — hoàn toàn khác biệt so với các LLM tiêu chuẩn vốn chỉ trả lời dựa trên dữ liệu huấn luyện hoặc hệ thống RAG truyền thống dựa vào tìm kiếm một lần.",
"kimi-k2-0711-preview.description": "kimi-k2 là mô hình nền MoE với khả năng lập trình và tác nhân mạnh mẽ (1T tham số tổng, 32B đang hoạt động), vượt trội hơn các mô hình mã nguồn mở phổ biến khác trong các bài kiểm tra về suy luận, lập trình, toán học và tác nhân.",
"kimi-k2-0905-preview.description": "kimi-k2-0905-preview cung cấp cửa sổ ngữ cảnh 256k, khả năng lập trình tác nhân mạnh hơn, chất lượng mã giao diện người dùng tốt hơn và hiểu ngữ cảnh cải thiện.",
"kimi-k2-instruct.description": "Kimi K2 Instruct là mô hình suy luận chính thức của Kimi với khả năng xử lý ngữ cảnh dài cho mã, hỏi đáp và nhiều hơn nữa.",
"kimi-k2-thinking-turbo.description": "Biến thể K2 tốc độ cao với khả năng suy luận sâu, ngữ cảnh 256k và tốc độ xuất ra 60–100 token/giây.",
"kimi-k2-thinking.description": "Kimi-K2 là mô hình cơ bản kiến trúc MoE được ra mắt bởi Moonshot AI với khả năng mã hóa và tác nhân siêu mạnh. Nó có tổng số tham số là 1T và tham số kích hoạt là 32B. Trong các bài kiểm tra hiệu suất điểm chuẩn ở các danh mục chính như lý luận kiến thức chung, lập trình, toán học và tác nhân, hiệu suất của mô hình K2 vượt trội so với các mô hình mã nguồn mở chính thống khác.",
"kimi-k2-turbo-preview.description": "kimi-k2 là mô hình nền MoE với khả năng lập trình và tác nhân mạnh mẽ (1T tham số tổng, 32B đang hoạt động), vượt trội hơn các mô hình mã nguồn mở phổ biến khác trong các bài kiểm tra về suy luận, lập trình, toán học và tác nhân.",
"kimi-k2.5.description": "Kimi K2.5 là mô hình linh hoạt nhất của Kimi cho đến nay, với kiến trúc đa phương thức gốc hỗ trợ cả đầu vào hình ảnh và văn bản, chế độ 'tư duy' và 'không tư duy', và cả nhiệm vụ trò chuyện và đại lý.",
"kimi-k2.description": "Kimi-K2 là mô hình nền MoE từ Moonshot AI với khả năng lập trình và tác nhân mạnh mẽ, tổng cộng 1T tham số với 32B đang hoạt động. Trong các bài kiểm tra về suy luận tổng quát, lập trình, toán học và tác vụ tác nhân, nó vượt trội hơn các mô hình mã nguồn mở phổ biến khác.",
"kimi-k2:1t.description": "Kimi K2 là mô hình LLM MoE lớn từ Moonshot AI với 1T tham số tổng và 32B đang hoạt động mỗi lần truyền. Nó được tối ưu hóa cho khả năng tác nhân bao gồm sử dụng công cụ nâng cao, suy luận và tổng hợp mã.",
"kling/kling-v3-image-generation.description": "Hỗ trợ tối đa 10 hình ảnh tham chiếu, cho phép bạn khóa các chủ thể, yếu tố và tông màu để đảm bảo phong cách nhất quán. Kết hợp chuyển đổi phong cách, tham chiếu chân dung/nhân vật, hợp nhất nhiều hình ảnh và vẽ lại cục bộ để kiểm soát linh hoạt. Cung cấp chi tiết chân dung thực tế, với hình ảnh tổng thể tinh tế và nhiều lớp, mang màu sắc và không khí điện ảnh.",
"kling/kling-v3-omni-image-generation.description": "Mở khóa hình ảnh kể chuyện điện ảnh với mô hình tạo hình ảnh mới và đầu ra trực tiếp 2K/4K. Phân tích sâu các yếu tố nghe nhìn trong gợi ý để thực hiện chính xác các hướng dẫn sáng tạo. Hỗ trợ đầu vào tham chiếu linh hoạt và nâng cấp chất lượng toàn diện, lý tưởng cho bảng phân cảnh, nghệ thuật khái niệm kể chuyện và thiết kế cảnh.",
"kling/kling-v3-omni-video-generation.description": "Tính năng \"Tham chiếu Tất cả trong Một\" mới hỗ trợ video dài 3–8 giây hoặc nhiều hình ảnh để neo các yếu tố nhân vật. Có thể khớp âm thanh gốc và chuyển động môi để thể hiện nhân vật chân thực. Cải thiện tính nhất quán của video và biểu đạt động. Hỗ trợ đồng bộ hóa nghe nhìn và lập bảng phân cảnh thông minh.",
"kling/kling-v3-video-generation.description": "Lập bảng phân cảnh thông minh hiểu các chuyển cảnh trong kịch bản, tự động sắp xếp vị trí camera và loại cảnh quay. Một khung đa phương thức gốc đảm bảo tính nhất quán nghe nhìn. Loại bỏ các ràng buộc về thời lượng, cho phép kể chuyện nhiều cảnh linh hoạt hơn.",
"kuaishou/kat-coder-pro-v1.description": "KAT-Coder-Pro-V1 (miễn phí trong thời gian giới hạn) tập trung vào hiểu mã và tự động hóa để hỗ trợ lập trình hiệu quả.",
"labs-devstral-small-2512.description": "Devstral Small 2 xuất sắc trong việc sử dụng công cụ để khám phá cơ sở mã, chỉnh sửa nhiều tệp và hỗ trợ các Agent kỹ thuật phần mềm.",
"labs-leanstral-2603.description": "Tác nhân mã nguồn mở đầu tiên của Mistral được thiết kế cho Lean 4, được xây dựng cho kỹ thuật chứng minh chính thức trong các kho lưu trữ thực tế. 119B tham số với 6.5B tham số hoạt động.",
"lite.description": "Spark Lite là một mô hình ngôn ngữ nhẹ với độ trễ cực thấp và xử lý hiệu quả. Hoàn toàn miễn phí và hỗ trợ tìm kiếm web theo thời gian thực. Phản hồi nhanh, hoạt động tốt trên thiết bị có tài nguyên hạn chế và phù hợp cho tinh chỉnh mô hình, mang lại hiệu quả chi phí cao và trải nghiệm thông minh, đặc biệt trong hỏi đáp kiến thức, tạo nội dung và tìm kiếm.",
"llama-3.1-70b-versatile.description": "Llama 3.1 70B cung cấp khả năng suy luận AI mạnh mẽ cho các ứng dụng phức tạp, hỗ trợ tính toán nặng với hiệu suất và độ chính xác cao.",
"llama-3.1-8b-instant.description": "Llama 3.1 8B là mô hình hiệu suất cao với khả năng tạo văn bản nhanh, lý tưởng cho các ứng dụng quy mô lớn và tiết kiệm chi phí.",
"llama-3.1-instruct.description": "Mô hình Llama 3.1 được tinh chỉnh theo hướng dẫn, tối ưu cho trò chuyện và vượt trội hơn nhiều mô hình trò chuyện mã nguồn mở trong các tiêu chuẩn ngành.",
"llama-3.2-11b-vision-instruct.description": "Khả năng suy luận hình ảnh mạnh mẽ trên hình ảnh độ phân giải cao, phù hợp cho các ứng dụng hiểu thị giác.",
"llama-3.2-11b-vision-preview.description": "Llama 3.2 được thiết kế cho các tác vụ kết hợp giữa thị giác và văn bản, xuất sắc trong mô tả hình ảnh và hỏi đáp thị giác, kết nối giữa tạo ngôn ngữ và suy luận hình ảnh.",
"llama-3.2-90b-vision-instruct.description": "Khả năng suy luận hình ảnh tiên tiến cho các ứng dụng tác nhân hiểu thị giác.",
"llama-3.2-90b-vision-preview.description": "Llama 3.2 được thiết kế cho các tác vụ kết hợp giữa thị giác và văn bản, xuất sắc trong mô tả hình ảnh và hỏi đáp thị giác, kết nối giữa tạo ngôn ngữ và suy luận hình ảnh.",
"llama-3.2-vision-instruct.description": "Mô hình Llama 3.2-Vision được tinh chỉnh theo hướng dẫn, tối ưu cho nhận diện hình ảnh, suy luận hình ảnh, mô tả và hỏi đáp hình ảnh tổng quát.",
"llama-3.3-70b-versatile.description": "Meta Llama 3.3 là mô hình ngôn ngữ đa ngữ với 70 tỷ tham số (văn bản vào/ra), cung cấp các phiên bản huấn luyện sẵn và tinh chỉnh theo hướng dẫn. Phiên bản chỉ văn bản được tinh chỉnh theo hướng dẫn tối ưu cho đối thoại đa ngữ và vượt trội hơn nhiều mô hình trò chuyện mã nguồn mở và đóng trong các tiêu chuẩn ngành.",
"llama-3.3-instruct.description": "Mô hình Llama 3.3 được tinh chỉnh theo hướng dẫn, tối ưu cho trò chuyện và vượt trội hơn nhiều mô hình trò chuyện mã nguồn mở trong các tiêu chuẩn ngành.",
"llama3-70b-8192.description": "Meta Llama 3 70B cung cấp khả năng xử lý độ phức tạp vượt trội cho các dự án đòi hỏi cao.",
"llama3-8b-8192.description": "Meta Llama 3 8B mang lại hiệu suất suy luận mạnh mẽ cho nhiều tình huống khác nhau.",
"llama3-groq-70b-8192-tool-use-preview.description": "Llama 3 Groq 70B Tool Use cung cấp khả năng gọi công cụ mạnh mẽ để xử lý hiệu quả các tác vụ phức tạp.",
"llama3-groq-8b-8192-tool-use-preview.description": "Llama 3 Groq 8B Tool Use được tối ưu cho việc sử dụng công cụ hiệu quả với khả năng tính toán song song nhanh.",
"llama3.1-8b.description": "Llama 3.1 8B: phiên bản Llama nhỏ, độ trễ thấp cho suy luận trực tuyến nhẹ và trò chuyện.",
"llama3.1.description": "Llama 3.1 là mô hình hàng đầu của Meta, mở rộng đến 405 tỷ tham số cho đối thoại phức tạp, dịch đa ngữ và phân tích dữ liệu.",
"llama3.1:405b.description": "Llama 3.1 là mô hình hàng đầu của Meta, mở rộng đến 405 tỷ tham số cho đối thoại phức tạp, dịch đa ngữ và phân tích dữ liệu.",
"llama3.1:70b.description": "Llama 3.1 là mô hình hàng đầu của Meta, mở rộng đến 405 tỷ tham số cho đối thoại phức tạp, dịch đa ngữ và phân tích dữ liệu.",
"llava-v1.5-7b-4096-preview.description": "LLaVA 1.5 7B kết hợp xử lý hình ảnh để tạo đầu ra phức tạp từ đầu vào hình ảnh.",
"llava.description": "LLaVA là mô hình đa phương thức kết hợp bộ mã hóa thị giác và Vicuna để hiểu ngôn ngữ-thị giác mạnh mẽ.",
"llava:13b.description": "LLaVA là mô hình đa phương thức kết hợp bộ mã hóa thị giác và Vicuna để hiểu ngôn ngữ-thị giác mạnh mẽ.",
"llava:34b.description": "LLaVA là mô hình đa phương thức kết hợp bộ mã hóa thị giác và Vicuna để hiểu ngôn ngữ-thị giác mạnh mẽ.",
"magistral-medium-2509.description": "Magistral Medium 1.2 là mô hình lý luận tiên phong từ Mistral AI (tháng 9 năm 2025) với hỗ trợ thị giác.",
"magistral-small-2509.description": "Magistral Small 1.2 là mô hình suy luận nhỏ mã nguồn mở từ Mistral AI (tháng 9/2025) với hỗ trợ thị giác.",
"mathstral.description": "MathΣtral được xây dựng cho nghiên cứu khoa học và suy luận toán học, với khả năng tính toán và giải thích mạnh mẽ.",
"max-32k.description": "Spark Max 32K cung cấp khả năng xử lý ngữ cảnh lớn với hiểu ngữ cảnh và suy luận logic mạnh mẽ, hỗ trợ đầu vào lên đến 32K token cho đọc tài liệu dài và hỏi đáp kiến thức riêng tư.",
"megrez-3b-instruct.description": "Megrez 3B Instruct là mô hình nhỏ, hiệu quả từ Wuwen Xinqiong.",
"meituan/longcat-flash-chat.description": "Mô hình nền không suy luận mã nguồn mở từ Meituan, được tối ưu cho đối thoại và tác vụ tác nhân, mạnh mẽ trong sử dụng công cụ và tương tác nhiều lượt phức tạp.",
"meta-llama-3-70b-instruct.description": "Mô hình mạnh mẽ với 70 tỷ tham số, xuất sắc trong suy luận, lập trình và các tác vụ ngôn ngữ rộng.",
"meta-llama-3-8b-instruct.description": "Mô hình linh hoạt với 8 tỷ tham số, được tối ưu cho trò chuyện và tạo văn bản.",
"meta-llama-3.1-405b-instruct.description": "Mô hình văn bản Llama 3.1 được tinh chỉnh theo hướng dẫn, tối ưu cho trò chuyện đa ngữ, hoạt động mạnh mẽ trong các tiêu chuẩn ngành giữa các mô hình trò chuyện mã nguồn mở và đóng.",
"meta-llama-3.1-70b-instruct.description": "Mô hình văn bản Llama 3.1 được tinh chỉnh theo hướng dẫn, tối ưu cho trò chuyện đa ngữ, hoạt động mạnh mẽ trong các tiêu chuẩn ngành giữa các mô hình trò chuyện mã nguồn mở và đóng.",
"meta-llama-3.1-8b-instruct.description": "Mô hình văn bản Llama 3.1 được tinh chỉnh theo hướng dẫn, tối ưu cho trò chuyện đa ngữ, hoạt động mạnh mẽ trong các tiêu chuẩn ngành giữa các mô hình trò chuyện mã nguồn mở và đóng.",
"meta-llama/Llama-2-13b-chat-hf.description": "LLaMA-2 Chat (13B) cung cấp khả năng xử lý ngôn ngữ mạnh mẽ và trải nghiệm trò chuyện ổn định.",
"meta-llama/Llama-2-70b-hf.description": "LLaMA-2 cung cấp khả năng xử lý ngôn ngữ mạnh mẽ và trải nghiệm tương tác ổn định.",
"meta-llama/Llama-3-70b-chat-hf.description": "Llama 3 70B Instruct Reference là mô hình trò chuyện mạnh mẽ cho đối thoại phức tạp.",
"meta-llama/Llama-3-8b-chat-hf.description": "Llama 3 8B Instruct Reference hỗ trợ đa ngôn ngữ và kiến thức đa lĩnh vực.",
"meta-llama/Llama-3.2-11B-Vision-Instruct-Turbo.description": "LLaMA 3.2 được thiết kế cho các tác vụ kết hợp giữa hình ảnh và văn bản. Mô hình vượt trội trong việc tạo chú thích hình ảnh và hỏi đáp trực quan, kết nối giữa sinh ngôn ngữ và suy luận thị giác.",
"meta-llama/Llama-3.2-3B-Instruct-Turbo.description": "LLaMA 3.2 được thiết kế cho các tác vụ kết hợp giữa hình ảnh và văn bản. Mô hình vượt trội trong việc tạo chú thích hình ảnh và hỏi đáp trực quan, kết nối giữa sinh ngôn ngữ và suy luận thị giác.",
"meta-llama/Llama-3.2-90B-Vision-Instruct-Turbo.description": "LLaMA 3.2 được thiết kế cho các tác vụ kết hợp giữa hình ảnh và văn bản. Mô hình vượt trội trong việc tạo chú thích hình ảnh và hỏi đáp trực quan, kết nối giữa sinh ngôn ngữ và suy luận thị giác.",
"meta-llama/Llama-3.3-70B-Instruct-Turbo.description": "Meta Llama 3.3 là mô hình ngôn ngữ đa ngữ 70B (văn bản vào/ra) được huấn luyện trước và tinh chỉnh theo hướng dẫn. Phiên bản chỉ văn bản được tinh chỉnh theo hướng dẫn tối ưu cho trò chuyện đa ngữ và vượt trội hơn nhiều mô hình trò chuyện mở và đóng trên các tiêu chuẩn đánh giá trong ngành.",
"meta-llama/Llama-Vision-Free.description": "LLaMA 3.2 được thiết kế cho các tác vụ kết hợp giữa hình ảnh và văn bản. Mô hình vượt trội trong việc tạo chú thích hình ảnh và hỏi đáp trực quan, kết nối giữa sinh ngôn ngữ và suy luận thị giác.",
"meta-llama/Meta-Llama-3-70B-Instruct-Lite.description": "Llama 3 70B Instruct Lite được xây dựng để đạt hiệu suất cao với độ trễ thấp hơn.",
"meta-llama/Meta-Llama-3-70B-Instruct-Turbo.description": "Llama 3 70B Instruct Turbo mang lại khả năng hiểu và sinh ngôn ngữ mạnh mẽ cho các tác vụ yêu cầu cao nhất.",
"meta-llama/Meta-Llama-3-8B-Instruct-Lite.description": "Llama 3 8B Instruct Lite cân bằng hiệu suất cho các môi trường hạn chế tài nguyên.",
"meta-llama/Meta-Llama-3-8B-Instruct-Turbo.description": "Llama 3 8B Instruct Turbo là mô hình ngôn ngữ hiệu suất cao cho nhiều trường hợp sử dụng khác nhau.",
"meta-llama/Meta-Llama-3.1-405B-Instruct-Turbo.description": "Mô hình Llama 3.1 Turbo 405B cung cấp khả năng xử lý ngữ cảnh khổng lồ cho xử lý dữ liệu lớn và vượt trội trong các ứng dụng AI quy mô siêu lớn.",
"meta-llama/Meta-Llama-3.1-405B-Instruct.description": "Llama 3.1 là dòng mô hình hàng đầu của Meta, mở rộng đến 405B tham số cho đối thoại phức tạp, dịch đa ngữ và phân tích dữ liệu.",
"meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo.description": "Llama 3.1 70B được tinh chỉnh kỹ lưỡng cho các ứng dụng tải cao; lượng tử hóa FP8 mang lại hiệu suất tính toán hiệu quả và độ chính xác cho các tình huống phức tạp.",
"meta-llama/Meta-Llama-3.1-70B.description": "Llama 3.1 là dòng mô hình hàng đầu của Meta, mở rộng đến 405B tham số cho đối thoại phức tạp, dịch đa ngữ và phân tích dữ liệu.",
"meta-llama/Meta-Llama-3.1-8B-Instruct-Turbo.description": "Llama 3.1 8B sử dụng lượng tử hóa FP8, hỗ trợ lên đến 131.072 token ngữ cảnh và nằm trong số các mô hình mở hàng đầu cho các tác vụ phức tạp trên nhiều tiêu chuẩn đánh giá.",
"meta-llama/llama-3-70b-instruct.description": "Llama 3 70B Instruct được tối ưu hóa cho đối thoại chất lượng cao và thể hiện hiệu suất mạnh mẽ trong các đánh giá của con người.",
"meta-llama/llama-3-8b-instruct.description": "Llama 3 8B Instruct được tối ưu hóa cho đối thoại chất lượng cao, vượt trội hơn nhiều mô hình đóng.",
"meta-llama/llama-3.1-70b-instruct.description": "Dòng Llama 3.1 mới nhất của Meta, biến thể 70B được tinh chỉnh theo hướng dẫn, tối ưu cho đối thoại chất lượng cao. Trong các đánh giá ngành, mô hình thể hiện hiệu suất mạnh mẽ so với các mô hình đóng hàng đầu. (Chỉ khả dụng cho các tổ chức đã xác minh doanh nghiệp.)",
"meta-llama/llama-3.1-8b-instruct.description": "Dòng Llama 3.1 mới nhất của Meta, biến thể 8B được tinh chỉnh theo hướng dẫn, đặc biệt nhanh và hiệu quả. Trong các đánh giá ngành, mô hình thể hiện hiệu suất mạnh mẽ, vượt qua nhiều mô hình đóng hàng đầu. (Chỉ khả dụng cho các tổ chức đã xác minh doanh nghiệp.)",
"meta-llama/llama-3.1-8b-instruct:free.description": "LLaMA 3.1 hỗ trợ đa ngôn ngữ và là một trong những mô hình sinh ngôn ngữ hàng đầu.",
"meta-llama/llama-3.2-11b-vision-instruct.description": "LLaMA 3.2 được thiết kế cho các tác vụ kết hợp giữa hình ảnh và văn bản. Mô hình vượt trội trong việc tạo chú thích hình ảnh và hỏi đáp trực quan, kết nối giữa sinh ngôn ngữ và suy luận thị giác.",
"meta-llama/llama-3.2-3b-instruct.description": "meta-llama/llama-3.2-3b-instruct",
"meta-llama/llama-3.3-70b-instruct.description": "Llama 3.3 là mô hình Llama mã nguồn mở đa ngữ tiên tiến nhất, mang lại hiệu suất gần tương đương 405B với chi phí rất thấp. Mô hình dựa trên Transformer và được cải tiến bằng SFT và RLHF để tăng tính hữu ích và an toàn. Phiên bản tinh chỉnh theo hướng dẫn được tối ưu cho trò chuyện đa ngữ và vượt trội hơn nhiều mô hình trò chuyện mở và đóng trên các tiêu chuẩn đánh giá trong ngành. Mốc kiến thức: Tháng 12 năm 2023.",
"meta-llama/llama-3.3-70b-instruct:free.description": "Llama 3.3 là mô hình Llama mã nguồn mở đa ngữ tiên tiến nhất, mang lại hiệu suất gần tương đương 405B với chi phí rất thấp. Mô hình dựa trên Transformer và được cải tiến bằng SFT và RLHF để tăng tính hữu ích và an toàn. Phiên bản tinh chỉnh theo hướng dẫn được tối ưu cho trò chuyện đa ngữ và vượt trội hơn nhiều mô hình trò chuyện mở và đóng trên các tiêu chuẩn đánh giá trong ngành. Mốc kiến thức: Tháng 12 năm 2023.",
"meta.llama3-1-405b-instruct-v1:0.description": "Meta Llama 3.1 405B Instruct là mô hình Llama 3.1 Instruct lớn nhất và mạnh mẽ nhất, rất tiên tiến cho suy luận đối thoại và tạo dữ liệu tổng hợp, đồng thời là nền tảng vững chắc cho huấn luyện tiếp theo hoặc tinh chỉnh theo miền cụ thể. Các mô hình LLM đa ngữ Llama 3.1 bao gồm các mô hình sinh văn bản được huấn luyện trước và tinh chỉnh theo hướng dẫn với kích thước 8B, 70B và 405B (văn bản vào/ra). Các mô hình tinh chỉnh theo hướng dẫn được tối ưu cho đối thoại đa ngữ và vượt trội hơn nhiều mô hình trò chuyện mở hiện có trên các tiêu chuẩn đánh giá phổ biến. Llama 3.1 được thiết kế cho mục đích thương mại và nghiên cứu trên nhiều ngôn ngữ. Các mô hình tinh chỉnh theo hướng dẫn phù hợp với trò chuyện kiểu trợ lý, trong khi các mô hình huấn luyện trước phù hợp với các tác vụ sinh ngôn ngữ rộng hơn. Đầu ra của Llama 3.1 cũng có thể được sử dụng để cải thiện các mô hình khác, bao gồm tạo và tinh chỉnh dữ liệu tổng hợp. Llama 3.1 là mô hình Transformer tự hồi tiếp với kiến trúc được tối ưu hóa. Các phiên bản tinh chỉnh sử dụng huấn luyện có giám sát (SFT) và học tăng cường từ phản hồi con người (RLHF) để phù hợp với sở thích của con người về tính hữu ích và an toàn.",
"meta.llama3-1-70b-instruct-v1:0.description": "Phiên bản cập nhật Meta Llama 3.1 70B Instruct với cửa sổ ngữ cảnh mở rộng 128K, hỗ trợ đa ngôn ngữ và khả năng suy luận được cải thiện. Các mô hình LLM đa ngữ Llama 3.1 bao gồm các mô hình sinh văn bản được huấn luyện trước và tinh chỉnh theo hướng dẫn với kích thước 8B, 70B và 405B (văn bản vào/ra). Các mô hình tinh chỉnh theo hướng dẫn được tối ưu cho đối thoại đa ngữ và vượt trội hơn nhiều mô hình trò chuyện mở hiện có trên các tiêu chuẩn đánh giá phổ biến. Llama 3.1 được thiết kế cho mục đích thương mại và nghiên cứu trên nhiều ngôn ngữ. Các mô hình tinh chỉnh theo hướng dẫn phù hợp với trò chuyện kiểu trợ lý, trong khi các mô hình huấn luyện trước phù hợp với các tác vụ sinh ngôn ngữ rộng hơn. Đầu ra của Llama 3.1 cũng có thể được sử dụng để cải thiện các mô hình khác (ví dụ: dữ liệu tổng hợp và tinh chỉnh). Đây là mô hình Transformer tự hồi tiếp, với SFT và RLHF để phù hợp với tính hữu ích và an toàn.",
"meta.llama3-1-8b-instruct-v1:0.description": "Phiên bản cập nhật Meta Llama 3.1 8B Instruct với cửa sổ ngữ cảnh 128K, hỗ trợ đa ngôn ngữ và khả năng suy luận được cải thiện. Dòng Llama 3.1 bao gồm các mô hình văn bản được tinh chỉnh theo hướng dẫn với kích thước 8B, 70B và 405B, tối ưu cho trò chuyện đa ngữ và hiệu suất cao trên các tiêu chuẩn đánh giá. Mô hình được thiết kế cho mục đích thương mại và nghiên cứu trên nhiều ngôn ngữ; các mô hình tinh chỉnh theo hướng dẫn phù hợp với trò chuyện kiểu trợ lý, trong khi các mô hình huấn luyện trước phù hợp với các tác vụ sinh ngôn ngữ rộng hơn. Đầu ra của Llama 3.1 cũng có thể được sử dụng để cải thiện các mô hình khác (ví dụ: dữ liệu tổng hợp và tinh chỉnh). Đây là mô hình Transformer tự hồi tiếp, với SFT và RLHF để phù hợp với tính hữu ích và an toàn.",
"meta.llama3-70b-instruct-v1:0.description": "Meta Llama 3 là mô hình ngôn ngữ mở dành cho nhà phát triển, nhà nghiên cứu và doanh nghiệp, được thiết kế để giúp họ xây dựng, thử nghiệm và mở rộng ý tưởng AI sinh ngôn ngữ một cách có trách nhiệm. Là một phần nền tảng cho đổi mới cộng đồng toàn cầu, mô hình phù hợp với tạo nội dung, AI hội thoại, hiểu ngôn ngữ, R&D và các ứng dụng doanh nghiệp.",
"meta.llama3-8b-instruct-v1:0.description": "Meta Llama 3 là một mô hình ngôn ngữ mở dành cho nhà phát triển, nhà nghiên cứu và doanh nghiệp, được thiết kế để hỗ trợ xây dựng, thử nghiệm và mở rộng các ý tưởng AI sinh ngữ một cách có trách nhiệm. Là một phần trong nền tảng đổi mới cộng đồng toàn cầu, mô hình này phù hợp với môi trường có tài nguyên hạn chế, thiết bị biên và yêu cầu thời gian huấn luyện nhanh hơn.",
"meta/Llama-3.2-11B-Vision-Instruct.description": "Khả năng suy luận hình ảnh mạnh mẽ trên ảnh độ phân giải cao, phù hợp cho các ứng dụng hiểu thị giác.",
"meta/Llama-3.2-90B-Vision-Instruct.description": "Khả năng suy luận hình ảnh tiên tiến dành cho các ứng dụng tác tử hiểu thị giác.",
"meta/Llama-3.3-70B-Instruct.description": "Llama 3.3 là mô hình Llama mã nguồn mở đa ngôn ngữ tiên tiến nhất, đạt hiệu suất gần tương đương mô hình 405B với chi phí rất thấp. Dựa trên kiến trúc Transformer và được cải tiến bằng SFT và RLHF để tăng tính hữu ích và an toàn. Phiên bản tinh chỉnh theo hướng dẫn được tối ưu cho trò chuyện đa ngôn ngữ và vượt trội hơn nhiều mô hình trò chuyện mở và đóng trong các bài đánh giá ngành. Mốc kiến thức: Tháng 12 năm 2023.",
"meta/Meta-Llama-3-70B-Instruct.description": "Mô hình mạnh mẽ với 70 tỷ tham số, xuất sắc trong suy luận, lập trình và các tác vụ ngôn ngữ tổng quát.",
"meta/Meta-Llama-3-8B-Instruct.description": "Mô hình linh hoạt với 8 tỷ tham số, được tối ưu hóa cho trò chuyện và sinh văn bản.",
"meta/Meta-Llama-3.1-405B-Instruct.description": "Mô hình văn bản Llama 3.1 tinh chỉnh theo hướng dẫn, được tối ưu cho trò chuyện đa ngôn ngữ, đạt hiệu suất cao trong các bài đánh giá ngành giữa các mô hình trò chuyện mở và đóng.",
"meta/Meta-Llama-3.1-70B-Instruct.description": "Mô hình văn bản Llama 3.1 tinh chỉnh theo hướng dẫn, được tối ưu cho trò chuyện đa ngôn ngữ, đạt hiệu suất cao trong các bài đánh giá ngành giữa các mô hình trò chuyện mở và đóng.",
"meta/Meta-Llama-3.1-8B-Instruct.description": "Mô hình văn bản Llama 3.1 tinh chỉnh theo hướng dẫn, được tối ưu cho trò chuyện đa ngôn ngữ, đạt hiệu suất cao trong các bài đánh giá ngành giữa các mô hình trò chuyện mở và đóng.",
"meta/llama-3.1-405b-instruct.description": "Mô hình LLM tiên tiến hỗ trợ sinh dữ liệu tổng hợp, chưng cất tri thức và suy luận cho chatbot, lập trình và các tác vụ chuyên ngành.",
"meta/llama-3.1-70b-instruct.description": "Được xây dựng cho đối thoại phức tạp với khả năng hiểu ngữ cảnh, suy luận và sinh văn bản xuất sắc.",
"meta/llama-3.1-70b.description": "Phiên bản cập nhật của Meta Llama 3 70B Instruct với ngữ cảnh 128K, hỗ trợ đa ngôn ngữ và khả năng suy luận được cải thiện.",
"meta/llama-3.1-8b-instruct.description": "Mô hình tiên tiến với khả năng hiểu ngôn ngữ, suy luận và sinh văn bản mạnh mẽ.",
"meta/llama-3.1-8b.description": "Llama 3.1 8B hỗ trợ cửa sổ ngữ cảnh 128K, lý tưởng cho trò chuyện thời gian thực và phân tích dữ liệu, đồng thời tiết kiệm chi phí đáng kể so với các mô hình lớn hơn. Được phục vụ bởi Groq trên phần cứng LPU cho suy luận nhanh và hiệu quả.",
"meta/llama-3.2-11b-vision-instruct.description": "Mô hình tiên phong kết hợp thị giác và ngôn ngữ, xuất sắc trong suy luận chất lượng cao từ hình ảnh.",
"meta/llama-3.2-11b.description": "Mô hình suy luận hình ảnh tinh chỉnh theo hướng dẫn (đầu vào văn bản + hình ảnh, đầu ra văn bản) được tối ưu cho nhận diện thị giác, suy luận hình ảnh, tạo chú thích và hỏi đáp hình ảnh tổng quát.",
"meta/llama-3.2-1b-instruct.description": "Mô hình ngôn ngữ nhỏ tiên tiến với khả năng hiểu, suy luận và sinh văn bản mạnh mẽ.",
"meta/llama-3.2-1b.description": "Mô hình chỉ văn bản dành cho các trường hợp sử dụng trên thiết bị như truy xuất cục bộ đa ngôn ngữ, tóm tắt và viết lại.",
"meta/llama-3.2-3b-instruct.description": "Mô hình ngôn ngữ nhỏ tiên tiến với khả năng hiểu, suy luận và sinh văn bản mạnh mẽ.",
"meta/llama-3.2-3b.description": "Mô hình chỉ văn bản được tinh chỉnh cho các trường hợp sử dụng trên thiết bị như truy xuất cục bộ đa ngôn ngữ, tóm tắt và viết lại.",
"meta/llama-3.2-90b-vision-instruct.description": "Mô hình tiên phong kết hợp thị giác và ngôn ngữ, xuất sắc trong suy luận chất lượng cao từ hình ảnh.",
"meta/llama-3.2-90b.description": "Mô hình suy luận hình ảnh tinh chỉnh theo hướng dẫn (đầu vào văn bản + hình ảnh, đầu ra văn bản) được tối ưu cho nhận diện thị giác, suy luận hình ảnh, tạo chú thích và hỏi đáp hình ảnh tổng quát.",
"meta/llama-3.3-70b-instruct.description": "Mô hình LLM tiên tiến mạnh về suy luận, toán học, tư duy thông thường và gọi hàm.",
"meta/llama-3.3-70b.description": "Sự cân bằng hoàn hảo giữa hiệu suất và hiệu quả. Được xây dựng cho AI hội thoại hiệu suất cao trong sáng tạo nội dung, ứng dụng doanh nghiệp và nghiên cứu, với khả năng hiểu ngôn ngữ mạnh mẽ cho tóm tắt, phân loại, phân tích cảm xúc và sinh mã.",
"meta/llama-4-maverick.description": "Dòng Llama 4 là bộ mô hình AI đa phương thức gốc hỗ trợ văn bản và trải nghiệm đa phương thức, sử dụng MoE để hiểu văn bản và hình ảnh hàng đầu. Llama 4 Maverick là mô hình 17B với 128 chuyên gia, được phục vụ bởi DeepInfra.",
"meta/llama-4-scout.description": "Dòng Llama 4 là bộ mô hình AI đa phương thức gốc hỗ trợ văn bản và trải nghiệm đa phương thức, sử dụng MoE để hiểu văn bản và hình ảnh hàng đầu. Llama 4 Scout là mô hình 17B với 16 chuyên gia, được phục vụ bởi DeepInfra.",
"microsoft/Phi-3-medium-128k-instruct.description": "Cùng một mô hình Phi-3-medium nhưng với cửa sổ ngữ cảnh lớn hơn, phù hợp cho RAG hoặc các lời nhắc few-shot.",
"microsoft/Phi-3-medium-4k-instruct.description": "Mô hình với 14 tỷ tham số, chất lượng cao hơn Phi-3-mini, tập trung vào dữ liệu chất lượng cao và yêu cầu suy luận phức tạp.",
"microsoft/Phi-3-mini-128k-instruct.description": "Cùng một mô hình Phi-3-mini nhưng với cửa sổ ngữ cảnh lớn hơn, phù hợp cho RAG hoặc các lời nhắc few-shot.",
"microsoft/Phi-3-mini-4k-instruct.description": "Thành viên nhỏ nhất trong dòng Phi-3, được tối ưu hóa cho chất lượng và độ trễ thấp.",
"microsoft/Phi-3-small-128k-instruct.description": "Cùng một mô hình Phi-3-small nhưng với cửa sổ ngữ cảnh lớn hơn, phù hợp cho RAG hoặc các lời nhắc few-shot.",
"microsoft/Phi-3-small-8k-instruct.description": "Mô hình với 7 tỷ tham số, chất lượng cao hơn Phi-3-mini, tập trung vào dữ liệu chất lượng cao và yêu cầu suy luận phức tạp.",
"microsoft/Phi-3.5-mini-instruct.description": "Phiên bản cập nhật của mô hình Phi-3-mini.",
"microsoft/Phi-3.5-vision-instruct.description": "Phiên bản cập nhật của mô hình Phi-3-vision.",
"microsoft/WizardLM-2-8x22B.description": "WizardLM 2 là mô hình ngôn ngữ từ Microsoft AI, nổi bật trong đối thoại phức tạp, đa ngôn ngữ, suy luận và trợ lý ảo.",
"microsoft/wizardlm-2-8x22b.description": "WizardLM-2 8x22B là mô hình Wizard tiên tiến nhất của Microsoft AI với hiệu suất cạnh tranh cao.",
"mimo-v2-flash.description": "MiMo-V2-Flash hiện đã chính thức trở thành mã nguồn mở! Đây là mô hình MoE (Mixture-of-Experts) được thiết kế đặc biệt để tối ưu hóa hiệu suất suy luận, với tổng cộng 309 tỷ tham số (15 tỷ được kích hoạt). Thông qua các cải tiến trong kiến trúc chú ý lai và tăng tốc suy luận MTP đa lớp, nó nằm trong Top 2 mô hình mã nguồn mở toàn cầu trên nhiều bộ tiêu chuẩn đánh giá tác nhân. Khả năng mã hóa của nó vượt qua tất cả các mô hình mã nguồn mở và cạnh tranh với các mô hình mã nguồn đóng hàng đầu như Claude 4.5 Sonnet, trong khi chỉ tiêu tốn 2,5% chi phí suy luận và cung cấp tốc độ tạo nhanh hơn gấp 2 lần—đẩy hiệu suất suy luận mô hình lớn đến giới hạn.",
"mimo-v2-omni.description": "MiMo-V2-Omni được thiết kế đặc biệt cho các tương tác và kịch bản thực thi đa phương tiện phức tạp trong thế giới thực. Chúng tôi đã xây dựng nền tảng toàn diện từ đầu, tích hợp văn bản, hình ảnh và giọng nói, đồng thời thống nhất “nhận thức” và “hành động” trong một kiến trúc duy nhất. Điều này không chỉ phá vỡ giới hạn truyền thống của các mô hình nhấn mạnh sự hiểu biết hơn thực thi, mà còn mang lại cho mô hình khả năng tự nhiên trong nhận thức đa phương tiện, sử dụng công cụ, thực thi chức năng và thao tác GUI. MiMo-V2-Omni có thể tích hợp liền mạch với các khung tác nhân chính, đạt được bước nhảy từ hiểu biết đến kiểm soát đồng thời giảm đáng kể rào cản triển khai các tác nhân đa phương tiện hoàn chỉnh.",
"mimo-v2-pro.description": "MiMo-V2-Pro được thiết kế đặc biệt cho các quy trình làm việc tác nhân cường độ cao trong các tình huống thực tế. Nó có hơn 1 nghìn tỷ tham số tổng cộng (42 tỷ tham số được kích hoạt), áp dụng kiến trúc chú ý lai sáng tạo và hỗ trợ độ dài ngữ cảnh siêu dài lên đến 1 triệu token. Dựa trên một mô hình nền tảng mạnh mẽ, chúng tôi liên tục mở rộng tài nguyên tính toán trên một phạm vi rộng hơn các tình huống tác nhân, mở rộng không gian hành động của trí tuệ và đạt được sự tổng quát hóa đáng kể—từ lập trình đến thực thi nhiệm vụ thực tế (“claw”).",
"minicpm-v.description": "MiniCPM-V là mô hình đa phương thức thế hệ tiếp theo của OpenBMB, nổi bật với khả năng OCR và hiểu đa phương thức cho nhiều tình huống sử dụng.",
"minimax-m2.1.description": "MiniMax-M2.1 là phiên bản mới nhất trong dòng MiniMax, được tối ưu hóa cho lập trình đa ngôn ngữ và các tác vụ phức tạp trong thế giới thực. Là mô hình gốc AI, MiniMax-M2.1 cải thiện đáng kể hiệu suất, hỗ trợ khung tác tử và khả năng thích ứng đa tình huống, nhằm giúp doanh nghiệp và cá nhân nhanh chóng tiếp cận phong cách làm việc và sống gắn liền với AI.",
"minimax-m2.5.description": "MiniMax-M2.5 là mô hình ngôn ngữ lớn tiên tiến được thiết kế cho năng suất thực tế và các nhiệm vụ lập trình.",
"minimax-m2.7.description": "MiniMax M2.7 là một mô hình ngôn ngữ lớn hiệu quả được xây dựng đặc biệt cho lập trình và quy trình làm việc tác nhân.",
"minimax-m2.description": "MiniMax M2 là mô hình ngôn ngữ lớn hiệu quả, được xây dựng đặc biệt cho lập trình và quy trình tác tử.",
"minimax/minimax-m2.1.description": "MiniMax-M2.1 là mô hình ngôn ngữ lớn tiên tiến, nhẹ, được tối ưu hóa cho lập trình, quy trình proxy và phát triển ứng dụng hiện đại, mang lại đầu ra rõ ràng, ngắn gọn và phản hồi nhanh hơn.",
"minimax/minimax-m2.description": "MiniMax-M2 là mô hình giá trị cao, xuất sắc trong các tác vụ lập trình và tác tử cho nhiều tình huống kỹ thuật.",
"minimaxai/minimax-m2.5.description": "MiniMax-M2.5 là mô hình ngôn ngữ lớn mới nhất từ MiniMax, với kiến trúc Mixture-of-Experts (MoE) gồm 229 tỷ tham số. Nó đạt hiệu suất hàng đầu trong ngành về lập trình, gọi công cụ tác nhân, nhiệm vụ tìm kiếm và các tình huống văn phòng.",
"ministral-3:14b.description": "Ministral 3 14B là mô hình lớn nhất trong dòng Ministral 3, cung cấp hiệu suất tiên tiến tương đương với đối tác Mistral Small 3.2 24B lớn hơn. Được tối ưu hóa cho triển khai cục bộ, nó mang lại hiệu suất cao trên nhiều phần cứng bao gồm cả thiết lập cục bộ.",
"ministral-3:3b.description": "Ministral 3 3B là mô hình nhỏ nhất và hiệu quả nhất trong dòng Ministral 3, cung cấp khả năng ngôn ngữ và thị giác mạnh mẽ trong một gói nhỏ gọn. Được thiết kế cho triển khai biên, nó mang lại hiệu suất cao trên nhiều phần cứng bao gồm cả thiết lập cục bộ.",
"ministral-3:8b.description": "Ministral 3 8B là mô hình mạnh mẽ và hiệu quả trong dòng Ministral 3, cung cấp khả năng văn bản và thị giác hàng đầu. Được xây dựng cho triển khai biên, nó mang lại hiệu suất cao trên nhiều phần cứng bao gồm cả thiết lập cục bộ.",
"ministral-3b-latest.description": "Ministral 3B là mô hình hàng đầu cho thiết bị biên của Mistral.",
"ministral-8b-latest.description": "Ministral 8B là mô hình biên hiệu quả về chi phí cao từ Mistral.",
"mistral-ai/Mistral-Large-2411.description": "Mô hình hàng đầu của Mistral cho các tác vụ phức tạp cần suy luận quy mô lớn hoặc chuyên biệt (tạo văn bản tổng hợp, tạo mã, RAG hoặc tác tử).",
"mistral-ai/Mistral-Nemo.description": "Mistral Nemo là mô hình LLM tiên tiến với khả năng suy luận, kiến thức thế giới và lập trình hàng đầu trong phân khúc.",
"mistral-ai/mistral-small-2503.description": "Mistral Small phù hợp với mọi tác vụ ngôn ngữ yêu cầu hiệu suất cao và độ trễ thấp.",
"mistral-large-2411.description": "Mistral Large là mô hình hàng đầu, mạnh mẽ trong các nhiệm vụ đa ngôn ngữ, lý luận phức tạp và tạo mã—lý tưởng cho các ứng dụng cao cấp.",
"mistral-large-2512.description": "Mistral Large 3, là mô hình đa phương thức đa năng tiên tiến nhất với trọng số mở, có kiến trúc Mixture of Experts chi tiết. Nó có 41B tham số hoạt động và 675B tổng tham số.",
"mistral-large-3:675b.description": "Mistral Large 3 là mô hình đa phương thức đa năng tiên tiến nhất với trọng số mở, có kiến trúc Mixture of Experts tinh chỉnh. Nó có 41B tham số hoạt động và 675B tổng tham số.",
"mistral-large-instruct.description": "Mistral-Large-Instruct-2407 là mô hình LLM dày đặc tiên tiến với 123 tỷ tham số, nổi bật về suy luận, kiến thức và lập trình.",
"mistral-large-latest.description": "Mistral Large là mô hình hàng đầu, vượt trội trong các nhiệm vụ đa ngôn ngữ, lý luận phức tạp và tạo mã cho các ứng dụng cao cấp.",
"mistral-large.description": "Mixtral Large là mô hình hàng đầu của Mistral, kết hợp tạo mã, toán học và suy luận với cửa sổ ngữ cảnh 128K.",
"mistral-medium-2508.description": "Mistral Medium 3.1 cung cấp hiệu suất tiên tiến với chi phí thấp hơn 8 lần và đơn giản hóa việc triển khai doanh nghiệp.",
"mistral-nemo-instruct.description": "Mistral-Nemo-Instruct-2407 là phiên bản tinh chỉnh theo hướng dẫn của Mistral-Nemo-Base-2407.",
"mistral-nemo.description": "Mistral Nemo là mô hình 12B hiệu quả cao từ Mistral AI và NVIDIA.",
"mistral-small-2506.description": "Mistral Small là lựa chọn tiết kiệm chi phí, nhanh chóng và đáng tin cậy cho dịch thuật, tóm tắt và phân tích cảm xúc.",
"mistral-small-2603.description": "Mô hình lai mạnh mẽ của Mistral thống nhất các khả năng hướng dẫn, lý luận và mã hóa trong một mô hình duy nhất. 119B tham số với 6.5B tham số hoạt động.",
"mistral-small-latest.description": "Mistral Small là lựa chọn tiết kiệm, nhanh và đáng tin cậy cho dịch thuật, tóm tắt và phân tích cảm xúc.",
"mistral-small.description": "Mistral Small phù hợp với mọi tác vụ ngôn ngữ yêu cầu hiệu suất cao và độ trễ thấp.",
"mistral.description": "Mistral là mô hình 7B của Mistral AI, phù hợp với nhiều tác vụ ngôn ngữ khác nhau.",
"mistral/codestral-embed.description": "Mô hình nhúng mã để nhúng các cơ sở mã và kho lưu trữ, hỗ trợ trợ lý lập trình.",
"mistral/codestral.description": "Mistral Codestral 25.01 là mô hình lập trình tiên tiến, được tối ưu hóa cho độ trễ thấp và tần suất sử dụng cao. Hỗ trợ hơn 80 ngôn ngữ và nổi bật trong FIM, sửa mã và tạo kiểm thử.",
"mistral/devstral-small.description": "Devstral là mô hình LLM tác tử cho các tác vụ kỹ thuật phần mềm, là lựa chọn mạnh mẽ cho các tác tử kỹ thuật phần mềm.",
"mistral/magistral-medium.description": "Tư duy phức tạp được hỗ trợ bởi hiểu biết sâu sắc với suy luận minh bạch mà bạn có thể theo dõi và xác minh. Duy trì suy luận chính xác cao trên nhiều ngôn ngữ, ngay cả giữa tác vụ.",
"mistral/magistral-small.description": "Tư duy phức tạp được hỗ trợ bởi hiểu biết sâu sắc với suy luận minh bạch mà bạn có thể theo dõi và xác minh. Duy trì suy luận chính xác cao trên nhiều ngôn ngữ, ngay cả giữa tác vụ.",
"mistral/ministral-3b.description": "Mô hình nhỏ gọn, hiệu quả cho các tác vụ trên thiết bị như trợ lý và phân tích cục bộ, mang lại hiệu suất độ trễ thấp.",
"mistral/ministral-8b.description": "Mô hình mạnh mẽ hơn với suy luận nhanh và tiết kiệm bộ nhớ, lý tưởng cho quy trình phức tạp và ứng dụng biên đòi hỏi cao.",
"mistral/mistral-embed.description": "Mô hình nhúng văn bản tổng quát cho tìm kiếm ngữ nghĩa, đo độ tương đồng, phân cụm và quy trình RAG.",
"mistral/mistral-large.description": "Mistral Large lý tưởng cho các tác vụ phức tạp cần suy luận mạnh hoặc chuyên môn hóa—tạo văn bản tổng hợp, tạo mã, RAG hoặc tác tử.",
"mistral/mistral-small.description": "Mistral Small lý tưởng cho các tác vụ đơn giản, có thể xử lý hàng loạt như phân loại, hỗ trợ khách hàng hoặc tạo văn bản, mang lại hiệu suất cao với chi phí hợp lý.",
"mistral/mixtral-8x22b-instruct.description": "Mô hình Instruct 8x22B. 8x22B là mô hình MoE mở được phục vụ bởi Mistral.",
"mistral/pixtral-12b.description": "Mô hình 12B với khả năng hiểu hình ảnh và văn bản.",
"mistral/pixtral-large.description": "Pixtral Large là mô hình thứ hai trong dòng đa phương thức của chúng tôi với khả năng hiểu hình ảnh tiên tiến. Xử lý tài liệu, biểu đồ và hình ảnh tự nhiên trong khi vẫn giữ được khả năng hiểu văn bản hàng đầu của Mistral Large 2.",
"mistralai/Mistral-7B-Instruct-v0.1.description": "Mistral (7B) Instruct nổi bật với hiệu suất mạnh mẽ trong nhiều tác vụ ngôn ngữ.",
"mistralai/Mistral-7B-Instruct-v0.2.description": "Mistral (7B) Instruct v0.2 cải thiện khả năng xử lý hướng dẫn và độ chính xác kết quả.",
"mistralai/Mistral-7B-Instruct-v0.3.description": "Mistral (7B) Instruct v0.3 mang lại hiệu suất tính toán hiệu quả và khả năng hiểu ngôn ngữ mạnh mẽ cho nhiều tình huống sử dụng.",
"mistralai/Mistral-7B-v0.1.description": "Mistral 7B nhỏ gọn nhưng hiệu suất cao, mạnh mẽ trong xử lý hàng loạt và các tác vụ đơn giản như phân loại và tạo văn bản, với khả năng suy luận vững chắc.",
"mistralai/Mixtral-8x22B-Instruct-v0.1.description": "Mixtral-8x22B Instruct (141B) là mô hình LLM rất lớn cho khối lượng công việc nặng.",
"mistralai/Mixtral-8x7B-Instruct-v0.1.description": "Mixtral-8x7B Instruct (46.7B) cung cấp dung lượng lớn cho xử lý dữ liệu quy mô lớn.",
"mistralai/Mixtral-8x7B-v0.1.description": "Mixtral 8x7B là mô hình MoE thưa giúp tăng tốc độ suy luận, phù hợp cho các tác vụ đa ngôn ngữ và tạo mã.",
"mistralai/mistral-nemo.description": "Mistral Nemo là mô hình 7.3B hỗ trợ đa ngôn ngữ và hiệu suất lập trình mạnh mẽ.",
"mixtral-8x7b-32768.description": "Mixtral 8x7B cung cấp tính toán song song chịu lỗi cho các tác vụ phức tạp.",
"mixtral.description": "Mixtral là mô hình MoE của Mistral AI với trọng số mở, hỗ trợ tạo mã và hiểu ngôn ngữ.",
"mixtral:8x22b.description": "Mixtral là mô hình MoE của Mistral AI với trọng số mở, hỗ trợ tạo mã và hiểu ngôn ngữ.",
"moonshot-v1-128k-vision-preview.description": "Các mô hình thị giác Kimi (bao gồm moonshot-v1-8k-vision-preview/moonshot-v1-32k-vision-preview/moonshot-v1-128k-vision-preview) có khả năng hiểu nội dung hình ảnh như văn bản, màu sắc và hình dạng đối tượng.",
"moonshot-v1-128k.description": "Moonshot V1 128K cung cấp ngữ cảnh siêu dài để tạo văn bản rất dài, xử lý lên đến 128.000 token, phù hợp cho nghiên cứu, học thuật và các tài liệu lớn.",
"moonshot-v1-32k-vision-preview.description": "Các mô hình thị giác Kimi (bao gồm moonshot-v1-8k-vision-preview/moonshot-v1-32k-vision-preview/moonshot-v1-128k-vision-preview) có khả năng hiểu nội dung hình ảnh như văn bản, màu sắc và hình dạng đối tượng.",
"moonshot-v1-32k.description": "Moonshot V1 32K hỗ trợ 32.768 token cho ngữ cảnh trung bình, lý tưởng cho tài liệu dài và hội thoại phức tạp trong sáng tạo nội dung, báo cáo và hệ thống trò chuyện.",
"moonshot-v1-8k-vision-preview.description": "Các mô hình thị giác Kimi (bao gồm moonshot-v1-8k-vision-preview/moonshot-v1-32k-vision-preview/moonshot-v1-128k-vision-preview) có khả năng hiểu nội dung hình ảnh như văn bản, màu sắc và hình dạng đối tượng.",
"moonshot-v1-8k.description": "Moonshot V1 8K được tối ưu hóa cho việc tạo văn bản ngắn với hiệu suất cao, xử lý 8.192 token cho các cuộc trò chuyện ngắn, ghi chú và nội dung nhanh.",
"moonshotai/Kimi-Dev-72B.description": "Kimi-Dev-72B là mô hình mã nguồn mở tối ưu hóa với RL quy mô lớn để tạo ra các bản vá mạnh mẽ, sẵn sàng sản xuất. Nó đạt 60,4% trên SWE-bench Verified, thiết lập kỷ lục mới cho các nhiệm vụ kỹ thuật phần mềm tự động như sửa lỗi và đánh giá mã.",
"moonshotai/Kimi-K2-Instruct-0905.description": "Kimi K2-Instruct-0905 là phiên bản Kimi K2 mới nhất và mạnh mẽ nhất. Đây là mô hình MoE hàng đầu với tổng 1T và 32B tham số hoạt động. Các điểm nổi bật bao gồm trí tuệ lập trình tác tử mạnh hơn với cải thiện đáng kể trên các bài kiểm tra và tác vụ thực tế, cùng với mã giao diện người dùng đẹp hơn và dễ sử dụng hơn.",
"moonshotai/Kimi-K2-Thinking.description": "Kimi K2 Thinking là mô hình suy nghĩ mã nguồn mở mới nhất và mạnh mẽ nhất. Nó mở rộng đáng kể độ sâu suy luận nhiều bước và duy trì sử dụng công cụ ổn định qua 200–300 lần gọi liên tiếp, thiết lập kỷ lục mới trên Humanity's Last Exam (HLE), BrowseComp và các tiêu chuẩn khác. Nó xuất sắc trong mã hóa, toán học, logic và các kịch bản Agent. Được xây dựng trên kiến trúc MoE với ~1 nghìn tỷ tham số tổng cộng, nó hỗ trợ cửa sổ ngữ cảnh 256K và gọi công cụ.",
"moonshotai/kimi-k2-0711.description": "Kimi K2 0711 là biến thể instruct trong dòng Kimi, phù hợp cho mã chất lượng cao và sử dụng công cụ.",
"moonshotai/kimi-k2-0905.description": "Kimi K2 0905 là bản cập nhật mở rộng hiệu suất ngữ cảnh và suy luận với các tối ưu hóa lập trình.",
"moonshotai/kimi-k2-instruct-0905.description": "Mô hình kimi-k2-0905-preview hỗ trợ cửa sổ ngữ cảnh 256k, với khả năng lập trình tác tử mạnh hơn, mã giao diện người dùng mượt mà và thực tế hơn, cùng khả năng hiểu ngữ cảnh tốt hơn.",
"moonshotai/kimi-k2-thinking-turbo.description": "Kimi K2 Thinking Turbo là phiên bản tốc độ cao của Kimi K2 Thinking, giảm đáng kể độ trễ trong khi vẫn giữ được khả năng suy luận sâu.",
"moonshotai/kimi-k2-thinking.description": "Kimi K2 Thinking là mô hình suy luận của Moonshot được tối ưu hóa cho các tác vụ suy luận sâu, với khả năng tác tử tổng quát.",
"moonshotai/kimi-k2.5.description": "Kimi K2.5 là mô hình Kimi thông minh nhất cho đến nay, với kiến trúc đa phương thức tự nhiên.",
"moonshotai/kimi-k2.description": "Kimi K2 là mô hình MoE lớn từ Moonshot AI với tổng 1T tham số và 32B hoạt động mỗi lần truyền, được tối ưu hóa cho khả năng tác tử bao gồm sử dụng công cụ nâng cao, suy luận và tổng hợp mã.",
"morph/morph-v3-fast.description": "Morph cung cấp mô hình chuyên biệt để áp dụng các thay đổi mã do các mô hình tiên tiến (ví dụ: Claude hoặc GPT-4o) đề xuất vào tệp hiện có của bạn với tốc độ NHANH 4500+ token/giây. Đây là bước cuối cùng trong quy trình lập trình AI và hỗ trợ 16k token đầu vào/đầu ra.",
"morph/morph-v3-large.description": "Morph cung cấp mô hình chuyên biệt để áp dụng các thay đổi mã do các mô hình tiên tiến (ví dụ: Claude hoặc GPT-4o) đề xuất vào tệp hiện có của bạn với tốc độ NHANH 2500+ token/giây. Đây là bước cuối cùng trong quy trình lập trình AI và hỗ trợ 16k token đầu vào/đầu ra.",
"musesteamer-2.0-lite-i2v.description": "So với Turbo, nó cung cấp hiệu suất vượt trội với hiệu quả chi phí tuyệt vời.",
"musesteamer-2.0-pro-i2v.description": "Dựa trên Turbo, hỗ trợ tạo video động 1080P, cung cấp chất lượng hình ảnh cao hơn và khả năng biểu đạt video nâng cao.",
"musesteamer-2.0-turbo-i2v-audio.description": "Hỗ trợ tạo video động 5 giây và 10 giây 720P có âm thanh. Cho phép tạo nội dung âm thanh-hình ảnh hội thoại đa nhân vật, với âm thanh và hình ảnh đồng bộ, hình ảnh chất lượng điện ảnh và chuyển động camera bậc thầy.",
"musesteamer-2.0-turbo-i2v.description": "Hỗ trợ tạo video động 5 giây 720P không âm thanh, với hình ảnh chất lượng điện ảnh, chuyển động camera phức tạp và cảm xúc và hành động nhân vật thực tế.",
"musesteamer-air-i2v.description": "Mô hình tạo video Baidu MuseSteamer Air hoạt động tốt về tính nhất quán của chủ thể, hiện thực vật lý, hiệu ứng chuyển động camera và tốc độ tạo. Hỗ trợ tạo video động 5 giây 720P không âm thanh, cung cấp hình ảnh chất lượng điện ảnh, tốc độ tạo nhanh và hiệu quả chi phí tuyệt vời.",
"musesteamer-air-image.description": "musesteamer-air-image là mô hình tạo hình ảnh được phát triển bởi đội tìm kiếm của Baidu để mang lại hiệu suất chi phí vượt trội. Nó có thể nhanh chóng tạo ra hình ảnh rõ ràng, hành động mạch lạc dựa trên các gợi ý của người dùng, biến mô tả của người dùng thành hình ảnh một cách dễ dàng.",
"nousresearch/hermes-2-pro-llama-3-8b.description": "Hermes 2 Pro Llama 3 8B là phiên bản cập nhật của Nous Hermes 2 với bộ dữ liệu nội bộ mới nhất được phát triển.",
"nvidia/Llama-3.1-Nemotron-70B-Instruct-HF.description": "Llama 3.1 Nemotron 70B là mô hình LLM tùy chỉnh của NVIDIA nhằm cải thiện tính hữu ích. Nó đạt hiệu suất cao trên Arena Hard, AlpacaEval 2 LC và GPT-4-Turbo MT-Bench, xếp hạng #1 trên cả ba bài kiểm tra tự động căn chỉnh tính đến ngày 1 tháng 10 năm 2024. Mô hình được huấn luyện từ Llama-3.1-70B-Instruct bằng RLHF (REINFORCE), Llama-3.1-Nemotron-70B-Reward và các prompt HelpSteer2-Preference.",
"nvidia/llama-3.1-nemotron-51b-instruct.description": "Mô hình ngôn ngữ đặc biệt với độ chính xác và hiệu quả vượt trội.",
"nvidia/llama-3.1-nemotron-70b-instruct.description": "Llama-3.1-Nemotron-70B-Instruct là mô hình tùy chỉnh của NVIDIA được thiết kế để cải thiện tính hữu ích của phản hồi LLM.",
"o1-mini.description": "o1-mini là mô hình suy luận nhanh, hiệu quả về chi phí, được thiết kế cho mã hóa, toán học và khoa học. Nó có ngữ cảnh 128K và cắt đứt kiến thức vào tháng 10 năm 2023.",
"o1-preview.description": "o1 là mô hình suy luận mới của OpenAI dành cho các nhiệm vụ phức tạp yêu cầu kiến thức rộng. Nó có ngữ cảnh 128K và cắt đứt kiến thức vào tháng 10 năm 2023.",
"o1-pro.description": "Dòng o1 được huấn luyện bằng học tăng cường để suy nghĩ trước khi trả lời và xử lý suy luận phức tạp. o1-pro sử dụng nhiều tài nguyên tính toán hơn để suy nghĩ sâu hơn và cung cấp câu trả lời chất lượng cao hơn một cách nhất quán.",
"o1.description": "o1 là mô hình suy luận mới của OpenAI với đầu vào văn bản + hình ảnh và đầu ra văn bản, phù hợp cho các tác vụ phức tạp đòi hỏi kiến thức rộng. Nó có cửa sổ ngữ cảnh 200K và mốc kiến thức đến tháng 10 năm 2023.",
"o3-2025-04-16.description": "o3 là mô hình suy luận mới của OpenAI với đầu vào văn bản+hình ảnh và đầu ra văn bản cho các tác vụ phức tạp đòi hỏi kiến thức rộng.",
"o3-deep-research.description": "o3-deep-research là mô hình nghiên cứu sâu tiên tiến nhất của chúng tôi cho các tác vụ nhiều bước phức tạp. Có thể tìm kiếm web và truy cập dữ liệu của bạn qua kết nối MCP.",
"o3-mini.description": "o3-mini là mô hình suy luận nhỏ mới nhất của chúng tôi, cung cấp trí tuệ cao hơn với chi phí và độ trễ tương đương o1-mini.",
"o3-pro-2025-06-10.description": "o3 Pro là mô hình suy luận mới của OpenAI với đầu vào văn bản+hình ảnh và đầu ra văn bản cho các tác vụ phức tạp đòi hỏi kiến thức rộng.",
"o3-pro.description": "o3-pro sử dụng nhiều tài nguyên tính toán hơn để suy nghĩ sâu hơn và liên tục đưa ra câu trả lời tốt hơn; chỉ khả dụng qua API Responses.",
"o3.description": "o3 là mô hình toàn diện mạnh mẽ, thiết lập tiêu chuẩn mới cho toán học, khoa học, lập trình và suy luận thị giác. Xuất sắc trong viết kỹ thuật và tuân thủ hướng dẫn, có thể phân tích văn bản, mã và hình ảnh cho các vấn đề nhiều bước.",
"o4-mini-2025-04-16.description": "o4-mini là mô hình suy luận của OpenAI với đầu vào văn bản+hình ảnh và đầu ra văn bản, phù hợp cho các tác vụ phức tạp đòi hỏi kiến thức rộng, với cửa sổ ngữ cảnh 200K.",
"o4-mini-deep-research.description": "o4-mini-deep-research là mô hình nghiên cứu sâu nhanh hơn, tiết kiệm hơn cho các nghiên cứu nhiều bước phức tạp. Có thể tìm kiếm web và truy cập dữ liệu của bạn qua kết nối MCP.",
"o4-mini.description": "o4-mini là mô hình nhỏ mới nhất trong dòng o-series, tối ưu cho suy luận nhanh, hiệu quả cao trong các tác vụ lập trình và thị giác.",
"open-codestral-mamba.description": "Codestral Mamba là mô hình ngôn ngữ Mamba 2 tập trung vào tạo mã, hỗ trợ các tác vụ lập trình và suy luận nâng cao.",
"open-mistral-7b.description": "Mistral 7B nhỏ gọn nhưng hiệu suất cao, mạnh mẽ trong xử lý hàng loạt và các tác vụ đơn giản như phân loại và tạo văn bản, với khả năng suy luận vững chắc.",
"open-mistral-nemo.description": "Mistral Nemo là mô hình 12B được đồng phát triển với Nvidia, cung cấp hiệu suất suy luận và lập trình mạnh mẽ với khả năng tích hợp dễ dàng.",
"open-mixtral-8x22b.description": "Mixtral 8x22B là mô hình MoE lớn hơn cho các tác vụ phức tạp, cung cấp khả năng suy luận mạnh mẽ và thông lượng cao hơn.",
"open-mixtral-8x7b.description": "Mixtral 8x7B là mô hình MoE thưa giúp tăng tốc suy luận, phù hợp cho các tác vụ đa ngôn ngữ và tạo mã.",
"openai/gpt-3.5-turbo-instruct.description": "Khả năng tương tự các mô hình GPT-3, tương thích với các điểm cuối hoàn thành cũ thay vì trò chuyện.",
"openai/gpt-3.5-turbo.description": "Mô hình GPT-3.5 mạnh mẽ và tiết kiệm chi phí nhất của OpenAI, được tối ưu cho trò chuyện nhưng vẫn hiệu quả với các tác vụ hoàn thành truyền thống.",
"openai/gpt-4-turbo.description": "GPT-4-turbo của OpenAI có kiến thức tổng quát rộng và chuyên môn theo lĩnh vực, tuân theo hướng dẫn ngôn ngữ tự nhiên phức tạp và giải quyết các vấn đề khó một cách chính xác. Giới hạn kiến thức đến tháng 4 năm 2023 với cửa sổ ngữ cảnh 128k.",
"openai/gpt-4.1-mini.description": "GPT-4.1 Mini cung cấp độ trễ thấp hơn và giá trị tốt hơn cho các tác vụ có ngữ cảnh trung bình.",
"openai/gpt-4.1-nano.description": "GPT-4.1 Nano là lựa chọn siêu tiết kiệm chi phí và độ trễ thấp cho các cuộc trò chuyện ngắn tần suất cao hoặc phân loại.",
"openai/gpt-4.1.description": "Dòng GPT-4.1 cung cấp cửa sổ ngữ cảnh lớn hơn và khả năng kỹ thuật cũng như suy luận mạnh mẽ hơn.",
"openai/gpt-4o-mini.description": "GPT-4o-mini là biến thể nhỏ, nhanh của GPT-4o dành cho các trường hợp sử dụng đa phương thức có độ trễ thấp.",
"openai/gpt-4o.description": "Dòng GPT-4o là mô hình Omni của OpenAI hỗ trợ đầu vào văn bản + hình ảnh và đầu ra văn bản.",
"openai/gpt-5-chat.description": "GPT-5 Chat là biến thể GPT-5 được tối ưu cho hội thoại với độ trễ thấp hơn để tăng tính tương tác.",
"openai/gpt-5-codex.description": "GPT-5-Codex là biến thể GPT-5 được tối ưu thêm cho lập trình và quy trình mã quy mô lớn.",
"openai/gpt-5-mini.description": "GPT-5 Mini là biến thể nhỏ hơn của GPT-5 dành cho các tình huống yêu cầu độ trễ thấp và chi phí thấp.",
"openai/gpt-5-nano.description": "GPT-5 Nano là biến thể siêu nhỏ dành cho các tình huống có yêu cầu nghiêm ngặt về chi phí và độ trễ.",
"openai/gpt-5-pro.description": "GPT-5 Pro là mô hình hàng đầu của OpenAI, cung cấp khả năng suy luận mạnh mẽ, sinh mã và các tính năng cấp doanh nghiệp, với định tuyến thời gian thực và chính sách an toàn nghiêm ngặt hơn.",
"openai/gpt-5.1-chat.description": "GPT-5.1 Chat là thành viên nhẹ của dòng GPT-5.1, được tối ưu cho hội thoại độ trễ thấp trong khi vẫn giữ khả năng suy luận và thực thi hướng dẫn mạnh mẽ.",
"openai/gpt-5.1-codex-mini.description": "GPT-5.1-Codex-Mini là phiên bản nhỏ hơn, nhanh hơn của GPT-5.1-Codex, phù hợp hơn cho các tình huống lập trình nhạy cảm với độ trễ và chi phí.",
"openai/gpt-5.1-codex.description": "GPT-5.1-Codex là biến thể GPT-5.1 được tối ưu cho kỹ thuật phần mềm và quy trình lập trình, phù hợp với tái cấu trúc lớn, gỡ lỗi phức tạp và các tác vụ lập trình tự động dài.",
"openai/gpt-5.1.description": "GPT-5.1 là mô hình hàng đầu mới nhất trong dòng GPT-5, với cải tiến đáng kể so với GPT-5 về suy luận tổng quát, tuân theo hướng dẫn và tính tự nhiên trong hội thoại, phù hợp với nhiều tác vụ.",
"openai/gpt-5.2-chat.description": "GPT-5.2 Chat là biến thể ChatGPT để trải nghiệm các cải tiến hội thoại mới nhất.",
"openai/gpt-5.2-pro.description": "GPT-5.2 Pro: biến thể GPT-5.2 thông minh và chính xác hơn (chỉ qua API Responses), phù hợp cho các vấn đề khó và suy luận nhiều lượt dài.",
"openai/gpt-5.2.description": "GPT-5.2 là mô hình hàng đầu cho lập trình và quy trình tác tử với khả năng suy luận mạnh mẽ và hiệu suất ngữ cảnh dài.",
"openai/gpt-5.description": "GPT-5 là mô hình hiệu suất cao của OpenAI dành cho nhiều tác vụ sản xuất và nghiên cứu.",
"openai/gpt-oss-120b.description": "Mô hình ngôn ngữ lớn đa năng với khả năng suy luận mạnh mẽ và có thể kiểm soát.",
"openai/gpt-oss-20b.description": "Mô hình ngôn ngữ nhỏ gọn, mã nguồn mở, được tối ưu cho độ trễ thấp và môi trường hạn chế tài nguyên, bao gồm triển khai cục bộ và biên.",
"openai/o1-mini.description": "o1-mini là mô hình suy luận nhanh, tiết kiệm chi phí được thiết kế cho lập trình, toán học và khoa học. Có ngữ cảnh 128K và giới hạn kiến thức đến tháng 10 năm 2023.",
"openai/o1-preview.description": "o1 là mô hình suy luận mới của OpenAI dành cho các tác vụ phức tạp yêu cầu kiến thức rộng. Có ngữ cảnh 128K và giới hạn kiến thức đến tháng 10 năm 2023.",
"openai/o1.description": "OpenAI o1 là mô hình suy luận hàng đầu được xây dựng để giải quyết các vấn đề phức tạp đòi hỏi tư duy sâu, mang lại khả năng suy luận mạnh mẽ và độ chính xác cao trong các tác vụ nhiều bước.",
"openai/o3-mini-high.description": "o3-mini (suy luận cao) cung cấp trí tuệ cao hơn với cùng chi phí và độ trễ như o1-mini.",
"openai/o3-mini.description": "o3-mini là mô hình suy luận nhỏ mới nhất của OpenAI, cung cấp trí tuệ cao hơn với cùng chi phí và độ trễ như o1-mini.",
"openai/o3.description": "OpenAI o3 là mô hình suy luận mạnh mẽ nhất, thiết lập chuẩn mới trong lập trình, toán học, khoa học và nhận thức thị giác. Xuất sắc trong các truy vấn phức tạp, đa chiều và đặc biệt mạnh trong phân tích hình ảnh, biểu đồ và sơ đồ.",
"openai/o4-mini-high.description": "o4-mini cấp suy luận cao, được tối ưu cho suy luận nhanh, hiệu quả với hiệu suất lập trình và thị giác mạnh mẽ.",
"openai/o4-mini.description": "OpenAI o4-mini là mô hình suy luận nhỏ, hiệu quả dành cho các tình huống yêu cầu độ trễ thấp.",
"openai/text-embedding-3-large.description": "Mô hình nhúng văn bản mạnh mẽ nhất của OpenAI cho các tác vụ tiếng Anh và không phải tiếng Anh.",
"openai/text-embedding-3-small.description": "Biến thể mô hình nhúng ada cải tiến của OpenAI với hiệu suất cao hơn.",
"openai/text-embedding-ada-002.description": "Mô hình nhúng văn bản cũ của OpenAI.",
"openrouter/auto.description": "Dựa trên độ dài ngữ cảnh, chủ đề và độ phức tạp, yêu cầu của bạn sẽ được định tuyến đến Llama 3 70B Instruct, Claude 3.5 Sonnet (tự kiểm duyệt) hoặc GPT-4o.",
"oswe-vscode-prime.description": "Raptor mini là mô hình xem trước được tối ưu hóa cho các nhiệm vụ liên quan đến mã.",
"oswe-vscode-secondary.description": "Raptor mini là mô hình xem trước được tối ưu hóa cho các nhiệm vụ liên quan đến mã.",
"paratera/deepseek-v3.2.description": "DeepSeek V3.2 là mô hình cân bằng giữa hiệu quả tính toán cao và hiệu suất suy luận và tác nhân xuất sắc.",
"perplexity/sonar-pro.description": "Sản phẩm hàng đầu của Perplexity với khả năng tìm kiếm làm nền, hỗ trợ truy vấn nâng cao và theo dõi.",
"perplexity/sonar-reasoning-pro.description": "Mô hình tập trung vào suy luận nâng cao, xuất ra chuỗi suy nghĩ (CoT) với tìm kiếm nâng cao, bao gồm nhiều truy vấn tìm kiếm cho mỗi yêu cầu.",
"perplexity/sonar-reasoning.description": "Mô hình tập trung vào suy luận, xuất ra chuỗi suy nghĩ (CoT) với giải thích chi tiết dựa trên tìm kiếm.",
"perplexity/sonar.description": "Sản phẩm nhẹ của Perplexity với tìm kiếm làm nền, nhanh hơn và rẻ hơn Sonar Pro.",
"phi3.description": "Phi-3 là mô hình nhẹ mã nguồn mở của Microsoft dành cho tích hợp hiệu quả và suy luận quy mô lớn.",
"phi3:14b.description": "Phi-3 là mô hình nhẹ mã nguồn mở của Microsoft dành cho tích hợp hiệu quả và suy luận quy mô lớn.",
"pixtral-12b-2409.description": "Pixtral mạnh trong hiểu biểu đồ/hình ảnh, hỏi đáp tài liệu, suy luận đa phương thức và tuân theo hướng dẫn. Có thể xử lý hình ảnh ở độ phân giải/tỷ lệ gốc và hỗ trợ nhiều hình ảnh trong cửa sổ ngữ cảnh 128K.",
"pixtral-large-latest.description": "Pixtral Large là mô hình đa phương thức mã nguồn mở 124B, được xây dựng trên Mistral Large 2, là mô hình thứ hai trong dòng đa phương thức của chúng tôi với khả năng hiểu hình ảnh tiên tiến.",
"pixverse/pixverse-v5.6-it2v.description": "Tải lên bất kỳ hình ảnh nào để tùy chỉnh tự do câu chuyện, nhịp độ và phong cách, tạo ra các video sống động và mạch lạc. PixVerse V5.6 là mô hình tạo video lớn tự phát triển bởi Aishi Technology, cung cấp các nâng cấp toàn diện trong cả khả năng chuyển văn bản thành video và hình ảnh thành video. Mô hình cải thiện đáng kể độ rõ nét của hình ảnh, độ ổn định trong chuyển động phức tạp và đồng bộ hóa âm thanh-hình ảnh. Độ chính xác đồng bộ môi và biểu cảm cảm xúc tự nhiên được cải thiện trong các cảnh hội thoại đa nhân vật. Bố cục, ánh sáng và tính nhất quán về kết cấu cũng được tối ưu hóa, nâng cao hơn nữa chất lượng tạo tổng thể. PixVerse V5.6 xếp hạng hàng đầu toàn cầu trên bảng xếp hạng phân tích nhân tạo về chuyển văn bản thành video và hình ảnh thành video.",
"pixverse/pixverse-v5.6-kf2v.description": "Đạt được các chuyển cảnh liền mạch giữa bất kỳ hai hình ảnh nào, tạo ra các chuyển cảnh video mượt mà và tự nhiên hơn với các hiệu ứng hình ảnh nổi bật. PixVerse V5.6 là mô hình tạo video lớn tự phát triển bởi Aishi Technology, cung cấp các nâng cấp toàn diện trong cả khả năng chuyển văn bản thành video và hình ảnh thành video. Mô hình cải thiện đáng kể độ rõ nét của hình ảnh, độ ổn định trong chuyển động phức tạp và đồng bộ hóa âm thanh-hình ảnh. Độ chính xác đồng bộ môi và biểu cảm cảm xúc tự nhiên được cải thiện trong các cảnh hội thoại đa nhân vật. Bố cục, ánh sáng và tính nhất quán về kết cấu cũng được tối ưu hóa, nâng cao hơn nữa chất lượng tạo tổng thể. PixVerse V5.6 xếp hạng hàng đầu toàn cầu trên bảng xếp hạng phân tích nhân tạo về chuyển văn bản thành video và hình ảnh thành video.",
"pixverse/pixverse-v5.6-r2v.description": "Nhập 2–7 hình ảnh để hợp nhất thông minh các chủ thể khác nhau trong khi duy trì phong cách thống nhất và chuyển động phối hợp, dễ dàng xây dựng các cảnh kể chuyện phong phú và nâng cao khả năng kiểm soát nội dung và tự do sáng tạo. PixVerse V5.6 là mô hình tạo video lớn tự phát triển bởi Aishi Technology, cung cấp các nâng cấp toàn diện trong cả khả năng chuyển văn bản thành video và hình ảnh thành video. Mô hình cải thiện đáng kể độ rõ nét của hình ảnh, độ ổn định trong chuyển động phức tạp và đồng bộ hóa âm thanh-hình ảnh. Độ chính xác đồng bộ môi và biểu cảm cảm xúc tự nhiên được cải thiện trong các cảnh hội thoại đa nhân vật. Bố cục, ánh sáng và tính nhất quán về kết cấu cũng được tối ưu hóa, nâng cao hơn nữa chất lượng tạo tổng thể. PixVerse V5.6 xếp hạng hàng đầu toàn cầu trên bảng xếp hạng phân tích nhân tạo về chuyển văn bản thành video và hình ảnh thành video.",
"pixverse/pixverse-v5.6-t2v.description": "Nhập mô tả văn bản để tạo video chất lượng cao với tốc độ cấp giây và căn chỉnh ngữ nghĩa chính xác, hỗ trợ nhiều phong cách. PixVerse V5.6 là mô hình tạo video lớn tự phát triển bởi Aishi Technology, cung cấp các nâng cấp toàn diện trong cả khả năng chuyển văn bản thành video và hình ảnh thành video. Mô hình cải thiện đáng kể độ rõ nét của hình ảnh, độ ổn định trong chuyển động phức tạp và đồng bộ hóa âm thanh-hình ảnh. Độ chính xác đồng bộ môi và biểu cảm cảm xúc tự nhiên được cải thiện trong các cảnh hội thoại đa nhân vật. Bố cục, ánh sáng và tính nhất quán về kết cấu cũng được tối ưu hóa, nâng cao hơn nữa chất lượng tạo tổng thể. PixVerse V5.6 xếp hạng hàng đầu toàn cầu trên bảng xếp hạng phân tích nhân tạo về chuyển văn bản thành video và hình ảnh thành video.",
"pixverse/pixverse-v6-it2v.description": "V6 là mô hình mới của PixVerse được ra mắt vào cuối tháng 3 năm 2026. Mô hình it2v (hình ảnh thành video) của nó xếp hạng thứ hai toàn cầu. Ngoài khả năng kiểm soát gợi ý của t2v (văn bản thành video), it2v có thể tái tạo chính xác màu sắc, độ bão hòa, cảnh và đặc điểm nhân vật của hình ảnh tham chiếu, mang lại cảm xúc nhân vật mạnh mẽ hơn và hiệu suất chuyển động tốc độ cao. Hỗ trợ video dài đến 15 giây, đầu ra trực tiếp âm nhạc và video, và nhiều ngôn ngữ. Lý tưởng cho các kịch bản như cận cảnh sản phẩm thương mại điện tử, quảng cáo, và mô phỏng mô hình C4D để trình bày cấu trúc sản phẩm, với đầu ra trực tiếp chỉ bằng một cú nhấp chuột.",
"pixverse/pixverse-v6-kf2v.description": "V6 là mô hình mới của PixVerse được ra mắt vào cuối tháng 3 năm 2026. Mô hình kf2v (khung hình chính thành video) của nó có thể kết nối liền mạch bất kỳ hai hình ảnh nào, tạo ra các chuyển cảnh video mượt mà và tự nhiên hơn. Hỗ trợ video dài đến 15 giây, đầu ra trực tiếp âm nhạc và video, và nhiều ngôn ngữ.",
"pixverse/pixverse-v6-t2v.description": "V6 là mô hình mới của PixVerse được ra mắt vào cuối tháng 3 năm 2026. Mô hình t2v (văn bản thành video) của nó cho phép kiểm soát chính xác hình ảnh video thông qua các gợi ý, tái tạo chính xác các kỹ thuật điện ảnh khác nhau. Các chuyển động camera như đẩy, kéo, lia, nghiêng, theo dõi và theo sát mượt mà và tự nhiên, với chuyển đổi góc nhìn chính xác và có thể kiểm soát. Hỗ trợ video dài đến 15 giây, đầu ra trực tiếp âm nhạc và video, và nhiều ngôn ngữ.",
"pro-128k.description": "Spark Pro 128K cung cấp dung lượng ngữ cảnh rất lớn, xử lý lên đến 128K ngữ cảnh, lý tưởng cho các tài liệu dài yêu cầu phân tích toàn văn và sự mạch lạc dài hạn, với logic mượt mà và hỗ trợ trích dẫn đa dạng trong các cuộc thảo luận phức tạp.",
"pro-deepseek-r1.description": "Mô hình dịch vụ chuyên dụng cho doanh nghiệp với khả năng đồng thời tích hợp.",
"pro-deepseek-v3.description": "Mô hình dịch vụ chuyên dụng cho doanh nghiệp với khả năng đồng thời tích hợp.",
"qianfan-70b.description": "Qianfan 70B là mô hình lớn tiếng Trung dành cho việc tạo nội dung chất lượng cao và lý luận phức tạp.",
"qianfan-8b.description": "Qianfan 8B là mô hình tổng quát cỡ trung, cân bằng giữa chi phí và chất lượng cho việc tạo văn bản và hỏi đáp.",
"qianfan-agent-intent-32k.description": "Qianfan Agent Intent 32K nhắm đến nhận diện ý định và điều phối tác nhân với hỗ trợ ngữ cảnh dài.",
"qianfan-agent-lite-8k.description": "Qianfan Agent Lite 8K là mô hình tác nhân nhẹ dành cho đối thoại đa lượt chi phí thấp và quy trình làm việc.",
"qianfan-check-vl.description": "Qianfan Check VL là mô hình kiểm duyệt nội dung đa phương thức cho các nhiệm vụ tuân thủ và nhận diện hình ảnh-văn bản.",
"qianfan-composition.description": "Qianfan Composition là mô hình sáng tạo đa phương thức cho việc hiểu và tạo nội dung hình ảnh-văn bản kết hợp.",
"qianfan-engcard-vl.description": "Qianfan EngCard VL là mô hình nhận diện đa phương thức tập trung vào các tình huống tiếng Anh.",
"qianfan-llama-vl-8b.description": "Qianfan Llama VL 8B là mô hình đa phương thức dựa trên Llama dành cho việc hiểu hình ảnh-văn bản tổng quát.",
"qianfan-multipicocr.description": "Qianfan MultiPicOCR là mô hình OCR đa hình ảnh dành cho việc phát hiện và nhận diện văn bản trên nhiều hình ảnh.",
"qianfan-qi-vl.description": "Qianfan QI VL là mô hình hỏi đáp đa phương thức dành cho việc truy xuất và hỏi đáp chính xác trong các tình huống hình ảnh-văn bản phức tạp.",
"qianfan-singlepicocr.description": "Qianfan SinglePicOCR là mô hình OCR một hình ảnh với khả năng nhận diện ký tự chính xác cao.",
"qianfan-vl-70b.description": "Qianfan VL 70B là mô hình VLM lớn dành cho việc hiểu hình ảnh-văn bản phức tạp.",
"qianfan-vl-8b.description": "Qianfan VL 8B là mô hình VLM nhẹ dành cho hỏi đáp và phân tích hình ảnh-văn bản hàng ngày.",
"qvq-72b-preview.description": "QVQ-72B-Preview là mô hình nghiên cứu thử nghiệm từ Qwen tập trung vào cải thiện lý luận hình ảnh.",
"qvq-max.description": "Mô hình lý luận hình ảnh Qwen QVQ hỗ trợ đầu vào hình ảnh và đầu ra chuỗi suy nghĩ, với hiệu suất mạnh mẽ hơn trong toán học, lập trình, phân tích hình ảnh, sáng tạo và các nhiệm vụ tổng quát.",
"qvq-plus.description": "Mô hình lý luận hình ảnh với đầu vào hình ảnh và đầu ra chuỗi suy nghĩ. Dòng qvq-plus theo sau qvq-max và cung cấp lý luận nhanh hơn với sự cân bằng tốt hơn giữa chất lượng và chi phí.",
"qwen-coder-plus.description": "Mô hình mã Qwen.",
"qwen-coder-turbo-latest.description": "Mô hình mã Qwen.",
"qwen-coder-turbo.description": "Mô hình mã Qwen.",
"qwen-flash.description": "Mô hình Qwen nhanh nhất và chi phí thấp nhất, lý tưởng cho các nhiệm vụ đơn giản.",
"qwen-image-2.0-pro.description": "Mô hình phiên bản đầy đủ Qwen-Image-2.0 tích hợp khả năng tạo hình ảnh và chỉnh sửa hình ảnh thành một năng lực thống nhất. Nó hỗ trợ hiển thị văn bản chuyên nghiệp hơn với khả năng hướng dẫn lên đến 1.000 token, mang lại kết cấu hình ảnh tinh tế và chân thực hơn, cho phép mô tả chi tiết các cảnh thực tế, và thể hiện sự liên kết ngữ nghĩa mạnh mẽ hơn với các gợi ý. Mô hình phiên bản đầy đủ cung cấp khả năng hiển thị văn bản mạnh mẽ nhất và mức độ chân thực cao nhất trong dòng 2.0.",
"qwen-image-2.0.description": "Mô hình phiên bản tăng tốc Qwen-Image-2.0 tích hợp khả năng tạo hình ảnh và chỉnh sửa hình ảnh thành một năng lực thống nhất. Nó hỗ trợ hiển thị văn bản chuyên nghiệp hơn với khả năng hướng dẫn lên đến 1.000 token, mang lại kết cấu hình ảnh tinh tế và chân thực hơn, cho phép mô tả chi tiết các cảnh thực tế, và thể hiện sự tuân thủ ngữ nghĩa mạnh mẽ hơn với các gợi ý. Phiên bản tăng tốc đạt được sự cân bằng tối ưu giữa chất lượng mô hình và hiệu suất.",
"qwen-image-edit-max.description": "Mô hình chỉnh sửa hình ảnh Qwen hỗ trợ đầu vào nhiều hình ảnh và đầu ra nhiều hình ảnh, cho phép chỉnh sửa văn bản trong hình ảnh chính xác, thêm, xóa hoặc di chuyển đối tượng, sửa đổi hành động của đối tượng, chuyển đổi phong cách hình ảnh và cải thiện chi tiết hình ảnh.",
"qwen-image-edit-plus.description": "Mô hình chỉnh sửa hình ảnh Qwen hỗ trợ đầu vào nhiều hình ảnh và đầu ra nhiều hình ảnh, cho phép chỉnh sửa văn bản trong hình ảnh chính xác, thêm, xóa hoặc di chuyển đối tượng, sửa đổi hành động của đối tượng, chuyển đổi phong cách hình ảnh và cải thiện chi tiết hình ảnh.",
"qwen-image-edit.description": "Qwen Image Edit là mô hình chỉnh sửa hình ảnh từ hình ảnh đầu vào và gợi ý văn bản, cho phép điều chỉnh chính xác và biến đổi sáng tạo.",
"qwen-image-max.description": "Mô hình tạo hình ảnh Qwen (dòng Max) mang lại tính chân thực và tự nhiên hình ảnh được cải thiện so với dòng Plus, giảm hiệu quả các lỗi tạo hình ảnh AI, và thể hiện hiệu suất vượt trội trong ngoại hình con người, chi tiết kết cấu và hiển thị văn bản.",
"qwen-image-plus.description": "Nó hỗ trợ nhiều phong cách nghệ thuật và đặc biệt thành thạo trong việc hiển thị văn bản phức tạp trong hình ảnh, cho phép thiết kế bố cục hình ảnh–văn bản tích hợp.",
"qwen-image.description": "Qwen-Image là mô hình tạo hình ảnh tổng quát hỗ trợ nhiều phong cách nghệ thuật và khả năng hiển thị văn bản phức tạp mạnh mẽ, đặc biệt là tiếng Trung và tiếng Anh. Nó hỗ trợ bố cục nhiều dòng, văn bản cấp đoạn và chi tiết tinh tế cho bố cục văn bản-hình ảnh phức tạp.",
"qwen-long.description": "Mô hình Qwen siêu lớn với ngữ cảnh dài và trò chuyện qua các kịch bản tài liệu dài và đa tài liệu.",
"qwen-math-plus-latest.description": "Qwen Math là mô hình ngôn ngữ chuyên giải quyết các bài toán toán học.",
"qwen-math-plus.description": "Qwen Math là mô hình ngôn ngữ chuyên giải quyết các bài toán toán học.",
"qwen-math-turbo-latest.description": "Qwen Math là mô hình ngôn ngữ chuyên giải quyết các bài toán toán học.",
"qwen-math-turbo.description": "Qwen Math là mô hình ngôn ngữ chuyên giải quyết các bài toán toán học.",
"qwen-max.description": "Mô hình Qwen siêu lớn quy mô hàng trăm tỷ hỗ trợ tiếng Trung, tiếng Anh và các ngôn ngữ khác; là mô hình API đứng sau các sản phẩm Qwen2.5 hiện tại.",
"qwen-omni-turbo.description": "Các mô hình Qwen-Omni hỗ trợ đầu vào đa phương thức (video, âm thanh, hình ảnh, văn bản) và đầu ra âm thanh và văn bản.",
"qwen-plus.description": "Mô hình Qwen siêu lớn được nâng cấp hỗ trợ tiếng Trung, tiếng Anh và các ngôn ngữ khác.",
"qwen-turbo.description": "Qwen Turbo sẽ không còn được cập nhật; thay thế bằng Qwen Flash. Mô hình Qwen siêu lớn hỗ trợ tiếng Trung, tiếng Anh và các ngôn ngữ khác.",
"qwen-vl-chat-v1.description": "Qwen VL hỗ trợ các tương tác linh hoạt bao gồm đầu vào đa hình ảnh, hỏi đáp đa lượt và các nhiệm vụ sáng tạo.",
"qwen-vl-max-latest.description": "Mô hình Qwen thị giác-ngôn ngữ siêu lớn. So với phiên bản nâng cao, nó cải thiện lý luận hình ảnh và tuân thủ hướng dẫn để có nhận thức và nhận thức mạnh mẽ hơn.",
"qwen-vl-max.description": "Mô hình Qwen thị giác-ngôn ngữ siêu lớn. So với phiên bản nâng cao, nó cải thiện lý luận hình ảnh và tuân thủ hướng dẫn để có nhận thức và nhận thức mạnh mẽ hơn.",
"qwen-vl-ocr.description": "Qwen OCR là mô hình trích xuất văn bản cho tài liệu, bảng biểu, hình ảnh bài thi và chữ viết tay. Nó hỗ trợ tiếng Trung, tiếng Anh, tiếng Pháp, tiếng Nhật, tiếng Hàn, tiếng Đức, tiếng Nga, tiếng Ý, tiếng Việt và tiếng Ả Rập.",
"qwen-vl-plus-latest.description": "Mô hình Qwen thị giác-ngôn ngữ quy mô lớn nâng cao với những cải tiến lớn về chi tiết và nhận diện văn bản, hỗ trợ độ phân giải trên một megapixel và tỷ lệ khung hình tùy ý.",
"qwen-vl-plus.description": "Mô hình Qwen thị giác-ngôn ngữ quy mô lớn nâng cao với những cải tiến lớn về chi tiết và nhận diện văn bản, hỗ trợ độ phân giải trên một megapixel và tỷ lệ khung hình tùy ý.",
"qwen-vl-v1.description": "Mô hình tiền huấn luyện được khởi tạo từ Qwen-7B với một mô-đun thị giác bổ sung và đầu vào độ phân giải hình ảnh 448.",
"qwen/qwen-2-7b-instruct.description": "Qwen2 là dòng mô hình ngôn ngữ lớn mới của Qwen. Qwen2 7B là mô hình dựa trên transformer xuất sắc trong hiểu ngôn ngữ, khả năng đa ngôn ngữ, lập trình, toán học và lý luận.",
"qwen/qwen-2-7b-instruct:free.description": "Qwen2 là dòng mô hình ngôn ngữ lớn mới với khả năng hiểu và tạo nội dung mạnh mẽ hơn.",
"qwen/qwen-2-vl-72b-instruct.description": "Qwen2-VL là phiên bản mới nhất của Qwen-VL, đạt hiệu suất hàng đầu trên các tiêu chuẩn đánh giá thị giác như MathVista, DocVQA, RealWorldQA và MTVQA. Mô hình có khả năng hiểu video dài hơn 20 phút để thực hiện hỏi đáp, đối thoại và sáng tạo nội dung chất lượng cao. Nó cũng xử lý tốt các nhiệm vụ suy luận phức tạp và ra quyết định, tích hợp với thiết bị di động và robot để hành động dựa trên ngữ cảnh hình ảnh và hướng dẫn văn bản. Ngoài tiếng Anh và tiếng Trung, mô hình còn đọc được văn bản trong hình ảnh ở nhiều ngôn ngữ khác, bao gồm hầu hết các ngôn ngữ châu Âu, tiếng Nhật, tiếng Hàn, tiếng Ả Rập và tiếng Việt.",
"qwen/qwen-2.5-72b-instruct.description": "Qwen2.5-72B-Instruct là một trong những mô hình ngôn ngữ lớn (LLM) mới nhất của Alibaba Cloud. Mô hình 72B mang lại cải tiến đáng kể trong lập trình và toán học, hỗ trợ hơn 29 ngôn ngữ (bao gồm tiếng Trung và tiếng Anh), và cải thiện rõ rệt khả năng tuân theo hướng dẫn, hiểu dữ liệu có cấu trúc và xuất dữ liệu có cấu trúc (đặc biệt là JSON).",
"qwen/qwen2.5-32b-instruct.description": "Qwen2.5-32B-Instruct là một trong những mô hình ngôn ngữ lớn (LLM) mới nhất của Alibaba Cloud. Mô hình 32B mang lại cải tiến đáng kể trong lập trình và toán học, hỗ trợ hơn 29 ngôn ngữ (bao gồm tiếng Trung và tiếng Anh), và cải thiện rõ rệt khả năng tuân theo hướng dẫn, hiểu dữ liệu có cấu trúc và xuất dữ liệu có cấu trúc (đặc biệt là JSON).",
"qwen/qwen2.5-7b-instruct.description": "Một mô hình ngôn ngữ song ngữ cho tiếng Trung và tiếng Anh, hỗ trợ ngôn ngữ, lập trình, toán học và suy luận.",
"qwen/qwen2.5-coder-32b-instruct.description": "Một mô hình LLM tiên tiến dành cho sinh mã, suy luận và sửa lỗi trên các ngôn ngữ lập trình phổ biến.",
"qwen/qwen2.5-coder-7b-instruct.description": "Một mô hình lập trình tầm trung mạnh mẽ với ngữ cảnh 32K, xuất sắc trong lập trình đa ngôn ngữ.",
"qwen/qwen3-14b.description": "Qwen3-14B là biến thể 14B dành cho các tình huống suy luận tổng quát và trò chuyện.",
"qwen/qwen3-14b:free.description": "Qwen3-14B là mô hình ngôn ngữ nhân quả với 14.8 tỷ tham số, được thiết kế cho suy luận phức tạp và trò chuyện hiệu quả. Mô hình có thể chuyển đổi giữa chế độ suy nghĩ (cho toán học, lập trình và logic) và chế độ không suy nghĩ (cho trò chuyện thông thường). Được tinh chỉnh để tuân theo hướng dẫn, sử dụng công cụ tác tử và sáng tạo nội dung bằng hơn 100 ngôn ngữ và phương ngữ. Hỗ trợ ngữ cảnh gốc 32K và mở rộng đến 131K với YaRN.",
"qwen/qwen3-235b-a22b-2507.description": "Qwen3-235B-A22B-Instruct-2507 là biến thể Instruct trong dòng Qwen3, cân bằng giữa sử dụng đa ngôn ngữ và các tình huống ngữ cảnh dài.",
"qwen/qwen3-235b-a22b-thinking-2507.description": "Qwen3-235B-A22B-Thinking-2507 là biến thể Thinking của Qwen3, được tăng cường cho các nhiệm vụ toán học và suy luận phức tạp.",
"qwen/qwen3-235b-a22b.description": "Qwen3-235B-A22B là mô hình MoE với 235 tỷ tham số từ Qwen, sử dụng 22 tỷ tham số hoạt động mỗi lần truyền. Mô hình có thể chuyển đổi giữa chế độ suy nghĩ cho suy luận phức tạp, toán học và lập trình, và chế độ không suy nghĩ cho trò chuyện hiệu quả. Cung cấp khả năng suy luận mạnh mẽ, hỗ trợ đa ngôn ngữ (hơn 100 ngôn ngữ/phương ngữ), tuân theo hướng dẫn nâng cao và sử dụng công cụ tác tử. Hỗ trợ ngữ cảnh gốc 32K và mở rộng đến 131K với YaRN.",
"qwen/qwen3-235b-a22b:free.description": "Qwen3-235B-A22B là mô hình MoE với 235 tỷ tham số từ Qwen, sử dụng 22 tỷ tham số hoạt động mỗi lần truyền. Mô hình có thể chuyển đổi giữa chế độ suy nghĩ cho suy luận phức tạp, toán học và lập trình, và chế độ không suy nghĩ cho trò chuyện hiệu quả. Cung cấp khả năng suy luận mạnh mẽ, hỗ trợ đa ngôn ngữ (hơn 100 ngôn ngữ/phương ngữ), tuân theo hướng dẫn nâng cao và sử dụng công cụ tác tử. Hỗ trợ ngữ cảnh gốc 32K và mở rộng đến 131K với YaRN.",
"qwen/qwen3-30b-a3b.description": "Qwen3 là thế hệ mô hình LLM mới nhất của Qwen với kiến trúc dày đặc và MoE, xuất sắc trong suy luận, hỗ trợ đa ngôn ngữ và các nhiệm vụ tác tử nâng cao. Khả năng chuyển đổi độc đáo giữa chế độ suy nghĩ cho suy luận phức tạp và chế độ không suy nghĩ cho trò chuyện hiệu quả đảm bảo hiệu suất linh hoạt và chất lượng cao.\n\nQwen3 vượt trội so với các mô hình trước như QwQ và Qwen2.5, mang lại hiệu suất xuất sắc trong toán học, lập trình, suy luận thông thường, sáng tạo nội dung và trò chuyện tương tác. Biến thể Qwen3-30B-A3B có 30.5 tỷ tham số (3.3B hoạt động), 48 lớp, 128 chuyên gia (8 hoạt động mỗi tác vụ), và hỗ trợ ngữ cảnh lên đến 131K với YaRN, thiết lập tiêu chuẩn mới cho các mô hình mã nguồn mở.",
"qwen/qwen3-30b-a3b:free.description": "Qwen3 là thế hệ mô hình LLM mới nhất của Qwen với kiến trúc dày đặc và MoE, xuất sắc trong suy luận, hỗ trợ đa ngôn ngữ và các nhiệm vụ tác tử nâng cao. Khả năng chuyển đổi độc đáo giữa chế độ suy nghĩ cho suy luận phức tạp và chế độ không suy nghĩ cho trò chuyện hiệu quả đảm bảo hiệu suất linh hoạt và chất lượng cao.\n\nQwen3 vượt trội so với các mô hình trước như QwQ và Qwen2.5, mang lại hiệu suất xuất sắc trong toán học, lập trình, suy luận thông thường, sáng tạo nội dung và trò chuyện tương tác. Biến thể Qwen3-30B-A3B có 30.5 tỷ tham số (3.3B hoạt động), 48 lớp, 128 chuyên gia (8 hoạt động mỗi tác vụ), và hỗ trợ ngữ cảnh lên đến 131K với YaRN, thiết lập tiêu chuẩn mới cho các mô hình mã nguồn mở.",
"qwen/qwen3-32b.description": "Qwen3-32B là mô hình ngôn ngữ nhân quả dày đặc với 32.8 tỷ tham số, được tối ưu hóa cho suy luận phức tạp và trò chuyện hiệu quả. Mô hình có thể chuyển đổi giữa chế độ suy nghĩ cho toán học, lập trình và logic, và chế độ không suy nghĩ cho trò chuyện nhanh hơn. Hiệu suất mạnh mẽ trong tuân theo hướng dẫn, sử dụng công cụ tác tử và sáng tạo nội dung bằng hơn 100 ngôn ngữ và phương ngữ. Hỗ trợ ngữ cảnh gốc 32K và mở rộng đến 131K với YaRN.",
"qwen/qwen3-32b:free.description": "Qwen3-32B là mô hình ngôn ngữ nhân quả dày đặc với 32.8 tỷ tham số, được tối ưu hóa cho suy luận phức tạp và trò chuyện hiệu quả. Mô hình có thể chuyển đổi giữa chế độ suy nghĩ cho toán học, lập trình và logic, và chế độ không suy nghĩ cho trò chuyện nhanh hơn. Hiệu suất mạnh mẽ trong tuân theo hướng dẫn, sử dụng công cụ tác tử và sáng tạo nội dung bằng hơn 100 ngôn ngữ và phương ngữ. Hỗ trợ ngữ cảnh gốc 32K và mở rộng đến 131K với YaRN.",
"qwen/qwen3-8b:free.description": "Qwen3-8B là mô hình ngôn ngữ nhân quả dày đặc với 8.2 tỷ tham số, được xây dựng cho các nhiệm vụ đòi hỏi suy luận và trò chuyện hiệu quả. Mô hình có thể chuyển đổi giữa chế độ suy nghĩ cho toán học, lập trình và logic, và chế độ không suy nghĩ cho trò chuyện thông thường. Được tinh chỉnh để tuân theo hướng dẫn, tích hợp tác tử và sáng tạo nội dung bằng hơn 100 ngôn ngữ và phương ngữ. Hỗ trợ ngữ cảnh gốc 32K và mở rộng đến 131K với YaRN.",
"qwen/qwen3-coder-plus.description": "Qwen3-Coder-Plus là mô hình tác tử lập trình thuộc dòng Qwen, được tối ưu hóa cho việc sử dụng công cụ phức tạp hơn và các phiên làm việc kéo dài.",
"qwen/qwen3-coder.description": "Qwen3-Coder là dòng mô hình sinh mã của Qwen3, mạnh mẽ trong việc hiểu và sinh mã từ tài liệu dài.",
"qwen/qwen3-max-preview.description": "Qwen3 Max (bản xem trước) là biến thể Max dành cho suy luận nâng cao và tích hợp công cụ.",
"qwen/qwen3-max.description": "Qwen3 Max là mô hình suy luận cao cấp trong dòng Qwen3, hỗ trợ suy luận đa ngôn ngữ và tích hợp công cụ.",
"qwen/qwen3-vl-plus.description": "Qwen3 VL-Plus là biến thể Qwen3 được tăng cường thị giác với lý luận đa phương thức và xử lý video được cải thiện.",
"qwen/qwen3.5-122b-a10b.description": "Qwen3.5-122B-A10B là mô hình ngôn ngữ lớn đa phương thức được phát triển bởi đội ngũ Qwen, với tổng số 122 tỷ tham số và chỉ 10 tỷ tham số hoạt động. Mô hình sử dụng kiến trúc lai hiệu quả cao kết hợp Gated Delta Networks với Sparse Mixture of Experts (MoE). Nó hỗ trợ ngữ cảnh dài 256K, có thể mở rộng lên khoảng 1 triệu token. Thông qua đào tạo hợp nhất sớm, mô hình đạt được khả năng nền tảng ngôn ngữ-hình ảnh thống nhất, hỗ trợ hiểu văn bản, hình ảnh và video. Nó mang lại hiệu suất xuất sắc trên nhiều tiêu chuẩn bao gồm kiến thức, suy luận, lập trình, tác nhân, hiểu hình ảnh và nhiệm vụ đa ngôn ngữ, vượt qua GPT-5-mini và Qwen3-235B-A22B trên một số chỉ số. Mô hình có chế độ Suy Nghĩ được bật mặc định, hỗ trợ gọi công cụ và bao phủ 201 ngôn ngữ và phương ngữ.",
"qwen/qwen3.5-27b.description": "Qwen3.5-27B là mô hình ngôn ngữ lớn đa phương thức được phát triển bởi đội ngũ Qwen với 27 tỷ tham số. Mô hình sử dụng kiến trúc lai hiệu quả cao kết hợp Gated Delta Networks với Gated Attention. Nó hỗ trợ ngữ cảnh dài 256K, có thể mở rộng lên khoảng 1 triệu token. Thông qua đào tạo hợp nhất sớm, mô hình đạt được khả năng nền tảng ngôn ngữ-hình ảnh thống nhất, hỗ trợ hiểu văn bản, hình ảnh và video. Nó mang lại hiệu suất xuất sắc trên nhiều tiêu chuẩn bao gồm suy luận, lập trình, tác nhân và hiểu hình ảnh, vượt qua Qwen3-235B-A22B và GPT-5-mini trên một số chỉ số. Mô hình có chế độ Suy Nghĩ được bật mặc định, hỗ trợ gọi công cụ và bao phủ 201 ngôn ngữ và phương ngữ.",
"qwen/qwen3.5-35b-a3b.description": "Qwen3.5-35B-A3B là mô hình ngôn ngữ lớn đa phương thức được phát triển bởi đội ngũ Qwen, với tổng số 35 tỷ tham số và chỉ 3 tỷ tham số hoạt động. Mô hình sử dụng kiến trúc lai hiệu quả cao kết hợp Gated Delta Networks với Sparse Mixture of Experts (MoE). Nó hỗ trợ ngữ cảnh dài 256K, có thể mở rộng lên khoảng 1 triệu token. Thông qua đào tạo hợp nhất sớm, mô hình đạt được khả năng nền tảng ngôn ngữ-hình ảnh thống nhất, hỗ trợ hiểu văn bản, hình ảnh và video. Nó mang lại hiệu suất xuất sắc trên nhiều tiêu chuẩn bao gồm suy luận, lập trình, tác nhân và hiểu hình ảnh. Mô hình có chế độ Suy Nghĩ được bật mặc định, hỗ trợ gọi công cụ và bao phủ 201 ngôn ngữ và phương ngữ.",
"qwen/qwen3.5-397b-a17b.description": "Qwen3.5-397B-A17B là mô hình ngôn ngữ hình ảnh mới nhất trong dòng Qwen, với kiến trúc Mixture of Experts (MoE) gồm 397 tỷ tham số và 17 tỷ tham số hoạt động. Mô hình hỗ trợ ngữ cảnh dài 256K, có thể mở rộng lên khoảng 1 triệu token. Nó hỗ trợ 201 ngôn ngữ và cung cấp khả năng hiểu ngôn ngữ-hình ảnh thống nhất, gọi công cụ và chế độ suy nghĩ suy luận.",
"qwen/qwen3.5-4b.description": "Qwen3.5-4B là mô hình ngôn ngữ lớn đa phương thức được phát triển bởi đội ngũ Qwen với 4 tỷ tham số, là mô hình Dense nhẹ nhất trong dòng Qwen3.5. Mô hình sử dụng kiến trúc lai hiệu quả cao kết hợp Gated Delta Networks với Gated Attention. Nó hỗ trợ ngữ cảnh dài 256K, có thể mở rộng lên khoảng 1 triệu token. Thông qua đào tạo hợp nhất sớm, mô hình đạt được khả năng nền tảng ngôn ngữ-hình ảnh thống nhất, hỗ trợ hiểu văn bản, hình ảnh và video. Nó mang lại hiệu suất xuất sắc trong các mô hình có kích thước tương tự, vượt qua GPT-5-Nano và Gemini-2.5-Flash-Lite trên một số chỉ số. Mô hình có chế độ Suy Nghĩ được bật mặc định, hỗ trợ gọi công cụ và bao phủ 201 ngôn ngữ và phương ngữ.",
"qwen/qwen3.5-9b.description": "Qwen3.5-9B là mô hình ngôn ngữ lớn đa phương thức được phát triển bởi đội ngũ Qwen với 9 tỷ tham số. Là mô hình Dense nhẹ trong dòng Qwen3.5, nó sử dụng kiến trúc lai hiệu quả cao kết hợp Gated Delta Networks với Gated Attention. Nó hỗ trợ ngữ cảnh dài 256K, có thể mở rộng lên khoảng 1 triệu token. Thông qua đào tạo hợp nhất sớm, mô hình đạt được khả năng nền tảng ngôn ngữ-hình ảnh thống nhất, hỗ trợ hiểu văn bản, hình ảnh và video. Mô hình có chế độ Suy Nghĩ được bật mặc định, hỗ trợ gọi công cụ và bao phủ 201 ngôn ngữ và phương ngữ.",
"qwen2.5-14b-instruct-1m.description": "Mô hình mã nguồn mở Qwen2.5 72B.",
"qwen2.5-14b-instruct.description": "Mô hình mã nguồn mở Qwen2.5 14B.",
"qwen2.5-32b-instruct.description": "Mô hình mã nguồn mở Qwen2.5 32B.",
"qwen2.5-72b-instruct.description": "Mô hình mã nguồn mở Qwen2.5 72B.",
"qwen2.5-7b-instruct.description": "Qwen2.5 7B Instruct là mô hình hướng dẫn mã nguồn mở trưởng thành dành cho trò chuyện và tạo nội dung đa kịch bản.",
"qwen2.5-coder-1.5b-instruct.description": "Mô hình mã nguồn mở Qwen mã.",
"qwen2.5-coder-14b-instruct.description": "Mô hình mã nguồn mở Qwen mã.",
"qwen2.5-coder-32b-instruct.description": "Mô hình mã nguồn mở Qwen mã.",
"qwen2.5-coder-7b-instruct.description": "Mô hình mã nguồn mở Qwen mã.",
"qwen2.5-coder-instruct.description": "Qwen2.5-Coder là mô hình tập trung vào mã mới nhất trong dòng Qwen (trước đây là CodeQwen).",
"qwen2.5-instruct.description": "Qwen2.5 là dòng mô hình ngôn ngữ lớn mới nhất của Alibaba, với các mô hình cơ bản và tinh chỉnh hướng dẫn từ 0.5B đến 72B tham số.",
"qwen2.5-math-1.5b-instruct.description": "Qwen-Math mang lại khả năng giải quyết bài toán toán học mạnh mẽ.",
"qwen2.5-math-72b-instruct.description": "Qwen-Math mang lại khả năng giải quyết bài toán toán học mạnh mẽ.",
"qwen2.5-math-7b-instruct.description": "Qwen-Math mang lại khả năng giải quyết bài toán toán học mạnh mẽ.",
"qwen2.5-omni-7b.description": "Các mô hình Qwen-Omni hỗ trợ đầu vào đa phương thức (video, âm thanh, hình ảnh, văn bản) và đầu ra âm thanh và văn bản.",
"qwen2.5-vl-32b-instruct.description": "Qwen2.5 VL 32B Instruct là mô hình đa phương thức mã nguồn mở phù hợp cho triển khai riêng tư và sử dụng đa kịch bản.",
"qwen2.5-vl-72b-instruct.description": "Cải thiện tuân thủ hướng dẫn, toán học, giải quyết vấn đề và lập trình, với khả năng nhận diện đối tượng tổng quát mạnh mẽ hơn. Hỗ trợ định vị chính xác các yếu tố thị giác trên nhiều định dạng, hiểu video dài (lên đến 10 phút) với thời gian sự kiện cấp giây, sắp xếp theo thời gian và hiểu tốc độ, và các tác nhân có thể điều khiển hệ điều hành hoặc di động thông qua phân tích và định vị. Khai thác thông tin chính mạnh mẽ và đầu ra JSON. Đây là phiên bản 72B, mạnh nhất trong dòng.",
"qwen2.5-vl-7b-instruct.description": "Qwen2.5 VL 7B Instruct là mô hình đa phương thức nhẹ cân bằng chi phí triển khai và khả năng nhận diện.",
"qwen2.5-vl-instruct.description": "Qwen2.5-VL là mô hình thị giác-ngôn ngữ mới nhất trong dòng Qwen.",
"qwen2.5.description": "Qwen2.5 là mô hình ngôn ngữ lớn thế hệ tiếp theo của Alibaba với hiệu suất mạnh mẽ trên nhiều trường hợp sử dụng đa dạng.",
"qwen2.5:0.5b.description": "Qwen2.5 là mô hình ngôn ngữ lớn thế hệ tiếp theo của Alibaba với hiệu suất mạnh mẽ trên nhiều trường hợp sử dụng đa dạng.",
"qwen2.5:1.5b.description": "Qwen2.5 là mô hình ngôn ngữ lớn thế hệ tiếp theo của Alibaba với hiệu suất mạnh mẽ trên nhiều trường hợp sử dụng đa dạng.",
"qwen2.5:72b.description": "Qwen2.5 là mô hình ngôn ngữ lớn thế hệ tiếp theo của Alibaba với hiệu suất mạnh mẽ trên nhiều trường hợp sử dụng đa dạng.",
"qwen2.description": "Qwen2 là mô hình ngôn ngữ lớn thế hệ tiếp theo của Alibaba với hiệu suất mạnh mẽ trên nhiều trường hợp sử dụng đa dạng.",
"qwen2:0.5b.description": "Qwen2 là mô hình ngôn ngữ lớn thế hệ tiếp theo của Alibaba với hiệu suất mạnh mẽ trên nhiều trường hợp sử dụng đa dạng.",
"qwen2:1.5b.description": "Qwen2 là mô hình ngôn ngữ lớn thế hệ tiếp theo của Alibaba với hiệu suất mạnh mẽ trên nhiều trường hợp sử dụng đa dạng.",
"qwen2:72b.description": "Qwen2 là mô hình ngôn ngữ lớn thế hệ tiếp theo của Alibaba với hiệu suất mạnh mẽ trên nhiều trường hợp sử dụng đa dạng.",
"qwen3-0.6b.description": "Qwen3 0.6B là mô hình cấp đầu vào dành cho lý luận đơn giản và các môi trường rất hạn chế.",
"qwen3-1.7b.description": "Qwen3 1.7B là mô hình siêu nhẹ dành cho triển khai trên thiết bị và biên.",
"qwen3-14b.description": "Qwen3 14B là mô hình cỡ trung dành cho hỏi đáp đa ngôn ngữ và tạo văn bản.",
"qwen3-235b-a22b-instruct-2507.description": "Qwen3 235B A22B Instruct 2507 là mô hình hướng dẫn hàng đầu dành cho nhiều nhiệm vụ tạo nội dung và lý luận.",
"qwen3-235b-a22b-thinking-2507.description": "Qwen3 235B A22B Thinking 2507 là mô hình tư duy siêu lớn dành cho lý luận khó.",
"qwen3-235b-a22b.description": "Qwen3 là mô hình Tongyi Qwen thế hệ tiếp theo với những cải tiến lớn trong lý luận, khả năng tổng quát, khả năng tác nhân và hiệu suất đa ngôn ngữ, và hỗ trợ chuyển đổi chế độ tư duy.",
"qwen3-30b-a3b-instruct-2507.description": "Qwen3 30B A3B Instruct 2507 là mô hình hướng dẫn cỡ trung-lớn dành cho tạo nội dung và hỏi đáp chất lượng cao.",
"qwen3-30b-a3b-thinking-2507.description": "Qwen3 30B A3B Thinking 2507 là mô hình tư duy cỡ trung-lớn cân bằng giữa độ chính xác và chi phí.",
"qwen3-30b-a3b.description": "Qwen3 30B A3B là mô hình tổng quát cỡ trung-lớn cân bằng giữa chi phí và chất lượng.",
"qwen3-32b.description": "Qwen3 32B phù hợp cho các nhiệm vụ tổng quát yêu cầu hiểu biết mạnh mẽ hơn.",
"qwen3-4b.description": "Qwen3 4B phù hợp cho các ứng dụng nhỏ đến trung bình và suy luận cục bộ.",
"qwen3-8b.description": "Qwen3 8B là mô hình nhẹ với triển khai linh hoạt cho khối lượng công việc đồng thời cao.",
"qwen3-coder-30b-a3b-instruct.description": "Mô hình mã nguồn mở Qwen mã. Mô hình qwen3-coder-30b-a3b-instruct mới nhất dựa trên Qwen3 và mang lại khả năng tác nhân lập trình mạnh mẽ, sử dụng công cụ và tương tác môi trường cho lập trình tự động, với hiệu suất mã xuất sắc và khả năng tổng quát vững chắc.",
"qwen3-coder-480b-a35b-instruct.description": "Qwen3 Coder 480B A35B Instruct là mô hình mã hàng đầu dành cho lập trình đa ngôn ngữ và hiểu mã phức tạp.",
"qwen3-coder-flash.description": "Mô hình mã Qwen. Dòng Qwen3-Coder mới nhất dựa trên Qwen3 và mang lại khả năng tác nhân lập trình mạnh mẽ, sử dụng công cụ và tương tác môi trường cho lập trình tự động, với hiệu suất mã xuất sắc và khả năng tổng quát vững chắc.",
"qwen3-coder-next.description": "Mã hóa Qwen thế hệ tiếp theo được tối ưu hóa cho việc tạo mã phức tạp nhiều tệp, gỡ lỗi và quy trình làm việc tác nhân thông lượng cao. Được thiết kế để tích hợp công cụ mạnh mẽ và cải thiện hiệu suất suy luận.",
"qwen3-coder-plus.description": "Mô hình mã Qwen. Dòng Qwen3-Coder mới nhất dựa trên Qwen3 và mang lại khả năng tác nhân lập trình mạnh mẽ, sử dụng công cụ và tương tác môi trường cho lập trình tự động, với hiệu suất mã xuất sắc và khả năng tổng quát vững chắc.",
"qwen3-coder:480b.description": "Mô hình hiệu suất cao của Alibaba dành cho các nhiệm vụ tác nhân và lập trình với ngữ cảnh dài.",
"qwen3-max-2026-01-23.description": "Qwen3 Max: Mô hình Qwen có hiệu suất tốt nhất cho các nhiệm vụ lập trình phức tạp, nhiều bước với hỗ trợ tư duy.",
"qwen3-max-preview.description": "Mô hình Qwen hiệu suất cao nhất cho các nhiệm vụ phức tạp, nhiều bước. Phiên bản xem trước hỗ trợ khả năng tư duy.",
"qwen3-max.description": "Các mô hình Qwen3 Max mang lại cải tiến lớn so với dòng 2.5 về năng lực tổng thể, hiểu tiếng Trung/Anh, tuân thủ hướng dẫn phức tạp, xử lý nhiệm vụ mở mang tính chủ quan, khả năng đa ngôn ngữ và sử dụng công cụ, với ít ảo giác hơn. Phiên bản qwen3-max mới nhất cải thiện lập trình tác tử và sử dụng công cụ so với qwen3-max-preview. Bản phát hành này đạt chuẩn SOTA thực tế và nhắm đến các nhu cầu tác tử phức tạp hơn.",
"qwen3-next-80b-a3b-instruct.description": "Mô hình mã nguồn mở Qwen3 thế hệ tiếp theo không hỗ trợ tư duy. So với phiên bản trước (Qwen3-235B-A22B-Instruct-2507), nó có khả năng hiểu tiếng Trung tốt hơn, lý luận logic mạnh hơn và cải thiện khả năng sinh văn bản.",
"qwen3-next-80b-a3b-thinking.description": "Qwen3 Next 80B A3B Thinking là phiên bản mô hình tư duy hàng đầu dành cho các nhiệm vụ phức tạp.",
"qwen3-omni-flash.description": "Qwen3-Omni-Flash là một mô hình lớn đa phương thức được xây dựng trên kiến trúc Thinker–Talker Mixture-of-Experts (MoE). Nó hỗ trợ hiểu hiệu quả qua văn bản, hình ảnh, âm thanh và video, cùng với khả năng tạo giọng nói. Mô hình cho phép tương tác dựa trên văn bản bằng 119 ngôn ngữ và tương tác giọng nói bằng 20 ngôn ngữ, tạo ra giọng nói giống con người để giao tiếp chính xác giữa các ngôn ngữ. Nó có khả năng tuân theo hướng dẫn mạnh mẽ và hỗ trợ tùy chỉnh lời nhắc hệ thống, cho phép thích nghi linh hoạt với các phong cách hội thoại và cài đặt vai trò khác nhau. Nó được áp dụng rộng rãi trong các tình huống như tạo văn bản, trợ lý giọng nói và phân tích đa phương tiện, mang lại trải nghiệm tương tác đa phương thức tự nhiên và liền mạch.",
"qwen3-vl-235b-a22b-instruct.description": "Qwen3 VL 235B A22B Instruct là mô hình đa phương thức hàng đầu dành cho các nhiệm vụ hiểu và sáng tạo đòi hỏi cao.",
"qwen3-vl-235b-a22b-thinking.description": "Qwen3 VL 235B A22B Thinking là phiên bản tư duy hàng đầu cho lập luận và lập kế hoạch đa phương thức phức tạp.",
"qwen3-vl-30b-a3b-instruct.description": "Qwen3 VL 30B A3B Instruct là mô hình đa phương thức lớn cân bằng giữa độ chính xác và hiệu suất lập luận.",
"qwen3-vl-30b-a3b-thinking.description": "Qwen3 VL 30B A3B Thinking là phiên bản tư duy sâu cho các nhiệm vụ đa phương thức phức tạp.",
"qwen3-vl-32b-instruct.description": "Qwen3 VL 32B Instruct là mô hình điều chỉnh theo hướng dẫn đa phương thức cho hỏi đáp hình ảnh-văn bản và sáng tạo chất lượng cao.",
"qwen3-vl-32b-thinking.description": "Qwen3 VL 32B Thinking là phiên bản tư duy sâu đa phương thức cho lập luận phức tạp và phân tích chuỗi dài.",
"qwen3-vl-8b-instruct.description": "Qwen3 VL 8B Instruct là mô hình đa phương thức nhẹ cho hỏi đáp hình ảnh hàng ngày và tích hợp ứng dụng.",
"qwen3-vl-8b-thinking.description": "Qwen3 VL 8B Thinking là mô hình chuỗi tư duy đa phương thức cho lập luận hình ảnh chi tiết.",
"qwen3-vl-flash.description": "Qwen3 VL Flash: phiên bản lập luận nhẹ, tốc độ cao cho các yêu cầu nhạy cảm với độ trễ hoặc khối lượng lớn.",
"qwen3-vl-plus.description": "Qwen VL là mô hình sinh văn bản với khả năng hiểu hình ảnh. Nó có thể thực hiện OCR, tóm tắt và lập luận, chẳng hạn như trích xuất thuộc tính từ ảnh sản phẩm hoặc giải quyết vấn đề từ hình ảnh.",
"qwen3.5-122b-a10b.description": "Hỗ trợ đầu vào văn bản, hình ảnh và video. Đối với các nhiệm vụ chỉ văn bản, hiệu suất của nó tương đương với Qwen3 Max, mang lại hiệu quả cao hơn và chi phí thấp hơn. Trong các khả năng đa phương thức, nó mang lại những cải tiến đáng kể so với dòng Qwen3 VL.",
"qwen3.5-27b.description": "Hỗ trợ đầu vào văn bản, hình ảnh và video. Đối với các nhiệm vụ chỉ văn bản, hiệu suất của nó tương đương với Qwen3 Max, mang lại hiệu quả cao hơn và chi phí thấp hơn. Trong các khả năng đa phương thức, nó mang lại những cải tiến đáng kể so với dòng Qwen3 VL.",
"qwen3.5-35b-a3b.description": "Hỗ trợ đầu vào văn bản, hình ảnh và video. Đối với các nhiệm vụ chỉ văn bản, hiệu suất của nó tương đương với Qwen3 Max, mang lại hiệu quả cao hơn và chi phí thấp hơn. Trong các khả năng đa phương thức, nó mang lại những cải tiến đáng kể so với dòng Qwen3 VL.",
"qwen3.5-397b-a17b.description": "Hỗ trợ đầu vào văn bản, hình ảnh và video. Đối với các nhiệm vụ chỉ văn bản, hiệu suất của nó tương đương với Qwen3 Max, mang lại hiệu quả cao hơn và chi phí thấp hơn. Trong khả năng đa phương thức, nó mang lại cải tiến đáng kể so với dòng Qwen3 VL.",
"qwen3.5-flash.description": "Mô hình Qwen nhanh nhất và chi phí thấp nhất, lý tưởng cho các nhiệm vụ đơn giản.",
"qwen3.5-omni-flash.description": "Qwen3.5 Omni Flash là một mô hình Qwen toàn phương thức nhanh, tiết kiệm chi phí, hỗ trợ đầu vào văn bản, hình ảnh và video.",
"qwen3.5-omni-plus.description": "Qwen3.5 Omni Plus hỗ trợ đầu vào văn bản, hình ảnh và video. Đây là mô hình Qwen toàn phương thức mới nhất dành cho hiểu và tạo đa phương thức chất lượng cao.",
"qwen3.5-plus.description": "Qwen3.5 Plus hỗ trợ đầu vào văn bản, hình ảnh và video. Hiệu suất của nó trên các nhiệm vụ văn bản thuần tương đương với Qwen3 Max, với hiệu suất tốt hơn và chi phí thấp hơn. Khả năng đa phương thức của nó được cải thiện đáng kể so với dòng Qwen3 VL.",
"qwen3.5:397b.description": "Qwen3.5 là mô hình nền tảng kết hợp thị giác-ngôn ngữ với kiến trúc lai (Mixture-of-Experts + linear attention), mang lại khả năng suy luận đa phương thức mạnh mẽ, mã hóa và khả năng ngữ cảnh dài với cửa sổ ngữ cảnh 256K.",
"qwen3.description": "Qwen3 là mô hình ngôn ngữ lớn thế hệ tiếp theo của Alibaba với hiệu suất mạnh mẽ trên nhiều trường hợp sử dụng khác nhau.",
"qwq-32b-preview.description": "QwQ là mô hình nghiên cứu thử nghiệm từ Qwen tập trung vào cải thiện khả năng lập luận.",
"qwq-32b.description": "QwQ là mô hình lập luận trong họ Qwen. So với các mô hình điều chỉnh theo hướng dẫn tiêu chuẩn, nó mang lại khả năng tư duy và lập luận giúp cải thiện đáng kể hiệu suất các tác vụ phía sau, đặc biệt là các vấn đề phức tạp. QwQ-32B là mô hình lập luận tầm trung có thể cạnh tranh với các mô hình hàng đầu như DeepSeek-R1 và o1-mini.",
"qwq-plus.description": "Mô hình lập luận QwQ được huấn luyện trên Qwen2.5 sử dụng học tăng cường (RL) để cải thiện đáng kể khả năng lập luận. Các chỉ số cốt lõi trong toán/mã (AIME 24/25, LiveCodeBench) và một số chuẩn đánh giá tổng quát (IFEval, LiveBench) đạt mức DeepSeek-R1 đầy đủ.",
"qwq.description": "QwQ là mô hình lập luận trong họ Qwen. So với các mô hình điều chỉnh theo hướng dẫn tiêu chuẩn, nó mang lại khả năng tư duy và lập luận giúp cải thiện đáng kể hiệu suất các tác vụ phía sau, đặc biệt là các vấn đề khó. QwQ-32B là mô hình lập luận tầm trung có thể cạnh tranh với các mô hình hàng đầu như DeepSeek-R1 và o1-mini.",
"qwq_32b.description": "Mô hình lập luận tầm trung trong họ Qwen. So với các mô hình điều chỉnh theo hướng dẫn tiêu chuẩn, khả năng tư duy và lập luận của QwQ giúp cải thiện đáng kể hiệu suất các tác vụ phía sau, đặc biệt là các vấn đề khó.",
"r1-1776.description": "R1-1776 là biến thể hậu huấn luyện của DeepSeek R1 được thiết kế để cung cấp thông tin thực tế không kiểm duyệt, không thiên lệch.",
"seedance-1-5-pro-251215.description": "Seedance 1.5 Pro của ByteDance hỗ trợ chuyển văn bản thành video, chuyển hình ảnh thành video (khung hình đầu tiên, khung hình đầu tiên + cuối cùng) và tạo âm thanh đồng bộ với hình ảnh.",
"seedream-5-0-260128.description": "ByteDance-Seedream-5.0-lite của BytePlus tích hợp khả năng tạo sinh tăng cường truy xuất web để cung cấp thông tin theo thời gian thực, nâng cao khả năng diễn giải các prompt phức tạp và cải thiện tính nhất quán của tài liệu tham chiếu cho hoạt động sáng tạo hình ảnh chuyên nghiệp.",
"solar-mini-ja.description": "Solar Mini (Ja) mở rộng Solar Mini với trọng tâm vào tiếng Nhật trong khi vẫn duy trì hiệu suất mạnh mẽ và hiệu quả với tiếng Anh và tiếng Hàn.",
"solar-mini.description": "Solar Mini là mô hình ngôn ngữ nhỏ gọn vượt trội hơn GPT-3.5, với khả năng đa ngôn ngữ mạnh mẽ hỗ trợ tiếng Anh và tiếng Hàn, mang lại giải pháp hiệu quả với dung lượng nhỏ.",
"solar-pro.description": "Solar Pro là mô hình ngôn ngữ thông minh cao từ Upstage, tập trung vào tuân thủ hướng dẫn trên một GPU duy nhất, với điểm IFEval trên 80. Hiện hỗ trợ tiếng Anh; bản phát hành đầy đủ dự kiến vào tháng 11 năm 2024 với hỗ trợ ngôn ngữ mở rộng và ngữ cảnh dài hơn.",
"sonar-deep-research.description": "Deep Research thực hiện nghiên cứu chuyên sâu cấp chuyên gia và tổng hợp thành các báo cáo dễ tiếp cận và có thể hành động.",
"sonar-pro.description": "Sản phẩm tìm kiếm nâng cao với khả năng liên kết tìm kiếm cho các truy vấn phức tạp và truy vấn tiếp theo.",
"sonar-reasoning-pro.description": "Sản phẩm tìm kiếm nâng cao với khả năng liên kết tìm kiếm cho các truy vấn phức tạp và truy vấn tiếp theo.",
"sonar-reasoning.description": "Sản phẩm tìm kiếm nâng cao với khả năng liên kết tìm kiếm cho các truy vấn phức tạp và truy vấn tiếp theo.",
"sonar.description": "Sản phẩm tìm kiếm nhẹ, nhanh hơn và rẻ hơn Sonar Pro.",
"sophnet/deepseek-v3.2.description": "DeepSeek V3.2 là mô hình cân bằng giữa hiệu quả tính toán cao và hiệu suất suy luận và tác nhân xuất sắc.",
"sora-2-pro.description": "Sora 2 Pro là mô hình tạo phương tiện tiên tiến nhất của chúng tôi, tạo video với âm thanh đồng bộ. Nó có thể tạo các đoạn clip động, chi tiết phong phú từ ngôn ngữ tự nhiên hoặc hình ảnh.",
"sora-2.description": "Sora 2 là mô hình tạo phương tiện mạnh mẽ mới của chúng tôi, tạo video với âm thanh đồng bộ. Nó có thể tạo các đoạn clip động, chi tiết phong phú từ ngôn ngữ tự nhiên hoặc hình ảnh.",
"spark-x.description": "Tổng quan về khả năng X2: 1. Giới thiệu điều chỉnh động chế độ suy luận, được kiểm soát thông qua trường `thinking`. 2. Mở rộng độ dài ngữ cảnh: 64K token đầu vào và 128K token đầu ra. 3. Hỗ trợ chức năng Function Call.",
"stable-diffusion-3-medium.description": "Mô hình chuyển văn bản thành hình ảnh mới nhất từ Stability AI. Phiên bản này cải thiện đáng kể chất lượng hình ảnh, hiểu văn bản và đa dạng phong cách, diễn giải chính xác hơn các yêu cầu ngôn ngữ tự nhiên phức tạp và tạo ra hình ảnh chính xác, đa dạng hơn.",
"stable-diffusion-3.5-large-turbo.description": "Stable Diffusion 3.5 Large Turbo tập trung vào tạo hình ảnh chất lượng cao với khả năng dựng chi tiết và độ trung thực cảnh mạnh mẽ.",
"stable-diffusion-xl-base-1.0.description": "Mô hình chuyển văn bản thành hình ảnh mã nguồn mở từ Stability AI với khả năng sáng tạo hình ảnh hàng đầu ngành. Nó có khả năng hiểu hướng dẫn mạnh mẽ và hỗ trợ định nghĩa ngược yêu cầu để tạo hình ảnh chính xác.",
"step-1-128k.description": "Cân bằng giữa hiệu suất và chi phí cho các kịch bản tổng quát.",
"step-1-256k.description": "Xử lý ngữ cảnh siêu dài, lý tưởng cho phân tích tài liệu dài.",
"step-1-32k.description": "Hỗ trợ các cuộc hội thoại trung bình cho nhiều kịch bản.",
"step-1-8k.description": "Mô hình nhỏ phù hợp cho các nhiệm vụ nhẹ.",
"step-1-flash.description": "Mô hình tốc độ cao phù hợp cho trò chuyện thời gian thực.",
"step-1.5v-mini.description": "Khả năng hiểu video mạnh mẽ.",
"step-1o-turbo-vision.description": "Khả năng hiểu hình ảnh mạnh mẽ, vượt trội hơn 1o trong toán học và lập trình. Nhỏ hơn 1o với đầu ra nhanh hơn.",
"step-1o-vision-32k.description": "Khả năng hiểu hình ảnh mạnh mẽ với hiệu suất thị giác tốt hơn so với dòng Step-1V.",
"step-1v-32k.description": "Hỗ trợ đầu vào thị giác cho tương tác đa phương thức phong phú hơn.",
"step-1v-8k.description": "Mô hình thị giác nhỏ dành cho các nhiệm vụ cơ bản về hình ảnh và văn bản.",
"step-1x-edit.description": "Mô hình này tập trung vào chỉnh sửa hình ảnh, sửa đổi và nâng cao hình ảnh dựa trên hình ảnh và văn bản do người dùng cung cấp. Nó hỗ trợ nhiều định dạng đầu vào, bao gồm mô tả văn bản và hình ảnh mẫu, và tạo ra các chỉnh sửa phù hợp với ý định của người dùng.",
"step-1x-medium.description": "Mô hình này cung cấp khả năng tạo hình ảnh mạnh mẽ với đầu vào gợi ý văn bản. Với hỗ trợ tiếng Trung bản địa, nó hiểu tốt hơn các mô tả tiếng Trung, nắm bắt ngữ nghĩa của chúng và chuyển đổi thành các đặc điểm hình ảnh để tạo ra hình ảnh chính xác hơn. Nó tạo ra hình ảnh độ phân giải cao, chất lượng cao và hỗ trợ một mức độ chuyển đổi phong cách.",
"step-2-16k-exp.description": "Bản dựng thử nghiệm Step-2 với các tính năng mới nhất và cập nhật liên tục. Không khuyến nghị sử dụng trong sản xuất.",
"step-2-16k.description": "Hỗ trợ tương tác ngữ cảnh lớn cho các cuộc hội thoại phức tạp.",
"step-2-mini.description": "Được xây dựng trên kiến trúc MFA thế hệ tiếp theo trong nhà, cung cấp kết quả tương tự như Step-1 với chi phí thấp hơn nhiều trong khi đạt được thông lượng cao hơn và độ trễ nhanh hơn. Xử lý các nhiệm vụ tổng quát với khả năng lập trình mạnh mẽ.",
"step-2x-large.description": "Mô hình hình ảnh StepFun thế hệ mới tập trung vào tạo hình ảnh, tạo ra hình ảnh chất lượng cao từ các gợi ý văn bản. Nó mang lại kết cấu thực tế hơn và khả năng hiển thị văn bản tiếng Trung/tiếng Anh mạnh mẽ hơn.",
"step-3.5-flash.description": "Mô hình suy luận ngôn ngữ hàng đầu của Stepfun. Mô hình này có khả năng suy luận xuất sắc và khả năng thực thi nhanh chóng, đáng tin cậy. Có thể phân tích và lập kế hoạch các nhiệm vụ phức tạp, gọi công cụ nhanh chóng và đáng tin cậy để thực hiện nhiệm vụ, và đủ khả năng cho các nhiệm vụ phức tạp như suy luận logic, toán học, kỹ thuật phần mềm và nghiên cứu chuyên sâu.",
"step-3.description": "Mô hình này có khả năng nhận thức thị giác mạnh mẽ và lý luận phức tạp, xử lý chính xác việc hiểu biết kiến thức đa lĩnh vực, phân tích chéo toán học-thị giác và một loạt các nhiệm vụ phân tích thị giác hàng ngày.",
"step-r1-v-mini.description": "Mô hình lý luận với khả năng hiểu hình ảnh mạnh mẽ có thể xử lý hình ảnh và văn bản, sau đó tạo văn bản sau khi lý luận sâu. Nó xuất sắc trong lý luận thị giác và mang lại khả năng toán học, lập trình và lý luận văn bản hàng đầu, với cửa sổ ngữ cảnh 100K.",
"stepfun-ai/step3.description": "Step3 là mô hình lý luận đa phương thức tiên tiến từ StepFun, được xây dựng trên kiến trúc MoE với 321 tỷ tham số tổng cộng và 38 tỷ tham số hoạt động. Thiết kế đầu-cuối của nó giảm thiểu chi phí giải mã trong khi mang lại lý luận ngôn ngữ-hình ảnh hàng đầu. Với thiết kế MFA và AFD, nó duy trì hiệu quả trên cả bộ tăng tốc hàng đầu và cấp thấp. Huấn luyện trước sử dụng hơn 20 nghìn tỷ token văn bản và 4 nghìn tỷ token hình ảnh-văn bản trên nhiều ngôn ngữ. Nó đạt hiệu suất hàng đầu trong các tiêu chuẩn toán học, mã và đa phương thức mã nguồn mở.",
"taichu4_vl_2b_nothinking.description": "Phiên bản không suy nghĩ của mô hình Taichu4.0-VL 2B có mức sử dụng bộ nhớ thấp hơn, thiết kế nhẹ, tốc độ phản hồi nhanh và khả năng hiểu đa phương thức mạnh mẽ.",
"taichu4_vl_32b.description": "Phiên bản suy nghĩ của mô hình Taichu4.0-VL 32B phù hợp cho các nhiệm vụ hiểu và suy luận đa phương thức phức tạp, thể hiện hiệu suất vượt trội trong suy luận toán học đa phương thức, khả năng tác nhân đa phương thức và hiểu hình ảnh và thị giác tổng quát.",
"taichu4_vl_32b_nothinking.description": "Phiên bản không suy nghĩ của mô hình Taichu4.0-VL 32B được thiết kế cho các tình huống hiểu hình ảnh và văn bản phức tạp và hỏi đáp kiến thức thị giác, xuất sắc trong chú thích hình ảnh, trả lời câu hỏi thị giác, hiểu video và nhiệm vụ định vị thị giác.",
"taichu4_vl_3b.description": "Phiên bản suy nghĩ của mô hình Taichu4.0-VL 3B thực hiện hiệu quả các nhiệm vụ hiểu và suy luận đa phương thức, với các nâng cấp toàn diện về hiểu thị giác, định vị thị giác, nhận diện OCR và các khả năng liên quan.",
"taichu_llm.description": "Mô hình ngôn ngữ lớn Zidong Taichu là mô hình tạo văn bản hiệu suất cao được phát triển bằng công nghệ toàn bộ nội địa. Thông qua nén cấu trúc của mô hình cơ sở hàng trăm tỷ tham số và tối ưu hóa theo nhiệm vụ, nó cải thiện đáng kể khả năng hiểu văn bản phức tạp và suy luận kiến thức. Nó xuất sắc trong các tình huống như phân tích tài liệu dài, trích xuất thông tin đa ngôn ngữ và tạo văn bản bị ràng buộc bởi kiến thức.",
"taichu_llm_14b.description": "Mô hình ngôn ngữ lớn Zidong Taichu là mô hình tạo văn bản hiệu suất cao được phát triển bằng công nghệ toàn bộ nội địa. Thông qua nén cấu trúc của mô hình cơ sở hàng trăm tỷ tham số và tối ưu hóa theo nhiệm vụ, nó cải thiện đáng kể khả năng hiểu văn bản phức tạp và suy luận kiến thức. Nó xuất sắc trong các tình huống như phân tích tài liệu dài, trích xuất thông tin đa ngôn ngữ và tạo văn bản bị ràng buộc bởi kiến thức.",
"taichu_llm_2b.description": "Mô hình ngôn ngữ lớn Zidong Taichu là mô hình tạo văn bản hiệu suất cao được phát triển bằng công nghệ toàn bộ nội địa. Thông qua nén cấu trúc của mô hình cơ sở hàng trăm tỷ tham số và tối ưu hóa theo nhiệm vụ, nó cải thiện đáng kể khả năng hiểu văn bản phức tạp và suy luận kiến thức. Nó xuất sắc trong các tình huống như phân tích tài liệu dài, trích xuất thông tin đa ngôn ngữ và tạo văn bản bị ràng buộc bởi kiến thức.",
"taichu_o1.description": "taichu_o1 là mô hình lớn suy luận thế hệ tiếp theo đạt được chuỗi suy nghĩ giống con người thông qua tương tác đa phương thức và học tăng cường. Nó hỗ trợ mô phỏng ra quyết định phức tạp và, trong khi duy trì đầu ra chính xác cao, tiết lộ các con đường suy luận có thể giải thích. Nó phù hợp cho phân tích chiến lược, suy nghĩ sâu và các tình huống tương tự.",
"tencent/Hunyuan-A13B-Instruct.description": "Hunyuan-A13B-Instruct sử dụng tổng số 80B tham số với 13B tham số hoạt động để sánh ngang với các mô hình lớn hơn. Nó hỗ trợ lý luận lai nhanh/chậm, hiểu văn bản dài ổn định và khả năng tác nhân hàng đầu trên BFCL-v3 và τ-Bench. GQA và các định dạng đa lượng tử cho phép suy luận hiệu quả.",
"tencent/Hunyuan-MT-7B.description": "Mô hình Dịch Hunyuan bao gồm Hunyuan-MT-7B và Hunyuan-MT-Chimera. Hunyuan-MT-7B là mô hình dịch nhẹ 7B hỗ trợ 33 ngôn ngữ cùng 5 ngôn ngữ dân tộc thiểu số Trung Quốc. Trong WMT25, nó đạt 30 giải nhất trên 31 cặp ngôn ngữ. Tencent Hunyuan sử dụng quy trình huấn luyện đầy đủ từ tiền huấn luyện đến SFT đến học tăng cường dịch và học tăng cường tổ hợp, đạt hiệu suất hàng đầu ở kích thước của nó với triển khai hiệu quả, dễ dàng.",
"text-embedding-3-large.description": "Mô hình nhúng mạnh mẽ nhất cho các nhiệm vụ tiếng Anh và không phải tiếng Anh.",
"text-embedding-3-small.description": "Mô hình nhúng thế hệ tiếp theo hiệu quả, tiết kiệm chi phí cho các kịch bản truy xuất và RAG.",
"thudm/glm-4-32b.description": "GLM-4-32B-0414 là mô hình mở 32B song ngữ (Trung/Anh) được tối ưu hóa cho tạo mã, gọi hàm và các nhiệm vụ tác nhân. Nó được tiền huấn luyện trên 15T dữ liệu chất lượng cao và nặng về lý luận và được tinh chỉnh thêm với căn chỉnh ưu tiên con người, lấy mẫu từ chối và học tăng cường. Nó xuất sắc trong lý luận phức tạp, tạo tác phẩm và đầu ra có cấu trúc, đạt hiệu suất GPT-4o và DeepSeek-V3-0324 trên nhiều tiêu chuẩn.",
"thudm/glm-4-32b:free.description": "GLM-4-32B-0414 là mô hình mở 32B song ngữ (Trung/Anh) được tối ưu hóa cho tạo mã, gọi hàm và các nhiệm vụ tác nhân. Nó được tiền huấn luyện trên 15T dữ liệu chất lượng cao và nặng về lý luận và được tinh chỉnh thêm với căn chỉnh ưu tiên con người, lấy mẫu từ chối và học tăng cường. Nó xuất sắc trong lý luận phức tạp, tạo tác phẩm và đầu ra có cấu trúc, đạt hiệu suất GPT-4o và DeepSeek-V3-0324 trên nhiều tiêu chuẩn.",
"thudm/glm-4-9b-chat.description": "Phiên bản mã nguồn mở của mô hình tiền huấn luyện GLM-4 mới nhất của Zhipu AI.",
"thudm/glm-z1-32b.description": "GLM-Z1-32B-0414 là phiên bản nâng cao khả năng suy luận của GLM-4-32B, được thiết kế để giải quyết các bài toán phức tạp về toán học, logic và lập trình. Mô hình này áp dụng học tăng cường mở rộng (RL) với ưu tiên cặp nhiệm vụ cụ thể và tổng quát để cải thiện các tác vụ nhiều bước phức tạp. So với GLM-4-32B, Z1 cải thiện đáng kể khả năng suy luận có cấu trúc và năng lực trong các lĩnh vực hình thức.\n\nMô hình hỗ trợ việc áp dụng các bước “tư duy” thông qua kỹ thuật nhắc lệnh, cải thiện tính mạch lạc cho các đầu ra dài, và được tối ưu hóa cho quy trình làm việc của tác nhân với ngữ cảnh dài (qua YaRN), gọi công cụ JSON, và lấy mẫu chi tiết để đảm bảo suy luận ổn định. Lý tưởng cho các trường hợp sử dụng yêu cầu suy luận nhiều bước hoặc diễn giải hình thức cẩn thận.",
"thudm/glm-z1-rumination-32b.description": "GLM Z1 Rumination 32B là mô hình suy luận sâu 32B thuộc dòng GLM-4-Z1, được tối ưu hóa cho các tác vụ mở phức tạp đòi hỏi tư duy kéo dài. Dựa trên glm-4-32b-0414, mô hình bổ sung các giai đoạn học tăng cường và căn chỉnh nhiều tầng, mang đến khả năng “suy ngẫm” mô phỏng quá trình xử lý nhận thức kéo dài. Điều này bao gồm suy luận lặp lại, phân tích nhiều bước và quy trình làm việc hỗ trợ công cụ như tìm kiếm, truy xuất và tổng hợp có nhận thức về trích dẫn.\n\nMô hình vượt trội trong viết nghiên cứu, phân tích so sánh và hỏi đáp phức tạp. Hỗ trợ gọi hàm cho các thao tác tìm kiếm/điều hướng (`search`, `click`, `open`, `finish`) trong quy trình tác nhân. Hành vi suy ngẫm được điều khiển bởi các vòng lặp nhiều lượt với định hình phần thưởng theo quy tắc và cơ chế ra quyết định trì hoãn, được đánh giá theo các khung nghiên cứu sâu như hệ thống căn chỉnh nội bộ của OpenAI. Phiên bản này ưu tiên chiều sâu hơn tốc độ.",
"tngtech/deepseek-r1t-chimera:free.description": "DeepSeek-R1T-Chimera được tạo ra bằng cách kết hợp DeepSeek-R1 và DeepSeek-V3 (0324), kết hợp khả năng suy luận của R1 với hiệu quả mã hóa của V3. Dựa trên kiến trúc DeepSeek-MoE Transformer và được tối ưu hóa cho việc tạo văn bản tổng quát.\n\nMô hình hợp nhất trọng số đã huấn luyện để cân bằng giữa suy luận, hiệu suất và khả năng tuân theo hướng dẫn. Phát hành theo giấy phép MIT cho mục đích nghiên cứu và thương mại.",
"togethercomputer/StripedHyena-Nous-7B.description": "StripedHyena Nous (7B) mang lại hiệu suất tính toán cao hơn nhờ kiến trúc và chiến lược tối ưu.",
"tts-1-hd.description": "Mô hình chuyển văn bản thành giọng nói mới nhất, được tối ưu hóa cho chất lượng cao.",
"tts-1.description": "Mô hình chuyển văn bản thành giọng nói mới nhất, được tối ưu hóa cho tốc độ thời gian thực.",
"upstage/SOLAR-10.7B-Instruct-v1.0.description": "Upstage SOLAR Instruct v1 (11B) được tinh chỉnh cho các tác vụ hướng dẫn chính xác với hiệu suất ngôn ngữ mạnh mẽ.",
"us.anthropic.claude-3-5-sonnet-20241022-v2:0.description": "Claude 3.5 Sonnet nâng tầm tiêu chuẩn ngành, vượt trội hơn các đối thủ và Claude 3 Opus trong nhiều đánh giá, đồng thời duy trì tốc độ và chi phí ở mức trung bình.",
"us.anthropic.claude-3-7-sonnet-20250219-v1:0.description": "Claude 3.7 Sonnet là mô hình thế hệ tiếp theo nhanh nhất của Anthropic. So với Claude 3 Haiku, nó cải thiện toàn diện các kỹ năng và vượt qua Claude 3 Opus trong nhiều bài kiểm tra trí tuệ.",
"v0-1.0-md.description": "v0-1.0-md là mô hình cũ được cung cấp qua API v0.",
"v0-1.5-lg.description": "v0-1.5-lg phù hợp cho các tác vụ tư duy hoặc suy luận nâng cao.",
"v0-1.5-md.description": "v0-1.5-md phù hợp cho các tác vụ hàng ngày và tạo giao diện người dùng.",
"veo-2.0-generate-001.description": "Mô hình tạo video tiên tiến nhất của chúng tôi, có sẵn cho các nhà phát triển trên gói trả phí của Gemini API.",
"veo-3.0-fast-generate-001.description": "Mô hình tạo video ổn định của chúng tôi, có sẵn cho các nhà phát triển trên gói trả phí của Gemini API.",
"veo-3.0-generate-001.description": "Mô hình tạo video ổn định của chúng tôi, có sẵn cho các nhà phát triển trên gói trả phí của Gemini API.",
"veo-3.1-fast-generate-preview.description": "Mô hình tạo video mới nhất của chúng tôi, có sẵn cho các nhà phát triển trên gói trả phí của Gemini API.",
"veo-3.1-generate-preview.description": "Mô hình tạo video mới nhất của chúng tôi, có sẵn cho các nhà phát triển trên gói trả phí của Gemini API.",
"vercel/v0-1.0-md.description": "Truy cập các mô hình phía sau v0 để tạo, sửa và tối ưu hóa ứng dụng web hiện đại với khả năng suy luận theo framework và kiến thức cập nhật.",
"vercel/v0-1.5-md.description": "Truy cập các mô hình phía sau v0 để tạo, sửa và tối ưu hóa ứng dụng web hiện đại với khả năng suy luận theo framework và kiến thức cập nhật.",
"vidu/viduq2-pro_img2video.description": "Nhập một hình ảnh và mô tả văn bản để tạo video. ViduQ2-Pro hình ảnh thành video là mô hình video \"Mọi thứ đều có thể tham chiếu\" đầu tiên trên thế giới. Nó hỗ trợ sáu chiều tham chiếu—hiệu ứng, biểu cảm, kết cấu, hành động, nhân vật và cảnh—cho phép chỉnh sửa video phát triển hoàn toàn. Thông qua việc thêm, xóa và sửa đổi có thể kiểm soát, nó đạt được chỉnh sửa video chi tiết, được thiết kế như một động cơ sáng tạo cấp sản xuất cho loạt phim hoạt hình, phim ngắn và sản xuất phim.",
"vidu/viduq2-pro_reference2video.description": "Nhập video tham chiếu, hình ảnh và mô tả văn bản để tạo video. ViduQ2-Pro tham chiếu thành video là mô hình video \"Mọi thứ đều có thể tham chiếu\" đầu tiên trên thế giới. Nó hỗ trợ sáu chiều tham chiếu—hiệu ứng, biểu cảm, kết cấu, hành động, nhân vật và cảnh—cho phép chỉnh sửa video phát triển hoàn toàn. Thông qua việc thêm, xóa và sửa đổi có thể kiểm soát, nó đạt được chỉnh sửa video chi tiết, được thiết kế như một động cơ sáng tạo cấp sản xuất cho loạt phim hoạt hình, phim ngắn và sản xuất phim.",
"vidu/viduq2-pro_start-end2video.description": "Nhập hình ảnh khung đầu tiên và cuối cùng cùng với mô tả văn bản để tạo video. ViduQ2-Pro khung hình chính thành video là mô hình video \"Mọi thứ đều có thể tham chiếu\" đầu tiên trên thế giới. Nó hỗ trợ sáu chiều tham chiếu—hiệu ứng, biểu cảm, kết cấu, hành động, nhân vật và cảnh—cho phép chỉnh sửa video phát triển hoàn toàn. Thông qua việc thêm, xóa và sửa đổi có thể kiểm soát, nó đạt được chỉnh sửa video chi tiết, được thiết kế như một động cơ sáng tạo cấp sản xuất cho loạt phim hoạt hình, phim ngắn và sản xuất phim.",
"vidu/viduq2-turbo_img2video.description": "Nhập một hình ảnh và mô tả văn bản để tạo video. ViduQ2-Turbo hình ảnh thành video là một động cơ tạo siêu nhanh. Một video 5 giây 720P có thể được tạo trong chỉ 19 giây, và một video 5 giây 1080P trong khoảng 27 giây. Hành động và biểu cảm nhân vật tự nhiên và thực tế, mang lại tính xác thực mạnh mẽ và hiệu suất xuất sắc trong các cảnh động cao như các chuỗi hành động, với chuyển động rộng rãi.",
"vidu/viduq2-turbo_start-end2video.description": "Nhập hình ảnh khung đầu tiên và cuối cùng cùng với mô tả văn bản để tạo video. ViduQ2-Turbo khung hình chính thành video là một động cơ tạo siêu nhanh. Một video 5 giây 720P có thể được sản xuất trong chỉ 19 giây, và một video 5 giây 1080P trong khoảng 27 giây. Hành động và biểu cảm nhân vật tự nhiên và thực tế, với tính xác thực mạnh mẽ, vượt trội trong các cảnh động cao như các chuỗi hành động, và hỗ trợ chuyển động rộng rãi.",
"vidu/viduq2_reference2video.description": "Nhập hình ảnh tham chiếu cùng với mô tả văn bản để tạo video. ViduQ2 tham chiếu thành video là một mô hình được thiết kế để tuân thủ hướng dẫn chính xác và nắm bắt cảm xúc tinh tế. Nó cung cấp khả năng kiểm soát câu chuyện xuất sắc, diễn giải và thể hiện chính xác các thay đổi biểu cảm vi mô; có ngôn ngữ điện ảnh phong phú, chuyển động camera mượt mà và căng thẳng hình ảnh mạnh mẽ. Được áp dụng rộng rãi trong phim và hoạt hình, quảng cáo và thương mại điện tử, phim ngắn và ngành du lịch văn hóa.",
"vidu/viduq2_text2video.description": "Nhập một gợi ý văn bản để tạo video. ViduQ2 văn bản thành video là một mô hình được thiết kế để tuân thủ hướng dẫn chính xác và nắm bắt cảm xúc tinh tế. Nó cung cấp khả năng kiểm soát câu chuyện xuất sắc, diễn giải và thể hiện chính xác các thay đổi biểu cảm vi mô; có ngôn ngữ điện ảnh phong phú, chuyển động camera mượt mà và căng thẳng hình ảnh mạnh mẽ. Được áp dụng rộng rãi trong phim và hoạt hình, quảng cáo và thương mại điện tử, phim ngắn và ngành du lịch văn hóa.",
"vidu/viduq3-pro_img2video.description": "Nhập một hình ảnh và mô tả văn bản để tạo video. ViduQ3-Pro hình ảnh thành video là một mô hình âm thanh-hình ảnh cấp cờ đầu. Nó hỗ trợ tạo âm thanh-hình ảnh đồng bộ dài đến 16 giây, cho phép chuyển đổi nhiều cảnh tự do trong khi kiểm soát chính xác nhịp độ, cảm xúc và tính liên tục của câu chuyện. Với quy mô tham số hàng đầu, nó mang lại chất lượng hình ảnh xuất sắc, tính nhất quán của nhân vật và biểu cảm cảm xúc, đáp ứng các tiêu chuẩn điện ảnh. Lý tưởng cho các kịch bản sản xuất chuyên nghiệp như quảng cáo (thương mại điện tử, TVC, chiến dịch biểu diễn), loạt phim hoạt hình, phim truyền hình trực tiếp và trò chơi.",
"vidu/viduq3-pro_start-end2video.description": "Nhập hình ảnh khung đầu tiên và cuối cùng cùng với mô tả văn bản để tạo video. ViduQ3-Pro khung hình chính thành video là một mô hình âm thanh-hình ảnh cấp cờ đầu. Nó hỗ trợ tạo âm thanh-hình ảnh đồng bộ dài đến 16 giây, cho phép chuyển đổi nhiều cảnh tự do trong khi kiểm soát chính xác nhịp độ, cảm xúc và tính liên tục của câu chuyện. Với quy mô tham số hàng đầu, nó mang lại chất lượng hình ảnh xuất sắc, tính nhất quán của nhân vật và biểu cảm cảm xúc, đáp ứng các tiêu chuẩn điện ảnh. Lý tưởng cho các kịch bản sản xuất chuyên nghiệp như quảng cáo (thương mại điện tử, TVC, chiến dịch biểu diễn), loạt phim hoạt hình, phim truyền hình trực tiếp và trò chơi.",
"vidu/viduq3-pro_text2video.description": "Nhập một gợi ý văn bản để tạo video. ViduQ3-Pro văn bản thành video là một mô hình âm thanh-hình ảnh cấp cờ đầu. Hỗ trợ tạo âm thanh-hình ảnh đồng bộ dài đến 16 giây, cho phép chuyển đổi nhiều cảnh tự do trong khi kiểm soát chính xác nhịp độ, cảm xúc và tính liên tục của câu chuyện. Với quy mô tham số hàng đầu, nó mang lại chất lượng hình ảnh xuất sắc, tính nhất quán của nhân vật và biểu cảm cảm xúc, đáp ứng các tiêu chuẩn điện ảnh. Lý tưởng cho các kịch bản sản xuất chuyên nghiệp như quảng cáo (thương mại điện tử, TVC, chiến dịch biểu diễn), loạt phim hoạt hình, phim truyền hình trực tiếp và trò chơi.",
"vidu/viduq3-turbo_img2video.description": "Nhập một hình ảnh và mô tả văn bản để tạo video. ViduQ3-Turbo hình ảnh thành video là một mô hình tăng tốc hiệu suất cao. Nó cung cấp tốc độ tạo cực nhanh trong khi duy trì hình ảnh chất lượng cao và biểu đạt động, vượt trội trong các cảnh hành động, biểu cảm cảm xúc và hiểu ngữ nghĩa. Hiệu quả chi phí và lý tưởng cho các kịch bản giải trí thông thường như hình ảnh mạng xã hội, bạn đồng hành AI và tài sản hiệu ứng đặc biệt.",
"vidu/viduq3-turbo_start-end2video.description": "Nhập hình ảnh khung đầu tiên và cuối cùng cùng với mô tả văn bản để tạo video. ViduQ3-Turbo khung hình chính thành video là một mô hình tăng tốc hiệu suất cao. Nó cung cấp tốc độ tạo cực nhanh trong khi duy trì hình ảnh chất lượng cao và biểu đạt động, vượt trội trong các cảnh hành động, biểu cảm cảm xúc và hiểu ngữ nghĩa. Hiệu quả chi phí và lý tưởng cho các kịch bản giải trí thông thường như hình ảnh mạng xã hội, bạn đồng hành AI và tài sản hiệu ứng đặc biệt.",
"vidu/viduq3-turbo_text2video.description": "Nhập một gợi ý văn bản để tạo video. ViduQ3-Turbo văn bản thành video là một mô hình tăng tốc hiệu suất cao. Nó cung cấp tốc độ tạo cực nhanh trong khi duy trì hình ảnh chất lượng cao và biểu đạt động, vượt trội trong các cảnh hành động, biểu cảm cảm xúc và hiểu ngữ nghĩa. Hiệu quả chi phí và phù hợp tốt cho các kịch bản giải trí thông thường như hình ảnh mạng xã hội, bạn đồng hành AI và tài sản hiệu ứng đặc biệt.",
"vidu2-image.description": "Vidu 2 là một mô hình nền tảng tạo video được thiết kế để cân bằng giữa tốc độ và chất lượng. Nó tập trung vào việc tạo video từ hình ảnh và kiểm soát khung hình đầu-cuối, hỗ trợ video dài 4 giây ở độ phân giải 720P. Tốc độ tạo được cải thiện đáng kể trong khi chi phí được giảm đáng kể. Việc tạo video từ hình ảnh khắc phục các vấn đề chuyển đổi màu sắc trước đây, mang lại hình ảnh ổn định và có thể kiểm soát, phù hợp cho thương mại điện tử và các ứng dụng tương tự. Ngoài ra, khả năng hiểu ngữ nghĩa của khung hình đầu và cuối và tính nhất quán giữa nhiều hình ảnh tham chiếu đã được nâng cao, làm cho nó trở thành một công cụ hiệu quả cho sản xuất nội dung quy mô lớn trong giải trí chung, truyền thông internet, phim hoạt hình ngắn và quảng cáo.",
"vidu2-reference.description": "Vidu 2 là một mô hình nền tảng tạo video được thiết kế để cân bằng giữa tốc độ và chất lượng. Nó tập trung vào việc tạo video từ hình ảnh và kiểm soát khung hình đầu-cuối, hỗ trợ video dài 4 giây ở độ phân giải 720P. Tốc độ tạo được cải thiện đáng kể trong khi chi phí được giảm đáng kể. Việc tạo video từ hình ảnh khắc phục các vấn đề chuyển đổi màu sắc trước đây, mang lại hình ảnh ổn định và có thể kiểm soát, phù hợp cho thương mại điện tử và các ứng dụng tương tự. Ngoài ra, khả năng hiểu ngữ nghĩa của khung hình đầu và cuối và tính nhất quán giữa nhiều hình ảnh tham chiếu đã được nâng cao, làm cho nó trở thành một công cụ hiệu quả cho sản xuất nội dung quy mô lớn trong giải trí chung, truyền thông internet, phim hoạt hình ngắn và quảng cáo.",
"vidu2-start-end.description": "Vidu 2 là một mô hình nền tảng tạo video được thiết kế để cân bằng giữa tốc độ và chất lượng. Nó tập trung vào việc tạo video từ hình ảnh và kiểm soát khung hình đầu-cuối, hỗ trợ video dài 4 giây ở độ phân giải 720P. Tốc độ tạo được cải thiện đáng kể trong khi chi phí được giảm đáng kể. Việc tạo video từ hình ảnh khắc phục các vấn đề chuyển đổi màu sắc trước đây, mang lại hình ảnh ổn định và có thể kiểm soát, phù hợp cho thương mại điện tử và các ứng dụng tương tự. Ngoài ra, khả năng hiểu ngữ nghĩa của khung hình đầu và cuối và tính nhất quán giữa nhiều hình ảnh tham chiếu đã được nâng cao, làm cho nó trở thành một công cụ hiệu quả cho sản xuất nội dung quy mô lớn trong giải trí chung, truyền thông internet, phim hoạt hình ngắn và quảng cáo.",
"viduq1-image.description": "Vidu Q1 là mô hình nền tảng tạo video thế hệ tiếp theo của Vidu, tập trung vào việc tạo video chất lượng cao. Nó tạo ra nội dung với các thông số cố định là 5 giây, 24 FPS và độ phân giải 1080P. Thông qua tối ưu hóa sâu về độ rõ nét hình ảnh, chất lượng và kết cấu tổng thể được cải thiện đáng kể, trong khi các vấn đề như biến dạng tay và rung khung hình được giảm thiểu đáng kể. Phong cách thực tế gần giống với các cảnh thực tế, và các phong cách hoạt hình 2D được bảo toàn với độ trung thực cao. Các chuyển đổi giữa khung hình đầu và cuối mượt mà hơn, làm cho nó phù hợp với các kịch bản sáng tạo yêu cầu cao như sản xuất phim, quảng cáo và phim hoạt hình ngắn.",
"viduq1-start-end.description": "Vidu Q1 là mô hình nền tảng tạo video thế hệ tiếp theo của Vidu, tập trung vào việc tạo video chất lượng cao. Nó tạo ra nội dung với các thông số cố định là 5 giây, 24 FPS và độ phân giải 1080P. Thông qua tối ưu hóa sâu về độ rõ nét hình ảnh, chất lượng và kết cấu tổng thể được cải thiện đáng kể, trong khi các vấn đề như biến dạng tay và rung khung hình được giảm thiểu đáng kể. Phong cách thực tế gần giống với các cảnh thực tế, và các phong cách hoạt hình 2D được bảo toàn với độ trung thực cao. Các chuyển đổi giữa khung hình đầu và cuối mượt mà hơn, làm cho nó phù hợp với các kịch bản sáng tạo yêu cầu cao như sản xuất phim, quảng cáo và phim hoạt hình ngắn.",
"viduq1-text.description": "Vidu Q1 là mô hình nền tảng tạo video thế hệ tiếp theo của Vidu, tập trung vào việc tạo video chất lượng cao. Nó tạo ra nội dung với các thông số cố định là 5 giây, 24 FPS và độ phân giải 1080P. Thông qua tối ưu hóa sâu về độ rõ nét hình ảnh, chất lượng và kết cấu tổng thể được cải thiện đáng kể, trong khi các vấn đề như biến dạng tay và rung khung hình được giảm thiểu đáng kể. Phong cách thực tế gần giống với các cảnh thực tế, và các phong cách hoạt hình 2D được bảo toàn với độ trung thực cao. Các chuyển đổi giữa khung hình đầu và cuối mượt mà hơn, làm cho nó phù hợp với các kịch bản sáng tạo yêu cầu cao như sản xuất phim, quảng cáo và phim hoạt hình ngắn.",
"volcengine/doubao-seed-2-0-code.description": "Doubao-Seed-2.0-Code được tối ưu hóa cho nhu cầu lập trình cấp doanh nghiệp. Dựa trên các khả năng xuất sắc của Agent và VLM trong Seed 2.0, nó đặc biệt nâng cao khả năng mã hóa với hiệu suất frontend vượt trội và tối ưu hóa nhắm mục tiêu cho các yêu cầu mã hóa đa ngôn ngữ phổ biến trong doanh nghiệp, làm cho nó lý tưởng để tích hợp với các công cụ lập trình AI khác nhau.",
"volcengine/doubao-seed-2-0-lite.description": "Cân bằng giữa chất lượng tạo nội dung và tốc độ phản hồi, phù hợp làm mô hình sản xuất đa dụng cấp độ chuyên nghiệp.",
"volcengine/doubao-seed-2-0-mini.description": "Chỉ đến phiên bản mới nhất của doubao-seed-2-0-mini",
"volcengine/doubao-seed-2-0-pro.description": "Chỉ đến phiên bản mới nhất của doubao-seed-2-0-pro",
"volcengine/doubao-seed-code.description": "Doubao-Seed-Code là mô hình ngôn ngữ lớn của ByteDance Volcano Engine, được tối ưu hóa cho lập trình tác nhân, thể hiện hiệu suất cao trong các bài kiểm tra lập trình và tác nhân với hỗ trợ ngữ cảnh 256K.",
"wan2.2-i2v-flash.description": "Wanxiang 2.2 Phiên bản Tốc độ cung cấp khả năng tạo siêu nhanh, với khả năng hiểu gợi ý và kiểm soát camera chính xác hơn. Nó duy trì tính nhất quán của các yếu tố hình ảnh trong khi cải thiện đáng kể độ ổn định và tỷ lệ thành công tổng thể.",
"wan2.2-i2v-plus.description": "Wanxiang 2.2 Phiên bản Pro cung cấp khả năng hiểu gợi ý chính xác hơn và chuyển động camera có thể kiểm soát. Nó duy trì tính nhất quán của các yếu tố hình ảnh trong khi cải thiện đáng kể độ ổn định và tỷ lệ thành công, và tạo ra nội dung phong phú, chi tiết hơn.",
"wan2.2-kf2v-flash.description": "Wanxiang 2.2 Phiên bản Tốc độ",
"wan2.2-kf2v-plus.description": "Wanxiang 2.2 Phiên bản Plus",
"wan2.2-t2i-flash.description": "Wanxiang 2.2 Flash là mô hình mới nhất với các nâng cấp về sáng tạo, ổn định và tính chân thực, mang lại khả năng tạo nhanh và giá trị cao.",
"wan2.2-t2i-plus.description": "Wanxiang 2.2 Plus là mô hình mới nhất với các nâng cấp về sáng tạo, ổn định và tính chân thực, tạo ra chi tiết phong phú hơn.",
"wan2.2-t2v-plus.description": "Wanxiang 2.2 Phiên bản Pro cung cấp khả năng hiểu gợi ý chính xác hơn, mang lại chuyển động mượt mà và ổn định, và tạo ra hình ảnh phong phú, chi tiết hơn.",
"wan2.5-i2i-preview.description": "Wanxiang 2.5 I2I Preview hỗ trợ chỉnh sửa hình ảnh đơn và hợp nhất nhiều hình ảnh.",
"wan2.5-i2v-preview.description": "Wanxiang 2.5 Bản Xem Trước hỗ trợ tạo giọng nói tự động và khả năng tích hợp các tệp âm thanh tùy chỉnh.",
"wan2.5-t2i-preview.description": "Wanxiang 2.5 T2I hỗ trợ lựa chọn linh hoạt kích thước hình ảnh trong giới hạn tổng diện tích pixel và tỷ lệ khung hình.",
"wan2.5-t2v-preview.description": "Wanxiang 2.5 Bản Xem Trước hỗ trợ tạo giọng nói tự động và khả năng tích hợp các tệp âm thanh tùy chỉnh.",
"wan2.6-i2v-flash.description": "Wanxiang 2.6 giới thiệu khả năng kể chuyện nhiều cảnh, đồng thời hỗ trợ tạo giọng nói tự động và khả năng tích hợp các tệp âm thanh tùy chỉnh.",
"wan2.6-i2v.description": "Wanxiang 2.6 giới thiệu khả năng kể chuyện nhiều cảnh, đồng thời hỗ trợ tạo giọng nói tự động và khả năng tích hợp các tệp âm thanh tùy chỉnh.",
"wan2.6-image.description": "Wanxiang 2.6 Image hỗ trợ chỉnh sửa hình ảnh và đầu ra bố cục hình ảnh–văn bản hỗn hợp.",
"wan2.6-r2v-flash.description": "Wanxiang 2.6 Tham chiếu thành Video – Flash cung cấp tốc độ tạo nhanh hơn và hiệu suất chi phí tốt hơn. Nó hỗ trợ tham chiếu các nhân vật cụ thể hoặc bất kỳ đối tượng nào, duy trì tính nhất quán về ngoại hình và giọng nói một cách chính xác, và cho phép tham chiếu nhiều nhân vật để biểu diễn cùng nhau.",
"wan2.6-r2v.description": "Wanxiang 2.6 Tham chiếu thành Video hỗ trợ tham chiếu các nhân vật cụ thể hoặc bất kỳ đối tượng nào, duy trì tính nhất quán về ngoại hình và giọng nói một cách chính xác, và cho phép tham chiếu nhiều nhân vật để biểu diễn cùng nhau. Lưu ý: Khi sử dụng video làm tham chiếu, video đầu vào cũng sẽ được tính vào chi phí. Vui lòng tham khảo tài liệu định giá mô hình để biết chi tiết.",
"wan2.6-t2i.description": "Wanxiang 2.6 T2I hỗ trợ lựa chọn linh hoạt kích thước hình ảnh trong giới hạn tổng diện tích pixel và tỷ lệ khung hình (giống như Wanxiang 2.5).",
"wan2.6-t2v.description": "Wanxiang 2.6 giới thiệu khả năng kể chuyện nhiều cảnh, đồng thời hỗ trợ tạo giọng nói tự động và khả năng tích hợp các tệp âm thanh tùy chỉnh.",
"wan2.7-i2v.description": "Wanxiang 2.7 Hình ảnh thành Video mang lại một nâng cấp toàn diện về khả năng hiệu suất. Các cảnh kịch tính có biểu cảm cảm xúc tinh tế và tự nhiên, trong khi các cảnh hành động thì mãnh liệt và ấn tượng. Kết hợp với các chuyển cảnh nhịp nhàng và động hơn, nó đạt được hiệu suất và khả năng kể chuyện mạnh mẽ hơn.",
"wan2.7-image-pro.description": "Wanxiang 2.7 Hình ảnh Phiên bản Chuyên nghiệp, hỗ trợ đầu ra độ phân giải cao 4K.",
"wan2.7-image.description": "Wanxiang 2.7 Hình ảnh, tốc độ tạo hình ảnh nhanh hơn.",
"wan2.7-r2v.description": "Wanxiang 2.7 Tham chiếu thành Video cung cấp các tham chiếu ổn định hơn cho các nhân vật, đạo cụ và cảnh. Nó hỗ trợ tối đa 5 hình ảnh hoặc video tham chiếu hỗn hợp, cùng với tham chiếu tông giọng âm thanh. Kết hợp với các khả năng cốt lõi được nâng cấp, nó mang lại hiệu suất và sức biểu đạt mạnh mẽ hơn.",
"wan2.7-t2v.description": "Wanxiang 2.7 Văn bản thành Video mang lại một nâng cấp toàn diện về khả năng hiệu suất. Các cảnh kịch tính có biểu cảm cảm xúc tinh tế và tự nhiên, trong khi các cảnh hành động thì mãnh liệt và ấn tượng. Được nâng cao với các chuyển cảnh nhịp nhàng và động hơn, nó đạt được hiệu suất diễn xuất và kể chuyện mạnh mẽ hơn.",
"wanx-v1.description": "Mô hình chuyển văn bản thành hình ảnh cơ bản. Tương ứng với Tongyi Wanxiang 1.0 General.",
"wanx2.0-t2i-turbo.description": "Vượt trội trong tạo chân dung có kết cấu với tốc độ vừa phải và chi phí thấp. Tương ứng với Tongyi Wanxiang 2.0 Speed.",
"wanx2.1-i2v-plus.description": "Wanxiang 2.1 Phiên bản Pro mang lại hình ảnh tinh tế hơn và chất lượng cao hơn.",
"wanx2.1-i2v-turbo.description": "Wanxiang 2.1 Phiên bản Tốc độ cung cấp hiệu suất chi phí cao.",
"wanx2.1-t2i-plus.description": "Phiên bản nâng cấp toàn diện với chi tiết hình ảnh phong phú hơn và tốc độ chậm hơn một chút. Tương ứng với Tongyi Wanxiang 2.1 Pro.",
"wanx2.1-t2i-turbo.description": "Phiên bản nâng cấp toàn diện với tốc độ tạo nhanh, chất lượng tổng thể mạnh mẽ và giá trị cao. Tương ứng với Tongyi Wanxiang 2.1 Speed.",
"wanx2.1-t2v-plus.description": "Wanxiang 2.1 Phiên bản Pro mang lại kết cấu hình ảnh phong phú hơn và hình ảnh chất lượng cao hơn.",
"wanx2.1-t2v-turbo.description": "Wanxiang 2.1 Phiên bản Tốc độ cung cấp hiệu suất chi phí tuyệt vời.",
"whisper-1.description": "Mô hình nhận dạng giọng nói tổng quát hỗ trợ ASR đa ngôn ngữ, dịch giọng nói và nhận diện ngôn ngữ.",
"wizardlm2.description": "WizardLM 2 là mô hình ngôn ngữ từ Microsoft AI, vượt trội trong đối thoại phức tạp, tác vụ đa ngôn ngữ, suy luận và trợ lý.",
"wizardlm2:8x22b.description": "WizardLM 2 là mô hình ngôn ngữ từ Microsoft AI, vượt trội trong đối thoại phức tạp, tác vụ đa ngôn ngữ, suy luận và trợ lý.",
"x-ai/grok-4-fast-non-reasoning.description": "Grok 4 Fast (Không Suy Luận) là mô hình đa phương thức hiệu suất cao, chi phí thấp của xAI (hỗ trợ cửa sổ ngữ cảnh 2M), phù hợp cho các tình huống nhạy cảm với độ trễ và chi phí mà không cần suy luận trong mô hình. Có thể bật suy luận qua tham số API khi cần. Lời nhắc và phản hồi có thể được xAI hoặc OpenRouter sử dụng để cải thiện các mô hình tương lai.",
"x-ai/grok-4-fast.description": "Grok 4 Fast là mô hình hiệu suất cao, chi phí thấp của xAI (hỗ trợ cửa sổ ngữ cảnh 2M), lý tưởng cho các trường hợp sử dụng có tính đồng thời cao và ngữ cảnh dài.",
"x-ai/grok-4.1-fast-non-reasoning.description": "Grok 4 Fast (Không Lý Luận) là mô hình đa phương thức thông lượng cao, chi phí thấp của xAI (hỗ trợ cửa sổ ngữ cảnh 2M) dành cho các kịch bản nhạy cảm với độ trễ và chi phí không yêu cầu lý luận trong mô hình. Nó nằm cùng với phiên bản lý luận của Grok 4 Fast, và lý luận có thể được kích hoạt thông qua tham số lý luận API khi cần. Các gợi ý và hoàn thành có thể được xAI hoặc OpenRouter sử dụng để cải thiện các mô hình trong tương lai.",
"x-ai/grok-4.1-fast.description": "Grok 4 Fast là mô hình thông lượng cao, chi phí thấp của xAI (hỗ trợ cửa sổ ngữ cảnh 2M), lý tưởng cho các trường hợp sử dụng đồng thời cao và ngữ cảnh dài.",
"x-ai/grok-4.description": "Grok 4 là mô hình lý luận hàng đầu của xAI với khả năng lý luận và đa phương thức mạnh mẽ.",
"x-ai/grok-code-fast-1.description": "Grok Code Fast 1 là mô hình mã nhanh của xAI với đầu ra dễ đọc, thân thiện với kỹ thuật.",
"x1.description": "Cập nhật X1.5: (1) thêm chế độ suy nghĩ động được kiểm soát bởi trường `thinking`; (2) độ dài ngữ cảnh lớn hơn với 64K đầu vào và 64K đầu ra; (3) hỗ trợ FunctionCall.",
"xai/grok-2-vision.description": "Grok 2 Vision xuất sắc trong các nhiệm vụ thị giác, mang lại hiệu suất SOTA trong lý luận toán học thị giác (MathVista) và hỏi đáp tài liệu (DocVQA). Nó xử lý tài liệu, biểu đồ, đồ thị, ảnh chụp màn hình và ảnh chụp.",
"xai/grok-2.description": "Grok 2 là mô hình tiên phong với lý luận tiên tiến, trò chuyện mạnh mẽ, hiệu suất lập trình và lý luận, và xếp hạng cao hơn Claude 3.5 Sonnet và GPT-4 Turbo trên LMSYS.",
"xai/grok-3-fast.description": "Mô hình hàng đầu của xAI xuất sắc trong các trường hợp sử dụng doanh nghiệp như trích xuất dữ liệu, lập trình và tóm tắt, với kiến thức sâu rộng trong các lĩnh vực tài chính, y tế, pháp luật và khoa học. Biến thể nhanh chạy trên cơ sở hạ tầng nhanh hơn để có phản hồi nhanh hơn nhiều với chi phí mỗi token cao hơn.",
"xai/grok-3-mini-fast.description": "Mô hình nhẹ của xAI suy nghĩ trước khi trả lời, lý tưởng cho các nhiệm vụ đơn giản hoặc dựa trên logic mà không cần kiến thức sâu rộng. Dấu vết lý luận thô có sẵn. Biến thể nhanh chạy trên cơ sở hạ tầng nhanh hơn để có phản hồi nhanh hơn nhiều với chi phí mỗi token cao hơn.",
"xai/grok-3-mini.description": "Mô hình nhẹ của xAI suy nghĩ trước khi trả lời, lý tưởng cho các nhiệm vụ đơn giản hoặc dựa trên logic mà không cần kiến thức sâu rộng. Dấu vết lý luận thô có sẵn.",
"xai/grok-3.description": "Mô hình hàng đầu của xAI xuất sắc trong các trường hợp sử dụng doanh nghiệp như trích xuất dữ liệu, lập trình và tóm tắt, với kiến thức sâu rộng trong các lĩnh vực tài chính, y tế, pháp luật và khoa học.",
"xai/grok-4.description": "Mô hình hàng đầu mới nhất của xAI với hiệu suất vượt trội trong ngôn ngữ tự nhiên, toán học và lý luận—một lựa chọn toàn diện lý tưởng.",
"yi-large-fc.description": "Được xây dựng trên yi-large với khả năng gọi công cụ nâng cao, phù hợp cho các kịch bản tác nhân và quy trình làm việc.",
"yi-large-preview.description": "Phiên bản sớm; khuyến nghị sử dụng yi-large (mới hơn).",
"yi-large-rag.description": "Dịch vụ nâng cao dựa trên yi-large, kết hợp truy xuất và tạo nội dung để có câu trả lời chính xác với tìm kiếm web thời gian thực.",
"yi-large-turbo.description": "Giá trị và hiệu suất vượt trội, được tinh chỉnh để cân bằng tốt giữa chất lượng, tốc độ và chi phí.",
"yi-large.description": "Mô hình 100B tham số mới với khả năng hỏi đáp và tạo văn bản mạnh mẽ.",
"yi-lightning-lite.description": "Phiên bản nhẹ; khuyến nghị sử dụng yi-lightning.",
"yi-lightning.description": "Mô hình hiệu suất cao mới nhất với suy luận nhanh hơn và đầu ra chất lượng cao.",
"yi-medium-200k.description": "Mô hình ngữ cảnh dài 200K dành cho hiểu biết sâu và tạo nội dung dài.",
"yi-medium.description": "Mô hình cỡ trung được tinh chỉnh với khả năng và giá trị cân bằng, tối ưu hóa cho việc tuân thủ hướng dẫn.",
"yi-spark.description": "Mô hình nhỏ gọn, nhanh với khả năng toán học và lập trình được tăng cường.",
"yi-vision-v2.description": "Mô hình thị giác dành cho các nhiệm vụ phức tạp với khả năng hiểu và phân tích đa hình ảnh mạnh mẽ.",
"yi-vision.description": "Mô hình thị giác dành cho các nhiệm vụ phức tạp với khả năng hiểu và phân tích hình ảnh mạnh mẽ.",
"z-ai/glm-4.5-air.description": "GLM 4.5 Air là biến thể nhẹ của GLM 4.5 dành cho các kịch bản nhạy cảm với chi phí trong khi vẫn giữ được khả năng lý luận mạnh mẽ.",
"z-ai/glm-4.5.description": "GLM 4.5 là mô hình hàng đầu của Z.AI với lý luận lai được tối ưu hóa cho kỹ thuật và các nhiệm vụ ngữ cảnh dài.",
"z-ai/glm-4.6.description": "GLM 4.6 là mô hình hàng đầu của Z.AI với độ dài ngữ cảnh mở rộng và khả năng lập trình.",
"z-ai/glm-4.7.description": "GLM-4.7 là mô hình hàng đầu mới nhất của Zhipu, mang lại khả năng tổng quát được cải thiện, câu trả lời đơn giản và tự nhiên hơn, và trải nghiệm viết hấp dẫn hơn.",
"z-ai/glm4.7.description": "GLM-4.7 là mô hình hàng đầu mới nhất của Zhipu, được tăng cường cho các tình huống mã hóa Agentic với khả năng mã hóa được cải thiện.",
"z-ai/glm5.description": "GLM-5 là mô hình nền tảng hàng đầu mới của Zhipu AI dành cho kỹ thuật tác nhân, đạt hiệu suất SOTA mã nguồn mở trong khả năng mã hóa và tác nhân. Nó tương đương với Claude Opus 4.5 về hiệu suất.",
"z-image-turbo.description": "Z-Image là mô hình tạo hình ảnh từ văn bản nhẹ có thể nhanh chóng tạo ra hình ảnh, hỗ trợ cả hiển thị văn bản tiếng Trung và tiếng Anh, và linh hoạt thích ứng với nhiều độ phân giải và tỷ lệ khung hình.",
"zai-org/GLM-4.5-Air.description": "GLM-4.5-Air là mô hình cơ bản dành cho các ứng dụng tác nhân sử dụng kiến trúc Mixture-of-Experts. Nó được tối ưu hóa cho sử dụng công cụ, duyệt web, kỹ thuật phần mềm và lập trình giao diện, và tích hợp với các tác nhân mã như Claude Code và Roo Code. Nó sử dụng lý luận lai để xử lý cả lý luận phức tạp và các kịch bản hàng ngày.",
"zai-org/GLM-4.5V.description": "GLM-4.5V là mô hình VLM mới nhất của Zhipu AI, được xây dựng trên mô hình văn bản hàng đầu GLM-4.5-Air (106B tổng, 12B hoạt động) với kiến trúc MoE để mang lại hiệu suất mạnh mẽ với chi phí thấp hơn. Nó theo con đường GLM-4.1V-Thinking và thêm 3D-RoPE để cải thiện lý luận không gian 3D. Được tối ưu hóa thông qua tiền huấn luyện, SFT và RL, nó xử lý hình ảnh, video và tài liệu dài và xếp hạng hàng đầu trong các mô hình mở trên 41 tiêu chuẩn đa phương thức công khai. Chế độ Thinking cho phép người dùng cân bằng giữa tốc độ và độ sâu.",
"zai-org/GLM-4.6.description": "So với GLM-4.5, GLM-4.6 mở rộng ngữ cảnh từ 128K lên 200K cho các nhiệm vụ tác nhân phức tạp hơn. Nó đạt điểm cao hơn trên các tiêu chuẩn mã và cho thấy hiệu suất thực tế mạnh mẽ hơn trong các ứng dụng như Claude Code, Cline, Roo Code và Kilo Code, bao gồm cả việc tạo trang giao diện tốt hơn. Lý luận được cải thiện và sử dụng công cụ được hỗ trợ trong quá trình lý luận, tăng cường khả năng tổng thể. Nó tích hợp tốt hơn vào các khung tác nhân, cải thiện các tác nhân công cụ/tìm kiếm và có phong cách viết được người dùng ưa thích hơn và tự nhiên hơn trong vai trò chơi.",
"zai-org/GLM-4.6V.description": "GLM-4.6V đạt độ chính xác hiểu hình ảnh SOTA cho quy mô tham số của nó và là mô hình đầu tiên tích hợp khả năng Gọi Hàm vào kiến trúc mô hình hình ảnh, thu hẹp khoảng cách từ \"nhận thức hình ảnh\" đến \"hành động có thể thực hiện\" và cung cấp nền tảng kỹ thuật thống nhất cho các đại lý đa phương thức trong các kịch bản kinh doanh thực tế. Cửa sổ ngữ cảnh hình ảnh được mở rộng lên 128k, hỗ trợ xử lý luồng video dài và phân tích đa hình ảnh độ phân giải cao.",
"zai/glm-4.5-air.description": "GLM-4.5 và GLM-4.5-Air là các mô hình hàng đầu mới nhất của chúng tôi dành cho các ứng dụng tác nhân, cả hai đều sử dụng MoE. GLM-4.5 có tổng số 355B và 32B tham số hoạt động mỗi lần chuyển tiếp; GLM-4.5-Air mỏng hơn với tổng số 106B và 12B tham số hoạt động.",
"zai/glm-4.5.description": "Dòng GLM-4.5 được thiết kế cho các tác nhân. GLM-4.5 hàng đầu kết hợp lý luận, lập trình và kỹ năng tác nhân với tổng số 355B tham số (32B hoạt động) và cung cấp các chế độ hoạt động kép như một hệ thống lý luận lai.",
"zai/glm-4.5v.description": "GLM-4.5V được xây dựng trên GLM-4.5-Air, kế thừa các kỹ thuật GLM-4.1V-Thinking đã được chứng minh và mở rộng với kiến trúc MoE mạnh mẽ 106B tham số.",
"zenmux/auto.description": "ZenMux tự động định tuyến chọn mô hình có giá trị tốt nhất và hiệu suất tốt nhất từ các tùy chọn được hỗ trợ dựa trên yêu cầu của bạn."
}