Một phòng thí nghiệm AI tương đối ít được chú ý vừa ra mắt một mô hình có thể xử lý đồng thời 150 tác vụ trong khi chạy trên phần cứng mà bạn có thể sở hữu. Apodex 1.1, được phát hành vào ngày 24 tháng 8 năm 2026, được xây dựng dựa trên một giả thuyết tưởng chừng đơn giản: nút thắt cổ chai thực sự đối với các tác nhân AI không phải là trí thông minh thuần túy, mà là môi trường mà chúng thực thi.
Gia đình mô hình, được mô tả chi tiết trong bài báo arXiv (2608.23283), định vị các môi trường thực thi là bề mặt mở rộng chính cho các tác nhân AI chạy dài hạn.
Mô hình nhỏ hơn, số liệu cạnh tranh
Apodex 1.1 đã đạt điểm chuẩn khiến nó có thể sánh ngang với các mô hình từ các phòng thí nghiệm có nguồn lực đáng kể hơn. Nó đạt 38,5 trên APEX-Agents và 78,8 trên GDPVal, hai bộ tiêu chuẩn được thiết kế để đo lường khả năng hoàn thành tác vụ của tác nhân và lý luận tổng quát trong điều kiện thực tế.
Trong các đánh giá chuyên ngành, kết quả vẫn duy trì. FrontierFinance đạt 54.3, trong khi FrontierScience-Research đạt 63.3. Theo nhóm Apodex, những con số này đặt mô hình này ngang hàng hoặc vượt các hệ thống lớn hơn từ Anthropic và OpenAI, cụ thể là Claude và các biến thể GPT-5.x.
Biến thể Apodex 1.1 Mini chạy trên 35 tỷ tham số, một phần nhỏ so với số lượng tham số của các mô hình tiên tiến từ các phòng thí nghiệm lớn. Nhóm đã phát hành trọng số mở cho biến thể này, nghĩa là các nhà nghiên cứu và doanh nghiệp có thể triển khai nó tại chỗ mà không cần chuyển mọi truy vấn qua API đám mây.
AgentOS và vấn đề phối hợp
Tiêu đề kiến trúc là những gì nhóm gọi là shared execution harness và AgentOS. Đây là các thành phần cấp cơ sở hạ tầng cho phép nhiều tác nhân AI cùng làm việc trên các phần khác nhau của một nhiệm vụ phức tạp, đồng thời duy trì một bản ghi nhất quán về những gì mỗi tác nhân đã làm và lý do tại sao.
Hệ thống hỗ trợ tối đa 150 tiểu đại lý chạy song song trên các tác vụ truy xuất và tổng hợp. Việc theo dõi nguồn gốc được tích hợp sẵn, nghĩa là mọi bước mà tiểu đại lý thực hiện đều được ghi lại và có thể truy xuất nguồn gốc.
Hệ thống phối hợp sử dụng những nhóm tác nhân bất đồng bộ, như nhóm mô tả. Thay vì buộc các tác nhân phải chờ trong hàng đợi, các nhiệm vụ được phân tách và phân phối đến nhiều cụm tác nhân có thể hoạt động độc lập và đồng bộ hóa đầu ra sau này.
Công cụ mã nguồn mở và góc nhìn nghiên cứu
Bên cạnh mô hình chính, Đội ngũ Apodex đã mở nguồn FrontierAgent, một nền tảng thực thi và nghiên cứu được xây dựng để hỗ trợ các quy trình kiểu ReAct. ReAct, viết tắt của Reasoning và Acting, là một khung làm việc nơi các mô hình AI luân phiên giữa việc suy nghĩ về một vấn đề và thực hiện các hành động cụ thể trong môi trường.
Phiên bản này đại diện cho một sự cải tiến đáng kể so với công việc trước đây của đội ngũ. Apodex 1.0 Mini, mô hình tiền nhiệm, rõ ràng đã gặp khó khăn với các tác vụ chồng chéo, loại công việc yêu cầu nhiều quy trình chia sẻ ngữ cảnh và tránh can thiệp vào đầu ra của nhau. Apodex 1.1 đặc biệt nhắm vào điểm yếu này.
