Today’s frontier report
Research Pool → Multi-Scout → Editor → Edition
3qk7 · AI LOCAL LABS TECHNICAL SCOUTING

AI FRONTIER

Signals worth understanding before they become obvious.

2026-10-11
01
testcreativecapability unlock

Qwen phát hành Qwen-Image-2.1-Turbo: checkpoint tăng tốc 8 bước cho tạo ảnh từ văn bản và chỉnh sửa ảnh

Qwen-Image-2.1-Turbo là checkpoint tăng tốc của Qwen-Image-2.1 cho tạo ảnh từ văn bản và chỉnh sửa ảnh với 8 bước khử nhiễu, dùng cùng kiến trúc tạo hình ảnh 7B và tải trực tiếp bằng QwenImage21Pipeline trong Diffusers.

  • Lịch lấy mẫu 8 bước được khuyến nghị được lưu cùng checkpoint và tự động tải; chỉ đặt num_inference_steps không ghi đè lịch này.
  • Quá trình tạo dùng CFG=1 theo mặc định, và prefix KV caching tái sử dụng ngữ cảnh văn bản và ảnh tham chiếu qua các bước khử nhiễu.
  • Thẻ mô hình ghi kích thước mô hình 7B tham số, kiểu tensor BF16 và giấy phép Qwen Research License Agreement.
  • Cần Diffusers hỗ trợ sigmas lấy mẫu được cấu hình theo pipeline (PR #14950), cùng bản dựng PyTorch tương thích CUDA, transformers>=5.17.0, accelerate và pillow.

Vì lịch 8 bước được đóng gói trong checkpoint, nhà phát triển có ít bước suy luận hơn và độ trễ thấp hơn, nhưng cần lưu ý lịch này áp dụng mặc định và các lịch khác chưa được đánh giá cho checkpoint này.

Hugging Face Trending
02
watchagentsnew architecture

Microsoft công bố Microsoft-Decision-1, mô hình chuyên cho quyết định của agent, OpenAI cũng ra mắt Decisions API

Microsoft đã công bố Microsoft-Decision-1, mô hình AI chuyên cho các tác vụ quyết định có cấu trúc. Phiên bản đầu tiên được xây dựng trên Qwen3.5-9B, với kế hoạch mở rộng sang MAI của Microsoft và các mô hình khác của OpenAI.

  • Phiên bản đầu tiên được xây dựng trên Qwen3.5-9B, với kế hoạch mở rộng sang MAI của Microsoft và các mô hình khác của OpenAI.
  • Mô hình xử lý ngữ cảnh đầu vào dài tới 32.000 token trong một lần suy luận.
  • Với 8 cách biến đổi đầu vào, tỷ lệ thay đổi phán đoán trung bình là 1,3%; thay đổi mô tả lựa chọn hoặc đảo và trộn thứ tự lựa chọn không làm thay đổi phán đoán.
  • Được kiểm chứng trên khoảng 150.000 câu hỏi và 36 benchmark, Microsoft báo cáo độ chính xác cao nhất trong số các mô hình so sánh, tốc độ nhanh hơn Quyet-1.0-Large 4,5 lần và nhanh hơn GPT-6 Sol tới 35 lần.

Với nhà phát triển agent, Decision-1 trả về xác suất đã hiệu chỉnh trong một lần suy luận, nên có thể dùng làm lớp điều khiển dựa trên độ tin cậy để tự động xử lý ca rõ ràng và chuyển ca mơ hồ cho con người.

AI Times Korea
03
opportunitydevelopercost collapse

LegalOn giảm một nửa chi phí Codex trong khi vẫn duy trì tốc độ phát triển

LegalOn đã cắt giảm 65% chi phí Codex ước tính hằng ngày trong khi vẫn duy trì tốc độ phát triển. Công ty đã ghép Astra, Sol và Luna với các tác vụ và quản lý ngân sách một cách chiến lược.

  • LegalOn đã cắt giảm 65% chi phí Codex ước tính hằng ngày.
  • Công ty vẫn duy trì tốc độ phát triển trong khi cắt giảm chi phí.
  • Công ty đã ghép Astra, Sol và Luna với các tác vụ và quản lý ngân sách một cách chiến lược.

Đối với các nhà xây dựng AI, điều này cho thấy việc ghép mô hình với tác vụ và quản lý ngân sách một cách chiến lược có thể cắt giảm mạnh chi phí tác nhân lập trình mà không đánh đổi tốc độ phát triển.

OpenAI News
04
watchresearchincremental

Google Research công bố báo cáo về các vấn đề mở trong quyền riêng tư và bảo mật của tác nhân AI theo góc nhìn ngữ cảnh

Google Research đã công bố một báo cáo hội thảo, được thực hiện với hơn 50 chuyên gia học thuật và công nghiệp, trình bày những thách thức nền tảng về quyền riêng tư và bảo mật của các tác nhân AI tự chủ và đề xuất cách tiếp cận nhiều lớp dựa trên Contextual Integrity ở cấp hệ thống, mô hình, người dùng và hệ sinh thái...

  • Báo cáo là kết quả của Google Contextual Agent Privacy and Security (CAPS) Workshop tổ chức vào cuối năm 2025 tại New York City, với hơn 50 nhà nghiên cứu và lãnh đạo ngành tham gia.
  • Báo cáo nêu rằng tác nhân AI khác với phần mềm tất định truyền thống ở ba khía cạnh: giao diện phi cấu trúc và sự mơ hồ đầu vào như prompt injection, luồng điều khiển xác suất, cùng tính tự chủ và ủy quyền.
  • Báo cáo đề xuất một công cụ chính sách theo ngữ cảnh như một phần của lớp giám sát, đánh giá liệu luồng dữ liệu được yêu cầu có phù hợp trước khi bất kỳ thông tin nào rời khỏi không gian làm việc của người dùng.
  • Báo cáo kêu gọi các chuẩn đánh giá đa tác nhân được chuẩn hóa, được mô tả là môi trường “Agent Gym” động để mô phỏng an toàn các tương tác phức tạp, dây chuyền trong thời gian dài.

Đối với nhà phát triển AI, báo cáo chuyển Contextual Integrity thành hướng thiết kế lớp giám sát và công cụ chính sách có thể triển khai, đồng thời chỉ ra sự thiếu vắng chuẩn đánh giá an toàn đa tác nhân dùng chung.

Google Research
05
watchresearchbenchmark jump

Sau khi khảo sát 1.933 bài báo IROS, chúng tôi thấy sáu thay đổi mới trong robot học

Leiphone đã khảo sát 1.933 bài báo IROS và xác định sáu thay đổi mới trong nghiên cứu robot học.

  • Khảo sát bao gồm 1.933 bài báo IROS.
  • Leiphone báo cáo sáu thay đổi mới trong robot học.

Với các nhà nghiên cứu robot học, khảo sát bài báo quy mô lớn này là điểm tham chiếu để theo dõi xu hướng nghiên cứu của IROS.

雷峰网
06
testresearchcapability unlock

Nghiên cứu mới Ant×Đại học Chiết Giang: giúp AI 'đọc' cảm xúc trong hội thoại streaming | EMNLP'26

Một nghiên cứu mới của Ant và Đại học Chiết Giang đề xuất phương pháp để AI nhận diện cảm xúc trong hội thoại streaming, và công trình đã được chấp nhận tại EMNLP'26.

  • Nghiên cứu được thực hiện chung bởi Ant và Đại học Chiết Giang.
  • Công trình đã được chấp nhận tại EMNLP'26.
  • Nghiên cứu tập trung vào hiểu cảm xúc trong hội thoại streaming.

Với người xây dựng hệ thống hội thoại thời gian thực, nhận diện cảm xúc trong bối cảnh streaming đáng được đưa vào đánh giá và thiết kế sản phẩm.

智源社区
07
watchmodelsopen source unlock

Mô hình lớn mã nguồn mở Zidong Taichu dẫn đầu 8 trong 9 benchmark quốc tế có thẩm quyền

Theo Sở Kinh tế và Công nghệ Thông tin tỉnh Hồ Bắc, mô hình lớn mã nguồn mở Zidong Taichu đứng đầu trong 8 trên 9 benchmark quốc tế có thẩm quyền.

  • Theo Sở Kinh tế và Công nghệ Thông tin tỉnh Hồ Bắc, mô hình lớn mã nguồn mở Zidong Taichu đứng đầu trong 8 trên 9 benchmark quốc tế có thẩm quyền.

Đối với nhà phát triển AI, việc Zidong Taichu đứng đầu trong 8 trên 9 benchmark quốc tế có thẩm quyền bổ sung một điểm so sánh mạnh mẽ khi đánh giá các mô hình mã nguồn mở.

湖北省经济和信息化厅
08
watchdeveloperincremental

Cải thiện năng suất “không đủ nếu chỉ dùng LLM”: startup AI Mỹ kết hợp AI truyền thống để xác minh câu trả lời

Theo EE Times Japan, một startup AI của Mỹ cho rằng chỉ dùng LLM là không đủ để cải thiện năng suất và kết hợp chúng với AI truyền thống để xác minh câu trả lời.

  • EE Times Japan đưa tin rằng cải thiện năng suất “không đủ nếu chỉ dùng LLM”.
  • Startup AI của Mỹ kết hợp LLM với AI truyền thống và xác minh câu trả lời.

Với nhà xây dựng AI, tín hiệu này cho thấy cải thiện năng suất cần kiến trúc kết hợp LLM với AI truyền thống và bước xác minh câu trả lời.

EE Times Japan