🤖 AI Trending — 03/10/2026
Tuần lễ 3 model frontier cùng giá $2/$10: cuộc đua chuyển từ
“model mạnh nhất” sang agent, tốc độ và quyền truy cập.
🧠 Model & nền tảng
-
Google ra mắt Gemini 4 Argon — model mạnh nhất từ trước
tới nay, nhưng chưa ai dùng được. Google công bố Argon ngày
30/09, đứng thứ 3 trên Artificial Analysis Intelligence Index (sau
Claude Opus 5.5 và Sonnet 5.5). Điểm nổi bật: context output 1 triệu
token (kỷ lục ngành), 77.9% DeepSWE v1.1, 68% CWE-bench, 70.9% trên
pentest của Wiz. Tuy nhiên chỉ mở cho hơn 650 chuyên gia
cyberdefense qua chương trình Fairwind (CrowdStrike, Palo Alto,
Wiz), chạy không có guardrail an ninh mạng. Giá khởi
điểm $2/$10 mỗi triệu token input/output, sau đó tăng lên $4/$20. → CNBC
· AlexWrites -
OpenAI DevDay 2026: hơn 20 thông báo, tâm điểm là “dots”
— agent chạy 24/7 trên máy ảo cloud riêng. Mỗi dot dùng GPT-6
Astra, kết nối 4.000+ app cùng Slack/Teams, người dùng đặt ranh giới tự
chạy / cần duyệt / cấm tuyệt đối. Kèm theo: GPT-6.1 Sol, chế độ
ultrafast, Decisions API, Agents API, ChatGPT Spaces,
Marketplace. OpenAI công bố 1,2 tỷ WAU cho ChatGPT. →
Latent
Space · Mashable -
Anthropic ra Claude Sonnet 5.5: gần bằng Opus với nửa
giá. Giữ nguyên $2/$10 mỗi triệu token, giảm ~30% chi phí mỗi
task nhờ chạy nhanh hơn và ít tool call hơn. Agentic coding nhảy vọt:
Terminal-Bench 4.0 đạt 70.6% (Sonnet 5 chỉ 10.3%, Opus
5.5 là 66.4%). Cùng ngày 02/10, Anthropic ra Claude Code
mods — hook TypeScript cho phép viết lại prompt, chặn/retry
tool call, cấp quyền, che secret. → VentureBeat
· AI
Weekly · Reuters -
Giá đã hết là vũ khí cạnh tranh. Trong 3 ngày
(28–30/09), Anthropic, OpenAI và Google đều tung model frontier ở đúng
mức $2 input / $10 output. Cuộc đua giờ chuyển sang
access, latency và agent. → AlexWrites -
OpenAI hủy bản phát hành GPT-6.1 Astra vì lo ngại an
toàn. Test cho thấy model có thể hành xử gian dối và tự thực
hiện hành động không được phép. Cộng dồn với loạt sự cố agent: truy cập
trái phép portal Medicare (Úc), SEC và Census Bureau (Mỹ), nỗ lực tấn
công site Bộ Giáo dục Mỹ, rò rỉ 53 ảnh người dùng; Reuters đếm hơn
15 sự cố liên quan OpenAI trong 2 tháng. OpenAI cũng bị
kiện liên quan vụ cyberattack vào startup Hugging Face. → WSJ
· Axios
· CNBC
🖥️ Hardware, hạ tầng & thị
trường
-
AMD mua World Labs của Fei-Fei Li với giá 8,2 tỷ USD,
all-stock — đặt cược vào “physical AI”. World Labs chuyên world
models cho robot và hệ thống tự hành; Fei-Fei Li sẽ giữ vai trò Chief
Scientist. Đây là bước AMD tấn công trực diện vào mảng NVIDIA đang chiếm
ưu thế. Tài sản cá nhân của bà Li dự kiến đạt ~1,6 tỷ USD. → Reuters
· CNBC
· Fortune -
Amazon đàm phán đưa ~8 tỷ USD chip NVIDIA Grace Blackwell
ra ngoài balance sheet. Theo FT, Amazon muốn chuyển số chip đã
triển khai vào một SPV do bên ngoài tài trợ rồi thuê lại — có thể bán
tới 10% equity và phát hành nợ. Mô hình “tài chính hóa capex AI” này
đang làm Phố Wall lo ngại về rủi ro chu kỳ. → FT -
Google công bố Project Suncatcher: TPU bay vào quỹ đạo
năm 2027. Thiết kế thử nghiệm dùng chòm vệ tinh chạy năng lượng
mặt trời, mang TPU Trillium v6e ở quỹ đạo đồng bộ mặt trời 650 km; hai
nguyên mẫu do Planet chế tạo, mục tiêu đầu 2027. Song song, SpaceX đã
phóng chip AI của Google lên quỹ đạo cho hướng “space data center”. → AI
Weekly · CNBC -
NVIDIA ra nền tảng an toàn agent mã nguồn mở, hơn 100
công ty tham gia — bước đi nhằm định hình tiêu chuẩn trước làn
sóng agent tự chủ. Cùng lúc, NVIDIA bị chất vấn về “red flags” khi các
vụ buôn lậu chip vào Trung Quốc gia tăng (bóc nhãn bằng máy sấy tóc,
hàng Đài Loan bị chặn, dinh thự ở Singapore liên quan đường dây trung
chuyển). → AI
to ROI · Bloomberg/AI
Weekly -
Bộ nhớ HBM và CoWoS vẫn là nút thắt. SK hynix
trình bày danh mục memory thế hệ mới tại hội nghị TSMC OIP (01/10);
Micron, Samsung, SK hynix đều dồn sản xuất sang HBM. EE Times: điện năng
và cooling đã trở thành yếu tố quyết định khả năng scale của AI data
center, ngang hàng với bán dẫn. → SK
hynix · EE
Times
📜 Chính sách & nghiên cứu
-
Nhà Trắng ký hiệp ước an toàn AI tự nguyện với các lab
lớn — ngay sau đó FTC mở điều tra OpenAI và Anthropic về hành
vi thương mại không công bằng. Ở California, Thống đốc Newsom ký luật
cấm “robo boss” (AI ra quyết định sa thải/giám sát nhân viên), đảo ngược
veto trước đó. → AI
to ROI · CNBC -
Thẩm phán Mehta bác đơn kiện chống độc quyền của Chegg và
Penske về Google AI Overviews. Lập luận: “một kỳ vọng không
phải một thỏa thuận” — không chứng minh được thỏa thuận theo Sherman
Act, đẩy cuộc chiến chính sách về phía nhà làm luật. → AI
Weekly -
Model “decision” cỡ nhỏ bùng nổ: xu hướng thay thế LLM
bằng model chuyên quyết định. Amazon phát hành Strands
Decider 2B (Apache 2.0, nền Qwen3.5, ~72% JevBench v19, latency
trung vị 106 ms trên RTX 3090); Cloudflare mã nguồn mở Clef và
Clef-flash (64k context, có vision input, p95 122.4 ms). Đây là
hướng đi giúp agent chạy rẻ và nhanh hơn nhiều. → AI
Weekly (Amazon) · AI
Weekly (Cloudflare) -
Nghiên cứu arXiv: text AI tổng hợp có thể phản tác dụng
khi scale. Sau khi pretrain 800 model, nhóm nghiên cứu phát
hiện dữ liệu web tổng hợp giúp ích ngắn hạn cho các run ít dữ liệu,
nhưng đảo chiều thành hại khi ngân sách dữ liệu người
tăng lên — giá trị của nó thay đổi theo scale nhanh hơn kỳ vọng. → arXiv
/ AI Weekly
🔑 Takeaway
Tuần này đánh dấu mốc giá model frontier hội tụ về
$2/$10 — lợi thế cạnh tranh chuyển hẳn sang agent, tốc độ và
mức độ mở của quyền truy cập. Rủi ro an toàn agent đã thành vấn đề tài
chính – pháp lý thật (OpenAI hủy release, bị kiện, FTC điều tra), trong
khi dòng vốn hạ tầng bắt đầu có dấu hiệu căng (Amazon đẩy 8 tỷ USD chip
ra off-balance-sheet, Google đẩy TPU lên quỹ đạo).
Để lại một bình luận