Bỏ qua tới nội dung chính
Quay lại tin tức

LWiAI Podcast số 258 - Opus 5.5, Sol và Luna, Muse, DeepSeek-V4.1-Flash, Xi

Last Week in AI· Last Week in AI· 3/10/2026general

Tập thứ 258 của chúng tôi với phần tóm tắt và thảo luận về các tin tức lớn trong lĩnh vực AI tuần trước! Được ghi hình vào ngày 26/9/2026; như thường lệ, tôi xin lỗi vì tập này ra mắt muộn, tập tiếp theo sẽ được phát hành sớm hơn! Dẫn chương trình bởi Andrey Kurenkov và Jeremie Harris. Quý vị có thể gửi câu hỏi và phản hồi cho chúng tôi qua email andreyvkurenkov@gmail.com và/hoặc hello@gladstone.ai. Được tài trợ bởi ODSC AI. Hội nghị ODSC AI West 2026 sẽ diễn ra từ ngày 27 đến 29/10 tại San Francisco và trực tuyến, với hơn 300 phiên thảo luận bao gồm AI tác nhân (agentic AI) cho doanh nghiệp, AI cá nhân và tự động hóa quy trình làm việc, AI vật lý và robot, AI tạo sinh (generative AI), cùng nhiều chủ đề khác! Hãy tham gia cùng hàng nghìn nhà khoa học dữ liệu.

Tập thứ 258 của chúng tôi với phần tóm tắt và thảo luận về các tin tức AI nổi bật tuần trước! Được ghi hình vào ngày 26/9/2026; như thường lệ, chúng tôi xin lỗi vì đã phát hành muộn, tập tiếp theo sẽ ra mắt sớm hơn! Được dẫn dắt bởi Andrey Kurenkov và Jeremie Harris. Quý vị có thể gửi câu hỏi và phản hồi cho chúng tôi qua email andreyvkurenkov@gmail.com và/hoặc hello@gladstone.ai. Được tài trợ bởi ODSC AI. Hội nghị ODSC AI West 2026 sẽ diễn ra từ ngày 27 đến 29/10 tại San Francisco và trực tuyến, với hơn 300 phiên thảo luận bao gồm AI tác nhân (agentic AI) cho doanh nghiệp, AI cá nhân và tự động hóa quy trình làm việc, AI vật lý và robot, AI tạo sinh (generative AI), cùng nhiều chủ đề khác! Hàng nghìn nhà khoa học dữ liệu, kỹ sư học máy (ML engineers), nhà nghiên cứu và lãnh đạo kỹ thuật sẽ tham dự sự kiện này. Đăng ký tại odsc.ai/west — sử dụng mã khuyến mãi LWAI để được giảm thêm 15% cho bất kỳ loại vé nào. Đọc bản tin văn bản của chúng tôi và bình luận về podcast tại https://lastweekin.ai/ Trong tập này: Anthropic đã phát hành Opus 5.5 với giá thấp hơn, hiệu suất nhanh hơn, kết quả điểm chuẩn mạnh mẽ, một thẻ hệ thống (system card) ghi nhận một số nỗ lực can thiệp vào môi trường thử nghiệm (sandbox-tampering), và mở rộng quyền truy cập an ninh mạng tập trung vào phòng thủ với các biện pháp bảo vệ nghiêm ngặt hơn. OpenAI đã ra mắt các gói GPT-6 rẻ hơn (Sol và Luna), cùng với những lo ngại về khả năng giải thích giảm sút và tầm nhìn đánh giá bên ngoài hạn chế; TypeSafe AI giới thiệu "Jev," một mô hình kiểu quyết định/phân loại nhanh, rẻ, được tối ưu hóa cho các đầu ra đã hiệu chỉnh. Muse của Meta đã mở rộng sang Mac, cho thấy số lượt tải xuống và người dùng ban đầu mạnh mẽ so với lần ra mắt di động sớm của ChatGPT, và phải đối mặt với sự phản đối khi Amazon chặn Muse khỏi hoạt động mua sắm do các chính sách và lo ngại về quyền riêng tư/bảo mật. Các cập nhật về mã nguồn mở và nghiên cứu bao gồm tính năng nén KV-cache (bộ nhớ đệm khóa-giá trị) DeepSeek 4.1 Flash, mô hình ba ngôi (ternary model) Bonsai 227B được nén cao của Prism, ngoại giao AI giữa Mỹ và Trung Quốc cùng tin đồn về một "quan chức cấp cao" (czar) về AI, một vụ kiện chống độc quyền về các lời kêu gọi "điều tiết" AI, sự thay đổi trong dư luận chống lại các trung tâm dữ liệu, và các nghiên cứu về phát hiện hành vi gian lận phần thưởng (reward hacking), biểu diễn "trục đau" (pain axis), lợi ích từ giao tiếp đa tác nhân (multi-agent communication), và tự cải thiện bằng phương pháp điều hòa (regularized harness self-improvement). Được tài trợ bởi LANGFUSE. Langfuse là nền tảng mã nguồn mở được áp dụng rộng rãi nhất để đánh giá và quan sát tác nhân AI, được tin cậy bởi Canva, Twilio, Ramp và 21 trong số 50 công ty Fortune 500. Tính năng theo dõi phân cấp (hierarchical tracing) ghi lại toàn bộ ngữ cảnh thực thi của quy trình làm việc LLM (cuộc gọi API, ngữ cảnh được truy xuất, hành động của tác nhân, chi phí, độ trễ) để ngay cả các kiến trúc tác nhân phức tạp cũng có thể gỡ lỗi trong môi trường sản xuất. Được cấp phép MIT, có thể tự lưu trữ hoặc quản lý trên Langfuse Cloud, không phụ thuộc vào khung công tác và nhà cung cấp, với hơn 100 tích hợp. Bắt đầu tại langfuse.com; có gói miễn phí hào phóng, không yêu cầu thẻ tín dụng. Xin cảm ơn các nhà tài trợ hiện tại của chúng tôi: Box - truy cập box.com/LWIAI để tìm hiểu thêm. Notion - truy cập notion.com/lwai để dùng thử Nền tảng nhà phát triển của Notion ngay hôm nay. ODSC AI - truy cập odsc.ai/east và sử dụng mã khuyến mãi LWAI để được giảm thêm 15% cho vé tham dự ODSC AI East 2026. Factor - truy cập factormeals.com/lwai50off và sử dụng mã lwai50off để được giảm 50% và bữa sáng miễn phí trong một năm. Dấu thời gian: (00:00:10) Giới thiệu / Chuyện phiếm (00:01:43) Xem trước tin tức Công cụ & Ứng dụng (00:02:59) Anthropic phát hành Opus 5.5 với giá thấp hơn và hiệu suất ngang Fable | TechCrunch + Cung cấp khả năng an ninh mạng tiên tiến cho các nhà phòng thủ. (00:24:31) OpenAI ra mắt GPT-6 Sol và Luna, tự hào về chi phí thấp hơn và ít lỗi hơn | TechCrunch. (00:29:34) Một loại mô hình AI mới từ nhà phát minh ChatGPT đang làm nức lòng các nhà phát triển | TechCrunch. Ứng dụng & Kinh doanh Meta Muse ra mắt trên Mac, cho phép AI thực hiện các tác vụ trên máy tính của bạn | TechCrunch Meta Muse đang vượt xa tốc độ ra mắt di động ban đầu của ChatGPT | TechCrunch Amazon chặn tác nhân AI Muse của Meta | The Verge Dự án & Mã nguồn mở DeepSeek-V4.1-Flash: Đẩy giới hạn nén bộ nhớ đệm KV Giới thiệu Bonsai 2 27B: Nén gần như không mất dữ liệu với dung lượng nhỏ hơn 9 lần Chính sách & An toàn Ông Trump và ông Tập sẽ thảo luận về rủi ro và cạnh tranh AI tại Hội nghị thượng đỉnh Mỹ-Trung - The New York Times + Các nhà đàm phán kiểm soát vũ khí cho rằng sẽ không có hiệp ước AI giữa Mỹ và Trung Quốc Bessent được nhắm cho vị trí 'người đứng đầu AI' của ông Trump Anthropic, OpenAI, SpaceXAI, Google bị kiện vì kêu gọi 'điều tiết' phát triển AI Nhiều người Mỹ hiện cho rằng các trung tâm dữ liệu gây tác động tiêu cực đến môi trường, chi phí năng lượng và nhiều vấn đề khác | Pew Research Center Giám sát và phát hiện hành vi gian lận phần thưởng bằng các biểu diễn nội bộ trong quá trình đánh giá LLM Trục Đau: LLM biểu diễn hành vi tự gây hại và hành động để giảm bớt nó Nghiên cứu & Phát triển OpenAI tuyên bố đã giải quyết một trong các 'Bài toán Thiên niên kỷ' của toán học - The New York Times + OpenAI muốn tham vấn các nhà toán học ưu tú về cách không mắc sai lầm lần nữa | The Verge Mở rộng khám phá thông qua giao tiếp trong thời gian thử nghiệm RRSI: Cải thiện bản thân đệ quy được điều chỉnh của các bộ điều khiển tác nhân

Nguồn tin: Last Week in AI — Tác giả: Last Week in AI. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.