Bỏ qua tới nội dung chính
Quay lại tin tức

AMD mua lại Taalas

Latent Space· 7/8/2026models

Trong bài viết "Luận điểm về ASIC tùy chỉnh", chúng tôi đã nhận định Taalas đáng được quan tâm, và trong bài "Điểm uốn suy luận", chúng tôi cho rằng mọi thứ sẽ phát triển theo chiều dọc. Tập Baseten của chúng tôi đã đưa ra một số phản biện hoài nghi đối với các LLM được khắc (etched LLM), không chỉ ASIC tùy chỉnh, nhưng rõ ràng Lisa Su hiện tại không đồng tình. Xin chúc mừng! Tin tức AI ngày 5-6/8/2026. Chúng tôi đã kiểm tra 12 subreddit, 544 tài khoản Twitter và không có thêm Discord nào. Trang web của AINews cho phép bạn tìm kiếm tất cả các số báo trước đây. Xin nhắc lại, AINews hiện là một phần của Latent Space. Bạn có thể chọn nhận/không nhận email theo tần suất! Tổng hợp Twitter AI Meta Muse Spark 1.2 đột phá: Olympia

Trong luận điểm về ASIC tùy chỉnh, chúng tôi đã nhận định Taalas đáng được chú ý, và trong bài viết về bước ngoặt suy luận, chúng tôi đã nói rằng mọi thứ sẽ phát triển theo chiều dọc. Tập Baseten của chúng tôi đã đưa ra một số phản biện hoài nghi đối với các LLM được khắc, không chỉ ASIC tùy chỉnh, nhưng rõ ràng Lisa Su hiện tại không đồng tình. Chúc mừng! Tin tức AI ngày 8/5/2026-8/6/2026. Chúng tôi đã kiểm tra 12 subreddit, 544 tài khoản Twitter và không có thêm Discord nào. Trang web của AINews cho phép bạn tìm kiếm tất cả các số báo trước đây. Xin nhắc lại, AINews hiện là một chuyên mục của Latent Space. Bạn có thể chọn nhận/không nhận email thường xuyên! Tổng hợp Twitter về AI Sự đột phá của Muse Spark 1.2 của Meta: Huy chương vàng Olympic, cải thiện điểm chuẩn và hiệu suất giá-thành tích vượt trội Muse Spark 1.2 đã nhanh chóng chuyển từ "không có trên bảng xếp hạng" thành một mô hình hàng đầu. Trên Vals Index, Muse Spark 1.2 đã lọt vào top 5 với giá 0,69 USD/lần kiểm tra, được báo cáo là rẻ hơn 3 lần so với Kimi và hơn 10 lần so với Fable, Opus và 5.6 Sol. Vals sau đó cho biết đây cũng là mô hình đầu tiên đạt trên 60% trên Finance Agent v2 với giá 0,77 USD/lần kiểm tra, so với mô hình số 1 trước đó là Opus 5 với giá 5,12 USD/lần kiểm tra và tốc độ nhanh gấp đôi (ValsAI). Bản vá v4.1.1 của Artificial Analysis cũng ghi nhận một trong những mức tăng điểm lớn nhất cho Muse Spark 1.2 sau khi cập nhật chấm điểm (Artificial Analysis). Meta cũng tuyên bố đạt được kết quả "suy luận thuần túy" mạnh mẽ bất thường. Meta cho biết các mô hình thuộc dòng Muse Spark được đào tạo nội bộ của họ đã đạt được hiệu suất cấp huy chương vàng trong năm kỳ thi Olympic STEM, bao gồm điểm lý thuyết tuyệt đối tại APhO và IPhO, cùng với hiệu suất cấp vàng tại IMO, IChO và RMM; ba kỳ thi đã được gửi trong điều kiện thi đấu trực tiếp và được chấm điểm chính thức (AI at Meta, Trapit Bansal). Meta nhấn mạnh không sử dụng công cụ nào—không tìm kiếm, mã hóa hay máy tính—và cho rằng một số cải tiến là nhờ sự điều phối đa tác nhân với suy luận song song. Tuyên bố đó ngay lập tức làm dấy lên cuộc tranh luận đang diễn ra về "LLM so với các công cụ hỗ trợ so với neurosymbolic", với các nhà phê bình và người ủng hộ diễn giải cách thiết lập khác nhau (fchollet, giffmana). Bài học rộng hơn: các kỹ sư ngày càng coi việc điều phối tác nhân, TTC và giao thức đánh giá là các tính năng sản phẩm hạng nhất. Câu chuyện về Muse ít nói về "một mô hình đã thắng" mà là "chất lượng mô hình + điều phối + định giá + năng lực phục vụ" hiện quyết định sự chấp nhận. Khung này xuất hiện trong các phản ứng so sánh tốc độ hiện tại của Meta với Google một cách thuận lợi và nhấn mạnh rằng các mô hình "Watermelon" lớn hơn vẫn được mong đợi (Rihard Jarc, alexandr_wang). Sự hợp nhất mô hình ChatGPT của OpenAI, mở rộng gói miễn phí và thúc đẩy plugin/bảo mật OpenAI đã hợp nhất các mô hình "instant" và "thinking" thành một mô hình trò chuyện trả phí duy nhất. Công ty thông báo rằng GPT-5.6 Sol hiện cung cấp cả suy luận tức thì và sâu sắc cho người dùng Plus/Pro trong ChatGPT, với một thanh trượt nỗ lực suy luận mới để chọn tốc độ so với tính toàn diện (OpenAI, OpenAI). OpenAI cho biết Sol được cập nhật giảm 68% phản hồi lỗi thực tế so với GPT-5.5 Instant trên một đánh giá có tính rủi ro cao bao gồm tài chính, y học và luật (OpenAI). Nhiều nhân viên OpenAI đã coi sự thay đổi này là một cột mốc về khả năng sử dụng: một mô hình, một giao diện trò chuyện, nỗ lực có thể điều chỉnh (gdb, michpokrass). Chính sách miễn phí đã trở nên cạnh tranh hơn. OpenAI thông báo người dùng Free và Go sẽ có quyền truy cập không giới hạn vào các cuộc trò chuyện văn bản với GPT-5.6 Luna bắt đầu từ ngày mai, cùng với nút "Think" (Suy nghĩ) cho các câu hỏi khó hơn (OpenAI). Điều này được hiểu rộng rãi là một động thái phân phối người dùng lớn (sama, kimmonismus). ARC Prize cũng đã chạy lại GPT-5.6 Luna sau khi giảm giá 80% và báo cáo khả năng không thay đổi với chi phí thấp hơn nhiều: 59,6% trên ARC-AGI-2 với 0,18 USD/tác vụ và 90,7% trên ARC-AGI-1 với 0,07 USD/tác vụ (arcprize). Phạm vi dành cho nhà phát triển cũng được mở rộng. OpenAI đã giới thiệu Agent Plugins, một tiêu chuẩn mở được xây dựng với AWS, Cursor, GitHub, Vercel và các đối tác khác để đóng gói Agent Skills và cấu hình máy chủ MCP theo một định dạng chung, với hỗ trợ khởi chạy trên Codex, ChatGPT, Cursor, GitHub Copilot, Kiro và Code (OpenAIDevs, OpenAIDevs). OpenAI cũng ra mắt Codex Security Review dưới dạng bản xem trước nghiên cứu, nhằm thực hiện đánh giá bảo mật theo ngữ cảnh kho lưu trữ trực tiếp trên các yêu cầu kéo (PR) của GitHub (OpenAIDevs, gdb). Tin đồn: một thông tin rò rỉ chưa được xác minh nhưng được lan truyền rộng rãi cho rằng "Astra" – được mô tả là bản huấn luyện trước mới lớn nhất của OpenAI kể từ GPT-4.5 và được gọi nội bộ là mewfour – có thể ra mắt vào tuần tới (synthwavedd). Tin đồn này lan truyền rộng rãi, nhưng không có xác nhận nào trong các nguồn thông tin. Các tác nhân (Agents), khung điều khiển (harnesses) và cơ sở hạ tầng MCP đang trở thành chiến trường hệ thống thực sự. Cloudflare đã thực hiện một trong những động thái thúc đẩy cơ sở hạ tầng đáng kể nhất trong ngày. Trong Tuần lễ Agents, công ty đã giới thiệu Kitesurf, một trình duyệt không trạng thái chạy hoàn toàn trên Workers, được thiết kế cho các trường hợp sử dụng tác nhân mà Chromium đầy đủ là quá mức cần thiết. Điểm nổi bật về kỹ thuật: tách tập lệnh/DOM khỏi việc hiển thị, khởi tạo các worker hiển thị một cách lười biếng chỉ khi cần, và giảm đáng kể chi phí CPU/bộ nhớ so với tự động hóa trình duyệt tiêu chuẩn (ashleypeacock, imluisduarte). Cloudflare cũng thúc đẩy WebMCP, nâng cấp AI Search, công cụ AI Readiness/AEO cấp độ bảng điều khiển, và một bài đăng trên blog về lõi không trạng thái được viết lại của MCP phù hợp hơn với cơ sở hạ tầng web thương mại như Workers (mattzcarey). MCP đang chuyển từ một khái niệm mới lạ sang một yêu cầu cơ bản. Ngoài Cloudflare, Weaviate đã thêm một điểm cuối /v1/mcp tích hợp trên cùng một cổng với API REST với các công cụ kiểm tra bộ sưu tập, liệt kê người thuê, tìm kiếm lai và công cụ upsert đối tượng – không yêu cầu dịch vụ MCP riêng biệt, với RBAC và các nút chuyển đổi độc lập cho quyền truy cập MCP/ghi (weaviate_io). Việc đóng gói plugin tương thích MCP cũng được thúc đẩy bởi việc OpenAI triển khai Agent Plugins và sự hỗ trợ của Cursor cho nó (cursor_ai). Cuộc tranh luận trong ngành đã chuyển từ "khung điều khiển có quan trọng không?" sang "trí thông minh nằm ở đâu?". François Chollet lập luận rằng một khung điều khiển lớn trong thời gian suy luận điều phối nhiều lệnh gọi thần kinh, theo định nghĩa, là neurosymbolic, và rằng các hệ thống hiện tại thường là "symbolic sandwiches" (bánh mì kẹp biểu tượng) hơn là các chương trình thần kinh đầu cuối (fchollet, fchollet, fchollet). Những người khác phản bác rằng trong khi h

Nguồn tin: Latent Space. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.