Thẻ: google ai

  • Google vừa thay đổi định nghĩa AI — và chatbot có thể đang biến mất

    Google vừa thay đổi định nghĩa AI — và chatbot có thể đang biến mất

    Google vừa thay đổi định nghĩa AI một lần nữa — và chatbot có thể đang biến mất

    Trong phần lớn hai năm qua, cuộc đua AI thường được kể bằng những câu hỏi khá quen thuộc.

    Model nào thông minh hơn.

    Model nào trả lời tốt hơn.

    Model nào thắng benchmark.

    Mỗi lần có sản phẩm mới ra mắt, gần như mọi so sánh đều quay lại cùng một khuôn mẫu: nhanh hơn bao nhiêu, ngữ cảnh dài hơn bao nhiêu, xử lý tốt hơn bao nhiêu.

    Nhưng nếu nhìn vào những gì Google vừa công bố tại I/O lần này, có cảm giác hãng đang cố dịch chuyển cuộc chơi sang hướng khác.

    Điều được nhắc nhiều không còn là mô hình lớn hơn hay điểm số cao hơn.

    Thay vào đó là một loạt thứ nhìn qua tưởng không liên quan: Search cá nhân hóa hơn, Gemini Flash mới, trợ lý chạy nền, khả năng làm việc xuyên ứng dụng, AI đọc ngữ cảnh từ Gmail, Calendar, tài liệu và bắt đầu xử lý thay người dùng.

    Nếu tách riêng từng tính năng sẽ rất dễ thấy rối.

    Nhưng đặt cạnh nhau thì chúng tạo thành một bức tranh khá rõ.

    Google có vẻ không còn xem AI là một cửa sổ chat nữa.

    Họ đang thử biến nó thành một lớp làm việc mới nằm phía trên toàn bộ hệ sinh thái.

    Đây là khác biệt khá thú vị.

    Trong giai đoạn đầu của AI tạo sinh, chatbot gần như là giao diện mặc định. Muốn làm gì thì mở một ô chat, nhập yêu cầu rồi chờ phản hồi.

    Cách này rất hiệu quả để giới thiệu công nghệ mới vì ai cũng hiểu cách dùng.

    Nhưng nó có một giới hạn khá rõ.

    Mỗi lần cần làm việc thật, người dùng vẫn phải tự chuyển qua lại giữa công cụ, ứng dụng và dữ liệu của mình.

    AI trả lời rất nhanh nhưng phần hành động vẫn nằm ở con người.

    Điều Google đang thử lần này có vẻ đi xa hơn một chút.

    Thay vì hỏi rồi nhận câu trả lời, AI bắt đầu được đặt vào vị trí hiểu ngữ cảnh, giữ trạng thái và thực hiện nhiều bước liên tiếp hơn.

    Ví dụ thay vì hỏi lịch hôm nay rồi mở Gmail rồi tìm tài liệu, hệ thống bắt đầu có khả năng gom những thứ đó lại thành một luồng làm việc liền mạch hơn.

    Đây cũng là lý do mình thấy việc Google nhấn mạnh Gemini 3.5 Flash lần này thú vị hơn benchmark.

    Bản thân model mới có thể quan trọng, nhưng thứ đáng chú ý hơn là nơi Google đang đặt nó vào.

    Không còn là một ứng dụng AI đứng riêng.

    Mà giống một lớp điều phối chạy xuyên qua Search, Gmail, Docs, Android và các dịch vụ khác.

    Nếu nhìn theo góc này thì câu chuyện lần này không còn là Google ra thêm một chatbot.

    Nó giống việc Google đang thử trả lời một câu hỏi lớn hơn.

    Nếu AI đủ nhanh, đủ rẻ và đủ hiểu ngữ cảnh, liệu người dùng còn cần mở ứng dụng để làm việc như hiện tại nữa không?

    Có thể đây mới là thay đổi đáng chú ý nhất của đợt công bố vừa rồi.

    Không phải AI thông minh hơn.

    Mà là AI bắt đầu muốn biến mất khỏi màn hình và trở thành thứ âm thầm làm việc phía sau.

    Nếu điều đó xảy ra, chatbot có thể chỉ là giao diện tạm thời của kỷ nguyên AI — chứ không phải đích đến cuối cùng.

    Google vừa thay đổi định nghĩa AI — và chatbot có thể đang biến mất
    Gemini 3.5 không phải nâng cấp — đây là cách Google muốn AI làm việc thay bạn

    Google thật sự vừa công bố gì và vì sao Gemini 3.5 Flash không phải trung tâm của câu chuyện?

    Nếu đọc các bài tổng hợp sau Google I/O theo kiểu lướt nhanh, rất dễ có cảm giác đây lại là một năm quen thuộc: Google ra model mới, nâng cấp Search, thêm tính năng cho Gmail, cập nhật Android và giới thiệu vài ý tưởng tương lai. Danh sách đủ dài để tạo cảm giác mọi thứ đều mới nhưng cũng đủ quen để khó nhớ chính xác điều gì thật sự thay đổi.

    Nhưng lần này có một điểm khá thú vị. Nếu bỏ tên sản phẩm sang một bên và chỉ nhìn cách các tính năng kết nối với nhau, sẽ thấy Google đang đẩy AI theo một hướng khác hẳn giai đoạn đầu của chatbot.

    Gemini 3.5 Flash là ví dụ khá rõ.

    Thông thường khi một model mới xuất hiện, thứ được nhắc nhiều nhất sẽ là benchmark, điểm số hoặc khả năng vượt ai đó ở một bài kiểm tra nào đó. Nhưng cách Google nói về Flash lần này lại khác. Họ dành nhiều thời gian hơn để nói về tốc độ phản hồi, khả năng duy trì ngữ cảnh, xử lý công việc liên tục và việc đưa AI vào bên trong các sản phẩm đang tồn tại.

    Nghe qua tưởng chỉ là khác biệt về marketing, nhưng thật ra đây có thể là thay đổi chiến lược.

    Một chatbot truyền thống thường hoạt động theo mô hình rất đơn giản: người dùng mở ứng dụng, nhập yêu cầu, nhận câu trả lời rồi quay lại công việc. AI đứng ngoài luồng làm việc.

    Những gì Google đang thử lần này lại giống một mô hình khác.

    Search bắt đầu được thiết kế để hiểu thêm ngữ cảnh cá nhân nếu người dùng cho phép. Gmail không chỉ hỗ trợ viết mà bắt đầu hiểu chuỗi trao đổi. Tài liệu không còn là nơi AI sinh văn bản rồi dừng lại mà trở thành nơi AI tham gia trực tiếp vào quá trình chỉnh sửa. Một số tính năng trợ lý mới cũng được mô tả như công cụ tiếp tục xử lý tác vụ thay vì chỉ phản hồi yêu cầu.

    Nếu nhìn từng tính năng riêng lẻ sẽ thấy chúng khá bình thường.

    Nhưng nếu đặt cạnh nhau sẽ thấy chúng đang cố trả lời cùng một câu hỏi: điều gì xảy ra nếu AI không còn là nơi để hỏi mà trở thành nơi để giao việc?

    Đây là khác biệt mình thấy đáng chú ý nhất của lần cập nhật này.

    Google dường như không còn muốn cạnh tranh để trở thành chatbot trả lời hay nhất nữa. Họ đang thử biến AI thành lớp làm việc chung phía trên các ứng dụng hiện có.

    Điều đó nghe hơi trừu tượng nên thử hình dung theo cách khác.

    Ngày trước, để chuẩn bị cho một cuộc họp, chúng ta phải mở lịch, tìm email, xem tài liệu rồi tổng hợp lại trong đầu. Với hướng đi mới này, Google đang thử để AI thực hiện nhiều bước chuẩn bị đó thay người dùng rồi chỉ đưa ra phần kết quả cuối cùng.

    Nếu cách tiếp cận này thành công, thứ thay đổi không phải chatbot.

    Thứ thay đổi sẽ là vai trò của ứng dụng.

    Và khi đó Gemini 3.5 Flash không còn là sản phẩm chính nữa.

    Nó giống động cơ phía sau cho một cách sử dụng máy tính khác với hiện tại.

    Minh họa chiến lược AI mới của Google khi Gemini chuyển từ chatbot sang lớp làm việc trong hệ sinh thái
    Hình minh họa phân tích chiến lược AI mới của Google với Gemini 3.5, workflow và tương lai hậu chatbot.

    Có thể thứ Google vừa giới thiệu không phải AI mạnh hơn. Mà là ý tưởng rằng trong tương lai, phần mềm sẽ bớt được mở ra và bắt đầu tự làm việc nhiều hơn.

    Vì sao Google không còn muốn cạnh tranh chatbot và cuộc chiến AI có thể đang đổi hướng?

    Nhìn từ bên ngoài, cuộc đua AI vài năm qua khá dễ hiểu.

    Mỗi hãng đều có một cửa sổ chat.

    Người dùng mở lên, nhập câu hỏi, nhận câu trả lời rồi so sánh xem ai nhanh hơn, thông minh hơn hoặc tự nhiên hơn.

    Mô hình này hiệu quả tới mức nhiều người bắt đầu mặc định rằng chatbot chính là hình dạng cuối cùng của AI.

    Nhưng nếu nhìn kỹ hơn sẽ thấy có một điểm hơi lạ.

    Con người thật ra không dành phần lớn thời gian làm việc trong cửa sổ chat.

    Chúng ta làm việc trong email, trình duyệt, tài liệu, lịch, ứng dụng ghi chú, bảng tính và hàng chục luồng thao tác nhỏ khác nhau.

    Đó là giới hạn khá rõ của chatbot.

    Nó rất giỏi trả lời nhưng lại đứng ngoài ngữ cảnh.

    Ví dụ nếu muốn chuẩn bị cho một cuộc họp, chatbot có thể giúp viết checklist hoặc tóm tắt tài liệu. Nhưng người dùng vẫn phải tự tìm email, mở lịch, đọc tài liệu, gom dữ liệu rồi quay lại đặt câu hỏi.

    Nói cách khác, AI thông minh hơn nhưng quy trình làm việc chưa thay đổi nhiều.

    Đây có thể là lý do khiến Google chọn hướng đi khác.

    Thay vì cố tạo nơi để hỏi tốt hơn, họ đang thử tạo nơi để công việc tự kết nối với nhau.

    Điểm này nghe khá giống những gì từng xảy ra với internet trước đây.

    Ngày đầu của web, người dùng phải nhớ địa chỉ website.

    Sau đó xuất hiện công cụ tìm kiếm.

    Rồi tới giai đoạn ứng dụng gom mọi thứ về một chỗ.

    Bây giờ AI có thể đang mở ra một lớp tiếp theo — nơi người dùng không cần nghĩ quá nhiều về ứng dụng đang dùng.

    Điều quan trọng ở đây không nằm ở việc AI làm được thêm một việc.

    Nó nằm ở việc AI bắt đầu nối nhiều việc nhỏ thành một quá trình liên tục.

    Đó là lý do những thứ Google công bố lần này nhìn qua rất khác nhau nhưng lại có cùng một hướng: AI xuất hiện sớm hơn trong quy trình và biến mất nhiều hơn khỏi giao diện.

    Search không còn đơn thuần là nơi tìm thông tin.

    Trợ lý không còn chỉ là nơi nhập prompt.

    Tài liệu không còn chỉ là nơi tạo nội dung.

    Mọi thứ bắt đầu chuyển từ phản hồi sang hỗ trợ hoàn thành.

    Đây cũng là lý do mình thấy cách gọi “AI assistant” đang bắt đầu hơi cũ.

    Assistant gợi cảm giác có một thực thể đứng cạnh chờ được yêu cầu.

    Nhưng hướng đi mới giống một hệ thống tự hiểu việc đang diễn ra và tham gia vào trước khi được gọi tên.

    Nếu điều đó xảy ra thật, cuộc chiến AI vài năm tới có thể sẽ không còn xoay quanh câu hỏi model nào mạnh hơn.

    Nó sẽ xoay quanh câu hỏi khó hơn nhiều.

    Ai kiểm soát được ngữ cảnh làm việc của người dùng.

    Ai kết nối được nhiều công cụ hơn.

    Và ai khiến con người ít phải chuyển đổi giữa các ứng dụng hơn.

    Đó là lúc chatbot có thể vẫn tồn tại, nhưng không còn là thứ quan trọng nhất nữa.

    Có thể Google không muốn thắng cuộc đua chatbot. Họ đang cố bỏ qua nó để đi thẳng tới lớp giao diện tiếp theo của máy tính.

    Google đang đưa AI đi đâu

    Nếu AI bắt đầu làm việc thay người dùng, điều gì sẽ thay đổi nhiều nhất?

    Điều thú vị của những thay đổi Google vừa giới thiệu là chúng không cố làm AI trở nên “ấn tượng” hơn theo cách dễ nhìn thấy. Không có quá nhiều màn demo kiểu giải toán khó hơn hay đạt điểm benchmark cao hơn. Thay vào đó, phần lớn tính năng đều xoay quanh một câu hỏi thực tế hơn nhiều: nếu AI đủ hiểu ngữ cảnh và đủ nhanh để tham gia trực tiếp vào công việc, cách chúng ta sử dụng máy tính sẽ thay đổi ra sao?

    Có lẽ thay đổi lớn nhất sẽ không nằm ở chuyện AI làm được nhiều việc hơn, mà nằm ở việc con người phải tự làm ít bước hơn.

    Trong phần lớn lịch sử máy tính cá nhân, gần như mọi thao tác đều dựa trên cùng một logic. Người dùng biết mình muốn gì, mở đúng ứng dụng, tìm đúng dữ liệu rồi tự kết nối các bước lại với nhau. Máy tính rất mạnh nhưng gần như không hiểu bối cảnh. Nó chờ lệnh rồi thực hiện.

    AI tạo sinh đã thay đổi một phần điều đó bằng khả năng hiểu ngôn ngữ tự nhiên. Nhưng đến hiện tại, phần lớn công cụ vẫn hoạt động như một lớp hỗ trợ nằm bên cạnh quy trình làm việc chứ chưa thật sự thay đổi quy trình đó. Chúng ta vẫn phải mở email, chuyển sang tài liệu, tìm lại cuộc họp cũ rồi quay lại cửa sổ AI để hỏi.

    Những gì Google đang thử lần này cho thấy một hướng khác. Thay vì để người dùng đóng vai trò người điều phối, AI bắt đầu được đặt vào vị trí theo dõi bối cảnh và kết nối các bước với nhau. Khi lịch, email, tài liệu và tìm kiếm bắt đầu chia sẻ ngữ cảnh tốt hơn, giá trị của AI không còn nằm ở từng câu trả lời riêng lẻ nữa. Giá trị bắt đầu xuất hiện ở phần chuyển tiếp giữa các công việc.

    Nghe có vẻ nhỏ nhưng đây là nơi rất nhiều thời gian bị tiêu tốn mỗi ngày. Phần lớn công việc văn phòng không khó vì từng tác vụ quá phức tạp. Nó mệt vì phải chuyển đổi liên tục giữa đọc, tìm, tổng hợp, ghi nhớ rồi quyết định. Nếu một lớp AI có thể giảm bớt phần ma sát đó, trải nghiệm sử dụng máy tính sẽ thay đổi nhiều hơn việc tăng thêm vài phần trăm chất lượng trả lời.

    Đây cũng là lý do mình nghĩ cuộc cạnh tranh AI vài năm tới sẽ không còn chỉ xoay quanh model. Một model tốt nhưng đứng ngoài hệ sinh thái chưa chắc tạo ra thay đổi lớn bằng một model đủ tốt nhưng được đặt đúng nơi trong quy trình làm việc.

    Điểm đáng chú ý là cách tiếp cận này cũng kéo theo một sự đánh đổi mới. Khi AI hiểu ngữ cảnh sâu hơn để giúp nhiều hơn, nó đồng thời cần tiếp cận nhiều lớp dữ liệu hơn trước. Điều đó khiến câu chuyện không còn chỉ là công nghệ mà bắt đầu liên quan tới quyền riêng tư, mức độ kiểm soát và việc người dùng sẵn sàng giao bao nhiêu quyền quyết định cho hệ thống.

    Đó có thể sẽ là câu hỏi thú vị nhất sau đợt công bố lần này. Không phải liệu AI có đủ thông minh hay không, mà là khi AI đủ hữu ích để làm việc thay một phần quy trình, chúng ta có còn muốn tự làm mọi thứ như trước nữa không.

    Thứ Google đang thử xây có thể không phải trợ lý tốt hơn. Nó là một môi trường nơi việc sử dụng phần mềm bắt đầu chuyển từ thao tác sang điều phối.

    Điều này khác ChatGPT hay Claude ở đâu và vì sao Google đang chọn một cuộc chơi khó hơn?

    Nếu chỉ nhìn từ góc độ người dùng phổ thông, rất dễ đặt câu hỏi: cuối cùng thì khác nhau ở đâu? Mở ChatGPT cũng hỏi được, mở Claude cũng làm việc được, Gemini cũng đang làm những thứ tương tự. Tại sao lại xem hướng đi lần này của Google là một thay đổi lớn hơn chuyện ra thêm model?

    Có lẽ điểm khác biệt nằm ở nơi AI được đặt vào.

    Phần lớn công cụ AI hiện tại, dù rất mạnh, vẫn đang tồn tại như một nơi để đi tới. Người dùng mở ứng dụng, bắt đầu một phiên làm việc rồi quay lại các công cụ khác sau khi có kết quả. Đây là mô hình cực kỳ hợp lý trong giai đoạn đầu vì nó đơn giản và dễ hiểu. Nhưng càng dùng lâu càng xuất hiện một giới hạn khá quen thuộc: AI giải quyết được từng phần việc nhưng chưa thật sự thay đổi cách công việc diễn ra.

    Google dường như đang chọn hướng ngược lại. Thay vì tạo một nơi để tập trung mọi việc vào đó, họ thử đưa AI đi ngược trở lại các công cụ người dùng vốn đã dùng hàng ngày. Search, Gmail, Calendar, Docs hay Android không bị thay thế. Chúng trở thành môi trường để AI xuất hiện tự nhiên hơn.

    Điểm này làm mình thấy chiến lược của Google thú vị nhưng cũng khó hơn nhiều.

    Làm một chatbot tốt là bài toán mô hình. Làm một lớp AI hoạt động xuyên hệ sinh thái lại là bài toán sản phẩm. Nó đòi hỏi tốc độ đủ nhanh, hiểu ngữ cảnh đủ tốt, đồng bộ dữ liệu đủ ổn định và quan trọng hơn cả là khiến người dùng cảm thấy mọi thứ diễn ra tự nhiên chứ không phải bị AI chen ngang.

    Đây là thứ từng xảy ra với smartphone trước đây.

    Những ứng dụng đầu tiên cố kéo người dùng vào bên trong chúng. Sau đó hệ điều hành bắt đầu hấp thụ nhiều chức năng hơn và người dùng dần ít nghĩ tới chuyện đang mở ứng dụng nào. Điều quan trọng chuyển từ “app nào tốt hơn” sang “toàn bộ trải nghiệm có liền mạch không”.

    AI có thể đang đi qua một quá trình tương tự.

    Nếu điều đó đúng thì vài năm tới chúng ta có thể sẽ bớt hỏi AI nào thông minh hơn và bắt đầu hỏi AI nào hiểu mình đang làm gì tốt hơn. Không phải vì model không còn quan trọng, mà vì khi chất lượng mô hình tiến gần nhau hơn, giá trị sẽ chuyển sang nơi AI xuất hiện trong quy trình làm việc.

    Đó cũng là lý do mình không nghĩ Google đang cố thắng bằng một chatbot tốt hơn.

    Họ đang đặt cược rằng người dùng cuối cùng sẽ không muốn mở thêm một công cụ mới. Họ sẽ muốn công cụ hiện tại tự thông minh hơn.

    Nếu điều đó xảy ra, người chiến thắng có thể không phải nơi có model mạnh nhất. Mà là nơi khiến AI biến mất khỏi giao diện nhưng xuất hiện đúng lúc nhất.

    Khác biệt lớn nhất của cuộc đua AI có thể không còn nằm ở câu trả lời tốt hơn. Nó nằm ở việc ai khiến người dùng ít phải nghĩ hơn để hoàn thành cùng một công việc.

    Nếu Google đúng, chatbot có thể chỉ là giai đoạn chuyển tiếp của AI

    Có một chi tiết khá thú vị nếu nhìn lại lịch sử công nghệ. Rất nhiều giao diện lớn cuối cùng đều không tồn tại theo hình dạng ban đầu.

    Thời kỳ đầu của internet, chúng ta nhớ địa chỉ website.

    Sau đó công cụ tìm kiếm xuất hiện và việc nhớ địa chỉ trở nên ít quan trọng hơn.

    Khi smartphone phổ biến, ứng dụng trở thành trung tâm của mọi trải nghiệm. Nhưng rồi rất nhiều thứ lại bị hút ngược vào hệ điều hành thông qua tìm kiếm, widget, thông báo và các lớp tự động hóa.

    Điều đó không có nghĩa website hay ứng dụng biến mất. Chúng chỉ lùi xuống phía sau.

    Mình bắt đầu có cảm giác AI cũng đang đi vào giai đoạn tương tự.

    Hai năm qua chatbot là hình dạng dễ hiểu nhất để giới thiệu AI với thế giới. Nó trực quan, ai cũng biết cách dùng và đủ khác biệt để tạo ra cảm giác đây là một kỷ nguyên mới. Nhưng càng dùng lâu càng thấy một giới hạn khá rõ: phần lớn thời gian chúng ta không sống trong cửa sổ chat.

    Chúng ta sống trong công việc, lịch, tài liệu, tìm kiếm, trao đổi và hàng chục ngữ cảnh nhỏ diễn ra đồng thời mỗi ngày.

    Đó là lý do điều mình thấy đáng chú ý nhất ở Google I/O lần này không phải Gemini 3.5 Flash mạnh hơn bao nhiêu hay AI trả lời nhanh hơn thế nào. Điều đáng chú ý hơn là Google đang bắt đầu cư xử như thể chatbot không còn là sản phẩm cuối cùng nữa.

    Thay vì kéo mọi thứ về một nơi để trò chuyện với AI, họ thử làm điều ngược lại: để AI đi tới nơi công việc đang diễn ra.

    Nếu hướng đi này thành công, vài năm tới chúng ta có thể sẽ ít mở ứng dụng AI hơn hiện tại. Không phải vì AI yếu đi mà vì nó bắt đầu được nhúng vào mọi nơi đủ tự nhiên để người dùng không còn nghĩ mình đang dùng AI nữa.

    Lúc đó, một thay đổi khá thú vị có thể xảy ra.

    Con người sẽ bớt dành thời gian tìm thông tin hơn.

    Bớt chuyển đổi giữa công cụ hơn.

    Bớt phải nhớ đang làm dở ở đâu hơn.

    Và nhiều thời gian hơn sẽ chuyển sang phần đánh giá, quyết định và chọn điều gì đáng làm tiếp theo.

    Nghe hơi quen.

    Đây cũng chính là hướng mà những bài gần đây mình từng viết đang dần chạm tới: AI Search làm việc đọc internet thay người dùng, Internet hậu SEO đặt lại vai trò của traffic, Trust Economy làm giá trị dịch chuyển từ thông tin sang niềm tin. Còn lần này, Google có vẻ đang thử dịch chuyển thêm một bước nữa — từ việc trả lời thay con người sang bắt đầu xử lý thay con người.

    Điều đó không có nghĩa ứng dụng sẽ biến mất.

    Cũng không có nghĩa AI sẽ tự làm mọi thứ.

    Nhưng có thể chúng ta đang nhìn thấy một thay đổi lớn hơn việc ra mắt thêm một model mới.

    Thay đổi đó là máy tính đang bắt đầu học cách hiểu công việc thay vì chỉ chờ lệnh.

    Và nếu điều đó thật sự xảy ra, vài năm nữa nhìn lại, chatbot có thể sẽ được nhớ tới giống cách chúng ta từng nhớ những ô tìm kiếm đầu tiên của internet — rất quan trọng, nhưng chỉ là giao diện mở đầu cho một thứ lớn hơn xuất hiện sau đó.

    Có thể điều Google vừa giới thiệu không phải tương lai của chatbot. Nó là dấu hiệu đầu tiên của một thời kỳ mà AI không còn là nơi để hỏi, mà trở thành cách mặc định để làm việc với máy tính.


    #googleio #gemini #aiworkflow #futureofai #productstrategy #snapsavevn

  • Gemini Omni là gì? Google đang chuẩn bị điều gì với AI đa phương thức?

    Gemini Omni là gì? Google đang chuẩn bị điều gì với AI đa phương thức?

    Gemini Omni là gì? Vì sao Google có vẻ không còn muốn làm chatbot nữa?

    Cảm giác rõ nhất khi nhìn vào các hãng AI hiện tại là họ không còn muốn dừng ở chatbot.

    Khoảng một năm trước, cuộc đua AI chủ yếu xoay quanh chuyện model nào trả lời thông minh hơn. ChatGPT gây bùng nổ vì khả năng chat tự nhiên. Claude nổi lên nhờ context dài. Gemini được Google đẩy mạnh để cạnh tranh trực tiếp với OpenAI. Nhưng thời gian gần đây, hướng đi của toàn bộ ngành AI bắt đầu thay đổi khá rõ.

    Các hãng không còn chỉ tập trung vào việc “AI trả lời tốt hơn”, mà đang cố biến AI thành một lớp nằm trên workflow, nội dung và hệ sinh thái sản phẩm.

    Đó cũng là lý do cái tên Gemini Omni bắt đầu được chú ý.

    Hiện tại, Google chưa công bố đầy đủ Gemini Omni như một sản phẩm hoàn chỉnh. Phần lớn thông tin đang xuất hiện đến từ các đoạn code, UI string, metadata và một số demo test được phát hiện trong hệ sinh thái Gemini. Một vài cụm như “Powered by Omni” hoặc “Create with Gemini Omni” đã bắt đầu xuất hiện trong các bản thử nghiệm nội bộ.

    Điều thú vị là leak lần này không giống nhiều tin đồn AI trước đây kiểu “concept tương lai”. Những dấu hiệu hiện tại cho thấy Google thực sự đang thử nghiệm một hướng đi mới cho Gemini.

    Và phần đáng chú ý nhất không nằm ở chữ “Omni”. Nó nằm ở việc Google có vẻ đang muốn biến Gemini thành nhiều hơn một chatbot.

    Trong vài năm đầu của AI, phần lớn mọi người dùng AI theo cách khá đơn giản: mở chatbox, nhập câu hỏi và nhận lại câu trả lời. Nhưng hiện tại, các hãng AI bắt đầu nhận ra một vấn đề rất lớn: chatbot là trải nghiệm tốt để bắt đầu, nhưng không phải đích đến cuối cùng.

    Người dùng không chỉ muốn AI “trả lời”. Họ muốn AI:

    – chỉnh sửa hình ảnh

    – tạo video

    – xử lý workflow

    – đọc dữ liệu

    – hỗ trợ công việc thật

    – kết nối với hệ sinh thái sản phẩm

    Đây là lúc khái niệm “multimodal AI” bắt đầu trở nên quan trọng hơn rất nhiều.

    Nếu nhìn vào hướng đi của Google thời gian gần đây sẽ thấy mọi thứ đang dần kết nối lại với nhau. Gemini, Veo, Android AI, Gmail AI, Docs AI và các workflow AI trong Workspace bắt đầu tạo cảm giác giống những mảnh ghép của cùng một hệ thống thay vì các công cụ tách rời.

    Theo mình, đây mới là phần đáng chú ý nhất của Gemini Omni.

    Nó có thể không chỉ là một model AI mới. Nó có thể là dấu hiệu cho thấy Google đang muốn gom text, image, video, audio và workflow AI vào cùng một hệ.

    Đây là thay đổi rất lớn.

    Trước đây, AI thường hoạt động theo kiểu “mỗi công cụ làm một việc”. Một app tạo ảnh. Một app tạo video. Một chatbot để hỏi đáp. Nhưng các hãng AI hiện tại bắt đầu đi theo hướng khác: tạo ra một lớp AI có thể xử lý nhiều loại nội dung và nhiều workflow trong cùng một nơi.

    OpenAI đang làm điều đó với GPT-4o và hệ ecosystem ChatGPT. Anthropic đi theo hướng workflow và AI agent với Claude. Và Google có vẻ đang muốn dùng Gemini Omni để kết nối toàn bộ sức mạnh từ ecosystem khổng lồ của họ.

    Điều này cũng giải thích vì sao nhiều leak hiện tại của Gemini Omni liên quan mạnh đến video và multimedia. Google không thiếu model AI mạnh. Thứ họ thật sự có lợi thế là hệ sinh thái: YouTube, Android, Chrome, Workspace, Search và lượng dữ liệu khổng lồ từ internet.

    Nếu AI được đặt ở giữa toàn bộ hệ sinh thái đó, Gemini sẽ không còn chỉ là chatbot nữa. Nó có thể trở thành một lớp AI nằm trên toàn bộ workflow digital của Google.

    Đó là lý do mình nghĩ Gemini Omni đáng chú ý hơn nhiều so với một “model leak” thông thường.

    Đây có thể là dấu hiệu cho thấy cuộc đua AI đang chuyển sang giai đoạn mới: không còn là chatbot nào thông minh hơn, mà là hệ AI nào kết nối được nhiều workflow hơn.

    Minh họa Gemini Omni kết nối AI workflow, video, image và hệ sinh thái Google
    Hình minh họa Gemini Omni với hệ AI đa phương thức kết nối text, video, image và workflow trong hệ sinh thái Google.

    Google có vẻ không còn muốn Gemini chỉ là nơi để chat. Họ đang muốn biến nó thành lớp AI nằm trên toàn bộ ecosystem.

    “Omni” thực ra có thể nghĩa là gì và vì sao đây mới là phần quan trọng nhất?

    Nếu chỉ nhìn cái tên Gemini Omni theo kiểu một model AI mới thì thật ra chưa có gì quá đặc biệt. AI bây giờ gần như tháng nào cũng có model mới, benchmark mới và demo mới. Nhưng cảm giác lần này hơi khác. Thứ đáng chú ý không nằm ở chuyện Gemini Omni mạnh hơn bao nhiêu phần trăm hay tạo video đẹp hơn bao nhiêu. Thứ đáng chú ý là hướng Google đang đi.

    Chữ “Omni” nhiều khả năng không đơn giản chỉ là tên marketing. Nó giống cách Google đang ám chỉ một hệ AI đa phương thức thật sự, nơi text, image, video, audio và workflow bắt đầu được gom vào cùng một trải nghiệm thay vì tách thành nhiều app riêng lẻ.

    Đây là thứ rất nhiều hãng AI đang cố làm, nhưng Google có lẽ là công ty sở hữu ecosystem phù hợp nhất cho hướng đi này.

    Chỉ cần nhìn vào hệ sinh thái hiện tại của Google sẽ thấy họ gần như có đủ mọi mảnh ghép cần thiết. YouTube cho video. Android cho mobile ecosystem. Chrome cho browser. Gmail cho email. Docs cho workflow văn phòng. Search cho dữ liệu internet. Veo cho AI video. Gemini cho conversational AI. Khi những thứ này bắt đầu được nối bằng một lớp AI chung, trải nghiệm sẽ khác hoàn toàn chatbot kiểu cũ.

    Đó cũng là lý do nhiều người đang xem Gemini Omni như dấu hiệu Google muốn biến Gemini thành một “AI operating layer” thay vì chỉ là một nơi để chat.

    Trước đây, khi dùng AI, workflow thường bị chia nhỏ. Muốn tạo ảnh thì mở một app khác. Muốn edit video thì dùng tool khác. Muốn viết content thì quay lại chatbot. Toàn bộ trải nghiệm khá rời rạc. Nhưng hướng đi của AI hiện tại đang cố xóa cảm giác đó.

    Theo các leak hiện tại, Gemini Omni có vẻ được thiết kế theo kiểu workflow AI liền mạch hơn. Ví dụ người dùng có thể bắt đầu bằng text, sau đó tạo hình, chuyển sang video rồi tiếp tục chỉnh sửa ngay trong cùng hệ thống. Nếu điều này đúng, đây sẽ là bước rất lớn so với kiểu chatbot truyền thống.

    Điều thú vị là cuộc đua AI hiện tại cũng đang thay đổi theo hướng này. Vài năm trước, các hãng cạnh tranh bằng việc model nào trả lời thông minh hơn. Nhưng bây giờ, model mạnh gần như đã trở thành “điều bắt buộc”. Thứ các hãng bắt đầu cạnh tranh là ecosystem và workflow.

    OpenAI đang cố biến ChatGPT thành một hệ AI có thể làm nhiều việc cùng lúc. Claude đi theo hướng AI workflow và context dài. Microsoft muốn đưa Copilot vào toàn bộ Office và Windows. Google có vẻ cũng đang đi chính xác hướng đó với Gemini Omni.

    Theo mình, đây mới là phần quan trọng nhất của cuộc đua AI hiện tại. AI không còn chỉ là chatbot nữa. Nó đang dần trở thành lớp nằm giữa người dùng và internet.

    Một ví dụ rất dễ hình dung là việc edit video. Trước đây, workflow video thường khá phức tạp: viết script, tạo asset, dựng video, chỉnh timeline rồi render bằng nhiều phần mềm khác nhau. Nhưng nếu AI có thể xử lý phần lớn workflow này trong cùng một hệ thống, trải nghiệm làm content sẽ thay đổi rất mạnh.

    Đó cũng là lý do các leak về Gemini Omni liên quan nhiều đến multimedia và video khiến giới AI chú ý hơn bình thường. Google có lợi thế rất lớn ở video nhờ YouTube và Veo. Nếu Gemini Omni thật sự kết nối được AI chat, AI video và workflow chỉnh sửa trong cùng một nơi, đây có thể là bước đi rất lớn của Google trong cuộc đua AI đa phương thức.

    Tất nhiên, hiện tại vẫn còn quá sớm để khẳng định Gemini Omni sẽ hoạt động chính xác ra sao. Google chưa công bố đầy đủ và phần lớn mọi thứ mới dừng ở mức leak hoặc demo thử nghiệm. Nhưng hướng đi thì đang ngày càng rõ hơn.

    Các hãng AI dường như đều đang cố thoát khỏi “chatbox”. Và Google có vẻ muốn dùng Gemini Omni để biến AI thành một lớp nằm trên toàn bộ hệ sinh thái của họ.

    Cuộc đua AI hiện tại có thể không còn là chatbot nào thông minh hơn. Nó đang dần trở thành cuộc đua xem hệ AI nào kết nối được nhiều workflow hơn.

    Gemini Omni có thể thay đổi AI video và workflow content như thế nào?

    Nếu nhìn vào các leak hiện tại, phần được nhắc nhiều nhất của Gemini Omni gần như đều xoay quanh video và multimedia. Đây cũng là lý do nhiều người trong giới AI bắt đầu chú ý hơn bình thường. Vì nếu Google thật sự đang gom Gemini, Veo và workflow AI vào cùng một hệ, tác động sẽ không chỉ nằm ở chuyện “tạo video bằng prompt”.

    Nó có thể thay đổi luôn cách người dùng làm content.

    Trong vài năm qua, AI video phát triển rất nhanh nhưng workflow thực tế vẫn khá rời rạc. Muốn tạo video AI thường phải đi qua rất nhiều bước: viết script bằng chatbot, tạo ảnh bằng một tool khác, animate bằng AI video rồi mang sang phần mềm edit để hoàn thiện. Dù AI đã mạnh hơn rất nhiều, cảm giác chung vẫn là “ghép nhiều công cụ lại với nhau”.

    Đây là điểm Gemini Omni có thể đang muốn thay đổi.

    Theo các demo và thông tin bị leak, Google dường như đang hướng tới kiểu workflow liền mạch hơn. Người dùng có thể bắt đầu bằng text, sau đó tạo visual, chuyển sang video rồi tiếp tục chỉnh sửa ngay trong cùng một hệ AI thay vì nhảy qua nhiều app khác nhau.

    Nghe có vẻ chỉ là cải thiện workflow, nhưng thật ra đây là thay đổi rất lớn.

    Một creator hiện tại thường mất rất nhiều thời gian cho các bước trung gian. Ví dụ muốn làm một video ngắn AI sẽ phải nghĩ idea, viết hook, tạo asset, dựng video, thêm subtitle rồi tối ưu format cho từng nền tảng. Nếu AI có thể xử lý phần lớn những bước này trong cùng một workflow, tốc độ sản xuất content sẽ thay đổi cực mạnh.

    Đó cũng là lý do nhiều người xem Gemini Omni như bước tiếp theo sau chatbot AI. Google có vẻ không chỉ muốn AI “trả lời”, mà muốn AI tham gia trực tiếp vào pipeline tạo nội dung.

    Một điểm rất đáng chú ý là Google đang có lợi thế cực lớn ở video nhờ YouTube. Đây là thứ OpenAI hay Anthropic chưa có. Nếu Gemini Omni được kết nối sâu với hệ sinh thái video của Google, AI của họ sẽ có nhiều lợi thế về workflow thực tế hơn chỉ benchmark model.

    Ví dụ rất dễ hình dung là một creator có thể dùng AI để lên idea video từ trend YouTube, tạo thumbnail, generate clip ngắn, remix nhiều version khác nhau rồi tối ưu cho Shorts trong cùng một hệ workflow. Đây là kiểu trải nghiệm mà các hãng AI hiện tại đều đang cố hướng tới.

    Theo mình, đây mới là phần đáng chú ý nhất của cuộc đua AI video hiện nay. Cuộc chơi không còn đơn giản là “AI tạo video đẹp hơn”. Nó đang dần trở thành cuộc đua xem hệ AI nào giúp người dùng tạo content nhanh và liền mạch hơn.

    Đây cũng là lý do các khái niệm như AI Agent, MCP hay workflow AI bắt đầu liên kết với nhau. Một model video mạnh thôi chưa đủ. Điều quan trọng hơn là AI có thể tham gia vào toàn bộ quá trình làm việc hay không.

    Nếu trước đây AI video giống một công cụ generate clip độc lập, thì hướng đi mới đang biến AI thành một phần nằm giữa toàn bộ workflow content.

    Điều thú vị là đây không chỉ ảnh hưởng tới creator lớn. Những creator solo hoặc business nhỏ có thể là nhóm thay đổi mạnh nhất.

    Trước đây, để vận hành content video đều đặn cần khá nhiều người: viết script, design thumbnail, dựng video, edit và tối ưu social. Nhưng khi AI bắt đầu gom nhiều workflow vào một hệ thống, một người có thể xử lý khối lượng công việc lớn hơn rất nhiều.

    Đây cũng là lý do khái niệm “one-person content business” xuất hiện ngày càng nhiều trong thời AI.

    Tất nhiên, hiện tại Gemini Omni vẫn chưa public đầy đủ nên còn quá sớm để khẳng định Google đã làm được tới đâu. Nhưng hướng đi đang ngày càng rõ hơn. AI video không còn chỉ là chuyện generate vài giây footage bằng prompt nữa.

    Google có vẻ đang muốn biến AI video thành một workflow content hoàn chỉnh.

    Cuộc đua AI video có thể đang chuyển từ “tạo clip bằng AI” sang “xây hệ AI làm content từ đầu đến cuối”.

    Đây không còn là chatbot nữa, AI đang dần trở thành một lớp nằm trên internet

    Nếu nhìn toàn bộ hướng đi của ngành AI trong khoảng một năm gần đây sẽ thấy một thay đổi rất rõ: các hãng AI đều đang cố thoát khỏi cái khung chatbox.

    Thời kỳ đầu của ChatGPT, mọi thứ khá đơn giản. Người dùng mở cửa sổ chat, nhập câu hỏi rồi nhận lại câu trả lời. Đó là trải nghiệm khiến AI bùng nổ rất nhanh vì nó dễ hiểu và dễ tiếp cận. Nhưng sau giai đoạn đầu, giới hạn của chatbot cũng bắt đầu lộ ra.

    Chatbot rất giỏi trả lời, nhưng công việc thật ngoài đời không chỉ là hỏi và đáp.

    Một workflow thực tế thường liên quan tới nhiều thứ hơn rất nhiều: dữ liệu, file, email, hình ảnh, video, lịch làm việc, dashboard, công cụ quản lý và hàng loạt thao tác nhỏ khác nhau. Đây là lý do các hãng AI bắt đầu chuyển hướng từ “AI chat” sang “AI workflow”.

    Đó cũng là lúc những khái niệm như MCP, AI Agent hay AI operating layer bắt đầu xuất hiện ngày càng nhiều.

    Nếu đọc riêng từng khái niệm sẽ thấy hơi kỹ thuật, nhưng thực ra tất cả đều đang đi về cùng một hướng: AI không còn muốn đứng riêng trong một ô chat nữa. Nó muốn nằm giữa người dùng và workflow digital.

    Theo mình, Gemini Omni cũng là một phần trong hướng đi đó.

    Google có lợi thế rất lớn vì họ gần như đã sở hữu sẵn toàn bộ ecosystem internet mà người dùng dùng mỗi ngày. Search, Gmail, Docs, Android, Chrome, YouTube… tất cả đều là nơi dữ liệu và workflow đang diễn ra liên tục.

    Nếu AI được đặt ở giữa những workflow đó, trải nghiệm sẽ khác hoàn toàn chatbot truyền thống.

    Ví dụ hiện tại, nếu muốn làm content, người dùng thường phải tự mở rất nhiều công cụ: xem trend trên YouTube, research Google, viết outline trong Docs, tạo hình bằng AI rồi edit video ở phần mềm khác. Toàn bộ workflow vẫn khá phân mảnh.

    Nhưng nếu AI hiểu toàn bộ ngữ cảnh đó và bắt đầu xử lý workflow xuyên suốt, AI sẽ không còn là “một app”. Nó sẽ giống một lớp nằm trên internet.

    Đây cũng là lý do nhiều người trong ngành AI bắt đầu nói tới khái niệm “AI operating system”.

    Nghe hơi lớn lao, nhưng ý rất đơn giản. Trước đây, internet xoay quanh app. Người dùng phải tự mở app để làm việc. Nhưng trong tương lai, rất có thể người dùng chỉ giao mục tiêu cho AI, còn AI sẽ tự kết nối workflow phía sau.

    Ví dụ thay vì:

    mở Gmail → đọc email → copy dữ liệu → mở Docs → viết nội dung → tạo slide → export file

    … người dùng có thể chỉ cần nói:

    “Tóm tắt cuộc họp hôm nay rồi tạo draft proposal giúp tôi.”

    Phần còn lại sẽ do AI xử lý thông qua hệ sinh thái sản phẩm phía sau.

    Đây là thay đổi rất lớn trong cách con người làm việc với internet.

    Thật ra, dấu hiệu của xu hướng này đã xuất hiện khá rõ rồi. OpenAI đang thêm GPT Actions và connector. Microsoft đẩy Copilot vào Windows và Office. Claude tập trung mạnh vào workflow và context dài. Google có vẻ cũng đang muốn đi hướng tương tự với Gemini Omni.

    Theo mình, đây mới là cuộc đua AI thật sự trong vài năm tới.

    Model mạnh rồi sẽ dần trở thành “điều bắt buộc”. Nhưng thứ quyết định người dùng ở lại hệ nào sẽ là workflow, ecosystem và mức độ AI tham gia được vào công việc thật.

    Đó cũng là lý do Google rất đáng chú ý trong giai đoạn này. Họ có thể không luôn tạo ra chatbot gây wow mạnh nhất, nhưng lại sở hữu một trong những ecosystem lớn nhất internet.

    Nếu Gemini Omni thật sự là bước đi nhằm kết nối toàn bộ ecosystem đó bằng AI, đây có thể là hướng đi quan trọng hơn rất nhiều so với chuyện benchmark model.

    AI đang dần chuyển từ “một công cụ để hỏi” thành “một lớp nằm trên toàn bộ workflow internet”.

    Google có thật sự đang nắm lợi thế trong cuộc đua AI không?

    Nếu chỉ nhìn vào ecosystem, Google gần như là công ty có vị trí mạnh nhất để xây một hệ AI toàn diện. Họ có Search, YouTube, Android, Chrome, Gmail, Maps, Workspace và lượng dữ liệu khổng lồ từ internet. Rất ít công ty công nghệ hiện tại sở hữu hệ sinh thái đủ rộng như vậy.

    Đó cũng là lý do mỗi khi Google leak một thứ như Gemini Omni, giới AI thường chú ý khá nhanh. Vì nếu Google thật sự kết nối được AI vào toàn bộ hệ sinh thái của họ, tác động sẽ rất lớn.

    Nhưng điều thú vị là dù có lợi thế cực mạnh về hạ tầng, Google vẫn chưa tạo được cảm giác “dẫn đầu AI” rõ ràng như OpenAI.

    Đây là một nghịch lý khá lạ của cuộc đua AI hiện tại.

    OpenAI không có ecosystem internet lớn như Google, nhưng lại tạo được trải nghiệm AI rất rõ ràng cho người dùng. ChatGPT khiến AI trở nên đơn giản: mở lên và dùng ngay. Trong khi đó, hệ AI của Google đôi khi tạo cảm giác hơi phân mảnh.

    Gemini, Bard trước đây, Workspace AI, AI Search, Veo, NotebookLM… rất nhiều sản phẩm mạnh, nhưng trải nghiệm tổng thể vẫn chưa thật sự liền mạch trong mắt người dùng phổ thông.

    Đây cũng là lý do mình nghĩ cuộc đua AI hiện tại không còn đơn giản là “ai có model mạnh hơn”.

    Model mạnh giờ gần như đã trở thành tiêu chuẩn cơ bản. GPT-4o mạnh. Claude mạnh. Gemini cũng mạnh. Nhưng càng về sau, người dùng càng quan tâm tới trải nghiệm thực tế hơn là benchmark.

    Ví dụ rất đơn giản là workflow hàng ngày. Nếu AI giúp tiết kiệm được thời gian thật, kết nối được dữ liệu thật và xử lý công việc thật, người dùng sẽ ở lại hệ đó dù benchmark chênh lệch không nhiều.

    Đây là nơi Google vừa rất mạnh, vừa có rủi ro lớn.

    Họ mạnh vì ecosystem quá rộng. Nhưng họ cũng đối mặt với bài toán rất khó: làm sao biến toàn bộ hệ sinh thái khổng lồ đó thành một trải nghiệm AI đủ đơn giản cho người dùng.

    Theo mình, đây mới là phần khó nhất của AI hiện tại.

    Xây model mạnh đã khó. Nhưng biến AI thành thứ người dùng thật sự muốn dùng mỗi ngày còn khó hơn.

    Google từng gặp vấn đề tương tự với rất nhiều sản phẩm trước đây. Công nghệ mạnh nhưng UX chưa tạo được cảm giác “gắn liền với cuộc sống” như cách Apple hoặc OpenAI thường làm.

    Đó là lý do Gemini Omni dù rất đáng chú ý nhưng vẫn cần nhìn khá tỉnh táo.

    Hiện tại phần lớn thông tin vẫn đang ở mức leak hoặc demo nội bộ. Chưa ai biết chính xác Google sẽ public nó theo dạng nào, workflow thật ra sao hoặc mức độ tích hợp sâu tới đâu.

    Một vấn đề khác là AI hiện tại vẫn còn khá thiếu consistency.

    AI có thể demo rất ấn tượng trong video giới thiệu, nhưng trải nghiệm thực tế lại là câu chuyện khác. Đây là điều gần như mọi hãng AI hiện tại đều gặp phải.

    Ví dụ AI video có thể tạo clip đẹp, nhưng workflow dài vẫn chưa ổn định hoàn toàn. AI Agent có thể xử lý task đơn giản, nhưng các workflow phức tạp vẫn dễ lỗi. AI chat có thể rất thông minh, nhưng đôi khi vẫn hallucinate hoặc xử lý context chưa đúng.

    Đây là lý do mình nghĩ cuộc đua AI trong vài năm tới sẽ không còn xoay quanh việc “ai demo wow hơn”. Cuối cùng, thứ quyết định người thắng có lẽ vẫn là trải nghiệm thực tế.

    Google có đủ sức mạnh để xây một hệ AI rất lớn. Nhưng thứ họ cần chứng minh không còn là model mạnh nữa. Họ cần chứng minh rằng AI của họ có thể trở thành một phần tự nhiên trong workflow hàng ngày của người dùng.

    Và thật ra, đây cũng là bài toán lớn nhất của toàn bộ ngành AI hiện tại.

    AI không còn thiếu model mạnh. Thứ các hãng đang cạnh tranh bây giờ là ecosystem, workflow và trải nghiệm thực tế.

    Sau Gemini Omni, internet có thể bước sang giai đoạn “AI-first”

    Điều thú vị nhất về Gemini Omni có lẽ không nằm ở bản thân model. Thứ đáng chú ý hơn là cảm giác internet đang bắt đầu chuyển sang một giai đoạn mới, nơi AI không còn là “công cụ bổ sung”, mà dần trở thành lớp nằm giữa người dùng và mọi workflow digital.

    Trong nhiều năm, internet vận hành theo kiểu app-first. Người dùng muốn làm gì sẽ tự mở app tương ứng. Muốn gửi email thì mở Gmail. Muốn tìm thông tin thì mở Google Search. Muốn edit video thì dùng phần mềm dựng phim. Toàn bộ trải nghiệm khá phân mảnh.

    Nhưng AI đang khiến logic đó bắt đầu thay đổi.

    Càng về sau, người dùng có thể sẽ ít quan tâm mình đang dùng app nào hơn. Điều họ quan tâm là AI có giải quyết được mục tiêu nhanh hơn hay không.

    Ví dụ thay vì:

    mở nhiều app → copy dữ liệu → xử lý thủ công → chuyển workflow qua lại

    … người dùng có thể chỉ cần nói:

    “Tạo cho tôi một video recap từ tài liệu cuộc họp hôm nay rồi đăng draft lên workspace.”

    Phần còn lại sẽ do AI xử lý thông qua hàng loạt workflow phía sau.

    Đây là thay đổi rất lớn trong cách con người tương tác với internet.

    Và thật ra, rất nhiều dấu hiệu của giai đoạn “AI-first” đã bắt đầu xuất hiện rồi.

    Search đang chuyển từ danh sách link sang AI summary. Content workflow đang chuyển từ nhiều tool sang AI workflow. Creator đang dùng AI để build content pipeline nhanh hơn. Các hệ AI như ChatGPT, Claude hay Gemini đều đang cố trở thành nơi người dùng bắt đầu công việc thay vì chỉ là nơi để hỏi.

    Theo mình, Gemini Omni đáng chú ý vì nó cho thấy Google cũng đang đi rất mạnh theo hướng đó.

    Google có thể không còn muốn AI chỉ nằm trong một ô chat nữa. Họ có vẻ đang muốn AI trở thành lớp nằm trên toàn bộ ecosystem: YouTube, Search, Android, Workspace, Chrome và workflow internet hàng ngày.

    Nếu điều đó xảy ra thật, cách dùng internet trong vài năm tới có thể sẽ khác rất nhiều hiện tại.

    Người dùng sẽ không còn nghĩ theo kiểu:

    “Mình phải mở app nào để làm việc này?”

    … mà bắt đầu nghĩ:

    “Mình muốn AI xử lý việc này như thế nào?”

    Đó là khác biệt rất lớn.

    Điều thú vị là sự thay đổi này không chỉ ảnh hưởng tới Big Tech. Creator, freelancer, business nhỏ và những người làm digital có thể là nhóm thay đổi mạnh nhất.

    Một người hiện tại đã có thể dùng AI để research, viết content, tạo hình, dựng video, đọc analytics và tối ưu workflow nhanh hơn rất nhiều so với trước đây. Khi AI workflow tiếp tục mạnh lên, mô hình “one-person business” sẽ còn phát triển mạnh hơn nữa.

    Đây cũng là lý do nhiều người bắt đầu xem AI như lớp hạ tầng mới của internet thay vì chỉ là trend công nghệ.

    Tất nhiên, hiện tại vẫn còn quá sớm để khẳng định Gemini Omni sẽ thay đổi cuộc chơi tới mức nào. Google vẫn cần chứng minh rất nhiều thứ: workflow thật có mượt không, AI có đủ ổn định không và trải nghiệm có đủ đơn giản cho người dùng phổ thông không.

    Nhưng hướng đi của ngành AI thì đang ngày càng rõ hơn.

    Cuộc đua không còn chỉ là model nào trả lời thông minh hơn. Nó đang dần trở thành cuộc đua xem hệ AI nào có thể trở thành lớp nằm trên toàn bộ internet.

    Và nếu nhìn theo góc đó, Gemini Omni có thể không chỉ là một model AI mới.

    Nó có thể là dấu hiệu internet đang bắt đầu bước sang giai đoạn AI-first.


    #geminiomni #googleai #gemini #aifuture #aiworkflow #aiagent #snapsavevn