Bỏ qua đến nội dung

Cách Garfunkel phân tích video

Dán liên kết, Garfunkel sẽ biến video thành báo cáo có cấu trúc: nội dung được nói, hình ảnh trong video, cách video thu hút sự chú ý ngay từ đầu, cùng một bộ nhãn cho mọi bài đăng và, nếu bạn muốn, phản ứng của mọi người. Dưới đây là từng bước theo thứ tự.

Sao chép trang này dưới dạng Markdown để bạn dán vào trợ lý AI.

  1. Bước 01/08

    Lấy bài đăng

    Chúng tôi mở liên kết và tải video cùng thông tin nền tảng hiển thị về video đó: chú thích, người đăng và số lượt xem, lượt thích, bình luận và chia sẻ. Các con số được giữ nguyên như nền tảng cung cấp để sau này bạn có thể sắp xếp và so sánh bài đăng. Tệp video chỉ được lưu trong lúc xử lý và sẽ bị xóa khi phân tích xong.

    Lấy bài đăngĐường dẫn video được chuyển thành thẻ bài đăng có ảnh thu nhỏ, nhà sáng tạo, chú thích và số lượt xem, lượt thích, bình luận.Liên kết…/video/1842@creator1.2M84K1.1K
  2. Bước 02/08

    Tách video

    Chúng tôi kiểm tra video có âm thanh hay không, sau đó tách âm thanh khỏi hình ảnh để phân tích riêng từng phần. Âm thanh được chuyển sang bước chép lời, còn hình ảnh được chuyển sang bước chọn khung hình. Hai phần được kết hợp lại khi tóm tắt bài đăng.

    Tách videoVideo được tách thành hai phần: dải hình ảnh và dạng sóng âm thanh.VideoHình ảnhÂm thanh
  3. Bước 03/08

    Chép lời âm thanh

    Mô hình nhận dạng lời nói ghi lại mọi lời thoại trong video, kèm dấu thời gian ở từng dòng để bạn biết nội dung nào được nói vào lúc nào. Video có lời nói luôn được phân tích kèm bản chép lời. Nếu bước này gặp lỗi, hệ thống sẽ thử lại thay vì bỏ qua; bài đăng xử lý thất bại sẽ không bị tính phí.

    Mô hình: Qwen3-ASR-0.6B · một mô hình nhận dạng lời nói mã nguồn mở

    Xem trong thẻ Bản chép lời của kết quả

    Chép lời âm thanhDạng sóng âm thanh được chuyển thành ba dòng lời thoại, mỗi dòng có dấu thời gian.0:000:030:07Bản chép lời0:00
    Mẹo ở đây là…
    0:03
    làm nóng chảo trước,
    0:07
    rồi mới cho dầu vào.
  4. Bước 04/08

    Chọn khung hình

    Chúng tôi dùng thuật toán lấy mẫu khung hình để giảm số lượng khung hình mà vẫn giữ nguyên ý nghĩa tổng thể của video. Mô hình AI xem những khung hình được chọn cùng với bản chép lời trong các bước tiếp theo.

    Chọn khung hìnhMột dải dài gồm các khung hình gần như giống nhau được rút gọn còn vài khung, mỗi khung cho thấy một nội dung khác nhau.Tất cả khung hìnhKhung hình được chọn mẫu
  5. Bước 05/08

    Tóm tắt

    Mô hình AI đọc bản chép lời và chú thích, đồng thời xem các khung hình để hiểu toàn bộ bài đăng thay vì từng phần riêng lẻ. Mô hình viết bản tóm tắt ngắn và kể lại diễn biến theo thứ tự, từng đoạn một, gắn mỗi đoạn với một thời điểm trong video.

    Mô hình: gpt-6.1-sol · đọc bản chép lời và các khung hình được lấy mẫu cùng nhau

    Tóm tắtCác dòng lời thoại và khung hình được đưa vào thẻ tóm tắt, liệt kê lần lượt các diễn biến chính cùng dấu thời gian.Bản chép lời0:000:030:07Khung hìnhTóm tắtDiễn biến theo thứ tự0:00
    Giới thiệu mẹo
    0:04
    Làm nóng chảo trước
    0:09
    Cho thấy kết quả
  6. Bước 06/08

    Tìm cách video thu hút sự chú ý

    Mô hình xem kỹ vài giây đầu để xác định điều thu hút sự chú ý: lời nói hoặc hình ảnh nào gây chú ý, đó là kiểu mở đầu nào và xuất hiện vào lúc nào. Mô hình cũng ghi lại điều mở đầu hứa hẹn với người xem, cách video thực hiện lời hứa đó và lý do cách mở đầu ấy hiệu quả.

    Mô hình: gpt-6.1-sol · cùng mô hình và lượt xử lý với phần tóm tắt

    Xem thẻ Phần mở đầu thu hút trong kết quả

    Tìm cách video thu hút sự chú ýDòng thời gian của những giây mở đầu, làm nổi bật đoạn tạo hook, loại hook và câu trích dẫn, cùng các mục về lời hứa, kết quả đạt được và lý do hook hiệu quả.Những giây đầu0:000:010:020:030:04Minh họa trực tiếp
    “Mẹo ở đây là…”
    Điều bài đăng hứa hẹnChiên mà thức ăn không dính chảo.
    Phần đáp ứng kỳ vọngCuối cùng, thức ăn trượt ra khỏi chảo dễ dàng.
    Vì sao hiệu quảCho thấy cách làm thay vì chỉ nói.
  7. Bước 07/08

    Gắn nhãn và phân tích

    Dựa trên bản tóm tắt, bản chép lời và các khung hình, mô hình điền cùng một bộ nhãn cho mọi bài đăng: hình thức, chủ đề, cảm xúc, giọng điệu, người và thương hiệu, địa điểm, đồ vật, cách dựng, cùng các tham chiếu văn hóa hoặc meme. Các nhãn chính được kiểm tra lại để đảm bảo nhất quán. Vì mọi bài đăng đều có cùng bộ nhãn, bạn có thể đặt hai bài bất kỳ cạnh nhau để so sánh.

    Mô hình: gpt-6-luna · điền nhãn và kiểm tra các tham chiếu văn hóa, meme

    Xem nhãn trong kết quả

    Gắn nhãn và phân tíchThẻ tóm tắt dẫn đến lưới gồm chín nhãn: thể loại bài đăng, chủ đề, cảm xúc, giọng điệu, người và thương hiệu, địa điểm, đồ vật, cách dựng và văn hóa.Tóm tắt
    Thể loạiHướng dẫn
    Chủ đềẨm thực
    Cảm xúcVui thích
    Giọng điệuTinh nghịch
    Người và thương hiệuMột nhà sáng tạo nội dung
    Địa điểmBếp gia đình
    Đồ vậtChảo, dầu ăn
    Cách dựngCắt cảnh nhanh
    Văn hóaÂm thanh thịnh hành
  8. Bước 08/08

    Đọc bình luận

    Khi bạn yêu cầu phân tích bình luận, chúng tôi thu thập bình luận và mô hình đọc từng bình luận trong ngữ cảnh của bài đăng: chú thích, bản tóm tắt và bản chép lời. Nhờ vậy, mỗi bình luận được đánh giá dựa trên những gì video thực sự nói và thể hiện. Báo cáo cho biết ai đồng tình, ai phản đối, mọi người hỏi gì và họ thích điều gì.

    Mô hình: gpt-6-luna · đọc từng bình luận trong ngữ cảnh bài đăng

    Thêm bình luận vào kết quả

    Đọc bình luậnBa bình luận được gắn nhãn: đồng tình, phản bác hoặc đặt câu hỏi; bên dưới là thanh thể hiện quan điểm chung.
    Cuối cùng cũng có người giải thích cho ra lẽ.Đồng tình
    Nhưng thực ra đâu phải làm như vậy.Phản biện
    Bạn mua chiếc chảo đó ở đâu vậy?Hỏi
    Mọi người đứng ở đâu

Các lớp ngữ cảnh

Mỗi bước kế thừa kết quả của bước trước, nên các bước sau không chỉ dựa vào video gốc. Mỗi bước sử dụng những nội dung sau.

  1. 01Bản chép lờiSử dụngÂm thanh
  2. 02Tóm tắt và hookSử dụngBản chép lời, chú thích và các khung hình được chọn mẫu
  3. 03NhãnSử dụngTóm tắt, bản chép lời, chú thích và các khung hình được chọn mẫu
  4. 04Báo cáo bình luậnSử dụngBình luận, chú thích, tóm tắt và bản chép lời

Mọi bài đăng đều có cùng cấu trúc

Mỗi bài đăng được phân tích thành dữ liệu có cấu trúc theo một lược đồ cố định: bài nào cũng có cùng trường dữ liệu và cùng định dạng. Nhờ vậy, kết quả nhất quán, dễ so sánh, sắp xếp, lọc và xuất sang bảng tính, API hoặc MCP.

{
  "format": "Tutorial",
  "theme": "Food & drink",
  "emotion": ["Joy"],
  "tone": ["Playful"],
  "hook": { "type": "Demonstration", "start": 0.0, "end": 2.0, "text": "So here’s the trick…" },
  "tags": ["home kitchen", "pan", "jump cuts"],
  "transcript": [{ "start": 0.0, "end": 2.4, "text": "So here’s the trick…" }],
  "comments": { "agree": 52, "push_back": 14, "questions": 18 }
}

Tên trường ở đây chỉ mang tính minh họa; tài liệu hướng dẫn có danh sách tên trường chính thức.

Bạn nhận được gì

  • Bản tóm tắt và diễn biến câu chuyện theo thứ tự
  • Bản chép lời có mốc thời gian
  • Hook: nội dung là gì, xuất hiện lúc nào và vì sao hiệu quả
  • Bộ nhãn nhất quán cho mọi bài đăng
  • Báo cáo bình luận khi bạn yêu cầu
  • Tìm theo ý nghĩa: tìm bài đăng dựa trên nội dung, không chỉ theo từ ngữ trong bài
  • Xuất dữ liệu sang bảng tính, API và MCP

Tệp video sẽ bị xóa sau khi phân tích xong.