🤖 เครื่องมือ AI

AI Agent: Web Scraping + OCR + Dual RAG

รวบรวมข้อมูลจาก web และ PDF เพื่อตอบคำถามด้วย RAG

5 คะแนนแอปเทพ
ยังไม่มีสมาชิกให้ดาว ❤️ 0 ถูกใจในกลุ่ม
คะแนนแอปเทพ5เต็ม 100
ถูกใจในกลุ่ม0ครั้ง
หมวด🤖เครื่องมือ AI

ผลงานนี้ทำอะไรได้

รวบรวมเนื้อหา รูปภาพ และ PDF จาก web พร้อมอ่านตัวอักษรด้วย OCR เพื่อนำเข้าฐานข้อมูล RAG ผู้ใช้เพิ่ม PDF ของตนเองและถามคำถามได้ โดยระบบค้นผ่าน Tavily เพิ่มเมื่อข้อมูลใน RAG ไม่เพียงพอ

เจ้าของผลงานเล่าไว้แบบนี้

https://teamproject-lemon.vercel.app # AI Agent: Web Scraping + OCR + Dual RAG (pgvector) + Agent (Tavily fallback) + Evaluation โปรเจกต์นี้เป็นระบบ **AI Agent** ที่ทำงานแบบ end-to-end: - **External (ระบบไปเก็บเอง):** ค้นเว็บ → scrape เนื้อหา/รูป/ไฟล์ PDF → caption รูป (BLIP) + แปลไทย (Argos) → OCR PDF (PyMuPDF + PaddleOCR fallback) → **Ingest เข้า RAG (Postgres + pgvector)** - **Internal (ผู้ใช้ upload):** upload PDF → OCR → ingest เข้า RAG (namespace=internal) - **Ask Agent:** ระบบตอบจาก RAG ก่อน (structured/semantic) ถ้าไม่พอค่อย **fallback ไป Tavily** (ใช้เฉพาะตอนถาม ไม่ใช้ในขั้น scraping) --- ## โครงสร้างโปรเจกต์ (สรุป) ``` full_project/ .env .gitignore README.md requirements.txt test.py ui/ index.html styles.css app.js workflow.html workflow.js swagger_custom.js backend/ settings.py main.py utils/ scraping/ vision/ ocr/ rag/ agent/ evaluation/ report_utils/ ``` --- ## 0) เตรียม .env สร้างไฟล์ `.env` ที่ root ของโปรเจกต์ (ข้าง README) โดยใช้ตัวอย่างนี้: ```env # ---- (optional) facebook login ---- FB_EMAIL= FB_PASS= # ---- API ---- API_HOST=0.0.0.0 API_PORT=8000 # ---- Paths ---- OUTPUT_BASE_DIR=./scraped_outputs UPLOAD_DIR=./tmp_uploads # ---- Vector DB (pgvector) ---- DATABASE_URL=postgresql+asyncpg://postgres:2026@127.0.0.1:5436/ragdb # ---- Ollama ---- OLLAMA_HOST=http://localhost:11434 EMBED_MODEL=nomic-embed-text:latest EMBED_DIMS=768 OLLAMA_LLM_MODEL=llama3.1:8b # ---- Image Caption ---- BLIP_MODEL=Salesforc

โดย 66070026-Jakkrapat · ดูโพสต์ต้นทาง

ให้คะแนนผลงานนี้

ต้องเข้าสู่ระบบก่อนถึงให้คะแนนได้ เข้าสู่ระบบหรือสมัครฟรี

ผลงานอื่นในหมวด เครื่องมือ AI

คำถามที่พบบ่อยเกี่ยวกับ AI Agent: Web Scraping + OCR + Dual RAG

AI Agent: Web Scraping + OCR + Dual RAG ทำอะไรได้

รวบรวมเนื้อหา รูปภาพ และ PDF จาก web พร้อมอ่านตัวอักษรด้วย OCR เพื่อนำเข้าฐานข้อมูล RAG ผู้ใช้เพิ่ม PDF ของตนเองและถามคำถามได้ โดยระบบค้นผ่าน Tavily เพิ่มเมื่อข้อมูลใน RAG ไม่เพียงพอ

ใครเป็นคนสร้าง AI Agent: Web Scraping + OCR + Dual RAG

66070026-Jakkrapat เป็นผู้สร้าง AI Agent: Web Scraping + OCR + Dual RAG ผลงานหมวดเครื่องมือ AI เว็บแอปเทพให้เครดิตเจ้าของผลงานและมีลิงก์กลับไปยังต้นทางทุกรายการ

AI Agent: Web Scraping + OCR + Dual RAG ยังเปิดใช้งานได้อยู่ไหม

ตรวจล่าสุดเมื่อ 27 ก.ย. 2569 เปิดไม่ขึ้น รายการนี้จึงถูกลดคะแนนอัตโนมัติ

คะแนน 5 จาก 100 ของ AI Agent: Web Scraping + OCR + Dual RAG คิดจากอะไร

คะแนนเต็ม 100 คิดจาก 4 ส่วน คือ เว็บยังเปิดใช้งานได้จริง 40 คะแนน (ลิงก์ตายเหลือ 5) คุณภาพเว็บจากการสแกนอัตโนมัติสูงสุด 20 คะแนน (ใช้บนมือถือได้ 5 โหลดเร็วสูงสุด 7 มีคำอธิบายเว็บ 4 มีภาษาไทย 4 รวมคะแนนบรรณาธิการ) ความนิยมในชุมชนต้นทางสูงสุด 20 คะแนน คิดแบบลดหลั่นตามจำนวน reactions และคะแนนดาวจากสมาชิกเว็บสูงสุด 20 คะแนน (ดาวเฉลี่ยคูณ 4)

เป็นเจ้าของผลงานนี้และอยากแก้ข้อมูลหรือนำออก แจ้งเราได้ที่นี่