ซอฟต์แวร์จดจำรูปภาพ หรือที่เรียกว่าคอมพิวเตอร์วิทัศน์ ช่วยให้แอปพลิเคชันสามารถตีความรูปภาพหรือวิดีโอได้ โดยจะประมวลผลรูปภาพเป็นอินพุตและสร้างเอาต์พุต เช่น ป้ายกำกับหรือกล่องขอบผ่านอัลกอริธึมการมองเห็นของคอมพิวเตอร์ ประกอบด้วยฟังก์ชันต่างๆ เช่น การกู้คืนรูปภาพ การจดจำวัตถุ และการสร้างฉากใหม่ ซึ่งโดยทั่วไปจะรวมอยู่ในแอปพลิเคชันอัจฉริยะ นักวิทยาศาสตร์ข้อมูลใช้ซอฟต์แวร์การจดจำรูปภาพเพื่อฝึกโมเดล ในขณะที่นักพัฒนารวมคุณสมบัติการจดจำรูปภาพไว้ในซอฟต์แวร์ของตน รูปแบบของการเข้าถึงซอฟต์แวร์นี้จะแตกต่างกันไปตามความต้องการของผู้ใช้ ตั้งแต่ไลบรารีหรือเฟรมเวิร์กการเรียนรู้ของเครื่องไปจนถึง API, SDK หรือแพลตฟอร์มแบบ end-to-end จำเป็นอย่างยิ่งที่จะต้องแยกแยะซอฟต์แวร์จดจำภาพออกจากเครื่องมือที่เกี่ยวข้อง แม้ว่าแพลตฟอร์มวิทยาศาสตร์ข้อมูลและแมชชีนเลิร์นนิงจะนำเสนอฟีเจอร์สำหรับการฝึกโมเดลคอมพิวเตอร์วิทัศน์ แต่ก็มีจุดเน้นที่กว้างกว่า นอกจากนี้ การจดจำรูปภาพแม้จะเป็นรูปแบบหนึ่งของการเรียนรู้ของเครื่อง แต่ก็แตกต่างจากความสามารถด้านการเรียนรู้ของเครื่องอื่นๆ เช่น กลไกการแนะนำ หรือการจดจำรูปแบบ ซอฟต์แวร์การรู้จำข้อความจัดอยู่ในหมวดหมู่ Optical Character Recognition (OCR) แม้ว่าซอฟต์แวร์การจดจำรูปภาพจำนวนมากจะมีจุดประสงค์หลายประการ แต่ซอฟต์แวร์บางตัวก็มีความเชี่ยวชาญเฉพาะด้าน เช่น การตรวจจับโลโก้ การจดจำใบหน้า การตรวจจับวัตถุ หรือการตรวจจับเนื้อหาที่ชัดเจน พวกเขาอาจจัดการเฉพาะไฟล์รูปภาพหรือทั้งรูปภาพและวิดีโอ นอกจากนี้ แม้ว่าส่วนใหญ่จะทำงานบนคลาวด์ แต่บางส่วนก็รองรับ Edge หรือการประมวลผลบนอุปกรณ์ หากต้องการรวมไว้ในหมวดหมู่ Image Recognition ผลิตภัณฑ์จะต้อง: * เสนออัลกอริธึมการเรียนรู้เชิงลึกที่ออกแบบมาเพื่อการรับรู้ภาพ * เชื่อมต่อกับพูลข้อมูลรูปภาพเพื่อเรียนรู้ฟังก์ชันหรือโซลูชันเฉพาะ * ยอมรับข้อมูลรูปภาพเป็นอินพุตและจัดเตรียมโซลูชันเป็นเอาต์พุต * เปิดใช้งานความสามารถในการจดจำรูปภาพสำหรับแอปพลิเคชัน กระบวนการ หรือบริการอื่นๆ