Anthropic เปิดตัว Claude 3.5 Sonnet เวอร์ชันอัปเกรด พร้อมฟีเจอร์ Computer Use เวอร์ชันทดสอบสาธารณะ
วันที่ 22 ตุลาคม 2024 Anthropic เปิดตัว Claude 3.5 Sonnet เวอร์ชันอัปเกรดที่อ้างว่าเหนือกว่ารุ่นก่อนในหลายมาตรฐานทดสอบโดยราคาและความเร็วเท่าเดิม พร้อมเปิดตัว Computer Use เวอร์ชันทดสอบสาธารณะ ให้ AI ควบคุมหน้าจอคอมพิวเตอร์ได้เหมือนมนุษย์ เป็นโมเดลแนวหน้ารายแรกที่เปิดให้ใช้ความสามารถนี้
วันที่ 22 ตุลาคม 2024 บริษัท Anthropic ได้เปิดตัว Claude 3.5 Sonnet เวอร์ชันอัปเกรด โดยระบุว่าโมเดลรุ่นใหม่นี้ทำผลงานเหนือกว่ารุ่นก่อนหน้าในหลายมาตรฐานการทดสอบระดับอุตสาหกรรม โดยเฉพาะความสามารถด้านการเขียนโค้ดที่พัฒนาขึ้นอย่างชัดเจน ขณะเดียวกันยังคงราคาและความเร็วในการตอบสนองเท่าเดิม พร้อมกันนี้ Anthropic ยังเปิดตัวฟีเจอร์ «Computer Use» เวอร์ชันทดสอบสาธารณะอย่างเป็นทางการ และประกาศล่วงหน้าถึงโมเดลขนาดเล็ก Claude 3.5 Haiku ที่กำลังจะตามมา
Computer Use คืออะไร
Computer Use ทำให้ Claude มีความสามารถ «มองหน้าจอ ขยับเมาส์ คลิกปุ่ม พิมพ์ข้อความ» สามารถควบคุมหน้าจอคอมพิวเตอร์เพื่อทำงานให้เสร็จได้เหมือนผู้ใช้ที่เป็นมนุษย์ ไม่ใช่แค่การโต้ตอบผ่านข้อความหรือคำสั่ง API ที่กำหนดไว้ล่วงหน้า นักพัฒนาสามารถใช้ฟีเจอร์นี้ได้ผ่านสามช่องทาง ได้แก่ Anthropic API, Amazon Bedrock และ Google Cloud Vertex AI โดย Anthropic เน้นย้ำว่านี่เป็นโมเดล AI แนวหน้ารายแรกที่เปิดให้ใช้ความสามารถ «ควบคุมคอมพิวเตอร์» ในเวอร์ชันทดสอบสาธารณะ
นัยเชิงเทคนิค: จาก «ตอบคำถาม» สู่ «ลงมือทำแทน»
ที่ผ่านมา ความก้าวหน้าของโมเดลภาษาขนาดใหญ่ส่วนใหญ่เน้นไปที่ความเข้าใจข้อความ การให้เหตุผล และการเขียนโค้ด ผู้ใช้ยังคงต้องนำผลลัพธ์จากโมเดลไปวางในตำแหน่งที่ถูกต้องด้วยตนเอง การมาถึงของ Computer Use แสดงให้เห็นว่าโมเดลเริ่มมีความสามารถข้ามผ่านขอบเขตนามธรรมของ «หน้าจอ» ได้แล้ว สามารถสังเกตองค์ประกอบบนหน้าจอ ตัดสินตำแหน่งและเนื้อหา แล้วลงมือปฏิบัติจริงในระดับเมาส์และแป้นพิมพ์ ทำให้ AI มีโอกาสดำเนินขั้นตอนการทำงานหลายขั้นตอนบนระบบภายในองค์กรที่มีอยู่แล้วได้โดยตรง
เปรียบเทียบคู่แข่งและปฏิกิริยาวงการ
เทียบกับเดือนกันยายนปีเดียวกัน ที่ OpenAI เปิดตัวชุดโมเดล o1, Google อัปเดตชุด Gemini-1.5, xAI เปิดใช้งานคลัสเตอร์ Colossus จุดแข่งขันส่วนใหญ่ยังอยู่ที่ «โมเดลฉลาดขึ้น ราคาถูกลง» การที่ Anthropic นำเสนอทั้งการอัปเกรดโมเดลและการขยายความสามารถควบคุมพร้อมกัน เท่ากับเปิดสนามแข่งขันใหม่ว่า «AI จะลงมือทำงานจริงได้หรือไม่» อย่างไรก็ตาม Anthropic เตือนว่าฟีเจอร์นี้ยังทำงานช้าและอาจตัดสินใจผิดพลาดหรือคลิกผิดตำแหน่งบนหน้าจอซับซ้อน จึงแนะนำให้ทดสอบในสภาพแวดล้อมที่ควบคุมได้ก่อน หลีกเลี่ยงการนำไปใช้กับระบบที่มีความเสี่ยงสูงโดยตรง
ความหมายสำหรับผู้บริหาร
สิ่งที่การอัปเกรดนี้บอกกับผู้บริหารโดยตรงที่สุด คือควรจับตาทิศทางที่ AI กำลังเปลี่ยนจาก «ให้คำแนะนำ» ไปสู่ «ลงมือทำแทน»: งานที่ต้องทำซ้ำบนหน้าจอในอนาคต เช่น การคัดลอกข้อมูลข้ามระบบ หรือการกรอกแบบฟอร์มที่ตายตัว มีโอกาสถูกมอบหมายให้ AI เอเจนต์ทำแทนได้ทีละน้อย ผู้บริหารสามารถเริ่มสำรวจได้ตั้งแต่ตอนนี้ว่างานในทีมส่วนใดทำซ้ำบ่อยและใช้วิจารณญาณต่ำ เพื่อเป็นตัวเลือกลำดับต้นๆ เมื่อจะนำเทคโนโลยีนี้มาใช้ในอนาคต
สมาชิกฟรีทำแบบทดสอบ คุยกับโค้ช AI ฟังบทความสะสมประวัติการเรียนรู้ สมัครรับ 100 พอยต์ทันที
สมัครฟรี