AirAi โครงการความร่วมมือทางนิเวศ: มอบเงินสนับสนุนจำนวน 10,000 ดอลลาร์สหรัฐ ให้กับผู้ที่ยังคงพัฒนาผลิตภัณฑ์หรือโซลูชันของตนอยู่
...
0. พื้นหลัง: ทำไมใบแจ้งหนี้ถึงบานปลายขนาดนี้ฉันทำโปรเจกต์เสริม (side projects) หลายโปรเจกต์ ในช่วงแรกก็ต้องซื้อการสมัครสมาชิกจากผู้ให้บริการอย่างเป็นทางการในราคา /เดือน หรือไม่ก็พยายามใช้บัตรเครดิตระหว่างประเทศ แต่ก็ถูกปฏิเสธบ่อยครั้ง เมื่อมาคำนวณค่าใช้จ่ายในตอนสิ้นเดือน ฉันพบสองเรื่องที่น่าหงุดหงิด:80% ของการร้องขอเป็นงานเล็กๆ น้อยๆ เช่น การสรุปข้อมูล การจัดหมวดหมู่ และการจัดรูปแบบ การใช้โมเดลที่แพงที่สุดกับงานเหล่านี้เป็นเพียงการสิ้นเปลืองเท่านั้น;การสมัครสมาชิกเป็นค่าใช้จ่ายที่คงที่ — ถ้ามีการเรียกใช้งานน้อยก็ขาดทุน แต่ถ้ามีการเรียกใช้งานมากก็ไม่เพียงพอ
เราใช้ Claude 3 Opus ในการประมวลผลและระบุข้อมูลใบแจ้งศุลกากรข้ามพรมแดน ซึ่งช่วยประหยัดต้นทุนการตรวจสอบด้วยมนุษย์ได้ถึง 60% แต่ก็เจอปัญหาหลายอย่างด้วย
Claude Fable 5 เป็นประเด็นร้อนแรงในวงการ AI ในวันนี้ โมเดล “ระดับตำนาน” นี้มีประสิทธิภาพที่ยอดเยี่ยม และได้รับความสนใจอย่างมากAndrej Karpathy เรียกมันว่า “น่าตื่นเต้นมาก” และเป็น “ความก้าวหน้าที่สำคัญที่คู่ควรกับการอัปเกรดเวอร์ชันใหญ่” ซึ่งอยู่ในระดับเดียวกับการปรับปรุงที่ Claude 4.5 นำมาในเดือนพฤศจิกายนปีที่แล้ว SWE-bench Pro ซึ่งเป็นเครื่องมือวัดประสิทธิภาพการเขียนโปรแกรม ให้คะแนน Fable 5 ได้ 80.3% ซึ่งสูงกว่า Opus 4.8 ถึง 11 จุดเปอร์เซ็นต์ Fable 5 มีคลังโค้ดที่มีขนาด 50 ล้านบรรทัดภาษา Ruby และสามารถทำการย้ายทั้งคลังโค้ดได้ภายในหนึ่งวัน ในขณะที่หากให้ทีมงานมนุษย์ทำงานเดียวกันนี้ จะต้องใช้เวลามากกว่าสองเดือน
Voice AI อีกหนึ่งเรื่องราวนอกเหนือจากโมเดลใหญ่ของจีเอ็ม ในขณะที่ทุกคนกําลังจ้องมองรุ่นใหญ่ของ Voice AI รุ่นใหม่ที่น่าสังเกตเริ่มปรากฏขึ้นในสนามที่ค่อนข้างเงียบสงบ แป้นพิมพ์กําลังสูญเสียการปกครองของมัน ในช่วงสองปีที่ผ่านมา OpenAI เปิดตัว API แบบ Realtime Google ทํา Gemini Live และ บริษัท โมเดลใหญ่ ๆ ในประเทศเกือบจะเริ่มวางรูปแบบ Voice AIมีความเชื่อมากขึ้นว่าเมื่อตัวแทนเข้ามาในเวิร์กโฟลว์เสียงจะกลายเป็นทางเข้าบริบทที่เป็นธรรมชาติมากกว่าแป้นพิมพ์ ถ้าตัวแทนต้องการเข้าสู่กระแสงานจริงๆ มันต้องเรียนรู้ที่จะเข้าใจเสียงเหล่านี้ก่อนและความสามารถชั้นแรกที่อยู่เบื้องหลังนี้คือ ASR (การจดจําเสียงอัตโนมัติ) สําหรับการวัดระดับ ASR ที่อุตสาหกรรมนิยมอ้างถึงมากที่สุดคือ Open ASR Leaderboard ของ Hugging Face ตัวชี้วัดหลักคืออัตราข้อผิดพลาดของคํา (WER) ยิ่งตัวเลขต่ําเท่าไหร่การระบุก็ยิ่งถูกต้องมากขึ้นเท่านั้น
ไม่มีเนื้อหาเพิ่มเติม