DNAfinity — Competitive Consensus (2026-07-16 · median-of-3 · หลัง calibration)

3 โมเดลให้คะแนนอิสระจาก code-truth แล้ว ตรวจกันเอง · 16 แอป × 2 เครื่อง · self-assessment เชิง directional — ยังไม่ผ่าน user research ใช้จัดลำดับ product ไม่ใช่เคลมการตลาด

3.37median-of-3 · 16 แอป
−0.3ทุกโมเดลลดคะแนนตัวเองหลัง calibrate โดยไม่มีใครแตะโค้ด
19คะแนนที่เจ้าตัวแก้เอง · ปิดข้อพิพาท 8 ประเด็น
1.0D7 Traction — เท่ากันทั้ง 16 แอป ไม่มี user ภายนอก

เทียบ 3 โมเดล + median + ช่วง

App🟣 Opus 4.8🔵 Gemini🟠 Codexmedianช่วงspread
SmeDNA3.864.144.434.143.86–4.430.57
WorkDNA3.714.144.144.143.71–4.140.43
AppForge3.864.004.004.003.86–4.000.14
BloomDNA3.713.864.143.863.71–4.140.43
MU-AI Core3.863.863.863.863.86–3.860.00
CareDNA3.433.713.863.713.43–3.860.43
MU-AI Game3.003.714.003.713.00–4.001.00 🔴
DataDNA3.293.433.713.433.29–3.710.42
FinDNA3.293.713.433.433.29–3.710.42
EmotiQ2.713.433.293.292.71–3.430.72
OperDNA2.433.143.143.142.43–3.140.71
TradeDNA3.003.143.433.143.00–3.430.43
InfluDNA1.863.002.712.711.86–3.001.14 🔴
PetDNA2.143.142.572.572.14–3.141.00 🔴
PlantDNA2.433.292.572.572.43–3.290.86
MUAI-Verse2.003.002.292.292.00–3.001.00 🔴
Portfolio3.043.543.473.37

calibration เปลี่ยนอะไร

ข้อจำกัดที่ต้องรู้: ยังเหลือ diverge >0.3 ใน 14/16 แอป (converge: MU-AI Core, AppForge) · 3 ช่องมี 2 เสียงอิสระไม่ใช่ 3 — Codex ประกาศเองว่าตอน recalibrate ไม่มี repo ของเครื่องนั้น จึงอ้าง partial ของอีกสองโมเดลแทน (D2 ของ TradeDNA/OperDNA/InfluDNA) · ห้ามเทียบกับ consensus รอบก่อนตรง ๆ — รอบก่อน 2026-07-16 ลิสต์แอปผิด (มี WisdomDNA / ไม่มี PlantDNA) · median รายมิติเฉลี่ยได้ 3.39 · median ของคะแนนรวมรายแอป = 3.37 (median ไม่เป็นเชิงเส้น)

รายงานเต็มรายโมเดล: 🟣 Opus 4.8 · 🔵 Gemini · 🟠 Codex · ต้นฉบับ .md ใน docs/competitive/ (CONSENSUS-2026-07-16.md · CALIBRATION-PLAYBOOK.md)