DNAfinity — Competitive Consensus (2026-07-16 · median-of-3 · หลัง calibration)
3 โมเดลให้คะแนนอิสระจาก code-truth แล้ว ตรวจกันเอง · 16 แอป × 2 เครื่อง · self-assessment เชิง directional — ยังไม่ผ่าน user research ใช้จัดลำดับ product ไม่ใช่เคลมการตลาด
3.37median-of-3 · 16 แอป
−0.3ทุกโมเดลลดคะแนนตัวเองหลัง calibrate โดยไม่มีใครแตะโค้ด
19คะแนนที่เจ้าตัวแก้เอง · ปิดข้อพิพาท 8 ประเด็น
1.0D7 Traction — เท่ากันทั้ง 16 แอป ไม่มี user ภายนอก
เทียบ 3 โมเดล + median + ช่วง
| App | 🟣 Opus 4.8 | 🔵 Gemini | 🟠 Codex | median | ช่วง | spread |
|---|---|---|---|---|---|---|
| SmeDNA | 3.86 | 4.14 | 4.43 | 4.14 | 3.86–4.43 | 0.57 ⚠ |
| WorkDNA | 3.71 | 4.14 | 4.14 | 4.14 | 3.71–4.14 | 0.43 ⚠ |
| AppForge | 3.86 | 4.00 | 4.00 | 4.00 | 3.86–4.00 | 0.14 ✅ |
| BloomDNA | 3.71 | 3.86 | 4.14 | 3.86 | 3.71–4.14 | 0.43 ⚠ |
| MU-AI Core | 3.86 | 3.86 | 3.86 | 3.86 | 3.86–3.86 | 0.00 ✅ |
| CareDNA | 3.43 | 3.71 | 3.86 | 3.71 | 3.43–3.86 | 0.43 ⚠ |
| MU-AI Game | 3.00 | 3.71 | 4.00 | 3.71 | 3.00–4.00 | 1.00 🔴 |
| DataDNA | 3.29 | 3.43 | 3.71 | 3.43 | 3.29–3.71 | 0.42 ⚠ |
| FinDNA | 3.29 | 3.71 | 3.43 | 3.43 | 3.29–3.71 | 0.42 ⚠ |
| EmotiQ | 2.71 | 3.43 | 3.29 | 3.29 | 2.71–3.43 | 0.72 ⚠ |
| OperDNA | 2.43 | 3.14 | 3.14 | 3.14 | 2.43–3.14 | 0.71 ⚠ |
| TradeDNA | 3.00 | 3.14 | 3.43 | 3.14 | 3.00–3.43 | 0.43 ⚠ |
| InfluDNA | 1.86 | 3.00 | 2.71 | 2.71 | 1.86–3.00 | 1.14 🔴 |
| PetDNA | 2.14 | 3.14 | 2.57 | 2.57 | 2.14–3.14 | 1.00 🔴 |
| PlantDNA | 2.43 | 3.29 | 2.57 | 2.57 | 2.43–3.29 | 0.86 ⚠ |
| MUAI-Verse | 2.00 | 3.00 | 2.29 | 2.29 | 2.00–3.00 | 1.00 🔴 |
| Portfolio | 3.04 | 3.54 | 3.47 | 3.37 | — | — |
calibration เปลี่ยนอะไร
- ทุกโมเดลขยับลง ~−0.3 โดยไม่มีใครแตะโค้ด — Codex 3.75→3.47 · Gemini 3.85→3.54 · เพราะเพิ่มเกณฑ์เดียว: "built ≠ shipped ≠ reachable" (flag ปิด = หลักฐานความพร้อม ไม่ใช่ประสบการณ์ → ให้เครดิต ฟีเจอร์/AI/Moat ได้ แต่ไม่ให้ ว้าว/Eco/ผู้ใช้)
- MU-AI Core = แอปแรกที่ 3 โมเดลลงตัวเลขเดียวกันเป๊ะ 3.86 (spread 0.00) — Codex กับ Opus พบ
DRAFT_ONLY/SUGGESTแยกกัน - ทุกโมเดลถูกจับผิดอย่างน้อย 1 จุด และจับคนอื่นได้อย่างน้อย 1 จุด — Opus 4.8 กล่าวหาผิด 2 ครั้ง + ให้คะแนนผิด 1 ครั้ง ถอน/แก้ทั้งหมด · Gemini เขียนโน้ตขัดคะแนนตัวเอง · Codex ยกคะแนนบนโค้ดที่ kill switch ตัวเองปิดอยู่
- ข้อพิพาทที่เหลือกระจุกที่นิยาม Eco — "wiring ที่ยัง flag ปิด" กับ "SSO อย่างเดียว" นับเป็น ecosystem ไหม
ข้อจำกัดที่ต้องรู้: ยังเหลือ diverge >0.3 ใน 14/16 แอป (converge: MU-AI Core, AppForge) ·
3 ช่องมี 2 เสียงอิสระไม่ใช่ 3 — Codex ประกาศเองว่าตอน recalibrate ไม่มี repo ของเครื่องนั้น จึงอ้าง partial ของอีกสองโมเดลแทน (D2 ของ TradeDNA/OperDNA/InfluDNA) ·
ห้ามเทียบกับ consensus รอบก่อนตรง ๆ — รอบก่อน 2026-07-16 ลิสต์แอปผิด (มี WisdomDNA / ไม่มี PlantDNA) ·
median รายมิติเฉลี่ยได้ 3.39 · median ของคะแนนรวมรายแอป = 3.37 (median ไม่เป็นเชิงเส้น)
รายงานเต็มรายโมเดล: 🟣 Opus 4.8 ·
🔵 Gemini ·
🟠 Codex ·
ต้นฉบับ .md ใน docs/competitive/ (CONSENSUS-2026-07-16.md · CALIBRATION-PLAYBOOK.md)