DNAfinity — Competitive Consensus (2026-07-11)
Code-truth rerun · median-of-4 independent model reviewers · rubric 7 มิติ × 0–5 · directional self-assessment (ยังไม่ผ่าน user research)
🟣 Claude Sonnet 4.6🟣 Claude Opus 4.8 — 17 read-only code subagents🟠 Codex🔵 Geminiทำไมรอบนี้ "ต่าง"
~3.7/5median consensus · 16 แอป
0 → shipHuman-DNA Engine deploy จริง 07-07 (moat ที่ 07-04 บอกเสี่ยงสุด)
14/16แอปที่ขยับขึ้น (รอบก่อนขยับ 2)
D7=1Traction เพดานทุกแอป — ยังไม่มี user ภายนอก
- เอกฉันท์ → ถกเถียง. 07-04 ตรงกัน 112/112 (100%). รอบนี้ re-derive อิสระเต็มรูปแบบ ไม่มี reconcile → ความเห็นต่างกลับมา (spread สูงสุด 1.03).
- เพิ่มโมเดลที่ 4 = ตัวจับผิด. Claude Opus 4.8 อ่านโค้ดจริงเข้มสุด เป็น low anchor เกือบทุกแอปที่ถกเถียง และ downgrade บางตัวที่ไม่มีโมเดลอื่นทำ.
- Human-DNA Engine: กระดาษ → โค้ด. 07-04 เคยสรุปว่า "engine = 0 code ยังไม่ควรนับเป็น moat". 07-11 deploy แล้ว + MU-AI Core เป็น producer ตัวแรก — ช่องว่างที่เคยเสี่ยงสุด กลายเป็นสิ่งที่ ship.
- ขยับเป็นวงกว้าง. 07-04 ขยับ 2 แอป; รอบนี้เกือบทุกแอปขึ้น +0.1 ถึง +0.5.
- เพดานคู่แข่งใหม่: "agentic-in-production". Cleo ย้ายเงินจริงอัตโนมัติ, Lindy = "AI employee" 5,000 integration → cap D2 ที่ 4 สำหรับแอปที่ "สมองครบ แต่มือยังไม่ขยับ".
ยอมรับตรง ๆ: ตัวที่เข้มสุด (Opus 4.8) portfolio = 3.45 ส่วนหนึ่งเพราะรวมแอปใหม่ที่ให้คะแนนต่ำ — ถ้าปรับ roster ให้เท่ารอบก่อน portfolio แทบ flat (3.56 vs 3.59). ควรอ่านคู่กับพาดหัว "3.7 / ขึ้นทั้งกระดาน".
คะแนน consensus ต่อแอป (median-of-4)
| App | Sonnet | Opus 4.8 | Codex | Gemini | Median | Δ 07-04 | Spread |
|---|---|---|---|---|---|---|---|
| WorkDNA | 4.43 | 4.3 | 4.4 | 4.4 | 4.40 | +0.1 | 0.13 |
| SmeDNA | 4.43 | 4.0 | 4.1 | 4.4 | 4.25 | +0.15 | 0.43 |
| BloomDNA | 4.14 | 3.9 | 4.1 | 4.1 | 4.10 | +0.2 | 0.24 |
| AppForge | 4.00 | 3.9 | 4.0 | 4.0 | 4.00 | 0.0 | 0.10 |
| MU-AI Core | 4.00 | 3.9 | 4.0 | 4.0 | 4.00 | +0.1 | 0.10 |
| CareDNA | 4.14 | 3.7 | 3.9 | 4.0 | 3.95 | +0.25 | 0.44 |
| FinDNA ◆ | 4.00 | 3.4 | 3.9 | 3.9 | 3.90 | +0.2 | 0.60 |
| MU-AI Game | 3.71 | 3.7 | 3.7 | 4.0 | 3.71 | +0.11 | 0.30 |
| DataDNA | 3.71 | 3.4 | 3.6 | 3.7 | 3.65 | +0.25 | 0.31 |
| EmotiQ | 3.71 | 3.3 | 3.4 | 3.7 | 3.55 | +0.25 | 0.41 |
| TradeDNA | 3.57 | 3.3 | 3.4 | 3.6 | 3.49 | +0.19 | 0.30 |
| PlantDNA new | 3.57 | 2.9 | 3.4 | 3.9 | 3.49 | new | 1.00 |
| PetDNA | 3.43 | 2.9 | 3.4 | 3.6 | 3.42 | +0.32 | 0.70 |
| MUAI-Verse ◆ | 3.43 | 2.4 | 3.4 | 3.4 | 3.40 | +0.5 | 1.03 |
| OperDNA | 3.29 | 3.3 | 3.4 | 3.3 | 3.30 | 0.0 | 0.11 |
| InfluDNA | 3.29 | 3.0 | 3.3 | 3.3 | 3.30 | 0.0 | 0.30 |
Portfolio: Gemini 3.83 · Sonnet 3.74 · Codex 3.71 · Opus 4.8 3.45 → median 3.73 / mean 3.68. ◆ = contested (ดูด้านล่าง). Tier: Leader ≥4.0 · Contender 3.5–3.99 · Developing <3.5.
เห็นตรง vs เห็นต่าง
- ตรงกันแน่น: D7 Traction = 1 ทั้ง 16 แอป × 4 โมเดล (เพดานเดียวกัน) · WorkDNA #1 ทุกโมเดล · AppForge & MU-AI Core แน่นสุด (spread 0.10) · OperDNA/InfluDNA = ท้ายกระดานที่ทุกคนเห็นตรง.
- ถกเถียงหนัก: FinDNA (0.60) — เป็น DNA node จริงหรือแค่ SSO? Opus grep เจอ 1 อ้างอิง → D5=3; อีก 3 โมเดลให้ D5=5 → นี่คือ correction ที่พลิก consensus ได้มากสุด · MUAI-Verse (1.03)/PlantDNA (1.00)/PetDNA (0.70) — Opus หัก stale/undeployed/corpus บาง; Gemini ให้เครดิต scope.
- แพตเทิร์น: Gemini ใจดีสุด (3.83) ↔ Opus 4.8 เข้มสุด (3.45); Sonnet & Codex อยู่กลาง. ต่างกันตรงคำถามเดียว — "ecosystem เป็นโค้ดจริง หรือแค่ share login?"
จุดแข็ง & ความเสี่ยง (consensus)
| จุดแข็ง | ความเสี่ยง |
|---|---|
| Human-DNA Engine ship + wire ข้ามแอป — moat ที่ copy ยาก | Traction=1 ทุกแอป — ยังไม่มี user ภายนอก (blocker #1) |
| Ecosystem + ไทย compliance-as-code (คู่แข่ง ~2 ทั้งสองมิติ) | งานเด่นหลายชิ้นยังอยู่ branch ไม่ deploy |
| วินัย honesty — ทุกแอปมี claim-matrix บล็อกการเคลมเกินจริงของตัวเอง | "Ecosystem" บางที่เป็นแค่ SSO ไม่ใช่ DNA wiring จริง |
| First-value + agentic pattern แพร่เร็วทั้ง estate | Agentic gap — "สมองครบ มือยังไม่ขยับ" (คู่แข่ง execute แล้ว) |
| Founder+AI leverage ~45.3× (332.58 vs 7.339 FTE-month) | ขาด integration ภายนอก (bank/broker/marketplace/device) |
Pull-quotes
"Traction remains the portfolio bottleneck. Every active app stays D7=1 … branch evidence counts for product readiness, not market trust."— Codex (verbatim)
"Human-DNA went from architecture on paper to a deployed engine with the first producer running — in 5 days — closing the gap the 07-04 report called the highest risk."— Claude Sonnet 4.6
"The largest systemic upgrade since development began … a real ecosystem moat, not just a claim."— Gemini
"Brain complete, hands don't move — most apps top out at D2=4 without a scheduler, while Cleo and Lindy already execute in production."— Claude Opus 4.8
Consolidated 2026-07-11 by the DNAfinity portal from 4 independent model reviews (median-of-4). Directional self-assessment for internal product prioritization — not user-research-validated. Source: docs/competitive/CONSENSUS-2026-07-11.md + per-model *-2026-07-11 reports.