I am truly blown away by Qwen-3.5-27B.
I am truly blown away by Qwen-3.5-27B. It's doing better than Haiku 4.5 on my OOD interp task that involves 50k context in an agentic setting. Such a great cheap model for research tasks.
I am truly blown away by Qwen-3.5-27B. It's doing better than Haiku 4.5 on my OOD interp task that involves 50k context in an agentic setting. Such a great cheap model for research tasks.
How it ranks: Backlist reads my Twitter/X timeline, scores every tweet for substance with an LLM rubric (not engagement), and publishes the daily top picks with a one-line takeaway. Curated by Surya Dantuluri.