Mensahe ng ChainThink, Setyembre 9, ayon sa opisyal na pahayag, ipinakilala at inilabas ng Ant Group ang unang orihinal na multi-modal na malaking modelo sa seryeng Ling-3.0-flash-VL.
Batay sa MoE architecture ng Ling-3.0-flash, may kabuuang 124B na parameter, 5.5B na parameter ang aktibo sa isang pagpapatakbo, natatagpuan nito ang suporta para sa imahe, teksto, at video bilang input, at may 256K Token na context window.
Samantala ay idinodok ang mekanismo ng visual feedback, na nagpapalit sa pagpapatupad ng gawain mula sa isang beses na pagbuo patungo sa isang saradong loop na “suriin → gawin → patunayan → ayusin,” at patuloy na ginagamit ang Ling-3.0-flash bilang epektibong node sa Agent workflow.
