2 connected nodes across dictionary, workflows, comparisons, prompts, tool stacks and use cases.
A model that reads and reasons across text, images, audio, and video.
A model that interprets images as first-class input.